Nowy Phi-3 firmy Microsoft to jeden z najmniejszych dostępnych modeli AI — i działa lepiej niż jego więksi rywale

Przez
Jugo Mobile
Jugo Mobile to platforma poświęcona wysokiej jakości treściom z zakresu gier, sportu i technologii. Odkrywaj najwyższej klasy materiały, nawiązuj kontakt z innymi pasjonatami i ekspertami. Poznaj...
5 min czytania

Microsoft ujawnił swój nowy, imponujący model sztucznej inteligencji Phi-3. Jest to niewielki model w porównaniu do takich modeli jak GPT-4, Gemini czy Llama 3, ale ma imponującą wielkość.

Te lekkie AI, zwane modelami małych języków, sprawiają, że wykonywanie niektórych zadań jest tańsze i łatwiejsze bez konieczności korzystania z dużej mocy obliczeniowej większych modeli.

Pomimo swoich niewielkich rozmiarów, Phi-3 mini w niektórych testach porównawczych radził sobie równie dobrze jak Llama 2, a Microsoft stwierdził, że jest tak samo responsywny jak model 10 razy większy.

Nie jest jasne, czy może to stanowić część przyszłej aktualizacji Copilot, ponieważ Microsoft chce udostępnić więcej funkcji na urządzeniu, czy też pozostanie to samodzielnym projektem.

Co to jest Microsoft Phi-3?

Phi-3 działa na iPhonie

Microsoft miał mini model Phi-3 działający na iPhonie z chipem A16 Bionic (Źródło zdjęcia: Microsoft)

Według wiceprezesa Azure Erica Boyda, Microsoft Phi-3 został przeszkolony w ramach „programu nauczania”. Rozmawiam z KrawędźBoyd powiedział, że wzięli listę 3000 słów i poprosili większy model językowy o stworzenie książek dla dzieci do nauczania Phi. Następnie szkolono go w zakresie tych nowych książek.

Przedstawiamy phi-3-mini… którego ogólna wydajność, mierzona zarówno w testach akademickich, jak i w testach wewnętrznych, dorównuje modelom takim jak Mixtral 8x7B i GPT-3.5, mimo że jest wystarczająco mała, aby można ją było zainstalować w telefonie.

Badania Microsoftu

Phi-3 jest dostępny w trzech rozmiarach; mini, który ma zaledwie 3,8 miliarda parametrów, mały model z 7 miliardami parametrów i średni model z 14 miliardami parametrów. Dla porównania GPT-4 ma ponad bilion parametrów, a najmniejszy model Llama 3 ma ich 8 miliardów.

Phi-3 opiera się na nauce Phi-1, która skupiała się na kodowaniu, i Phi-2, której uczono rozumowania. To ulepszone rozumowanie dotyczy tego, w jaki sposób może on dorównać GPT-3.5 pod względem jakości odpowiedzi pomimo szkolenia na znacznie mniejszym zbiorze danych.

To przechodzenie w kierunku mniejszych modeli, które działają równie dobrze, a nawet przewyższają dużych graczy, stanowi rosnącą tendencję. Meta Llama 3 70B niemal osiągnęła poziom GPT-4 w niektórych testach porównawczych, a mniejsze modele wydają się znajdować specyficzne nisze.

Wydajność Phi-3 „konkuruje z modelami takimi jak Mixtral 8x7B i GPT-3.5” – wyjaśnili naukowcy z Microsoftu w swoim artykule papier na nowym modelu. Stało się to „mimo że był na tyle mały, że można go było wdrożyć na telefonie”.

Zdaniem zespołu innowacja polegała wyłącznie na zbiorze danych. Składały się na to mocno przefiltrowane dane internetowe i syntetyczne dane z książek dla dzieci opracowanych przez inną sztuczną inteligencję.

Dlaczego potrzebujemy Phi-3?

Microsoft Phi-3 został zaprojektowany do działania na szerszej gamie urządzeń i znacznie szybciej, niż jest to możliwe w przypadku większych modeli. Należy do rodziny modeli takich jak StabilityAI Zephyr, Google Gemini Nano i Claude 3 Haiku firmy Anthropic, które można uruchomić na laptopie lub telefonie — bez konieczności korzystania z Internetu.

W przyszłości modele te można będzie łączyć ze smartfonami, osadzać je w chipie umieszczonym w inteligentnym głośniku, a nawet wbudować w lodówkę, aby udzielać porad dotyczących nawyków żywieniowych.

Chociaż modele oparte na chmurze, takie jak Google Gemini Ultra, Claude 3 Opus i GPT-4-Turbo, zawsze będą lepsze od mniejszych modeli we wszystkich obszarach, mają one kilka wad, w tym koszt, szybkość i to, że do korzystania z nich wymagane jest połączenie internetowe.

Te maleńkie modele umożliwiają czatowanie z wirtualnym asystentem, nawet jeśli nie masz połączenia z Internetem, umożliwiają AI podsumowywanie treści bez wysyłania danych w trybie offline, a nawet pracę na urządzeniu z Internetem rzeczy bez wiedzy, że sztuczna inteligencja jest w użyciu.

Mówi się, że Apple prawie całkowicie polega na tych lokalnych modelach, aby zapewnić obsługę nowej generacji generatywnych funkcji AI w iOS 18, a Google wdrożył Gemini Nano w większej liczbie telefonów z Androidem.

  • Apple GPT: najnowsze wiadomości, prawdopodobna data premiery i przewidywane funkcje
  • Bing z ChatGPT to teraz Copilot — co to oznacza dla Ciebie
  • Google przedstawia sztuczną inteligencję Gemini dla chatbota Bard — i może pokonać ChatGPT
Udostępnij ten artykuł
Obserwuj
Jugo Mobile to platforma poświęcona wysokiej jakości treściom z zakresu gier, sportu i technologii. Odkrywaj najwyższej klasy materiały, nawiązuj kontakt z innymi pasjonatami i ekspertami. Poznaj najnowsze trendy i innowacje w naszej dynamicznej społeczności. Dołącz do nas i doświadcz przyszłości już dziś!
Rozwijaj swoją markę i dotrzyj do szerszej publiczności. Reklamuj się u nas już dziś i zyskaj uwagę tysięcy.
© 2025 Jugo Mobile. Wszelkie prawa zastrzeżone.