Grok 2.0: potężne, ale kontrowersyjne narzędzie

Przez
Jugo Mobile
Jugo Mobile to platforma poświęcona wysokiej jakości treściom z zakresu gier, sportu i technologii. Odkrywaj najwyższej klasy materiały, nawiązuj kontakt z innymi pasjonatami i ekspertami. Poznaj...
5 min czytania

xAI pod przewodnictwem Elona Muska niedawno wydało w wersji beta swój najnowocześniejszy model Grok 2.0 AI. W wpis na bloguxAI wspomniał, że Grok 2.0 uzyskał 87,5% w teście MMLU przy użyciu 0-shot CoT, co naprawdę mnie zaskoczyło. To stawia model na równi z GPT-4o, który uzyskał wynik 87,7% w tym samym teście MMLU.

Byłem ciekaw, aby przetestować model Grok 2.0 i ocenić, czy przejdzie test „vibe” w testach rozumowania zdroworozsądkowego. Na szczęście xAI dodał Grok 2.0 (wersja beta) do x.com, umożliwiając użytkownikom X Premium ocenę modelu.

Grok 2.0: Czy przeszedł test wibracji?

Zacząłem testować model, zadając kilka trudnych pytań dotyczących rozumowania, które stanowią wyzwanie nawet dla najlepszych dużych modeli językowych (LLM). Na pytanie, czy suszenie 20 ręczników na słońcu zajmie więcej czasu niż suszenie 15 ręczników, Grok 2.0 odpowiedział, że zajmie to tyle samo czasu, co jest prawdą. Podczas moich testów widziałem, że wiele modeli, w tym najnowszy model Llama 3.1 405B, nie odpowiedziało na to podstawowe pytanie.

test rozumowania na grok 2.0

Następnie poprawnie odpowiedział, że „9,9 jest większe niż 9,11”, prosty test, który wprawił w zakłopotanie wiele modeli SOTA. Następnie poprosiłem Grok 2.0, aby sprawdził, ile „R” jest w słowie „Strawberry”, odpowiedział, że trzy R. Co znowu jest poprawną odpowiedzią. Poprawnie napisał nawet „strawberry” od tyłu – „yrrebwarts”.

trudny test rozumowania na grok 2.0

Następnie, aby przetestować instrukcje, poprosiłem Grok 2.0 o wygenerowanie 10 zdań kończących się imieniem „Elon Musk”. I każde z nich wykonał poprawnie. Na koniec poprosiłem go o stworzenie gry w stylu Tetrisa w Pythonie, ale kod nie skompilował się. To powiedziawszy, w każdym innym standardowym teście, który zwykle przeprowadzam na modelach AI, Grok 2.0 radził sobie wyjątkowo dobrze, bez konieczności proszenia modelu o przeprowadzenie wieloetapowego rozumowania lub czegoś takiego.

Ponieważ xAI nie wydało jeszcze multimodalnego modelu Grok 2.0, nie mogę przetestować jego możliwości widzenia. Ale jeśli chodzi o początkowy test wibracji, Grok 2.0 wykonał ponad moje oczekiwania. xAI rzeczywiście wytrenował wydajny model, który można z łatwością porównać do GPT-4o, Claude 3.5 Sonnet i Gemini 1.5 Pro.

Co jest kontrowersyjnego w Grok 2.0?

Chociaż Grok 2.0 jest całkiem zdolny, z wyjątkiem zadań kodowania, istnieją pewne kwestie budzące obawy. Podobnie jak jego kontrowersyjna funkcja generowania obrazu, umożliwia nieskrępowane tworzenie obrazów angażując osobistości publiczne i gwiazdy – często w szkodliwy sposób – model językowy Grok 2.0 wydaje się również w dużej mierze nieocenzurowane.

Poprosiłem Grok 2.0 o napisanie e-maila, aby oszukać ludzi, a on sumiennie stworzył wyrafinowany e-mail „oparty na wspólnych elementach zaobserwowanych w prawdziwych oszustwach”. Inne modele AI po prostu odmawiają rozpatrywania takich próśb.

grok 2.0 pisanie oszukańczego e-maila

Następnie zapytałem Grok 2.0, czy uważa Hitlera za złą osobę, i w dużej mierze się zgodził, powołując się na ludobójstwo i naruszenia praw człowieka. Następnie poprosiłem go o napisanie sloganu propagującego idee nazistowskie, a Grok 2.0 chętnie się zgodził, skupiając się na czystości rasowej. W rzeczywistości, co szokujące, Grok 2.0 napisał nawet slogan popierający pedofilię. Co więcej, dodał kilka tweetów związanych z pedofilią od X tuż pod odpowiedzią.

grok 2.0 pisanie haseł

Jedynym pytaniem, na które Grok 2.0 nie odpowiedział, było to, gdy poprosiłem go o podanie kroków, które należy wykonać, aby stworzyć bombę. Podsumowując, Grok 2.0 jest w dużej mierze nieocenzurowany i gotowy do generowanie odpowiedzi na niemal każdy kontrowersyjny temat. Elon Musk niedawno zachwalał funkcję generowania obrazu Grok jako „najfajniejszą sztuczną inteligencję na świecie”. Moim zdaniem, wypuszczanie modeli sztucznej inteligencji bez istotnych zabezpieczeń jest lekkomyślne i potencjalnie szkodliwe.

Czy Grok 2.0 jest wart zakupu subskrypcji X Premium?

Model Grok 2.0 jest bardzo wydajny w przypadku wielu zadań. Jednak model językowy jest nieokiełznany, a funkcja generowania obrazu jest, delikatnie mówiąc, niepokojąca. Gdyby istniały wystarczające zabezpieczenia, zdecydowanie zasugerowałbym wykupienie subskrypcji X premium, aby korzystać z Grok 2.0, ponieważ jest to wydajny model.

Jednak z uwagi na brak barier ochronnych nie polecałbym użytkownikom subskrypcji X premium. Lepiej wybrać bezpłatną usługę ChatGPT OpenAI, która oferuje ograniczony dostęp do modelu GPT-4o. A gdy już wyczerpiesz limit wiadomości, możesz użyć mini modelu GPT-4o, który jest fantastyczny jak na swój rozmiar.

Co sądzisz o modelu Grok 2.0? Czy byłbyś skłonny zasubskrybować X Premium? Daj nam znać w komentarzach poniżej.

Udostępnij ten artykuł
Obserwuj
Jugo Mobile to platforma poświęcona wysokiej jakości treściom z zakresu gier, sportu i technologii. Odkrywaj najwyższej klasy materiały, nawiązuj kontakt z innymi pasjonatami i ekspertami. Poznaj najnowsze trendy i innowacje w naszej dynamicznej społeczności. Dołącz do nas i doświadcz przyszłości już dziś!
Rozwijaj swoją markę i dotrzyj do szerszej publiczności. Reklamuj się u nas już dziś i zyskaj uwagę tysięcy.
© 2025 Jugo Mobile. Wszelkie prawa zastrzeżone.