Co tak naprawdę poprawiono w Groku 4.7?

Problemem nie był brak inteligencji. Problemem była kondycja.

Grok 4.7 już jest i najprostszy nagłówek brzmi „większy model”. Zgadza się, mówi się o około 2,1 biliona parametrów zamiast mniej więcej 1,5 biliona w wersji 4.6. Tyle że to nie jest najciekawsze. Najciekawsze jest to, co xAI chciało naprawić.

Sprinter, który miał przebiec maraton

Dzisiejsze modele świetnie radzą sobie z pojedynczym pytaniem. Pytasz, dostajesz celną odpowiedź. Ale prawdziwa praca to nie jedno pytanie. Naprawianie zagmatwanego kodu, porządny research, dokument składany krok po kroku przez całe popołudnie. I właśnie przy takich długich zadaniach modele się gubią, zapominają, co robiły, schodzą z kursu.

Dlatego Grok 4.7 przeszedł dłuższy trening ze wzmacnianiem, na trudniejszych zadaniach, celowo dobranych tak, żeby przeważały te wymagające wielu godzin pracy. Ma też dokładniej sprawdzać po sobie wyniki. Mniej sprintu, więcej wytrzymałości.

I co, zadziałało?

Wygląda na to, że tak, i nie mówi tego tylko samo xAI. W niezależnym rankingu agentów programistycznych prowadzonym przez Artificial Analysis wynik skoczył z 47 do 56 punktów. Poprawiły się wszystkie trzy składowe, a zadania w terminalu wypadły prawie dwa razy lepiej. To daje czwarte miejsce, za czołówką Anthropic i OpenAI. Nie zwycięstwo, ale konkretny krok naprzód.

Do tego okno kontekstu na 500 tysięcy tokenów, przebudowane zabezpieczenia, które mają być trudniejsze do obejścia i jednocześnie rzadziej odmawiać przy niewinnych prośbach, a cena za token bez zmian.

A czemu model xAI nagle siedzi w chmurze Google?

Mniej sensacji, niż się wydaje. Grok 4.7 trafił na korporacyjną platformę AI Google, tylko że ta platforma to po prostu wielki sklep z ponad dwustoma modelami, w tym od Anthropic i Mistrala. Grok dołączył do półki, i tyle. A Google zarabia tak czy siak, bo klient płaci za korzystanie z modelu, a model chodzi na serwerach Google. Kto by nie wygrał wyścigu, kasyno i tak bierze swoją działkę.