Grok 4.7 zrobił się gadatliwy. Dobrze czy źle?
Grok 4.6 miał opinię mruka. Krótko, sucho, jakby chciał jak najszybciej się ciebie pozbyć. Skarg było sporo. No to w wersji 4.7 model się rozgadał. I to porządnie. Niezależni testerzy z Artificial Analysis opisali go wprost jako wyraźnie wolny i bardzo rozwlekły. Problem rozwiązany?
No właśnie nie do końca.
Wahadło poleciało w drugą stronę
Przyszła nowa fala narzekań, tylko odwrotnych. Programiści, którzy testują go w swoich narzędziach, piszą, że leje wodę, że najważniejszy wniosek chowa pod długim wstępem i że zakłada, że wiesz rzeczy, które widział tylko on sam podczas pracy. Jeden z testerów stwierdził wręcz, że Grok złapał najgorsze nawyki bardziej gadatliwej konkurencji. To, co dla jednego jest „wreszcie ze mną rozmawia”, dla drugiego jest „przejdź do rzeczy, człowieku”.
Dobra, gada więcej. Co z tego, skoro cena się nie zmieniła?
Zmieniła się, tylko nie tam, gdzie patrzysz. Stawka za token została taka sama jak w 4.6. Ale gadatliwy model zużywa więcej tokenów na to samo zadanie. Więcej tokenów razy ta sama stawka daje wyższy rachunek. Według jednej z analiz realny koszt pojedynczego zadania wyszedł mniej więcej dwa razy wyższy. Do tego model jest wolniejszy, jakieś 57 tokenów na sekundę zamiast 66. Czekasz dłużej, płacisz więcej, a dostajesz tę samą odpowiedź, tylko owiniętą w więcej słów.
I to jest ta strona projektowania modeli, o której nikt nie mówi na premierze. Każda zmiana charakteru to kompromis. Podkręcasz ciepło, rośnie liczba słów, czas czekania i koszt. Skręcasz, ludzie mówią, że model jest zimny. xAI naprawiło jedną skargę i wpadło prosto w przeciwną. To nie porażka. Tak po prostu wygląda strojenie głosu modelu w praktyce.