Jak daleko Mistral Large 4 jest od czołówki?
Jeśli chodzi o ogólną inteligencję, to nie jest blisko. W indeksie Artificial Analysis Large 4 dostaje 38 punktów. Chińskie otwarte modele GLM-5.3 i Kimi K3 mają 45 i 44, a do najlepszych zamkniętych, czyli Claude Opus 5.5 i GPT-6 Astra, brakuje jeszcze więcej. Drugi serwis, Vals AI, stawia go mniej więcej na 32. lub 33. miejscu wśród 44 do 45 modeli, z wynikiem około 48 procent.
To znaczy, że to po prostu słaby model, o którym narobiono hałasu?
Nie, i tu robi się ciekawie. 38 punktów to wyraźnie ponad medianą 26 wśród porównywalnych modeli w tym samym indeksie. W teście dla agentów prawniczych zajmuje szóste miejsce na 76. To dobry model w lidze, w której samo „dobry" już nie wystarcza.
I to jest prawdziwa historia czołówki AI. Możesz zbudować coś mocnego, wydać górę pieniędzy i i tak wylądować w środku tabeli, bo szczyt cały czas ucieka.