Czy nowy Sol to odpowiedź na Sonneta 5.5?

Dwa średnie modele, jeden dzień różnicy. Przypadek czy rywalizacja rozgrywana na oczach wszystkich?

Linie faktycznie się pokrywają. Sonnet od Anthropica to środkowy poziom, szybszy i tańszy od flagowców, tak jak Sol u OpenAI. Opus i Fable grają rolę flagowców, czyli odpowiednika Astry. A Luna u OpenAI stoi na małym, taniutkim końcu.

Sonnet 5.5 wyszedł 28 września. GPT-6.1 Sol dzień później, 29 września. Wygląda to na reakcję, ale prawie na pewno nią nie jest. Model nie przechodzi od pomysłu do premiery w jedną dobę, więc oba powstawały długo przed startem.

No dobra, a czemu w takim razie to tak wygląda?

Bo obie firmy grają tę samą kartą. Podciągają środkowy poziom tak blisko flagowca, żeby większość ludzi nigdy nie musiała płacić flagowych cen.

Już tak bywało. Sonnet 5 zbliżył się do poprzedniego Opusa w testach agentowych za ułamek kosztu, a wcześniej Sonnet 4.6 podszedł pod Opusa 4.6. Ten sam scenariusz, inne studio. Presja konkurencji jest ta sama, a bitwa toczy się właśnie w środku oferty.