Czy GPT-6.1 Sol to po prostu tańsza Astra?

W wielu zadaniach jest o włos od flagowca, a kosztuje jedną piątą. To po co komu w ogóle ta droższa?

Szybkie porządki w rodzinie. GPT-6 ma kilka poziomów: Astra to top, a Sol to wersja szybsza i tańsza. GPT-6.1 Sol nie jest większym modelem. To po prostu lepszy Sol, który wyszedł tydzień po poprzednim.

I teraz robi się ciekawie. W testach z kodowania i pracy biurowej nowy Sol jest blisko Astry. W obsłudze komputera traci do niej ledwie dwa punkty, a jedno zadanie kosztuje mniej więcej siedem razy mniej. W DeepSWE, czyli trudnym teście na prawdziwych projektach programistycznych, ma 75,2 procent, więcej niż najlepszy wynik Astry. A cena? Dwa dolary za milion tokenów wejściowych i dziesięć za wyjściowe, przy dziesięciu i pięćdziesięciu u Astry.

Momencik. Skoro tańszy jest tak blisko, to po co komu jeszcze Astra?

Bo różnica nie zniknęła, tylko się przesunęła. W teście naukowym Terminal-Bench Science nowy Sol dostaje 57,0 procent, a Astra 68,1. Zadanie kosztuje tam 5,47 dolara zamiast 23,80. Czyli płacisz ponad cztery razy więcej za jedenaście punktów procentowych. Czy warto, zależy od tego, jak trudne masz problemy.

I jeszcze jedno: te liczby w większości podaje sam OpenAI, więc traktuj je jak mocną wskazówkę, a nie wyrok.