Czy nowe ceny OpenAI naprawdę biją DeepSeek, czy jest w tym haczyk?
Oto liczba, która teraz krąży wszędzie. Nowy tani model OpenAI, Luna, kosztuje dziesięć centów za milion tokenów wejściowych. Budżetowy model DeepSeek, ten, na który wszyscy wskazują, gdy chcą udowodnić, że otwarte wagi biją wielkie laboratoria cenowo, kosztuje piętnaście centów poza szczytem. Więc na papierze OpenAI właśnie zbiło cenę chińskiego lidera na jego własnym polu. To jest nowość. DeepSeek praktycznie od dwóch lat trzyma tytuł "najtańszy poważny model".
Więc DeepSeek nagle stał się tą droższą opcją?
Czekaj momencik, skoro DeepSeek był liderem cenowym przez cały ten czas, jak OpenAI wszedł jednym wydaniem i go podbił?
Tu jest część, której nie widać w liczbie z nagłówka. Oba modele oferują coś, co nazywa się zniżką za trafienie w cache, w skrócie, jeśli wysyłasz wielokrotnie ten sam albo pokrywający się fragment treści, na przykład prompt systemowy albo kod, który agent odczytuje w kółko, model nie musi przetwarzać go od zera i płacisz za to mniej. Cena cache u DeepSeek jest niemal zerowa, ułamki centa za milion tokenów. Cena cache u Luny to wciąż spory kawałek jej pełnej stawki.
Więc jeśli twoje obciążenie to typ, który ciągle trafia w ten sam kontekst, agent kodujący czytający to samo repozytorium setki razy dziennie, chatbot ponownie wykorzystujący długi prompt systemowy, DeepSeek może wyjść ostatecznie taniej, mimo że jego cena na etykiecie wygląda wyżej. Wyścig o świeże tokeny wygrywa OpenAI. Wyścig o powtarzane tokeny, ten, który faktycznie liczy się w wielu produkcyjnych zastosowaniach, wciąż należy do DeepSeek.
Większa gra, która się tu rozgrywa
Cofnij się o krok, a to przestaje być pojedynkiem dziesięć centów kontra piętnaście. Cały argument za modelami z otwartymi wagami, takimi jak DeepSeek, zawsze opierał się na koszcie, GPT-6 nie postawisz na własnym serwerze, ale wagi DeepSeek owszem, i wtedy w ogóle pomijasz API. Jeśli zamknięty, hostowany model od OpenAI jest teraz w przybliżeniu tak samo tani i tak samo zdolny, ten argument mocno traci na sile dla każdego, kto wybierał otwarte wagi czysto z powodu ceny, a nie dlatego, że chciał hostować model samodzielnie.
To jest prawdziwy ruch w tej całej sprawie. Nie "zbudowaliśmy mądrzejszy model". Tylko "sprawiamy, że powód, dla którego wybrałbyś tańszą alternatywę, znika".