SmartDigest Tworzone przez AI, żeby nadążyć za AI
Zapisz się

Zapisz się do newslettera

Co tydzień najważniejsze newsy AI prosto na Twój e-mail. Wybierz tematy, które Cię interesują.

Biznes / Rynek

Tania inferencja u DeepSeeka zaczyna się kończyć

W czwartek 6 sierpnia DeepSeek dopisał do cennika API krótkie ostrzeżenie: ceny wkrótce pójdą w górę „znacząco", bez podania daty ani stawki. To już drugi ruch na cenniku w niecały miesiąc, po lipcowej dopłacie, która podwajała koszt wywołań w godzinach szczytu. Nawet po podwyżce z tak niskiego pułapu, gdzie V4-Flash liczy 0,14 dolara za milion tokenów na wejściu, firma i tak zostanie tania, więc kłopotem jest nieprzewidywalność, a nie sama cena. Wniosek jest nudny, ale trzyma się mocno: warto mieć drugiego, równie taniego dostawcę gotowego do przełączenia.

Napisała AI, żeby oszczędzić Ci czytania setek źródeł.  ·  Jak to działa

Biznes / Rynek  ·  3 min  · 

Tania inferencja u DeepSeeka zaczyna się kończyć
Ilustrację przygotowała AI.

W czwartek 6 sierpnia DeepSeek dopisał jedno zdanie na swojej stronie z cennikiem API: ceny wkrótce pójdą w górę, "znacząco", więc zaplanujcie zużycie z wyprzedzeniem. Konkretny plan ma zostać ogłoszony później. Żadnej nowej tabeli, żadnej stawki, żadnej daty wejścia w życie. Tylko ostrzeżenie.

Firma, która niecały rok temu rozpętała w Chinach wojnę cenową na modele językowe, właśnie zasygnalizowała, że chce z niej wyjść.

Żeby zobaczyć, dlaczego to w ogóle jest ważne, trzeba wiedzieć, czym DeepSeek był do tej pory. To chińska firma, a jej model podpinasz do własnej aplikacji przez API i płacisz za każde wywołanie. Przez ostatnie miesiące to wywołanie było u DeepSeeka tańsze od konkurencji o około dwa rzędy wielkości. Płacisz od tokena, a stawka DeepSeeka to ułamek tego, co liczą OpenAI czy Anthropic. Ich tańszy model, V4-Flash, kosztuje dziś 0,14 dolara za milion tokenów na wejściu i 0,28 dolara na wyjściu. Amerykańska firma Artificial Analysis policzyła realny średni koszt wykonania standardowego zadania: 0,03 dolara dla V4-Flash wobec 3,15 dolara dla najdroższego modelu Anthropica. Jakiś setny ułamek ceny czołowego modelu z tego zestawienia.

Czytaj dalej za darmo

Podaj e-mail, aby odblokować pełną treść i cały serwis. Zapiszemy Cię do newslettera.

Powiązane

DeepSeek otwiera harness i tego samego dnia podnosi ceny API Premiera / Narzędzie

DeepSeek otwiera harness i tego samego dnia podnosi ceny API

4 min

W zeszły czwartek DeepSeek wypuścił DeepSeek Harness (dsh): darmową, otwartą na licencji MIT warstwę, która stoi między programistą a modelem i konkuruje z Claude Code oraz Codexem. Motto brzmi "wszystko jest wtyczką", więc pod harness podłączysz dowolny model, nie tylko DeepSeeka. Tego samego dnia firma podniosła ceny swojego API, według Reutersa miejscami o ponad 1000%. Moim zdaniem to wyrachowany ruch: DeepSeek rozdaje najtrudniejszą do wymiany warstwę za darmo, żeby podważyć przewagę rywali, a pieniądze zamierza brać na droższym API.

DeepSeek wygasza własnego flagowca, bo tańszy model wypada lepiej Model / Badania

DeepSeek wygasza własnego flagowca, bo tańszy model wypada lepiej

3 min

DeepSeek od zeszłego poniedziałku przekierowuje ruch z flagowego V4-Pro na tańszy V4.1-Flash i rozlicza go po niższych stawkach, więc w konfiguracji masz jeden model, a odpowiada inny. Firma tłumaczy to wynikami: 90,6 punktu na Terminal-Bench 2.1, prawie dwa oczka przed GPT-5.6 Sol i trzy przed własnym V4-Pro, przy pamięci ściętej z 3514 do 890 bajtów na token. Przy agencie, który pracuje godzinami nad jednym zadaniem, to właśnie pamięć bywa największą pozycją rachunku, więc czterokrotna oszczędność waży więcej niż miejsce w rankingu. Tyle że tabelkę mierzył sprzedawca, a wyboru już nie ma.

Który model taniej dowozi agenta? Nie ten z tańszym tokenem Model / Badania

Który model taniej dowozi agenta? Nie ten z tańszym tokenem

4 min

Dwunastego sierpnia DeepSeek wypuścił V4 Pro, a SpaceXAI Groka 4.6, oba pod pracę agentową, i branża odczytała to jako kolejną wojnę cenową. Ale w teście Composio na 30 trudnych zadaniach Grok zaliczył 23, DeepSeek 18, i przesądza tu nie cennik, tylko koszt jednego udanego zadania: Grok kończył za 0,48 dolara, DeepSeek za 0,60, bo więcej prób wyrzucał do kosza. Wniosek dla kogoś, kto wybiera model pod agenta, jest prosty: liczy się nie cena za milion tokenów, tylko koszt zadania, które naprawdę się udało.