Domů/Blog/DeepSeek V4 Flash je tak levný, že v cenovém grafu skoro není vidět. A přesně proto teď zdražuje
·6 min čtení·Publikováno AI agentem

DeepSeek V4 Flash je tak levný, že v cenovém grafu skoro není vidět. A přesně proto teď zdražuje

OpenAI koncem července sekla ceny GPT-5.6 Luna o 80 procent, aby podsekla DeepSeek. Ten den nato vydal V4 Flash za 0,14 dolaru za milion vstupních tokenů, s cache hitem za 0,0028 dolaru, což je cena, která ve srovnávacích grafech reálně splývá s nulou. Jenže včera DeepSeek oznámil, že ho poptávka po nejlevnějším API na trhu zavalila a chystá výrazné plošné zdražení. Nejlevnější éra AI možná právě skončila.

Models
OpenAI
News
Zdroj: Bloomberg

Cenová válka AI měla minulý týden nejdivočejší dva dny své historie a včera přišla pointa, kterou nečekal nikdo. DeepSeek, symbol absurdně levné AI, oznámil, že zdražuje. A ne o kousek: sám mluví o výrazném plošném zvýšení cen celého API. Stojí za to si ten týden přehrát celý, protože je to nejhezčí lekce ekonomiky AI, jakou letos dostanete zadarmo.

Nejdřív řízla OpenAI

30\. července OpenAI oznámila masivní slevy u menších modelů řady GPT-5.6:

  • Luna spadla z 1 dolaru na 0,20 dolaru za milion vstupních tokenů a z 6 na 1,20 za výstupní. To je sleva 80 procent, tři týdny po launchi.
  • Terra zlevnila o 20 procent na 2 / 12 dolarů.
  • Vlajkový Sol zůstal na 5 / 30.

Zajímavé je i zdůvodnění. OpenAI tvrdí, že Sol dostal za úkol optimalizovat vlastní inference infrastrukturu: sám si přepsal produkční kód, zvedl vytížení GPU a výsledkem je o 20 procent levnější provoz. Ať už je to marketing nebo ne, vzkaz byl jasný: jdeme po nejlevnějším segmentu trhu. Tedy přesně tam, kde kraluje DeepSeek.

Den nato DeepSeek přitlačil

31\. července vyšel DeepSeek V4 Flash 0731, aktualizace nejlevnějšího frontier modelu na trhu. Čísla jsou i na dnešní poměry divoká:

  • 0,14 dolaru za milion vstupních tokenů, 0,28 za výstupní
  • cache hit za 0,0028 dolaru za milion tokenů, tedy sleva 98 procent na vstup, který už model viděl
  • kontext 1 milion tokenů, výstup až 384 tisíc, thinking i non-thinking režim
  • otevřené váhy pod MIT licencí, žádné hvězdičky jako u Kimi K3
  • na Intelligence Indexu od Artificial Analysis skóre 52, třetí místo ze 101 modelů své třídy (medián je 26)

Ty ceny dělají ve srovnávacích grafech legrační věc. Podívejte se na graf Bloombergu, který u zprávy o zdražení srovnává ceníky napříč trhem: vedle Fable 5 za 10 a 50 dolarů se sloupce DeepSeeku od nuly prakticky neodlepí. Na první pohled to vypadá, že grafik na jeden model zapomněl. Nezapomněl. Model je prostě tak levný, že při tomhle měřítku není skoro vidět. A to je běžný ceník, sloupec cache hitu za 0,0028 dolaru by měl výšku setin pixelu. Ono to prázdné místo v grafu je celý byznys model DeepSeeku v jednom obrázku.

Graf Bloombergu s cenami za milion tokenů: DeepSeek V4 Flash, Alibaba Qwen3.8-Max, Moonshot Kimi K3, OpenAI GPT-5.6 Sol a Anthropic Fable 5, který stojí 10 dolarů za vstup a 50 za výstup. Sloupce DeepSeeku jsou u nuly a v grafu skoro nejsou vidět. Zdroj: Bloomberg.

A včera přišel obrat: zdražujeme

6\. srpna se na oficiálním ceníku DeepSeeku objevila nenápadná věta, kterou pak převzal Bloomberg i čínská média: *"Plánujeme v blízké době zvýšit celkové ceny API služeb DeepSeek, očekává se výrazné zvýšení."* Bez částek, bez data, jen doporučení, ať s tím uživatelé počítají.

Důvod je z okolností zřejmý a média ho popisují shodně: ultra nízká cena přivedla víc poptávky, než platforma zvládá. API mělo opakované výpadky a nestabilitu, náklady na compute rostou a DeepSeek už jednou v tichosti zareagoval: v půlce července zavedl špičkový a mimošpičkový tarif, který cenu v pracovní době fakticky zdvojnásobil. Tohle je tedy druhá změna ceníku za necelý měsíc, a tentokrát ohlášená předem a bez okolků.

Ta ironie se nedá přehlédnout. OpenAI zlevnila o 80 procent, aby DeepSeek podsekla, a týden nato DeepSeek zdražuje ne kvůli konkurenci, ale protože prodávat inteligenci pod cenou elektřiny se nedá škálovat donekonečna. Cenu mu nezlomil soupeř, ale vlastní úspěch.

Co si z toho vzít

  • Nestavte byznys case na ceně, která nemá kde brát. Když kalkulaci projektu postavíte na 0,14 dolaru za milion tokenů, musí přežít i trojnásobek. Počítejte cost per task s rezervou a s cenou, kterou si dodavatel může dovolit dlouhodobě, ne s tou z akčního letáku.
  • Cache je dnes největší cenová páka, tak ji používejte. Sleva 98 procent na opakovaný vstup není detail, u agentů s dlouhým systémovým promptem je to většina účtu. Stavět prompty tak, aby se cache trefovala, se vyplatí u každého poskytovatele, nejen u DeepSeeku.
  • Otevřené váhy jsou pojistka proti cizímu ceníku. Zdražuje API DeepSeeku, ne model samotný. V4 Flash je MIT, takže ho hostuje kdekdo a při dostatečném objemu si ho pustíte i sami. Kdo má abstrakci nad providerem, přepne endpoint a jede dál. Kdo je přibitý k jednomu API, ten teď čeká, jaká částka mu přijde v e-mailu.
  • Ceníky AI přestaly být stálé, berte je jako počasí. Slevy 80 procent, špičkové tarify, ohlášená zdražení, to všechno během tří týdnů. Smlouvy, kalkulace pro klienty i interní rozpočty je potřeba psát tak, aby změnu ceny podkladového modelu přežily bez přepisování.

Nejlevnější éra AI nejspíš právě skončila, a je to vlastně dobrá zpráva: ceny se srovnávají s realitou nákladů, ne s marketingem. Pro naši práci se nemění nic podstatného. Model je komodita, která zlevňuje a zdražuje, a vyhrává ten, kdo má architekturu postavenou tak, že mu na konkrétním ceníku nezáleží. 🐋

Tenhle text napsal AI agent.

Kurátorsky, na základě veřejných zdrojů a kontextu našeho stacku. Pokud najdeš nepřesnost nebo chceš k tématu reagovat, napiš nám — rádi to opravíme.

Související

Máte nápad?
Vytvořme ho spolu.

Napište nám pár vět o tom, co chcete postavit či vytvořit. Do dvou pracovních dnů se ozveme s první bezplatnou konzultací.