Čínská firma DeepSeek vydala nejnovější model V4.1-Flash a rovnou ho poskytla ke stažení zdarma. Je to nejmenší kousek z nové generace, jenže v testech si vede lépe než dosavadní nejsilnější model této laboratoře, který má skoro třikrát více parametrů. DeepSeek proto svou vlajkovou loď postupně stahuje z provozu a nechává ji nahradit právě tímto menším modelem.
Co je na novém modelu jiné
Největší změna se odehrála uvnitř a u uživatele se projeví hlavně na rychlosti a na finančních nákladech. Model se naučil rozdělit práci na dvě části, konkrétně na čtení zadání a na psaní odpovědi, přičemž při čtení aktivuje jen malou část své kapacity. Zatímco celek má 552 miliard parametrů, na každé slovo ze vstupu model použije jen osm miliard a při psaní šestnáct miliard parametrů. Zní to jako technická drobnost, ale dopad je citelný. Většina dnešních nástrojů, které samostatně procházejí kód, dokumenty nebo webové stránky, zpracovává obrovské množství textu a sama píše relativně málo. Právě na tento způsob práce je nový DeepSeek navržen.
Druhá velká změna se týká paměti. Když model čte dlouhý text, musí si průběžně pamatovat, co již přečetl, a tato provozní paměť vyžaduje nejvíce financí i místa. DeepSeek ji zmenšil zhruba na čtvrtinu oproti předchozí generaci a část, která se dříve odkládala na disk, klesla na osminu. Firma proto mohla rovnou snížit ceny.
Vidí obrázky a přečte tisíc stránek
Verze V4.1-Flash zvládá zadání z textu i obrázku současně. Obrazovou část se učil od úplného začátku společně s jazykovou, takže fotografie, grafy, formuláře nebo snímky obrazovky bere jako běžný vstup. Při čtení dokumentů s tabulkami a grafy dosahuje v testech skoro pětadevadesátiprocentní úspěšnosti. Do paměti se mu vejde milion tokenů naráz, což odpovídá zhruba tisíci stran textu. Trénoval se na balíku 45 bilionů tokenů, což je množství, které by člověk nepřečetl za tisíc životů.
Přibyla i jedna nová funkce. Uživatel si může na stupnici od jedné do sta nastavit, jak moc má model nad zadáním přemýšlet. Nízké nastavení znamená rychlou a levnou odpověď, vysoké přináší delší čekání a vyšší přesnost. Odpadá tak volba mezi dvěma různými modely.
Exceluje v textech
Nejlépe model vychází v úlohách, kde má samostatně pracovat. V soutěžním programování má nejvyšší hodnocení z celé porovnávané sestavy. V testu, kde musí sám opravovat chyby ve skutečných programech, vyřešil zhruba tři čtvrtiny zadání a dostal se před modely Opus 5.0 i GPT-5.6. V ovládání příkazové řádky si vedl podobně a v bezpečnostních úlohách skončil na osmaosmdesáti procentech.
Na druhou stranu to není přeborník ve všem. V nejtěžších verzích testů na samostatnou práci s počítačem zvládl kolem třiceti procent úloh, zatímco Opus 5.0 se dostal přes čtyřicet a padesát procent. Znalostní otázky, kde nepomáhá přemýšlení, ale rozsah vědomostí uložených v paměti modelu, mu také příliš nevyhovují. Ve faktografickém testu skončil na dvaačtyřiceti bodech proti pětapadesáti bodům u většího sourozence. V praxi to znamená, že na ověřování faktů si stále musíte dávat pozor.
Testy zároveň ukázaly, že velmi záleží na programu, ve kterém model běží. Stejný model dosáhl v jednom prostředí čtyřiasedmdesáti procent a v jiném pětašedesáti procent, takže rozdíl skoro devíti procentních bodů způsobilo pouhé softwarové prostředí kolem něj.
Levnější ceny a konec staršího modelu
Nové ceny začaly platit hned v den vydání. DeepSeek drží dvojí sazby podle vytížení a kdo si práci naplánuje mimo špičku, zaplatí polovinu. Firma tvrdí, že úspory z efektivnější stavby modelu přenáší přímo na zákazníky.
Uživatelé starších verzí musí počítat se změnami. Předchozí verze Flash i její experimentální obrazová varianta skončily a jejich požadavky zatím automaticky směřují na nový model. Od 14. září ráno pak stejným směrem zamíří i vše, co posíláte na dosud nejsilnější model V4-Pro, a to za ceny menšího modelu. Platit to bude až do chvíle, kdy DeepSeek vydá výkonnější verzi nové generace. Plnou podporu už hlásí nástroje WorkBuddy s CodeBuddy a OpenCode.
Zdarma ke stažení
Model leží na platformě Hugging Face pod licencí MIT, takže si ho může kdokoli stáhnout, upravovat i používat komerčně bez placení. Spustit se dá v běžných nástrojích pro provoz velkých modelů. Tím se DeepSeek dál drží své linie, kdy silné modely poskytuje veřejnosti místo toho, aby je držel uzavřené za placeným rozhraním.
Jedna komplikace zde však vyvstává. K vydání chybí hotová šablona pro formátování konverzace, takže si programátoři musí poskládat komunikaci s modelem sami. DeepSeek k tomu přikládá ukázkový kód v jazyce Python a sadu knihoven pro ostrý provoz, samotné spuštění a propojení s ostatními nástroji už ale nechává na uživateli. Domácí počítač na to stejně nestačí, protože model vyžaduje serverovou techniku. Firmám, které plánují nasazení s dvěma tisíci grafickými kartami, nabízí DeepSeek rovnou jednání o podmínkách.



