OpenAI vydává GPT‑6.1 Sol pro programování a pracovní agenty

OpenAI vydává GPT‑6.1 Sol pro programování a pracovní agenty

Ondřej Barták
Ondřej Barták
podnikatel a programátor
29. 9. 2026
3 minut čtení · 6 zhlédnutí
Poslechněte si článek
Audio verze článku
OpenAI vydává GPT‑6.1 Sol pro programování a pracovní agenty

OpenAI představilo GPT‑6.1 Sol, nástupce GPT‑6 Sol pro agentní programování, ovládání počítače a odbornou práci. Model je dostupný v Codexu, ChatGPT Work a přes API. Podle firemních testů lépe řeší softwarové úlohy i vícekrokové pracovní procesy než předchozí verze a v části hodnocení se přibližuje GPT‑6 Astra.

Programování: shoda s Astrou v DeepSWE

Pro programátory je jedním z hlavních výsledků srovnání v DeepSWE v1.1. Tento benchmark hodnotí složité softwarové úlohy v reálných repozitářích. Podle OpenAI v něm GPT‑6.1 Sol vyrovnal výsledek GPT‑6 Astra a nejlepší skóre předchozího GPT‑6 Sol překonal o 6,4 procentního bodu. Srovnání se starší verzí přitom zahrnuje rozdílné nastavení reasoning effort, tedy míry uvažování modelu: nový Sol dosáhl uvedeného zlepšení při nižším nastavení, než jaké předchozí model využil pro svůj nejlepší výsledek.

Odborné otázky nad složitými PDF

Další část hodnocení se soustředí na práci s dokumenty. GDP.pdf ověřuje přesnost odpovědí na odborné otázky, jejichž podklady obsahují složité PDF soubory. Nejde jen o informace v souvislých odstavcích: test zahrnuje také tabulky, grafy, diagramy a detaily uvedené drobným textem.

Podle OpenAI získal nový Sol v GDP.pdf vyšší skóre než Opus 5.5 v konfiguraci s fallbacky. Toto srovnání platí napříč testovanými nastaveními reasoning effort, nikoli pouze pro jedno zvolené nastavení. Vedle porovnání s Opusem firma uvádí také výsledek vůči svému vyššímu modelu: výkon GPT‑6.1 Sol se v odpovídání na odborné otázky nad těmito dokumenty přiblížil GPT‑6 Astra.

Firemní procesy a ovládání počítače

AutomationBench 1.0.6 hodnotí, zda agent správně dokončí celý vícekrokový podnikový proces. Úlohy využívají 47 nástrojů a zahrnují prodej, marketing, provoz, zákaznickou podporu, finance a HR. Při středním nastavení reasoning effort podle OpenAI GPT‑6.1 Sol překonal Opus 5.5 o 2,2 procentního bodu. Proti GPT‑6 Sol činilo zlepšení 4,8 procentního bodu; obě generace Solu byly v tomto porovnání hodnoceny při stejném středním nastavení.

Ovládání počítače firma hodnotila v offline sadě OSWorld 2.0 z vydání v2026.08.08. Agenti v ní plní dlouhé pracovní postupy zahrnující každodenní i odborné úkoly. Zveřejněnou metrikou je částečná odměna za plnění těchto úloh v offline hodnocení. Při maximálním reasoning effort podle OpenAI nový Sol překonal předchozí verzi o sedm procentních bodů, ale za Astrou, rovněž při maximálním nastavení, zaostal o 2,1 bodu.

Vědecké úlohy: Astra zůstává vpředu

Terminal-Bench Science 0.1 rozšiřuje srovnání na vědecké pracovní postupy. Zahrnuje analýzu dat, simulace a dokazování vět. OpenAI uvádí, že GPT‑6.1 Sol při maximálním reasoning effort více než zdvojnásobil skóre GPT‑6 Sol. Posun proti předchozí generaci zde neznamená vyrovnání výsledku vyššího modelu: nejvyšší skóre mezi testovanými modely nadále patřilo GPT‑6 Astra, která dosáhla 68,1 %.

Faktické chyby a hlášení poruch nástroje

Faktickou správnost OpenAI měřilo na záměrně obtížné sadě odidentifikovaných konverzací, v nichž uživatelé dříve upozornili na chybu modelu, nikoli na reprezentativním vzorku běžného používání. Sledovanou veličinou byl podíl odpovědí obsahujících alespoň jednu faktickou chybu. Při nízkém reasoning effort tento podíl klesl z 11,4 % u GPT‑6 Sol na 7,7 % u nové verze.

Samostatný bezpečnostní test sledoval, zda agent uživateli oznámí poruchu vyhledávacího nástroje. Úlohy byly vybrány tak, aby vyvolávaly selhání, a jejich výsledky nepopisují četnost chyb při běžném používání. Při maximálním reasoning effort podle firmy GPT‑6.1 Sol problém neoznámil ve 2,1 % případů, zatímco předchozí Sol ve 4,9 % a Astra v 1,5 %.

Přístup v Codexu, ChatGPT Work a API

GPT‑6.1 Sol mohou v ChatGPT Work a Codexu používat uživatelé tarifů Plus, Pro, Business, Enterprise a Edu. Vývojáři mají přístup přes OpenAI API pod přesným označením gpt-6.1-sol. V prostředí Chat model zatím dostupný není.

Standardní ceny API činí 2 USD za milion vstupních tokenů, 0,10 USD za milion vstupních tokenů z cache a 10 USD za milion výstupních tokenů. Standardní vstupní a výstupní sazby představují pětinu sazeb GPT‑6 Astra. Podle OpenAI je vstup z cache o 95 % levnější než standardní vstup a o 50 % levnější než vstup z cache u GPT‑6 Sol. Firma tuto sazbu spojuje s provozem agentů, kteří opakovaně využívají stejný kontext napříč požadavky.

Vedle standardní varianty OpenAI plánuje v následujících dnech nabídnout GPT‑6.1 Sol Ultrafast. Tato varianta má podle společnosti v Codexu generovat tokeny až osmkrát rychleji než standardní Sol.

Reklama

S tvorbou obsahu pomáhá UpTier.

SEO a GEO na autopilota. Multiagentní systémy UpTier píší a optimalizují obsah pro vyhledávače i AI odpovědi.

Objevte UpTier ↗

Kategorie:AI
Líbil se vám tento článek?
Objevte další zajímavé příspěvky na blogu
Zpět na blog

Související články

Amazon vydal Strands Decider 2B: místo textu vybírá další krok AI agentůAmazon vydal Strands Decider 2B: místo textu vybírá další krok AI agentů
Strands Decider 2B vybírá z předem určených možností a přidává skóre jistoty. Rozhodovací model od AWS je plně open-source, již dostupný a dostatečně malý pro lokální provoz.
1 min čtení
1. 10. 2026
OpenAI oznámila zastavení kampaně na získávání skrytého uvažování modelůOpenAI oznámila zastavení kampaně na získávání skrytého uvažování modelů
Útočníci podle OpenAI manipulovali konverzacemi, aby získali chráněné interní uvažování. Firma popsala červencovou kampaň, část aktivit připsala lidem spojeným s Moonshot AI a posílila ochranu modelů i účtů.
3 min čtení
1. 10. 2026
Meta zakládá Enterprise Platform pro nasazení AI ve firmáchMeta zakládá Enterprise Platform pro nasazení AI ve firmách
Nová iniciativa má převést AI technologie Mety do podnikových produktů a služeb. Zpočátku se zaměří na Muse, Meta Business Agent, Muse API a Muse Code. Vedení převezme CJ Desai, který přichází z MongoDB.
1 min čtení
1. 10. 2026
Přihlaste se k odběru našeho newsletteru
Zůstaňte informováni o nejnovějších příspěvcích, exkluzivních nabídkách, a aktualizacích.
CodedTrip

Provozovatel: CodedTrip LLC, USA.

YouTube
TikTok