OpenAI představilo GPT‑6.1 Sol, nástupce GPT‑6 Sol pro agentní programování, ovládání počítače a odbornou práci. Model je dostupný v Codexu, ChatGPT Work a přes API. Podle firemních testů lépe řeší softwarové úlohy i vícekrokové pracovní procesy než předchozí verze a v části hodnocení se přibližuje GPT‑6 Astra.
Programování: shoda s Astrou v DeepSWE
Pro programátory je jedním z hlavních výsledků srovnání v DeepSWE v1.1. Tento benchmark hodnotí složité softwarové úlohy v reálných repozitářích. Podle OpenAI v něm GPT‑6.1 Sol vyrovnal výsledek GPT‑6 Astra a nejlepší skóre předchozího GPT‑6 Sol překonal o 6,4 procentního bodu. Srovnání se starší verzí přitom zahrnuje rozdílné nastavení reasoning effort, tedy míry uvažování modelu: nový Sol dosáhl uvedeného zlepšení při nižším nastavení, než jaké předchozí model využil pro svůj nejlepší výsledek.
Odborné otázky nad složitými PDF
Další část hodnocení se soustředí na práci s dokumenty. GDP.pdf ověřuje přesnost odpovědí na odborné otázky, jejichž podklady obsahují složité PDF soubory. Nejde jen o informace v souvislých odstavcích: test zahrnuje také tabulky, grafy, diagramy a detaily uvedené drobným textem.
Podle OpenAI získal nový Sol v GDP.pdf vyšší skóre než Opus 5.5 v konfiguraci s fallbacky. Toto srovnání platí napříč testovanými nastaveními reasoning effort, nikoli pouze pro jedno zvolené nastavení. Vedle porovnání s Opusem firma uvádí také výsledek vůči svému vyššímu modelu: výkon GPT‑6.1 Sol se v odpovídání na odborné otázky nad těmito dokumenty přiblížil GPT‑6 Astra.
Firemní procesy a ovládání počítače
AutomationBench 1.0.6 hodnotí, zda agent správně dokončí celý vícekrokový podnikový proces. Úlohy využívají 47 nástrojů a zahrnují prodej, marketing, provoz, zákaznickou podporu, finance a HR. Při středním nastavení reasoning effort podle OpenAI GPT‑6.1 Sol překonal Opus 5.5 o 2,2 procentního bodu. Proti GPT‑6 Sol činilo zlepšení 4,8 procentního bodu; obě generace Solu byly v tomto porovnání hodnoceny při stejném středním nastavení.
Ovládání počítače firma hodnotila v offline sadě OSWorld 2.0 z vydání v2026.08.08. Agenti v ní plní dlouhé pracovní postupy zahrnující každodenní i odborné úkoly. Zveřejněnou metrikou je částečná odměna za plnění těchto úloh v offline hodnocení. Při maximálním reasoning effort podle OpenAI nový Sol překonal předchozí verzi o sedm procentních bodů, ale za Astrou, rovněž při maximálním nastavení, zaostal o 2,1 bodu.
Vědecké úlohy: Astra zůstává vpředu
Terminal-Bench Science 0.1 rozšiřuje srovnání na vědecké pracovní postupy. Zahrnuje analýzu dat, simulace a dokazování vět. OpenAI uvádí, že GPT‑6.1 Sol při maximálním reasoning effort více než zdvojnásobil skóre GPT‑6 Sol. Posun proti předchozí generaci zde neznamená vyrovnání výsledku vyššího modelu: nejvyšší skóre mezi testovanými modely nadále patřilo GPT‑6 Astra, která dosáhla 68,1 %.
Faktické chyby a hlášení poruch nástroje
Faktickou správnost OpenAI měřilo na záměrně obtížné sadě odidentifikovaných konverzací, v nichž uživatelé dříve upozornili na chybu modelu, nikoli na reprezentativním vzorku běžného používání. Sledovanou veličinou byl podíl odpovědí obsahujících alespoň jednu faktickou chybu. Při nízkém reasoning effort tento podíl klesl z 11,4 % u GPT‑6 Sol na 7,7 % u nové verze.
Samostatný bezpečnostní test sledoval, zda agent uživateli oznámí poruchu vyhledávacího nástroje. Úlohy byly vybrány tak, aby vyvolávaly selhání, a jejich výsledky nepopisují četnost chyb při běžném používání. Při maximálním reasoning effort podle firmy GPT‑6.1 Sol problém neoznámil ve 2,1 % případů, zatímco předchozí Sol ve 4,9 % a Astra v 1,5 %.
Přístup v Codexu, ChatGPT Work a API
GPT‑6.1 Sol mohou v ChatGPT Work a Codexu používat uživatelé tarifů Plus, Pro, Business, Enterprise a Edu. Vývojáři mají přístup přes OpenAI API pod přesným označením gpt-6.1-sol. V prostředí Chat model zatím dostupný není.
Standardní ceny API činí 2 USD za milion vstupních tokenů, 0,10 USD za milion vstupních tokenů z cache a 10 USD za milion výstupních tokenů. Standardní vstupní a výstupní sazby představují pětinu sazeb GPT‑6 Astra. Podle OpenAI je vstup z cache o 95 % levnější než standardní vstup a o 50 % levnější než vstup z cache u GPT‑6 Sol. Firma tuto sazbu spojuje s provozem agentů, kteří opakovaně využívají stejný kontext napříč požadavky.
Vedle standardní varianty OpenAI plánuje v následujících dnech nabídnout GPT‑6.1 Sol Ultrafast. Tato varianta má podle společnosti v Codexu generovat tokeny až osmkrát rychleji než standardní Sol.



