Provozuje
Technology

Giganti v oblasti umělé inteligence uvedli během tří týdnů na trh čtyři průkopnické modely, zatímco závod nabírá na obrátkách

Čtyři renomovaná výzkumná centra zabývající se umělou inteligencí (AI) uvedla v červenci 2026 během tří týdnů na trh průkopnické jazykové modely a rozdíl mezi tím, čeho tyto systémy dosahují bez lidského zásahu, a předchozími verzemi se výrazně zmenšil.

SDÍLET
Giganti v oblasti umělé inteligence uvedli během tří týdnů na trh čtyři průkopnické modely, zatímco závod nabírá na obrátkách

Hlavní body

  • Společnost xAI uvedla 8. července na trh model Grok 4.5 za cenu 2–6 dolarů za milion tokenů, čímž podbila cenu modelu Opus 4.8 o více než 60 %.
  • Společnost Anthropic uvedla 24. července model Claude Opus 5 jako nový výchozí model v rámci předplatného služby Claude Max.
  • Společnost Moonshot AI zveřejnila model Kimi K3, svůj největší model s 2,8 biliony parametrů.

Grok 4.5 od xAI, Claude Opus 5 od Anthropic, řada GPT-5.6 od OpenAI a Kimi K3 od Moonshot AI se všechny zaměřují na stejný problém: zajistit, aby systém umělé inteligence zvládl několikahodinový úkol, od výzkumu přes kódování až po strukturované reportování, aniž by ztratil přehled o plánu.

Grok 4.5 se učí na reálných vývojářských relacích

Společnost xAI vydala model Grok 4.5 8. července. Model běží na bázi 1,5 bilionu parametrů a byl částečně trénován na reálných datech o používání z platformy Cursor, kterou společnost SpaceXAI získala na začátku tohoto roku. Cena je stanovena na 2 dolary za milion vstupních tokenů a 6 dolarů za milion výstupních tokenů, s kontextovým oknem o velikosti 500 000 tokenů.

Elon X post screenshot.
Elon hovoří o vydání Grok 4.5 dne 8. července 2026.

Elon Musk popsal Grok 4.5 jako model třídy Opus, který běží rychleji a s nižšími náklady. Nezávislé sledovací subjekty jej řadí na čtvrté místo v indexu Artificial Analysis Intelligence Index, před všemi modely s otevřenou váhou, přičemž jeho cena je o více než 60 % nižší než u modelů Claude Opus 4.8 a GPT-5.5. V testu Terminal-Bench 2.1, který hodnotí, jak dobře model plní inženýrské úkoly v příkazovém řádku, dosáhl Grok 4.5 skóre 83,3 %.

Větší změnou je efektivita tokenů. Společnost xAI uvádí, že model potřebuje přibližně pětinu výstupních tokenů, které model Opus 4.8 vyžadoval pro srovnatelné úkoly, což snižuje náklady na provozování dlouhých relací agenta.

Claude Opus 5 drží cenovou laťku

Společnost Anthropic vydala 24. července model Claude Opus 5 a prezentuje jej jako model, který se výkonem blíží modelu Claude Fable 5, nejvýkonnějšímu produktu společnosti, a to za poloviční cenu oproti modelu Fable, jehož cena za vstup je 10 USD a za výstup 50 USD. Samotný Opus 5 má stejné ceny – 5 dolarů za vstup a 25 dolarů za výstup – jako jeho předchůdce, Opus 4.8.

Claude X post screenshot.
Oznámení o Claude Opus 5 na X.

Model je dodáván s kontextovým oknem o velikosti 1 milionu tokenů, maximálním počtem 128 000 výstupních tokenů a nastavitelnou úrovní úsilí při uvažování, která sahá od nízké až po nový režim „xhigh“. Společnost Anthropic uvádí, že Opus 5 stanovuje nové rekordy v testech Frontier-Bench a GDPval-AA, dvou hodnoceních zaměřených na programování a práci s informacemi, i když v úkolech z oblasti kyberbezpečnosti zaostává za omezeným modelem Claude Mythos 5. Opus 5 je nyní výchozím modelem v rámci služby Claude Max a nejvýkonnější volbou v rámci služby Claude Pro.

OpenAI rozdělilo GPT-5.6 do tří úrovní

OpenAI uvolnilo GPT-5.6 k všeobecné dostupnosti 9. července po dvoutýdenní předpremiéře omezené na přibližně 20 organizací prověřených americkou vládou, a to v návaznosti na výkonný příkaz související s bezpečnostním přezkumem modelů nové generace. Tato řada se dodává ve třech úrovních: Sol, vlajková loď, s cenou 5 USD za vstup a 30 USD za výstup na milion tokenů; Terra, model střední úrovně za 2,50 $ a 15 $, který podle OpenAI odpovídá modelu GPT-5.5 za poloviční cenu; a Luna, rychlá a nízkonákladová úroveň za 1 $ a 6 $.

OpenAI X post screenshot.
Oznámení o ChatGPT 5.6 Sol prostřednictvím X.

OpenAI uvádí, že Sol vede žebříček Artificial Analysis Coding Agent Index a dosahuje skóre 88,8 % v testu Terminal-Bench 2.1, přičemž toto skóre stoupá na 91,9 %, když model spouští čtyři subagenty paralelně v rámci svého nového ultra režimu. Všechny tři úrovně mají nejvyšší interní hodnocení rizika OpenAI z hlediska potenciálu zneužití v kybernetické a biologické oblasti, což vyvolalo dodatečné přezkoumání během předběžného testování pod dohledem vlády.

Kimi K3 posouvá modely s otevřenou váhou k hranicím možností

Společnost Moonshot AI vydala 16. července model Kimi K3, model typu „mixture of experts“ s 2,8 biliony parametrů, celkem 896 experty a 16 aktivními experty na jeden úkol. Model disponuje kontextovým oknem o velikosti 1 milionu tokenů a nativním multimodálním vstupem, přičemž cena API činí 3 dolary za vstup a 15 dolarů za výstup na milion tokenů. Společnost Moonshot se zavázala zveřejnit kompletní otevřené váhy do 27. července.

Kimi Moonshot X post screenshot.
Oznámení o modelu Kimi K3 na platformě X.

K3 je dosud největší model s otevřenými váhami, který byl uveden na trh, a je přibližně o 75 % větší než předchozí největší široce používaný otevřený model. Nezávislé sledovací služby řadí K3 na čtvrté místo mezi současnými špičkovými systémy, za modely Claude Fable 5 a GPT-5.6 Sol, ale před modelem Claude Opus 4.8.

Proč je rozdíl oproti starším modelům důležitý

Kontextová okna s méně než 200 000 tokeny kdysi nutila vývojáře rozdělovat rozsáhlé kódové základny nebo výzkumné balíčky na fragmenty. Každý model v této skupině nyní pracuje s 500 000 tokeny nebo více, přičemž tři ze čtyř dosahují 1 milionu, což umožňuje, aby jedna relace pojala celé repozitáře nebo hromadu primárních zdrojových dokumentů.

Změnila se také spolehlivost agentů. Systémy z období let 2023 a 2024 často ztratily svůj plán již po několika voláních nástrojů. Modely vydané tento měsíc jsou navrženy tak, aby zvládly desítky koordinovaných kroků a dokázaly se zotavit, když volání nástroje vrátí nesprávná data, místo aby se zasekly.

Pro vývojáře to v praxi znamená nižší náklady na dokončený úkol, nikoli vyšší strop u jakéhokoli jednotlivého benchmarku. Řízení výpočetního úsilí v Opus 5, odstupňované ceny v GPT-5.6 a tvrzení o efektivitě modelu Grok 4.5 směřují ke stejnému cíli: umožnit týmům zvolit, kolik výpočetního výkonu si daný úkol zaslouží, namísto placení cen za vlajkové modely za každý požadavek.

Pro podniky a tvůrce politik znamená vládou řízené zavádění modelu GPT-5.6 signál, že do harmonogramů vydávání největších modelů je nyní zabudován dohled, a není přidáván až dodatečně. Krátké, vládou nařízené pozastavení přístupu k modelům Fable a Mythos společností Anthropic v červnu bylo dřívější verzí stejného vzorce.

Tento článek byl přeložen z angličtiny pomocí umělé inteligence. Původní anglická verze je autoritativním zdrojem; automatické překlady mohou obsahovat nepřesnosti, zejména v právní a regulační terminologii.