Poháňa
Technology

Giganti v oblasti umelej inteligencie uviedli za tri týždne na trh štyri priekopnícke modely, pričom súťaž naberá na obrátkach

Štyri renomované laboratóriá zaoberajúce sa umelou inteligenciou (AI) v priebehu troch týždňov v júli 2026 zverejnili najnovšie jazykové modely a rozdiel medzi tým, čo tieto systémy dokážu bez ľudského zásahu, a tým, čo bolo k dispozícii predtým, sa výrazne zmenšil.

NAPÍSAL
ZDIEĽAŤ
Giganti v oblasti umelej inteligencie uviedli za tri týždne na trh štyri priekopnícke modely, pričom súťaž naberá na obrátkach

Kľúčové body

  • Spoločnosť xAI uviedla 8. júla na trh model Grok 4.5 za cenu 2 až 6 USD za milión tokenov, čím podcenila cenu modelu Opus 4.8 o viac ako 60 %.
  • Spoločnosť Anthropic uviedla 24. júla model Claude Opus 5 ako nový predvolený model v rámci predplatného služby Claude Max.
  • Spoločnosť Moonshot AI zverejnila model Kimi K3, svoj najväčší model s 2,8 biliónmi parametrov.

Grok 4.5 od xAI, Claude Opus 5 od Anthropic, rodina GPT-5.6 od OpenAI a Kimi K3 od Moonshot AI sa zameriavajú na ten istý problém: dosiahnuť, aby systém umelej inteligencie zvládol niekoľkohodinovú úlohu, od výskumu cez kódovanie až po štruktúrované vykazovanie, bez toho, aby stratil prehľad o pláne.

Grok 4.5 je trénovaný na reálnych vývojárskych reláciách

Spoločnosť xAI vydala model Grok 4.5 8. júla. Model beží na báze 1,5 bilióna parametrov a bol čiastočne trénovaný na skutočných údajoch o používaní z platformy Cursor, ktorú spoločnosť SpaceXAI získala začiatkom tohto roka. Cena je stanovená na 2 doláre za milión vstupných tokenov a 6 dolárov za milión výstupných tokenov, s kontextovým oknom 500 000 tokenov.

Elon X post screenshot.
Elon hovorí o vydaní Grok 4.5 8. júla 2026.

Elon Musk opísal Grok 4.5 ako model triedy Opus, ktorý beží rýchlejšie a s nižšími nákladmi. Nezávislé hodnotiace subjekty ho zaradili na štvrté miesto v rebríčku Artificial Analysis Intelligence Index, pred všetkými modelmi s otvorenou váhou, pričom jeho cena je o viac ako 60 % nižšia ako v prípade modelov Claude Opus 4.8 a GPT-5.5. V teste Terminal-Bench 2.1, ktorý hodnotí, ako dobre model plní inžinierske úlohy v príkazovom riadku, dosiahol Grok 4.5 skóre 83,3 %.

Väčší posun nastal v oblasti efektívnosti tokenov. Spoločnosť xAI uvádza, že model potrebuje približne pätinu výstupných tokenov, ktoré model Opus 4.8 vyžadoval na porovnateľné úlohy, čo znižuje náklady na prevádzku dlhých relácií agenta.

Claude Opus 5 si udržuje cenovú hladinu

Spoločnosť Anthropic vydala 24. júla model Claude Opus 5 a prezentuje ho ako model, ktorý sa výkonnosťou približuje modelu Claude Fable 5, najschopnejšej verzii spoločnosti, pričom jeho cena je polovičná v porovnaní s cenou modelu Fable, ktorá je 10 USD za vstup a 50 USD za výstup. Samotný Opus 5 má rovnaké ceny – 5 USD za vstup a 25 USD za výstup – ako jeho predchodca, Opus 4.8.

Claude X post screenshot.
Oznámenie o Claude Opus 5 prostredníctvom X.

Model je dodávaný s kontextovým oknom s kapacitou 1 milión tokenov, maximálnym počtom 128 000 výstupných tokenov a nastaviteľnou úrovňou náročnosti uvažovania, ktorá sa pohybuje od nízkej až po nový režim „xhigh“. Spoločnosť Anthropic uvádza, že Opus 5 stanovuje nové rekordy v testoch Frontier-Bench a GDPval-AA, dvoch hodnoteniach kódovania a práce so znalosťami, hoci v úlohách týkajúcich sa kyberbezpečnosti zaostáva za obmedzeným modelom Claude Mythos 5. Opus 5 je teraz predvoleným modelom v službe Claude Max a najvýkonnejšou voľbou v službe Claude Pro.

OpenAI rozdelilo GPT-5.6 do troch úrovní

OpenAI sprístupnilo GPT-5.6 pre širokú verejnosť 9. júla po dvojtýždňovom predbežnom testovaní obmedzenom na približne 20 organizácií preverených vládou USA, a to v nadväznosti na výkonné nariadenie súvisiace s bezpečnostným preskúmaním modelov Frontier. Táto rodina sa dodáva v troch úrovniach: Sol, vlajková loď, s cenou 5 USD za vstup a 30 USD za výstup na milión tokenov; Terra, model strednej úrovne s cenou 2,50 USD a 15 USD, ktorý podľa OpenAI zodpovedá modelu GPT-5.5 za polovičnú cenu; a Luna, rýchla a nízkonákladová úroveň s cenou 1 USD a 6 USD.

OpenAI X post screenshot.
Oznámenie o ChatGPT 5.6 Sol prostredníctvom X.

OpenAI uvádza, že Sol vedie rebríček Artificial Analysis Coding Agent Index a dosahuje 88,8 % v teste Terminal-Bench 2.1, pričom tento výsledok stúpa na 91,9 %, keď model spúšťa štyroch subagentov paralelne v rámci svojho nového ultra režimu. Všetky tri úrovne majú najvyššie interné hodnotenie rizika spoločnosti OpenAI z hľadiska potenciálu zneužitia v kybernetickom a biologickom prostredí, čo vyvolalo dodatočné preskúmanie počas predbežného testovania s obmedzeným prístupom pre vládne subjekty.

Kimi K3 posúva modely s otvorenou váhou na hranice možností

Spoločnosť Moonshot AI 16. júla uviedla na trh model Kimi K3, model typu „mixture of experts“ s 2,8 biliónmi parametrov, celkovo 896 expertmi a 16 aktívnymi expertmi na jednu úlohu. Model disponuje kontextovým oknom s kapacitou 1 milión tokenov a natívnym multimodálnym vstupom, pričom cena API je 3 USD za vstup a 15 USD za výstup na milión tokenov. Spoločnosť Moonshot sa zaviazala zverejniť úplné otvorené váhy do 27. júla.

Kimi Moonshot X post screenshot.
Oznámenie o modeli Kimi K3 prostredníctvom X.

K3 je najväčší model s otvorenými váhami, ktorý bol doteraz vydaný, približne o 75 % väčší ako predchádzajúci najväčší široko používaný otvorený model. Nezávislé sledovacie systémy zaraďujú K3 na štvrté miesto medzi súčasnými špičkovými systémami, za modelmi Claude Fable 5 a GPT-5.6 Sol, ale pred modelom Claude Opus 4.8.

Prečo je dôležitý rozdiel oproti starším modelom

Kontextové okná s menším počtom ako 200 000 tokenov kedysi nútili vývojárov rozdeľovať rozsiahle kódové základne alebo výskumné balíky na fragmenty. Každý model v tejto skupine teraz beží s 500 000 tokenmi alebo viac, pričom tri zo štyroch dosahujú 1 milión, čo umožňuje, aby jedna relácia pojala celý repozitár alebo súbor primárnych zdrojových dokumentov.

Zlepšila sa aj spoľahlivosť agentov. Systémy z obdobia rokov 2023 a 2024 často stratili svoj plán už po niekoľkých volaniach nástrojov. Modely vydané tento mesiac sú navrhnuté tak, aby zvládli desiatky koordinovaných krokov a obnovili sa, keď volanie nástroja vráti nesprávne údaje, namiesto toho, aby sa zasekli.

Pre vývojárov to v praxi znamená nižšie náklady na dokončenú úlohu, nie vyšší strop v rámci akéhokoľvek jednotlivého benchmarku. Kontrola náročnosti v Opus 5, odstupňované ceny v GPT-5.6 a tvrdenia o efektivite modelu Grok 4.5 smerujú k rovnakému cieľu: umožniť tímom zvoliť si, koľko výpočtového výkonu si úloha zaslúži, namiesto toho, aby za každú požiadavku platili ceny ako za vlajkové modely.

Pre podniky a tvorcov politík znamená vládou riadené zavádzanie modelu GPT-5.6 signál, že do harmonogramov vydávania najväčších modelov je teraz zabudovaný dohľad, a nie je pridávaný až dodatočne. Krátke, vládou nariadené pozastavenie prístupu k modelom Fable a Mythos spoločnosťou Anthropic v júni bolo skoršou verziou toho istého vzorca.

Tento článok bol preložený z angličtiny pomocou umelej inteligencie. Pôvodná anglická verzia je autoritatívnym zdrojom; automatické preklady môžu obsahovať nepresnosti, najmä v právnej a regulačnej terminológii.