У липні 2026 року чотири провідні лабораторії штучного інтелекту (ШІ) протягом трьох тижнів випустили передові мовні моделі, і розрив між тим, що ці системи здатні зробити без втручання людини, та попередніми досягненнями різко скоротився.
Гіганти у сфері штучного інтелекту запустили 4 передові моделі за 3 тижні, а гонка набирає обертів

Основні висновки
- 8 липня xAI випустила Grok 4.5 за ціною 2–6 доларів за мільйон токенів, що на понад 60% нижче за ціну Opus 4.8.
- 24 липня компанія Anthropic випустила Claude Opus 5 як нову модель за замовчуванням для передплатників Claude Max.
- Moonshot AI опублікувала Kimi K3 — свою найбільшу модель із 2,8 трильйонами параметрів.
Grok 4.5 від xAI, Claude Opus 5 від Anthropic, сімейство GPT-5.6 від OpenAI та Kimi K3 від Moonshot AI спрямовані на вирішення однієї й тієї ж проблеми: забезпечення здатності системи штучного інтелекту виконувати багатогодинні завдання — від дослідження до кодування та структурованої звітності — без втрати орієнтації у плані.
Grok 4.5 навчається на реальних сесіях розробників
xAI випустила Grok 4.5 8 липня. Модель працює на базі з 1,5 трильйона параметрів і була частково навчена на реальних даних використання з Cursor — платформи для кодування, яку SpaceXAI придбала на початку цього року. Вартість становить 2 долари за мільйон вхідних токенів і 6 доларів за мільйон вихідних токенів, з контекстним вікном у 500 000 токенів.

Ілон Маск описав Grok 4.5 як модель класу Opus, яка працює швидше та з меншими витратами. Незалежні аналітики посідають їй четверте місце в Індексі штучного аналітичного інтелекту, випереджаючи всі моделі з відкритою вагою, при ціні, що на понад 60 % нижча за Claude Opus 4.8 та GPT-5.5. У тесті Terminal-Bench 2.1, який оцінює, наскільки добре модель виконує інженерні завдання в командному рядку, Grok 4.5 набрав 83,3%.
Більш суттєвою зміною є ефективність використання токенів. xAI заявляє, що модель потребує приблизно п’ятої частини вихідних токенів, які були необхідні Opus 4.8 для виконання аналогічних завдань, що знижує вартість проведення тривалих сеансів роботи агента.
Claude Opus 5 зберігає цінову позицію
24 липня компанія Anthropic випустила Claude Opus 5, позиціонуючи її як модель, яка наближається за продуктивністю до Claude Fable 5 — найпотужнішого продукту компанії — при ціні, що становить половину від вартості Fable: 10 доларів за вхідні дані та 50 доларів за вихідні. Сама Opus 5 має ті ж ціни — 5 доларів за вхідні дані та 25 доларів за вихідні — що й її попередниця, Opus 4.8.

Модель має контекстне вікно розміром 1 мільйон токенів, максимальну кількість вихідних токенів 128 000 та налаштування інтенсивності міркування, яке варіюється від низького до нового режиму xhigh. Компанія Anthropic заявляє, що Opus 5 встановлює нові рекорди у тестах Frontier-Bench та GDPval-AA — двох оцінках кодування та роботи з знаннями, хоча у завданнях з кібербезпеки вона поступається обмеженій моделі Claude Mythos 5. Opus 5 тепер є моделлю за замовчуванням у Claude Max та найпотужнішим варіантом у Claude Pro.
OpenAI розділила GPT-5.6 на три рівні
9 липня OpenAI перевела GPT-5.6 у режим загальної доступності після двотижневого попереднього тестування, обмеженого приблизно 20 організаціями, перевіреними урядом США, відповідно до виконавчого наказу, пов’язаного з перевіркою безпеки передових моделей. Ця серія представлена трьома рівнями: Sol — флагманська модель, вартість якої становить 5 доларів за вхід і 30 доларів за вихід на мільйон токенів; Terra — модель середнього рівня за 2,50 та 15 доларів, яка, за словами OpenAI, відповідає GPT-5.5 за половину вартості; та Luna — швидкий та недорогий рівень за 1 та 6 доларів.

OpenAI повідомляє, що Sol очолює індекс Artificial Analysis Coding Agent Index і набирає 88,8% у тесті Terminal-Bench 2.1, а цей показник зростає до 91,9%, коли модель запускає чотири субагенти паралельно в новому режимі «ultra». Усі три рівні мають найвищий внутрішній рейтинг ризику OpenAI щодо потенційного зловживання в кіберпросторі та біологічній сфері, що спричинило додаткову перевірку під час попереднього перегляду, доступ до якого обмежувався урядом.
Kimi K3 виводить моделі з відкритою вагою на новий рівень
16 липня компанія Moonshot AI випустила Kimi K3 — модель «суміші експертів» з 2,8 трильйонами параметрів, що включає загалом 896 експертів, з яких 16 активних для кожного завдання. Модель має контекстне вікно розміром 1 мільйон токенів та вбудовану підтримку мультимодальних вхідних даних, а вартість API становить 3 долари за вхід та 15 доларів за вихід на мільйон токенів. Компанія Moonshot зобов’язалася опублікувати повні відкриті ваги до 27 липня.

K3 — це найбільша на сьогодні модель з відкритими вагами, яка приблизно на 75 % перевищує за розміром попередню найбільшу широко використовувану відкриту модель. За даними незалежних аналітиків, K3 посідає четверте місце серед сучасних передових систем, поступаючись Claude Fable 5 та GPT-5.6 Sol, але випереджаючи Claude Opus 4.8.
Чому важливий розрив із попередніми моделями
Контекстні вікна розміром менше 200 000 токенів раніше змушували розробників розбивати великі кодові бази або дослідницькі пакети на фрагменти. Зараз кожна модель у цій групі працює з 500 000 токенів або більше, причому три з чотирьох — з 1 мільйоном, що дозволяє в рамках однієї сесії обробляти повне репозиторій або набір первинних джерел.
Надійність агентів також покращилася. Системи періоду 2023–2024 років часто втрачали свій план після кількох викликів інструментів. Моделі, випущені цього місяця, побудовані так, щоб підтримувати десятки скоординованих кроків і відновлюватися, коли виклик інструменту повертає некоректні дані, замість того, щоб зупинятися.
Для розробників практичним ефектом є зниження вартості кожного виконаного завдання, а не підвищення максимальних показників у окремих тестах. Механізми контролю навантаження в Opus 5, багаторівневе ціноутворення в GPT-5.6 та заяви щодо ефективності Grok 4.5 вказують на одну й ту саму мету: дати командам можливість самостійно обирати, скільки обчислювальних ресурсів потребує завдання, замість того, щоб платити флагманські ціни за кожен запит.
Для підприємств та політиків урядове впровадження GPT-5.6 свідчить про те, що нагляд тепер вбудовано у графіки випуску найбільших моделей, а не додається постфактум. Короткочасне, спрямоване урядом призупинення доступу до Fable та Mythos компанією Anthropic у червні було попередньою версією того самого сценарію.
Цю статтю перекладено з англійської мови за допомогою штучного інтелекту. Оригінальна англомовна версія є авторитетним джерелом; автоматичні переклади можуть містити неточності, особливо в юридичній та нормативній термінології.

















