Aangedreven door
Technology

AI-giganten brengen in drie weken tijd vier baanbrekende modellen op de markt nu de race in een stroomversnelling komt

Vier toonaangevende laboratoria op het gebied van kunstmatige intelligentie (AI) hebben in juli 2026 binnen een periode van drie weken baanbrekende taalmodellen gelanceerd, en de kloof tussen wat deze systemen zonder menselijke tussenkomst tot stand brengen en wat er eerder mogelijk was, is sterk verkleind.

GESCHREVEN DOOR
DELEN
AI-giganten brengen in drie weken tijd vier baanbrekende modellen op de markt nu de race in een stroomversnelling komt

Belangrijkste punten

  • xAI bracht op 8 juli Grok 4.5 op de markt voor $2/$6 per miljoen tokens, waarmee het de prijs van Opus 4.8 met meer dan 60% onderbood.
  • Anthropic bracht op 24 juli Claude Opus 5 uit als het nieuwe standaardmodel voor Claude Max-abonnementen.
  • Moonshot AI heeft Kimi K3 gepubliceerd, zijn grootste model met 2,8 biljoen parameters.

Grok 4.5 van xAI, Claude Opus 5 van Anthropic, de GPT-5.6-familie van OpenAI en Kimi K3 van Moonshot AI richten zich allemaal op hetzelfde probleem: een AI-systeem in staat stellen een taak van meerdere uren uit te voeren – van onderzoek tot coderen tot gestructureerde rapportage – zonder het overzicht te verliezen.

Grok 4.5 is getraind op echte ontwikkelaarssessies

xAI heeft op 8 juli Grok 4.5 uitgebracht. Het model draait op een basis van 1,5 biljoen parameters en is deels getraind op echte gebruiksgegevens van Cursor, het programmeerplatform dat SpaceXAI eerder dit jaar heeft overgenomen. De prijs bedraagt 2 dollar per miljoen invoertokens en 6 dollar per miljoen uitvoertokens, met een contextvenster van 500.000 tokens.

Elon X post screenshot.
Elon bespreekt de release van Grok 4.5 op 8 juli 2026.

Elon Musk beschreef Grok 4.5 als een model van de Opus-klasse dat sneller en tegen lagere kosten draait. Onafhankelijke trackers plaatsen het op de vierde plaats in de Artificial Analysis Intelligence Index, vóór alle open-weight-modellen, tegen een prijs die meer dan 60% lager ligt dan die van Claude Opus 4.8 en GPT-5.5. Op Terminal-Bench 2.1, een test die meet hoe goed een model technische taken via de opdrachtregel uitvoert, scoorde Grok 4.5 83,3%.

De grootste verandering zit hem in de tokenefficiëntie. xAI zegt dat het model ongeveer een vijfde van de output-tokens nodig heeft die Opus 4.8 voor vergelijkbare taken nodig had, wat de kosten van het uitvoeren van lange agentsessies verlaagt.

Claude Opus 5 houdt de prijs op peil

Anthropic bracht op 24 juli Claude Opus 5 uit en positioneerde het als een model dat bijna de prestaties van Claude Fable 5 evenaart – de meest geavanceerde versie van het bedrijf – tegen de helft van de prijs van Fable: $10 voor input en $50 voor output. Opus 5 zelf hanteert dezelfde prijzen van $5 voor input en $25 voor output als zijn voorganger, Opus 4.8.

Claude X post screenshot.
Aankondiging van Claude Opus 5 via X.

Het model wordt geleverd met een contextvenster van 1 miljoen tokens, maximaal 128.000 output-tokens en een instelbare redeneringsinspanning die varieert van ‘low’ tot een nieuwe ‘xhigh’-modus. Anthropic zegt dat Opus 5 nieuwe records vestigt op Frontier-Bench en GDPval-AA, twee evaluaties voor programmeer- en kenniswerk, hoewel het achterblijft bij het beperkte Claude Mythos 5-model bij cyberbeveiligingstaken. Opus 5 is nu het standaardmodel op Claude Max en de sterkste optie op Claude Pro.

OpenAI splitst GPT-5.6 op in drie niveaus

OpenAI heeft GPT-5.6 op 9 juli algemeen beschikbaar gemaakt, na een previewperiode van twee weken die beperkt was tot ongeveer 20 door de Amerikaanse overheid gescreende organisaties, in navolging van een uitvoeringsbesluit in verband met de veiligheidsbeoordeling van geavanceerde modellen. De reeks wordt aangeboden in drie niveaus: Sol, het vlaggenschip, geprijsd op $5 voor input en $30 voor output per miljoen tokens; Terra, een model uit het middensegment voor $2,50 en $15, dat volgens OpenAI even goed presteert als GPT-5.5 tegen de helft van de kosten; en Luna, een snelle, goedkope optie voor $1 en $6.

OpenAI X post screenshot.
Aankondiging van ChatGPT 5.6 Sol via X.

OpenAI meldt dat Sol aan kop gaat in de Artificial Analysis Coding Agent Index en 88,8% scoort op Terminal-Bench 2.1, oplopend tot 91,9% wanneer het model vier subagenten parallel laat draaien in de nieuwe „ultra“-modus. Alle drie de niveaus hebben de hoogste interne risicobeoordeling van OpenAI voor potentieel cyber- en biologisch misbruik, wat aanleiding gaf tot extra toetsing tijdens de voorbeeldexpositie die beperkt was tot overheidsinstanties.

Kimi K3 verlegt de grenzen van open gewichtsmodellen

Moonshot AI heeft op 16 juli Kimi K3 uitgebracht, een ‘mixture of experts’-model met 2,8 biljoen parameters, in totaal 896 experts en 16 actieve experts per taak. Het model beschikt over een contextvenster van 1 miljoen tokens en native multimodale invoer, met API-tarieven van $ 3 voor invoer en $ 15 voor uitvoer per miljoen tokens. Moonshot heeft toegezegd de volledige open gewichten uiterlijk 27 juli te publiceren.

Kimi Moonshot X post screenshot.
Aankondiging van Kimi K3 via X.

K3 is het grootste model met open gewichten dat tot nu toe is uitgebracht, ongeveer 75% groter dan het vorige grootste, veelgebruikte open model. Onafhankelijke trackers plaatsen K3 op de vierde plaats onder de huidige toonaangevende systemen, achter Claude Fable 5 en GPT-5.6 Sol, maar vóór Claude Opus 4.8.

Waarom het verschil met oudere modellen van belang is

Contextvensters van minder dan 200.000 tokens dwongen ontwikkelaars vroeger om grote codebases of onderzoekspakketten in fragmenten op te splitsen. Elk model in deze groep draait nu op 500.000 tokens of meer, waarbij drie van de vier op 1 miljoen zitten, waardoor een enkele sessie een volledige repository of een stapel primaire brondocumenten kan bevatten.

Ook de betrouwbaarheid van de agents is verbeterd. Systemen uit de periode 2023 en 2024 raakten vaak hun plan kwijt na een handvol toolaanroepen. De modellen die deze maand zijn uitgebracht, zijn zo gebouwd dat ze tientallen gecoördineerde stappen kunnen volhouden en zich herstellen wanneer een toolaanroep onjuiste gegevens retourneert, in plaats van vast te lopen.

Voor ontwikkelaars betekent dit in de praktijk lagere kosten per voltooide taak, in plaats van een hogere bovengrens voor een afzonderlijke benchmark. De inspanningsbeperkingen in Opus 5, de gedifferentieerde prijsstelling in GPT-5.6 en de efficiëntieclaims achter Grok 4.5 wijzen allemaal in dezelfde richting: teams laten kiezen hoeveel rekenkracht een taak verdient, in plaats van voor elk verzoek de prijzen van vlaggenschipmodellen te betalen.

Voor ondernemingen en beleidsmakers geeft de door de overheid gecontroleerde uitrol van GPT-5.6 aan dat toezicht nu is ingebouwd in de releaseschema’s voor de grootste modellen, en niet achteraf wordt toegevoegd. De korte, door de overheid opgelegde opschorting van de toegang tot Fable en Mythos door Anthropic in juni was een eerdere versie van hetzelfde patroon.

Dit artikel is met behulp van AI uit het Engels vertaald. De originele Engelstalige versie is de gezaghebbende bron; geautomatiseerde vertalingen kunnen onnauwkeurigheden bevatten, met name in juridische en regelgevende terminologie.