Fire høyprofilerte laboratorier innen kunstig intelligens (KI) lanserte språkmodeller i frontier-klassen i løpet av en treukersperiode i juli 2026, og gapet mellom hva disse systemene fullfører uten menneskelig inngripen og det som kom før, har krympet kraftig.
AI-giganter slipper løs 4 banebrytende modeller på 3 uker idet kappløpet går inn i overgir

Viktige punkter
- xAI lanserte Grok 4.5 8. juli til $2/$6 per million tokens, og underkuttet Opus 4.8-prisingen med over 60%.
- Anthropic lanserte Claude Opus 5 24. juli som ny standardmodell i Claude Max-abonnementer.
- Moonshot AI publiserte Kimi K3, sin største modell med 2,8 billioner parametere.
Grok 4.5 fra xAI, Claude Opus 5 fra Anthropic, GPT-5.6-familien fra OpenAI og Kimi K3 fra Moonshot AI retter seg alle mot det samme problemet: å få et KI-system til å gjennomføre en fler-timers oppgave, fra research til koding til strukturert rapportering, uten å miste oversikten over planen.
Grok 4.5 Trenes på Reelle Utviklerøkter
xAI lanserte Grok 4.5 8. juli. Modellen kjører på en base med 1,5 billioner parametere og ble delvis trent på reelle bruksdata fra Cursor, kodeplattformen SpaceXAI kjøpte tidligere i år. Prisene ligger på $2 per million input-tokens og $6 per million output-tokens, med et kontekstvindu på 500 000 tokens.

Elon Musk beskrev Grok 4.5 som en Opus-klasse-modell som kjører raskere og til lavere kostnad. Uavhengige trackere plasserer den som nummer fire på Artificial Analysis Intelligence Index, foran alle åpne vektmodeller, med prising mer enn 60% under Claude Opus 4.8 og GPT-5.5. På Terminal-Bench 2.1, en test som måler hvor godt en modell fullfører kommandolinje-ingeniøroppgaver, scoret Grok 4.5 83,3%.
Den større endringen er token-effektivitet. xAI sier at modellen trenger omtrent en femtedel av output-tokensene som Opus 4.8 krevde for sammenlignbare oppgaver, noe som senker kostnaden ved å kjøre lange agentsesjoner.
Claude Opus 5 Holder Linjen på Pris
Anthropic lanserte Claude Opus 5 24. juli, og posisjonerte den som en modell som kommer nær ytelsen til Claude Fable 5, selskapets mest kapable lansering, til halvparten av Fables prising på $10 for input og $50 for output. Opus 5 har selv den samme prisingen på $5 for input og $25 for output som forgjengeren, Opus 4.8.

Modellen leveres med et kontekstvindu på 1 million tokens, 128 000 maks output-tokens, og en justerbar innstilling for resonnement-innsats som spenner fra lav til en ny xhigh-modus. Anthropic sier Opus 5 setter nye rekorder på Frontier-Bench og GDPval-AA, to evalueringer for koding og kunnskapsarbeid, selv om den ligger bak den begrensede Claude Mythos 5-modellen på cybersikkerhetsoppgaver. Opus 5 er nå standardmodellen på Claude Max og det sterkeste alternativet på Claude Pro.
OpenAI Deler GPT-5.6 i Tre Nivåer
OpenAI gjorde GPT-5.6 generelt tilgjengelig 9. juli etter en to ukers forhåndsvisning begrenset til rundt 20 organisasjoner godkjent av den amerikanske regjeringen, i kjølvannet av en presidentordre knyttet til sikkerhetsgjennomgang av frontier-modeller. Familien leveres i tre nivåer: Sol, flaggskipet, priset til $5 for input og $30 for output per million tokens; Terra, en mellomklassemodell til $2,50 og $15 som OpenAI sier matcher GPT-5.5 til halv pris; og Luna, et raskt, rimelig nivå til $1 og $6.

OpenAI rapporterer at Sol leder Artificial Analysis Coding Agent Index og når 88,8% på Terminal-Bench 2.1, og stiger til 91,9% når modellen kjører fire underagenter parallelt under sin nye ultra-modus. Alle tre nivåene har OpenAIs høyeste interne risikovurdering for potensialet for cyber- og biologisk misbruk, noe som utløste ekstra gjennomgang under den myndighetsstyrte forhåndsvisningen.
Kimi K3 Skyver Åpne Vektmodeller Mot Frontieren
Moonshot AI lanserte Kimi K3 16. juli, en «mixture of experts»-modell med 2,8 billioner parametere, 896 totale eksperter og 16 aktive per oppgave. Modellen har et kontekstvindu på 1 million tokens og innebygd multimodal input, med API-prising på $3 for input og $15 for output per million tokens. Moonshot har forpliktet seg til å publisere fullstendige åpne vekter innen 27. juli.

K3 er den største åpen-vekt-modellen som er lansert til dags dato, omtrent 75% større enn den tidligere største, bredt brukte åpne modellen. Uavhengige trackere plasserer K3 som nummer fire blant dagens frontier-systemer, bak Claude Fable 5 og GPT-5.6 Sol, men foran Claude Opus 4.8.
Hvorfor Gapet til Eldre Modeller Betyr Noe
Kontekstvinduer under 200 000 tokens tvang tidligere utviklere til å dele opp store kodebaser eller forskningspakker i fragmenter. Hver modell i denne gruppen kjører nå på 500 000 tokens eller mer, med tre av de fire på 1 million, noe som gjør at én enkelt økt kan romme et helt repository eller en bunke primærkildedokumenter.
Agentpåliteligheten har også flyttet seg. Systemer fra perioden 2023 og 2024 mistet ofte planen etter en håndfull verktøykall. Modellene som ble lansert denne måneden er bygget for å opprettholde dusinvis av koordinerte steg og hente seg inn igjen når et verktøykall returnerer dårlige data, i stedet for å stoppe opp.
For utviklere er den praktiske effekten lavere kostnad per ferdig oppgave snarere enn et høyere tak på en enkelt benchmark. Innsatskontroller i Opus 5, nivåbasert prising i GPT-5.6 og effektivitetspåstandene bak Grok 4.5 peker mot samme mål: å la team velge hvor mye regnekraft en oppgave fortjener, i stedet for å betale flaggskippriser for hver forespørsel.
For virksomheter og beslutningstakere signaliserer den myndighetsstyrte utrullingen av GPT-5.6 at tilsyn nå er bygget inn i lanseringsplaner for de største modellene, ikke lagt til i etterkant. Anthropics korte, myndighetsdirigerte suspensjon av tilgang til Fable og Mythos i juni var en tidligere versjon av det samme mønsteret.
Denne artikkelen er oversatt fra engelsk ved hjelp av kunstig intelligens. Den originale engelske versjonen er den autoritative kilden; automatiske oversettelser kan inneholde unøyaktigheter, særlig i juridisk og regulatorisk terminologi.

















