3min Security

Claude Sonnet 5.5 verschijnt, OpenAI annuleert Astra 6.1

Claude Sonnet 5.5 verschijnt, OpenAI annuleert Astra 6.1

Terwijl Anthropic de eigen modellenreeks weer uitbreidt, trekt OpenAI aan de rem. Sonnet 5.5 is een compactere variant van Opus 5.5, met net als die grotere versie een focus op efficiëntie, korte teksten en prestaties die ooit tot de grootste modellen beperkt bleven. Ondertussen had OpenAI nu Astra 6.1, de opvolger van het meest capabele model, willen uitbrengen. Echter is dat uit veiligheidsoverwegingen niet aan de orde. Hoe kan dat?

Laten we eerst beginnen met Sonnet 5.5. Anthropic had met de release van Opus 5.5 al aangekondigd dat het deze generatie verder zou uitbreiden. In tegenstelling tot 5.1 (waar alleen Fable van uitkwam) of 4.8 (met enkel Opus) is de 5.5-generatie duidelijk deel van een bredere strategie. Vandaar ook dat we naast het relatief zware Opus en de middenklasser Sonnet ook expliciet weer een klein Haiku-model mogen verwachten. Het heeft bijna een heel jaar geduurd voordat laatstgenoemde van een update is voorzien.

Onverrassend

Sonnet 5.5 verrast niet: net al de beste LLM’s met die naam is dit een Sonnet dat op papier erg in de buurt komt van de grotere modellen, maar voor een lager tarief. Bovenal is snelheid een voordeel bovenop Opus: waar de accuratesse al goed genoeg is, zul je met Sonnet 5.5 eerder tot een output komen. Bij sommige metingen is Sonnet 5.5 ontzettend veel beter dan directe voorganger Sonnet 5: 70,6 procent in Terminal-Bench 4.0 tegenover 10,3 procent voor 5 en 61,6 procent in een toets over charts lezen (Chartography) waar Sonnet 5 op 15,6 procent bleef steken.

Sonnet 5.5 op Max effort benadert de vaardigheden van Opus 5.5. Als dit in de praktijk ook zo aanvoelt, is er dus van Sonnet naar Opus sprake van een onafgebroken reeks aan mogelijkheden met prioriteiten tussen snelheid/prijsvoordeel en kwaliteit/kosten.

Het zou weinig mensen moeten verrassen dat Opus 5.5 en Sonnet 5.5 zijn uitgekomen nádat Anthropic om een pauze op meer capabele AI-modellen heeft gevraagd. De industrie lijkt het daarmee eens, waarover zo meer. Op papier is Fable 5.1 lichtelijk overtroffen door de nieuwe Opus, maar in principe zou een Fable-klasse altijd meer vaardigheden en dus meer risico’s met zich meebrengen dan kleinere modellen. Vandaar dat Anthropic zich verzekerd voelt van acceptabel en veilig AI-gedrag met deze nieuwe LLM’s.

OpenAI neemt adempauze

OpenAI vierde deze week DevDay, het jaarlijkse evenement waarbij de ChatGPT-maker met de eigen community in levenden lijve spreekt. Het had moeten gaan over een terugkeer van ChatGPT Pro op het 20x-prijsniveau en een update aan GPT-6 Astra met het nummer 6.1. Maar eerstgenoemde is lang niet zo voordelig als de voorganger was: het abonnement zou de helft van de dollarwaarde met zich meebrengen ten opzichte van het eerdere duurste Pro-abonnement.

Het zwaarder tellende nieuws voor OpenAI is dat het zelf graag een nieuwer model had willen uitbrengen, maar dat niet kan. GPT-6.1 Astra had nog autonomer op moeten treden voor gebruikers. Het probleem is dat die extra autonomie tot misleidend gedrag en het gebruik van onveilige externe tools leidt. Om die reden legt OpenAI zichzelf een pauze op die de bredere industrie al heeft gesuggereerd.

Het leidt ertoe dat Anthropic en OpenAI mogelijk hun voorsprong opgeven. Het is tot nu toe altijd een kwestie van tijd geweest voordat capabele modellen vanuit Amerikaanse en Chinese rivalen kwamen die de noodzaak van een nieuw ‘frontier model’ vereisten vanuit de twee AI-koplopers. Zodra de concurrentie (zij het Meta, SpaceXAI, Google, DeepSeek, Z.ai of Moonshot AI) Opus 5.5 en GPT-6 Astta bijbeent, ontstaat de echte test van de adempauze die OpenAI en Anthropic inlassen.

Lees ook: GPT-6 Astra, het antwoord van OpenAI op Fable, wordt nu uitgerold