Gemini 4 Carbon zou bij coderen Opus 5.5 evenaren
Google heeft Gemini 4 "Argon" nog niet uitgebracht, en er gaan nu al berichten rond over de opvolger. Binnen het bedrijf wordt een nieuwe variant met de naam Carbon getest, en minstens één Google-medewerker denkt dat die kan concurreren met het beste programmeermodel van Anthropic.
De details komen van Business Insider, dat naar eigen zeggen documenten, screenshots en interne chats heeft ingezien. Volgens die berichtgeving test Google verschillende Gemini 4-varianten onder de codenamen Argon, Barium en Carbon. Het bewijs is onofficieel en voorlopig, maar het geeft een zeldzame inkijk in het tempo waarin Google aan zijn volgende frontiermodel sleutelt.
Carbon duikt op in het interne programmeerplatform van Google
De afgelopen dagen is Carbon uitgerold op Jetski, het interne programmeerplatform van Google. Volgens Business Insider presteert het beter dan Argon, vooral bij programmeertaken.
Eén medewerker vergeleek Carbon met Opus 5.5, het sterkste programmeermodel van Anthropic. Daar hoort wel een kanttekening bij: het model moet nog verder getest worden voordat iemand harde conclusies kan trekken.
De vergelijking valt op naast eerdere feedback over Argon. Bij sommige programmeertaken deden vroege versies van Argon een andere medewerker denken aan Opus 5, het oudere model van Anthropic. De interne reacties op Argon waren over het geheel genomen wel positief. Toch wijst het verschil tussen "voelt als Opus 5" en "voelt als Opus 5.5" erop dat Carbon een flinke stap vooruit is voor softwarewerk, in elk geval volgens de mensen die het binnen Google gebruiken.
Wat Argon precies is
Over de rol van Argon bestond enige verwarring. Volgens vroege geruchten ging het om een Flash-model, een versie die is afgestemd op snelheid in plaats van topprestaties. Google maakte daar een einde aan toen het zijn Gemini-agent voor Google Workspace aankondigde.
In die aankondiging gaf Google elke modelfamilie een eigen taak. In de woorden van het bedrijf: "Argon voor frontier-redeneren, Flash voor snelheid en volume, Omni voor generatieve media en Gemma voor lichte edge-workloads met open gewichten."
Daarmee staat Argon bovenaan in de line-up van Google. Het is het krachtigste redeneermodel van Google en speelt in dezelfde klasse als Opus van Anthropic en Astra van OpenAI.
Carbon en Barium zijn dus hoogstwaarschijnlijk checkpoints of updates binnen de Argon-familie, en geen nieuwe niveaus op zich. Een paar details wijzen daarop:
- Eén medewerker noemde Carbon intern het "Gemini pro next model", wat duidt op een release onder de naam Argon.
- Uit interne documenten blijkt dat het Argon-model dat Google nu heeft gepresenteerd eerder de naam "Barium-B" droeg.
- De codenamen lijken opeenvolgende versies van dezelfde modellijn aan te duiden, en niet afzonderlijke producten.
Het is nog onduidelijk of Carbon als Argon-update of als zelfstandig model verschijnt.
Een snellere updatecyclus
Met zijn Flash-modellen heeft Google al een hoog tempo aangehouden, en de codenamen van Gemini 4 wijzen op hetzelfde snelle ritme. Dat kan betekenen dat Google beter is geworden in het inzetten van AI-systemen om hun opvolgers te helpen bouwen.
Google DeepMind-medewerker Vedant Misra leek daarop te zinspelen. In een reactie op het bericht van Business Insider schreef hij op X: "Heb je weleens gehoord van recursieve zelfverbetering." Die term beschrijft AI die wordt gebruikt om betere AI te maken. OpenAI en Anthropic hebben allebei vergelijkbare vooruitgang in hun eigen werk gemeld.
De apps van Google maken zich op
Google heeft nog geen officiële lanceringsdatum voor Gemini 4 bekendgemaakt, maar de producten van het bedrijf veranderen al op een manier die op voorbereiding lijkt.
- De Gemini-app biedt nu een "Automatische" modus voor de modellen uit de 3-serie.
- Gebruikers kunnen de redeneerintensiteit instellen van laag tot hoog, een wijziging die samenvalt met de herindeling van de Gemini-abonnementen door Google.
- Google AI Studio, de ontwikkeltool van het bedrijf, heeft een nieuwe "Ultra"-modus gekregen die "geavanceerde vaardigheden en tools" belooft.
Logan Kilpatrick van Google bevestigde dat het team bezig is om het maximale uit Argon te halen.
Onze kijk
Uitgelekte interne indrukken zijn geen benchmarks. Eén medewerker die Carbon met Opus 5.5 vergelijkt, is niet meer dan één datapunt, en het bericht zelf zegt dat er meer tests nodig zijn. Lezers doen er goed aan de bewering te zien als een aanwijzing voor de richting, niet als een eindoordeel.
Die richting doet er wel toe. Programmeren is uitgegroeid tot een belangrijk strijdtoneel voor frontierlabs, en de Opus-modellen van Anthropic gelden daar als maatstaf. Als Google die achterstand binnen de Argon-familie kan wegwerken, krijgen ontwikkelaars die een model kiezen voor programmeeragents mogelijk een sterker alternatief van Google dan voorheen.
Het interessantste aspect is misschien wel het tempo. De opmerking van Misra past, samen met vergelijkbare uitspraken van OpenAI en Anthropic, in een breder verhaal in de sector over AI die de ontwikkeling van modellen versnelt. Het eigen onderzoek van Google naar zelfverbeterende agents wijst dezelfde kant op. De vragen om in de gaten te houden: verschijnt Carbon onder de naam Argon, hoe presteert het in onafhankelijke tests, en houdt Google zijn korte releasecycli vol zodra Gemini 4 publiek beschikbaar is?
