AI & computing › Generatieve AI & synthetische media
Google toont nieuw AI-model Gemini 4 Argon, maar het is nog niet te gebruiken
Google heeft zijn nieuwste AI-model Gemini 4 Argon gepresenteerd. Het model zou toonaangevend zijn in programmeren, kennistaken en cyberbeveiliging, maar voorlopig mag alleen een select groepje testers ermee werken.
Na een zomer vol kleinere 'Flash'-modellen keert Google terug met een zwaargewicht: Gemini 4 Argon. Het bedrijf claimt dat dit frontier-model op meerdere vlakken beter presteert dan concurrenten als GPT-6 Astra en Opus 5.5. Toch kan het grote publiek er nog niet mee aan de slag. Google start met een beperkte testfase, voornamelijk gericht op cyberbeveiliging.
Indrukwekkende cijfers, maar nog geen toegang
Op de softwarebenchmark DeepSWE v1.1 scoort Argon 77,9 procent, hoger dan rivaliserende modellen. Ook op de Vals Index, een test voor economische analyses, zou het model de concurrentie voorblijven. Opvallend is de nieuwe limiet voor uitvoer: waar eerdere Gemini-modellen tot 64.000 tokens per antwoord konden genereren, haalt Argon nu 1 miljoen tokens. Daardoor kan het model grotere taken in één keer afronden, zonder dat een gebruiker het werk moet opknippen.
Voor ontwikkelaars die er straks wel mee mogen werken, rekent Google tijdelijk 2 dollar per miljoen invoertokens en 10 dollar per miljoen uitvoertokens. Tokens die opnieuw gebruikt worden uit het kortetermijngeheugen van het model krijgen 95 procent korting, een vorm van promptcaching die veel AI-aanbieders inmiddels toepassen om herhaald rekenwerk te besparen.
Google test het zelf al volop
Hoewel het model nog niet publiek is, gebruikt Google het intern al uitgebreid. Door grootschalige telemetriedata uit zijn datacenters te analyseren, zegt het bedrijf 300 tebibyte aan geheugen te hebben bespaard — omgerekend zo'n 330.000 gigabyte. Daarnaast zetten AI-agents van Argon zogeheten codemigratie in: ze herschrijven bestaande C/C++-code naar de programmeertaal Rust, die als veiliger geldt omdat hij veelvoorkomende geheugenfouten voorkomt. Het gaat onder meer om de kernbibliotheken re2 en libgav1, en om meer dan 800.000 regels code in de Zircon-kernel van Googles besturingssysteem Fuchsia.
Cyberbeveiliging als eerste toepassing
Omdat een model van deze omvang volgens Google zorgvuldige, gefaseerde introductie vereist, krijgen alleen deelnemers aan het zogeheten Fairwind-programma toegang tot de cyberbeveiligingsfuncties. Beveiligingsbedrijf Wiz gebruikt Argon naar eigen zeggen al om kwetsbaarheden op te sporen, en ontdekte zo een ernstig lek dat persoonsgegevens in ziekenhuissystemen wereldwijd kon blootleggen. Andere AI-modellen zouden dit probleem over het hoofd hebben gezien, al onderbouwt Google die claim niet met details.
Na een zomer met meldingen over AI-modellen die bij hacks werden misbruikt, benadrukt Google dat het bij Argon systemen heeft ingebouwd die mee kunnen kijken met de redeneerstappen van het model. Deze vorm van chain-of-thought-monitoring moet voorkomen dat het model buiten de gestelde grenzen handelt, een risico dat in de sector bekendstaat als misalignment. Wanneer Argon breed beschikbaar komt, laat Google nog in het midden. Na de cyberbeveiligingstests volgen eerst betalende API-gebruikers en abonnees van Google AI Ultra.
Achtergrond & begrippen
Wat betekent dit voor de toekomst? Gemini 4 Argon laat zien dat AI-modellen steeds vaker eerst worden ingezet voor interne techniek en beveiliging, voordat ze bij consumenten terechtkomen. De grotere uitvoerlimiet en de focus op het bewaken van het eigen redeneerproces wijzen erop dat AI-bedrijven zowel de mogelijkheden als de risico's van hun modellen serieuzer proberen te beheersen.
- Frontier-model
- Een AI-model dat de grens van het technisch haalbare opzoekt, met de meeste rekenkracht en de nieuwste technieken.
- Token
- Een stukje tekst, vaak een deel van een woord, waarmee taalmodellen informatie verwerken en genereren.
- Promptcaching
- Een techniek waarbij eerder gebruikte invoer wordt onthouden, zodat een AI-model niet telkens hetzelfde werk opnieuw hoeft te doen.
- Chain-of-thought-monitoring
- Het meelezen met de tussenstappen die een AI-model doorloopt voordat het een antwoord geeft, om ongewenst gedrag vroegtijdig te signaleren.
- Misalignment
- De situatie waarin een AI-systeem zich anders gedraagt dan de makers bedoelden of wilden.
- Codemigratie
- Het proces waarbij bestaande software van de ene programmeertaal naar de andere wordt overgezet, bijvoorbeeld om veiligheid of onderhoudbaarheid te verbeteren.
- Tebibyte (TiB)
- Een eenheid voor digitale opslag, gelijk aan ruim 1000 gigabyte, vaak gebruikt bij het meten van geheugengebruik in datacenters.
Bronnen
Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.