Google wprowadza Argon. Ten model AI w wielu testach jest lepszy od produktów OpenAI i Anthropic
Google zaprezentowało nowy model AI – Gemini 4 Argon. Firma chwali się, że w wielu benchmarkach Argon wypada lepiej od GPT-6 Astra czy nowych modeli Claude. Google tłumaczy, że – ze względów bezpieczeństwa – będzie udostępniać go etapami.

Według firmy Gemini 4 Argon wypada bardzo dobrze w benchmarkach pracy opartej na wiedzy. Jego dużą przewagę widać choćby w Harvey’s Legal Agent Benchmark, gdzie uzyskał 19,6 proc., podczas gdy GPT-6 Astra osiągnął 5,4 proc., Claude Fable 5.1 – 6,7 proc., a Claude Opus 5.5 – 3,8 proc.
Przy programowaniu sytuacja się wyrównuje. Model Google prowadzi w DeepSWE v1.1 z wynikiem 77,9 proc. oraz w Vibe Code Bench z wynikiem 91,9 proc. Jednak w FrontierSWE v2 lepszy był GPT-6 Astra, który zdobył 65,5 proc. wobec 55 proc. Gemini. W Terminal-bench 4.0 najlepiej poradził sobie Claude Opus 5.5 – 66,4 proc., podczas gdy Gemini uzyskał 57,4 proc.
Model dobrze wypadł też w testach naukowych, wyprzedzając konkurencję choćby w GraphWalks. Jednak w Terminal-Bench Science 0.1 musiał uznać przewagę GPT-6 Astra. Model OpenAI zdobył tam 68,1 proc. przy 57,6 proc. Gemini. Z kolei w testach sprawdzających obsługę komputera i rozumienie treści multimodalnych Argon uzyskał 39,5 proc. w Agent’s Last Exam, 71,6 proc. w Chartography i 91,7 proc. w LVBench. W OSWorld-2.0 uległ jednak GPT-6 Astra – model OpenAI zdobył 72,6 proc., a Argon 69,2 proc. W benchmarku cyberbezpieczeństwa CWE-bench v1 Gemini i GPT-6 Astra uzyskały po 68 proc., Claude Opus 5.5 osiągnął zaś 67 proc.
Argon już jest stosowany wewnątrz Google
Google pisze na swoim blogu, że model dobrze sprawdza się też poza programowaniem. Radzi sobie z analizą długich filmów, dokumentów czy skomplikowanych wykresów.
Google ujawniło też, że nowy model jest już używany wewnątrz firmy. Jednym z zastosowań jest optymalizacja wykorzystania pamięci w centrach danych Google. Dzięki Argonowi udało się zwolnić setki terabajtów pamięci bez kupowania dodatkowego sprzętu.
Argon – jak twierdzi Google – będzie też wspomagał cyberochronę. Model potrafi autonomicznie znajdować, weryfikować i łatać krytyczne luki w oprogramowaniu. Z Argona korzysta już Wiz w ramach inicjatywy Scan for Good. Program ma bezpłatnie pomagać w ochronie infrastruktury krytycznej, usług publicznych i organizacji non-profit przez wyszukiwanie i usuwanie groźnych podatności. Podczas demonstracji Argon wykrył błąd w oprogramowaniu używanym przez placówki medyczne, który mógł prowadzić do ujawnienia danych osobowych. Google podkreśla, że inne czołowe modele przeoczyły ten problem.
Google zapewnia, że Argon ma zabezpieczenia przed wykraczaniem poza zamiar użytkownika podczas wykonywania zadania. Odpowiednie mechanizmy monitorują tok działania modelu oraz – w razie potrzeby – przerywają wykonywanie zadania.
Gemini 4 Argon początkowo trafił do wybranych ekspertów zajmujących się cyberbezpieczeństwem w ramach programu Fairwind oraz do zaufanych testerów. Ich uwagi zostaną wykorzystane do poprawy modelu przed szerszym udostępnieniem go firmom i konsumentom. Premiera będzie odbywać się etapami, a wśród pierwszych szerszych grup użytkowników znajdą się subskrybenci Google AI Ultra.