„Es liefert Spitzenleistung in komplexen Arbeitsabläufen über reale Softwareentwicklung, unternehmerische Wissensarbeit wie Recht und Finanzen sowie Cybersicherheitsverteidigung hinweg“, erklärte Koray Kavukcuoglu, Senior Vice President bei Google DeepMind und Chief AI Architect bei Google.

Die Ankündigung folgt knapp einen Monat auf die Vorstellung von Gemini 3.8 Flash Cyber, das Google damals als sein leistungsfähigstes Cybersicherheitsmodell bezeichnet hatte. Gegenüber diesem Vorgänger zeigt Argon laut Google „beeindruckende Sprünge“ beim Aufspüren von Schwachstellen und schneidet auch bei der Erfassung der Angriffsfläche sowie beim Erzeugen von Proof-of-Concepts zur Bestätigung von Funden besser ab.

Zu den Ergebnissen zählt nach Darstellung des Unternehmens eine zuvor unbekannte kritische Schwachstelle, durch die sensible personenbezogene Daten in einer weltweit in Krankenhäusern eingesetzten Gesundheitssoftware offenlagen. Welches Produkt betroffen war, gab Google nicht bekannt.

Geplant ist zudem eine Variante von Argon ohne Cyber-Guardrails, die vertrauenswürdigen Verteidigern und internen Teams zur Verfügung gestellt werden soll, damit diese den vollen Funktionsumfang nutzen können.

Vor einer breiteren Verfügbarkeit arbeitet Google nach eigenen Angaben daran, die Schutzmechanismen zu verstärken: gegen Fehlausrichtung (Misalignment), gegen Missbrauch durch Angreifer sowie gegen indirekte Prompt-Injektionen (IPI). In einer von Google veröffentlichten Modellbewertung belegt Argon im IPI-Benchmark von Gray Swan den ersten Platz vor anderen Modellen.

„Wir setzen Maßnahmen gegen Fehlausrichtung ein, die Argons Gedankenkette und Handlungen überwachen und die Ausführung bei Bedarf stoppen“, teilte Google mit. Das Unternehmen forderte die Branche auf, die Transparenz der Argumentationsketten gerade in dieser Phase wachsender Fähigkeiten zu erhalten, damit sich Fehlausrichtungen anhand der Modellgedanken weiterhin erkennen und diagnostizieren lassen.