Teilnehmende Projekte erhalten laut Anthropic „gründliche, periodische Sicherheitsscans durch unsere stärksten Modelle, ohne Kosten". Die Ergebnisse werden vollständig vom Modell erzeugt und durchlaufen weder eine menschliche Prüfung noch eine Triage — dadurch soll häufiger und schneller gescannt werden können. Für die Berichte sollen die leistungsfähigsten Modelle des Unternehmens zum Einsatz kommen, darunter Claude Mythos.
Bei der Auswahl der Projekte will sich Anthropic an Kriterien orientieren, die denen von Googles OSS-Fuzz ähneln; das Verfahren könne sich im Lauf der Zeit ändern. Maintainer sollen eine kurze Beschreibung beilegen, warum ihr Projekt wichtig ist, sofern dies „nicht ohnehin selbstverständlich ist".
Die Anmeldung erfolgt durch Kern-Maintainer über einen Pull Request im GitHub-Repository des OSS Scanner, ergänzt um eine YAML-Konfigurationsdatei. Pflichtangaben sind:
- Link auf das zu klonende Git-Repository
- E-Mail-Adresse des primären Ansprechpartners
- ein repository-relativer Pfad zu einem Dockerfile, das die Umgebung aufsetzt, alle Abhängigkeiten vorinstalliert und das Projekt baut, damit ein Agent das Sicherheitsaudit offline durchführen kann
„Das Dockerfile konfiguriert die Umgebung, in der das Projekt läuft, und installiert alle Abhängigkeiten, sodass der Agent sein Sicherheitsaudit ohne jeden Internetzugang durchführen kann", so Anthropic. Empfohlen wird, zu prüfen, ob die Testfälle innerhalb des gebauten Containers bestehen.
Optional lassen sich in der YAML-Datei weitere Angaben hinterlegen:
- zusätzliche E-Mail-Adressen, die bei allen Berichten in Kopie gesetzt werden
- die Projekt-Homepage
- ein öffentlicher GPG-Schlüssel zur Verschlüsselung der Berichts-E-Mails
- ein repository-relativer Pfad zu einer Bedrohungsmodell-Datei („threat_model.md"), die festlegt, welcher Code getestet werden soll, wie Schwachstellen klassifiziert werden oder wie Berichte formatiert sein sollen
- Abschalten des Empfangs von Fehlerberichten über „disabled: true"
Zum Zeitpunkt der Veröffentlichung lagen 116 Pull Requests vor. Anders als andere Programme zur Schwachstellenmeldung will Anthropic keine 90-Tage-Frist für die Offenlegung der Funde ansetzen, da die Berichte Fehlalarme enthalten können. „Falls wir einen dieser Berichte später manuell über unser bestehendes CVD-Programm validieren, können wir ihn nach unserer CVD-Richtlinie offenlegen, beginnend 90 Tage nach dem Zeitpunkt, zu dem Sie benachrichtigt wurden, dass ein Mensch diesen Bericht validiert hat", heißt es weiter. Mit wachsendem Vertrauen in die Leistungsfähigkeit des OSS Scanner könne künftig für einzelne Berichte über Schwachstellen hoher Schwere eine Offenlegungsfrist eingeführt werden.
Nach eigenen Angaben hat Anthropic bislang mehr als 29.000 Schwachstellenkandidaten in einigen der wichtigsten Softwareprojekte der Welt identifiziert. Etwas mehr als 6.000 Schwachstellen wurden an Maintainer gemeldet, woraus bis zum 2. Oktober 2026 insgesamt 584 Advisories hervorgingen.
Parallel stellte Anthropic das Critical Infrastructure Defense Program vor, das im Rahmen der Cyber Mission des Unternehmens kritische Infrastruktur und Open-Source-Software absichern soll. Hintergrund ist, dass KI Angreifern zunehmend hilft, Schwachstellen zu finden und auszunutzen, Phasen von Cyberoperationen zu automatisieren und Angriffe schneller und in größerem Maßstab durchzuführen. Das Programm soll Verteidiger mit passenden Werkzeugen ausstatten, Fehlerbehebungen beschleunigen und neue sichere Architekturen sowie Programmierpraktiken erschließen. „Unsere Prognose lautet, dass KI in zwei Jahren die Verteidigung begünstigen wird: Es wird einfacher sein, Fehler vor der Auslieferung zu finden, von Grund auf sichere Software zu schreiben und Systeme aktiv mit Modellen zu verteidigen", so Anthropic.
