Anthropic öffnet seine stärksten KI-Modelle für einen größeren Kreis von Sicherheitsteams. Das erweiterte Cyber Verification Program bündelt seit dem 6. Oktober 2026 den Zugang zu Claude Opus 5.5, Claude Sonnet 5.5 und Claude Mythos 5.1 in drei Stufen, von der Malware-Analyse bis zum Test an Stromnetzen. Im Gegenzug müssen die teilnehmenden Organisationen der Speicherung ihrer Daten zustimmen.

drweb.de als bevorzugte Quelle auf Google hinzufügenQualitätsgeprüfte Inhalte direkt in Google News & DiscoverJetzt hinzufügen

Die Partner aus Anthropics Programm Project Glasswing fanden zwischen April und Juli 2026 rund 129.000 verifizierte Schwachstellen.[1] Das bislang geschlossene Programm geht jetzt in der obersten Stufe des neuen Cyber-Programms auf. Mit eigenen Scans in Open-Source-Projekten spürte Anthropic bis Oktober weitere 5.500 Lücken auf.

Das Wichtigste in Kürze

  • Das Cyber Verification Program (CVP) hat drei Stufen: Defense Access, Red Team Access und Specialized Access.
  • Alle Stufen umfassen Claude Opus 5.5, Claude Sonnet 5.5 und Claude Mythos 5.1, die Unterschiede liegen in den Schutzfiltern.
  • Project Glasswing geht in Specialized Access auf, Bewerber für diese Stufe prüft Anthropic gemeinsam mit der US-Regierung.
  • Teilnehmende Organisationen müssen der Speicherung ihrer Daten zustimmen, damit Anthropic Missbrauch erkennt.

Wie funktioniert das Stufenmodell?

Drei Schlüssel und ein oranger Anhänger an einem Ring, davor eine Lupe
Claude-Modelle nutzen identische Basis-Architekturen mit gestuften Schutzfiltern, die riskante Anfragen blockieren und Cyberattacken verhindern

Alle drei Stufen greifen auf dieselben Modelle zu und unterscheiden sich allein in den Schutzfiltern, die riskante Anfragen in Echtzeit blockieren.[1] Die allgemein verfügbaren Claude-Modelle sperren laut Anthropic den Großteil der Cyberarbeit, damit Angreifer das Werkzeug nicht nutzen. Code-Reviews, das Patchen bekannter Fehler, die Lückensuche im eigenen Quellcode und die Triage von Sicherheitsalarmen bleiben dort erlaubt.

Defense Access richtet sich an Sicherheitsteams in Unternehmen, Behörden, Hochschulen und gemeinnützigen Organisationen, an Betreiber kritischer Infrastruktur sowie an Open-Source-Maintainer und einzelne Forscher mit nachweisbarer Erfahrung. Freigegeben sind Incident Response, Malware-Analyse und die Prüfung von Schwachstellen, über Anträge entscheidet Anthropic binnen weniger Tage.

Red Team Access erlaubt zusätzlich beauftragte Penetrationstests und steht nur Organisationen offen. Specialized Access verzichtet ganz auf Cyber-Sperren und ist für Tests an Flugsystemen, Stromnetzen, Telekommunikation und Interbanken-Infrastruktur gedacht. Mitglieder von Project Glasswing wechseln ohne neue Prüfung in diese Stufe.[1]

Wie viel lassen die Filter durch?

Gemessen hat Anthropic die Stufen mit CyScenarioBench, einem Test für mehrstufige Cyberoperationen unter realistischen Bedingungen.[1] In der Stufe Defense Access griffen die Filter in 46 von 50 Durchläufen ein, vier Aufgaben liefen durch. In Red Team Access blockierte kein Filter, und Claude Opus 5.5 löste 34 der 50 Aufgaben.

Nach dem Fund beginnt die Arbeit beim Patchen. Von den bisher gemeldeten Lücken stuften die Prüfer mehr als 33.000 als kritisch oder hoch ein, die tatsächliche Wirkung schätzt Anthropic mindestens fünfmal höher. Mit Mythos fanden Microsoft-Teams im April allein in SharePoint 231 kritische und wichtige Lücken, rund 300 mittelschwere Funde stellte der Konzern beim Patchen hinten an.

Anthropics Cyber-Programm in Zahlen
Drei Stufen regeln, wie viel Angriffsarbeit die Claude-Modelle übernehmen
129.000
verifizierte Schwachstellen fanden Glasswing-Partner von April bis Juli 2026
33.000+
der gemeldeten Lücken gelten bisher als kritisch oder hoch
46 von 50
Testläufe brachen in Defense Access an einem Filter ab
34 von 50
Aufgaben löste Claude Opus 5.5 in Red Team Access ohne Sperre
Die drei Zugangsstufen im Überblick
Defense AccessAbwehr: Incident Response, Malware-Analyse, Prüfung von Schwachstellen; offen auch für Open-Source-Maintainer und einzelne Forscher
Red Team AccessAngriffstests: zusätzlich beauftragte Penetrationstests, nur für Organisationen
Specialized AccessOhne Cyber-Sperren: Tests an Stromnetzen, Flugsystemen und Telekommunikation, Prüfung gemeinsam mit der US-Regierung

Anthropic verteilt Angriffskraft nach Vertrauensstufe. Europäische Netzbetreiber bekommen die stärkste Stufe nur nach einer Prüfung mit der US-Regierung.

Markus Seyfferth, Chefredakteur Dr. Web
Zitat teilen

Wie lösen Google und OpenAI das Dual-Use-Problem?

Anthropic folgt einem Muster, das sich bei den großen US-Laboren durchsetzt. Google gab Gemini 4 Argon Ende September zuerst den Verteidigern aus dem Fairwind-Programm, ausdrücklich ohne Cyber-Schutzfilter. OpenAI öffnete GPT-5.5-Cyber bereits im Mai für geprüfte Sicherheitsteams und Behörden in der EU.

Gegen offene Modelle hilft die Zugangskontrolle nur begrenzt. Zhipus frei herunterladbares GLM-5.3 baute in Anthropics eigenem Test fast so viele Exploits wie Claude Mythos Preview. Aus offenen Gewichten lassen sich Sperren entfernen, Anthropics Stufen begrenzen deshalb vor allem den Missbrauch der eigenen Modelle.

Was bedeutet das Programm für Sicherheitsteams im DACH-Raum?

Für Defense Access und Red Team Access nennt Anthropic keine regionale Beschränkung, Dienste in der EU erbringt die Anthropic Ireland Limited.[1] Die Pflicht zur Datenspeicherung gehört vor dem Antrag auf den Tisch des Datenschutzbeauftragten. Logs aus Incident Response und Malware-Analyse enthalten oft personenbezogene Daten wie IP-Adressen oder E-Mail-Inhalte. Für die Verarbeitung solcher Daten durch einen Dienstleister verlangt Artikel 28 DSGVO einen Vertrag zur Auftragsverarbeitung.[2]

Mehr gefundene Lücken erhöhen auch den Meldedruck. Seit dem 11. September 2026 müssen Hersteller aktiv ausgenutzte Schwachstellen nach dem Cyber Resilience Act binnen 24 Stunden vorab und binnen 72 Stunden ausführlich melden.[3] Für Unternehmen unter dem NIS2-Umsetzungsgesetz gehört der Umgang mit Schwachstellen ohnehin zum Risikomanagement. Sicherheitsteams klären vor dem Antrag am besten, welche Stufe ihr Auftrag braucht, und planen die Kapazität zum Patchen gleich mit.

Grundlegende Schutzmaßnahmen fassen die Cybersecurity-Grundlagen zusammen, weitere Modelle und Anbieter sammelt die KI-Rubrik.

FAQ: Anthropic öffnet Mythos 5.1 für mehr Sicherheitsteams und staffelt den Zugang in drei Stufen

Was ist das Cyber Verification Program von Anthropic?

Das Cyber Verification Program gibt geprüften Sicherheitsteams Zugang zu Claude-Modellen mit gelockerten Cyber-Schutzfiltern. Seit dem 6. Oktober 2026 hat das Programm drei Stufen und umfasst Claude Opus 5.5, Claude Sonnet 5.5 und Claude Mythos 5.1.

Welche Zugangsstufen umfasst das Programm?

Defense Access deckt Abwehrarbeit wie Incident Response und Malware-Analyse ab. Red Team Access erlaubt zusätzlich beauftragte Penetrationstests. Specialized Access hat keine Cyber-Sperren und ist für Tests an kritischer Infrastruktur wie Stromnetzen gedacht.

Was passiert mit Project Glasswing?

Project Glasswing geht in der Stufe Specialized Access auf. Bisherige Glasswing-Mitglieder wechseln ohne neue Prüfung für die aktuellen Modelle in diese Stufe. Neue Bewerber für Specialized Access prüft Anthropic gemeinsam mit der US-Regierung.

Können Unternehmen aus Deutschland teilnehmen?

Anthropic nennt für Defense Access und Red Team Access keine regionale Beschränkung, Dienste in der EU erbringt Anthropic Ireland. Teilnehmende Organisationen müssen der Speicherung ihrer Daten zustimmen, was eine Prüfung nach DSGVO nahelegt.

Quellen

[1] Anthropic: „Expanding the Cyber Verification Program“

[2] EUR-Lex: „Verordnung (EU) 2016/679 (DSGVO), Artikel 28“

[3] EUR-Lex: „Verordnung (EU) 2024/2847 (Cyber Resilience Act), Artikel 14“

Mehr Newshunger?

4,2 12 Bewertungen

Wie hat Ihnen dieser Artikel gefallen?