NewsKI-SicherheitAnthropicCybersecurity

Anthropic öffnet Claude für Sicherheitsforscher – mit reduzierten Schutzfiltern

Der KI-Anbieter erweitert sein Cyber Verification Program strukturiert in drei Zugriffsstufen. Sicherheitsteams erhalten Zugang zu Claude-Modellen mit gelockerten Sicherheitsfiltern für Penetrationstests und Schwachstellensuche.

129.000 Schwachstellen in 4 Monaten

Anthropic öffnet Claude für Sicherheitsforscher – mit reduzierten Schutzfiltern

Anthropic macht Ernst mit seiner Strategie, KI-Sicherheitsforschung zu institutionalisieren. Das Unternehmen öffnet sein Cyber Verification Program (CVP) für deutlich mehr Sicherheitsfachleute und gibt ihnen Zugang zu Claudes stärksten Modellen mit reduzierten Sicherheitsfiltern – speziell für Aufgaben wie Schwachstellensuche, Malware-Analyse, Incident Response und Penetrationstests.

Kurz & knapp

  • Drei Zugriffsstufen: Defense Access (Unternehmen, Behörden, Universitäten, kritische Infrastruktur), Red Team Access (autorisierte Angriffssimulationen) und Specialized Access (Flugsteuerungen, Stromnetze, Bankinfrastruktur – mit US-Regierungsprüfung)
  • Bisherige Erfolge: Partner des Vorgängerprogramms Project Glasswing fanden laut Anthropic zwischen April und Juli 2026 mindestens 129.000 bestätigte Schwachstellen, davon über 33.000 als kritisch eingestuft
  • Beschleunigungseffekt: Mehrere Partner berichten, die KI habe ihre Arbeit um Monate bis Jahre beschleunigt
  • Regulierte Öffnung: Anthropic prüft Anträge selbst oder gemeinsam mit der US-Regierung – keine unkontrollierte Freigabe

Warum die Sperrfilter normalerweise aktiv bleiben

Die allgemein verfügbaren Claude-Modelle blockieren den Großteil dieser Sicherheitsarbeit – nicht aus Böswilligkeit, sondern aus Logik: Dieselben Fähigkeiten, die Sicherheitsforschern helfen, Lücken zu finden, nutzen auch Angreifern. Einfache Aufgaben wie Code-Review oder das Patchen bekannter Schwachstellen bleiben ohne Sonderzugang möglich. Aber tiefere Penetrationstests oder Malware-Analyse? Da greift Claude normalerweise nicht an.

Das CVP löst diesen Konflikt durch Vertrauensprüfung und Transparenz: Wer sich registriert, wird überprüft. Wer Zugang erhält, arbeitet unter Bedingungen, die Anthropic nachvollziehen kann.

Drei Ebenen für unterschiedliche Risiken

Zugriffsstufe Zielgruppe Einsatzzweck Besonderheit
Defense Access Sicherheitsteams, Universitäten, Open-Source-Entwickler, Einzelforscher Schwachstellensuche, Incident Response Offen für Einzelpersonen
Red Team Access Organisationen Autorisierte Angriffssimulationen Nur für Organisationen, nicht für Einzelne
Specialized Access Kritische Infrastruktur (Flugsteuerung, Stromnetze, Bankensysteme) Tests an hochsensiblen Systemen Gemeinsame Prüfung mit US-Regierung

Die Zahlen sprechen für sich

Das Vorgängerprogramm Project Glasswing hat bereits gezeigt, was möglich ist. Zwischen April und Juli 2026 fanden Partner des Programms laut Anthropic mindestens 129.000 bestätigte Schwachstellen. Über 33.000 wurden als hochgefährlich oder kritisch eingestuft. Wichtig: Diese Zahlen basieren auf Umfragen unter einem Teil der Partner – die tatsächliche Wirkung sei mindestens fünfmal höher, so Anthropic.

Mehrere Partner gaben an, dass Claude ihre Arbeit um Monate bis Jahre beschleunigt hat. Das ist keine Marketing-Aussage, sondern ein Indiz dafür, dass KI-gestützte Sicherheitsforschung tatsächlich skaliert.

Was das für deutsche Unternehmen bedeutet

Die Expansion des CVP ist ein Signal: Anthropic positioniert Claude nicht als Werkzeug für Angreifer, sondern als Werkzeug für Verteidiger – und baut dafür Strukturen auf. Für deutsche Unternehmen und Behörden, die Claude evaluieren, heißt das konkret: Wenn ihr Sicherheitsteam Zugang braucht, habt ihr jetzt einen klaren Weg. Gleichzeitig bleibt die Frage offen, wie schnell und unkompliziert die Genehmigung läuft – und ob die Prüfung durch US-Behörden bei kritischer Infrastruktur politische Hürden schafft.

Quellen

Redaktionell verantwortet von Ideal Syka. Quellen und Arbeitsweise: Redaktion & Methode. Hinweise und Korrekturen: ai@i6eal.de.

Teilen
← Alle Beiträge

Alle Analysen basieren auf eigenen Messungen von i6eal oder auf klar gekennzeichneten Quellen. Zahlen sind Momentaufnahmen und können sich ändern; Korrekturen weisen wir transparent aus.