Anthropic hat die Umstrukturierung seines Cyber Verification Program (CVP) angekündigt und es mit Project Glasswing zu einem Angebot mit drei Zugriffsstufen auf seine leistungsfähigsten Modelle zusammengeführt. Der Schritt beruht auf einem doppelten Problem: Modelle, die Verteidigern beim Auffinden und Beheben von Schwachstellen helfen, können auch Angreifern nützliche Fähigkeiten bereitstellen.
Die allgemein verfügbaren Claude-Modelle, darunter Claude Opus 5.5, Sonnet 5.5 und Fable 5.1, sind mit Kontrollen ausgestattet, die die meisten Cyberaktivitäten verhindern. Im neuen Programm umfassen die drei Stufen Opus 5.5, Sonnet 5.5, Mythos 5.1 und künftige Modelle, doch für jede Stufe gelten unterschiedliche Verifizierungsanforderungen und Betriebskontrollen.
Drei Stufen für die Cybernutzung
Defense Access ist für den Betrieb von Security Operations Centern und Incident Response, das Reverse Engineering von Schadsoftware sowie die Analyse und Verifizierung von Schwachstellen vorgesehen. Sicherheitsteams, die ihre eigenen Systeme verteidigen, Betreiber kritischer Infrastrukturen, kleine Sicherheitsunternehmen, Betreuer von Open-Source-Projekten sowie einzelne Forscher mit einer nachgewiesenen Erfolgsbilanz bei der Meldung von Schwachstellen können sich dafür bewerben. Anthropic erklärt, innerhalb weniger Tage auf Anfragen antworten zu wollen.
Red Team Access umfasst zusätzlich autorisierte Penetrationstests und Red-Team-Übungen, wobei sich die Aktivitäten auf Systeme beschränken müssen, für deren Test der Antragsteller eine Genehmigung besitzt. Maßnahmen, die körperlichen Schaden oder weitreichende Störungen verursachen könnten, wie etwa die Verbreitung von Ransomware, bleiben in Echtzeit verboten. Diese Stufe steht ausschließlich Organisationen offen. Die Prüfung soll voraussichtlich einige Wochen dauern; qualifizierte Antragsteller erhalten vorübergehend Defense Access.
Specialized Access unterliegt den geringsten Cyberbeschränkungen, ist jedoch auf eine kleine Zahl von Organisationen beschränkt, die zur Prüfung sensibler Systeme befugt sind, etwa Stromnetze, Luftfahrtsysteme, Telekommunikationsnetze und zwischen Banken genutzte Überweisungsinfrastrukturen. Anthropic prüft Anträge für diese Stufe in Zusammenarbeit mit der US-Regierung. Die derzeitigen Glasswing-Mitglieder wechseln in diese Stufe.
Hinweise auf die Wirkung des Programms
Anthropic erklärte, die Glasswing-Partner hätten zwischen April und Juli mindestens 129.000 verifizierte Schwachstellen entdeckt, während ein von dem Unternehmen durchgeführter Open-Source-Scan zwischen April und Oktober weitere 5.500 Schwachstellen ergeben habe. Mehr als 33.000 davon wurden als hochriskant oder kritisch eingestuft. Das Unternehmen schätzt, dass die tatsächliche Wirkung mindestens fünfmal größer sein könnte, da die Zahlen nur eine Stichprobe der Teilnehmer abdecken.
Was ändert sich praktisch?
Das neue Design verwandelt den Zugang zu Cyberfähigkeiten von getrennten Ausnahmen in einen einheitlichen Prozess, der auf der Identität der Organisation, dem Umfang der Genehmigung und der Sensibilität der Zielsysteme beruht. Im Gegenzug müssen die teilnehmenden Organisationen der Speicherung von Daten zustimmen, damit Anthropic den Missbrauch überwachen kann. Das Unternehmen will Enterprise Frontier Safeguards später im Herbst bereitstellen, sodass berechtigte Kunden Daten in einer von ihnen kontrollierten Cloud-Infrastruktur speichern können. Bis dahin können Organisationen, die über einen Zugriff ohne Datenspeicherung auf Fable 5.1 oder Mythos 5.1 verfügen, CVP mit dieser Einstellung nutzen.
CVP ist auf Claude Platform, Google Cloud Vertex AI und Microsoft Foundry verfügbar. Auf Amazon Bedrock steht es ausschließlich Kunden offen, die für Enterprise Frontier Safeguards berechtigt sind. Die derzeitigen Mitglieder werden automatisch für den Zugriff auf die neuen Modelle bewertet und behalten ihre aktuellen Einstellungen für frühere Modelle.