Am 22. Mai veröffentlichte Anthropic den ersten Monatsbericht zu Project Glasswing und gab dabei erstmals offiziell Einblicke in die Sicherheitsleistung des internen Spitzenmodells Claude Mythos Preview. Seit Projektstart im Vormonat nutzten Anthropic sowie rund 50 Partner das Modell Mythos Preview, um wichtige Basiskomponenten-Software zu scannen; insgesamt wurden dabei über 10.000 Schwachstellen hohen oder kritischen Schweregrads entdeckt. Bei den meisten Partnern stieg die Entdeckungsrate der Schwachstellen im Vergleich zu früheren Methoden um mehr als das Zehnfache. Konkrete Beispiele: Cloudflare fand in zentralen Systemkomponenten 2.000 Schwachstellen – davon 400 hohen/kritischen Schweregrads – wobei die Fehlalarmrate deutlich niedriger ausfiel als bei manuellen Tests. Mozilla entdeckte in Firefox 150 insgesamt 271 Schwachstellen, was mehr als das Zehnfache der Zahl ist, die bei Tests mit Claude Opus 4.6 an Firefox 148 festgestellt wurden. Das britische AI-Sicherheitsinstitut (AISI) bestätigte, dass Mythos Preview das erste Modell ist, das beide von ihnen definierten Bereiche für Netzwerkangriffssimulationen vollständig abdeckt. Zudem half Mythos Preview einer Bankpartnerin dabei, einen betrügerischen Geldtransfer in Höhe von 1,5 Millionen US-Dollar zu erkennen und zu blockieren.
Bei einem von Anthropic allein durchgeführten Scan von Open-Source-Software wurden in über 1.000 Projekten rund 23.000 potenzielle Schwachstellen identifiziert; davon werden geschätzt 6.202 als hohen oder kritischen Schweregrads eingestuft. Stichprobenartige Überprüfungen durch unabhängige Sicherheitsexperten ergaben, dass 90,6 % der Meldungen tatsächlich Schwachstellen darstellen und 62,4 % davon hohen oder kritischen Schweregrads sind; insgesamt dürften letztendlich fast 3.900 solcher Schwachstellen bestätigt werden. Ein bereits öffentlich dokumentierter Fall ist die Möglichkeit zur Fälschung von Zertifikaten in der wolfSSL-Verschlüsselungsbibliothek (CVE-2026-5194). Im Bericht heißt es, dass das größte Hindernis mittlerweile nicht mehr die Entdeckung, sondern die Behebung von Schwachstellen sei: Die Entwickler von Open-Source-Projekten seien massiv überlastet; einige bäten sogar darum, dass Anthropic die Offenlegung der Ergebnisse verlangsame. Aktuell vergehen im Durchschnitt zwei Wochen, bis eine kritische Schwachstelle behoben wird. Microsoft und Palo Alto Networks verzeichnen inzwischen einen starken Anstieg an Patches. Anthropic warnt, dass bald „Modelle mit ähnlichen Cybersicherheitsfähigkeiten breiter verfügbar sein werden“, gibt Ratschläge, wie Verteidiger sich an diese neue Phase anpassen können, und skizziert außerdem mögliche Pläne für zukünftige öffentliche Veröffentlichungen von Modellen der Mythos-Klasse.