Das Modell, das einen 29-jährigen Speicherfehler im Squid proxy — der die gesamte Commit-Historie des Repos vorausspringt — gefunden hat, arbeitet jetzt für Verteidiger. Am 21. August hat Anthropic die Sicherheitsfähigkeiten von Claude Mythos 5 über vier Kanäle geöffnet: Claude Security (unternehmensweite Code-Analyse, derzeit in öffentlicher Beta), Integrationen mit Sicherheitsanbietern, die in den kommenden Wochen erscheinen, ein erweitertes Cyber-Verification-Programm für geprüfte Verteidiger und ein neuer Defender Advantage Fund, der 35 Millionen Dollar an Guthaben für das Patchen von Open-Source-Software bereitstellt.
Niemand bekommt das Modell
Hier ist der Teil, der es wert ist, studiert zu werden: kein direkter Modellzugriff, Punkt. Mythos 5 führt zugewiesene Aufgaben im Hintergrund aus und liefert nur gezielte Ausgaben — Patches, Alarme, Anleitungen zur Behebung. Sie erhalten die Ergebnisse, nie die Gewichte oder ein rohes Prompt-Fenster. Angreifer können das, was sie nicht berühren können, nicht wiederverwenden.
Warum das wichtig ist
Dies ist eine neue Vorlage für die Auslieferung gefährlicher Fähigkeiten: bereitstellen, nicht verkaufen. Ein Frontier-Lab behandelt offensive Sicherheitsfähigkeiten wie eine kontrollierte Substanz — und setzt 35 Millionen Dollar darauf, dass Verteidiger, die so ausgerüstet sind, schneller agieren als ausgesperrte Angreifer. Jedes Labor mit einem beängstigenden Modell wird als Nächstes genau dieses Designproblem haben.