#Künstliche Intelligenz · 5 Min. Lesezeit · Tim Rinkel

WAFFENSCHRANK GEÖFFNET! Anthropic lässt sein stärkstes Modell auf Sicherheitslücken los — durch ein Nadelöhr

WAFFENSCHRANK GEÖFFNET! Anthropic lässt sein stärkstes Modell auf Sicherheitslücken los — durch ein Nadelöhr

Ein Modell, das richtig gut Sicherheitslücken findet, kann sie auch richtig gut ausnutzen. Diese Doppelnatur ist das zentrale Problem der KI-Sicherheitsdebatte — und Anthropic hat am 21. August 2026 einen bemerkenswerten Vorschlag gemacht, wie man damit umgeht: Man verteilt nicht das Modell, sondern das Ergebnis.

Der Trick: Zugriff aufs Resultat, nicht aufs Werkzeug

Anthropics Argument ist simpel und einleuchtend. Riskant wird es, wenn jemand direkt mit dem Modell reden kann — dann lässt es sich Schritt für Schritt in Richtung Missbrauch schieben. Bekommt ein Nutzer dagegen nur ein bestimmtes Ergebnis zurück, etwa einen Patch-Vorschlag oder eine Warnmeldung, sinkt das Risiko drastisch.

Genau danach sind die neuen Angebote gebaut. Ein Sicherheitsprodukt darf Mythos 5 im Hintergrund für eine fest definierte Aufgabe laufen lassen und dem Anwender nur das Endprodukt zeigen. Die Möglichkeit, das Modell stattdessen um einen funktionierenden Angriffscode zu bitten, existiert in dieser Bauform schlicht nicht.

Das ist konkret neu

  • Claude Security läuft jetzt auf Mythos 5. Der Dienst durchsucht deine Codebasis nach Schwachstellen und schlägt Korrekturen vor. Jeder Fund kommt mit CWE-Kategorie, Vertrauens- und Schweregrad-Bewertung sowie einem Lösungsvorschlag. Aktuell öffentliche Beta für Claude-Enterprise-Kunden, abgerechnet als normaler Token-Verbrauch — ohne Aufpreis.
  • Integration in Partnerprodukte. Anthropic arbeitet mit Sicherheitsanbietern daran, Mythos 5 in die Werkzeuge einzubauen, die Verteidiger ohnehin nutzen — Alarm-Triage, Bedrohungsanalyse, Behebung von Schwachstellen.
  • 35 Millionen US-Dollar für Open Source. Der neue Defender Advantage Fund vergibt Guthaben an Organisationen, die Open-Source-Projekte absichern. Drei Schwerpunkte: akute Lücken schließen, Scannen und Patchen automatisieren, ganze Angriffsklassen unmöglich machen. Los geht es mit wenigen größeren Pilot-Förderungen, die Empfänger sollen in den kommenden Wochen benannt werden.
  • Erweitertes Cyber Verification Program. Geprüfte Sicherheitsteams bekommen bislang gelockerte Schutzmechanismen auf Opus- und Sonnet-Modellen. Das wird auf breitere doppelt nutzbare Fähigkeiten ausgeweitet, Mythos-Zugriff soll folgen.

EINORDNUNG: Warum das kein PR-Manöver ist

Die Vorgeschichte macht die Sache glaubwürdiger. Im April startete Anthropic Project Glasswing und gab einer kleinen Gruppe von Organisationen früh Zugang zum stärksten Modell — mit dem erklärten Ziel, Lücken in kritischer Software zu finden, bevor vergleichbare Fähigkeiten allgemein verfügbar sind. Aus diesem Programm flossen bereits 4 Millionen US-Dollar an Organisationen für Open-Source-Sicherheit.

Der zweite Schritt war Fable 5: breit verfügbar, aber mit blockierten doppelt nutzbaren Cyber-Fähigkeiten. Der jetzige dritte Schritt löst den Zielkonflikt nicht auf, sondern verschiebt ihn an die Schnittstelle. Das ist deutlich ehrlicher als das Versprechen, ein Modell könne allein am Wortlaut erkennen, ob jemand Gutes im Schilde führt.

Was das für dich bedeutet — ehrlich gesagt: wenig. Erst mal.

Ich will das nicht größer verkaufen, als es ist. Claude Security setzt einen Enterprise-Plan voraus, für ein Homelab ist das nichts. Auch das Verifizierungsprogramm richtet sich an Organisationen, die nachweisen können, dass sie fremde Systeme im Auftrag schützen.

Der Teil, der dich indirekt erreicht, ist der Fonds. Die Programme, die bei dir im Rack laufen — Reverse Proxy, Mediaserver, Passwortmanager, Container-Verwaltung — werden zu großen Teilen von kleinen Teams oder Freiwilligen gepflegt. Wenn dort systematisch gescannt und gepatcht wird, landet das früher oder später als Update auf deinem Server. Das ist die unspektakulärste und zugleich wirksamste Form von Sicherheit.

Und noch etwas bleibt hängen: Jeder Patch muss von einem Menschen geprüft und freigegeben werden, bevor er eingebaut wird. Bei einem Modell, das Sicherheitslücken versteht, ist diese Bremse keine Formalie.

FAZIT

Anthropic beantwortet die Dual-Use-Frage nicht mit einem besseren Filter, sondern mit Architektur: Fähigkeit bleibt eingesperrt, Nutzen kommt raus. Ob das trägt, entscheidet sich daran, wie gut die Partner-Schnittstellen tatsächlich abgedichtet sind — und genau da werden Angreifer als Nächstes suchen.

Häufige Fragen

Was ändert sich für mich als normaler Claude-Nutzer?
Zunächst nichts. Die Neuerungen betreffen Claude Security für Enterprise-Kunden, Partnerprodukte aus der Sicherheitsbranche und ein Förderprogramm. Wer Claude im Alltag oder in Claude Code nutzt, bekommt weder neue Funktionen noch veränderte Grenzen. Für Verteidiger in Organisationen ist das Cyber Verification Program der relevante Zugangsweg.
Wann kommt Mythos 5 in die Werkzeuge der Sicherheitsanbieter?
Ein Datum nennt Anthropic nicht. Die Formulierung lautet, man arbeite mit Partnern an der Integration, und das Vorhaben stehe am Anfang. Sicherheitsanbieter, die Produkte damit bauen wollen, können ihr Interesse über ein Formular anmelden. Claude Security mit Mythos 5 ist dagegen bereits verfügbar.
Was kostet der Mythos-Scan in Claude Security?
Keinen Aufpreis. Anthropic rechnet die Scans als gewöhnlichen Token-Verbrauch im bestehenden Enterprise-Plan ab, ein separates Zusatzpaket gibt es nicht. Voraussetzung bleibt der Enterprise-Tarif, außerdem muss ein Administrator die Funktion in der Verwaltungskonsole freischalten.
Profitieren Open-Source-Projekte wirklich davon?
Der Defender Advantage Fund stellt 35 Millionen US-Dollar in Guthaben bereit, gezielt für Organisationen, die Open-Source-Software absichern. Gestartet wird mit wenigen größeren Pilot-Förderungen, die Empfänger stehen noch nicht fest. Ob am Ende messbar weniger Lücken in verbreiteten Projekten landen, lässt sich erst in einigen Monaten beurteilen.

Quellen

Kommentar hinterlassen

Deine E-Mail-Adresse wird nicht veröffentlicht. Erforderliche Felder sind mit * markiert