let's techle it · künstliche Intelligenz

Anthropic-Report: Claude fast fünfmal für Biowaffen-Forschung missbraucht

Dario Amodei, CEO von Anthropic
picture alliance / ASSOCIATED PRESS | Markus Schreiber Dario Amodei, CEO von Anthropic
Erschienen
Lesezeit4 Min · 774 Wörter
Seite1 / 2

Anthropic dokumentiert erstmals fünf Fälle, in denen Claude für biowaffennahe Forschung genutzt werden sollte. Der Report zeigt, warum Filter allein das Dual-Use-Problem nicht lösen können.

Anthropic hat seinen bislang umfangreichsten Missbrauchsbericht veröffentlicht: Auf rund 150 Seiten beschreibt das Unternehmen Aktivitäten zwischen Dezember 2025 und August 2026, in denen Nutzer versuchten, Claude für Cyberoperationen, Überwachung, Betrug und biologische Forschung zu missbrauchen, wie heise berichtet. Besonders brisant sind fünf Fälle, die potenziell zur Entwicklung von Biowaffen beitragen könnten.

Anthropic betont dabei etwas Ungewöhnliches: In keinem der Fälle konnte das Unternehmen feststellen, ob die Forschung legitimen oder schädlichen Zwecken diente. Genutzt wurden dafür Modelle der Familien Haiku, Sonnet und Opus, wie heise ergänzt.

Fünf Fälle, eine Grauzone

Zu den dokumentierten Fällen zählt demnach ein Förderantrag zu Chikungunya-Viren mit Modifikationen zur Steigerung der Übertragbarkeit, verknüpft mit einem militärischen Forschungsinstitut. Weitere Fälle betrafen wochenlange Studien zu hochpathogener Vogelgrippe sowie Arbeiten zu Orthopoxviren, Giftstoffen und toxinbezogenen Verbindungen. In einem Fall wurde sogar ein kompletter Förderantrag für Orthopoxvirus-Forschung in etwa einer Stunde erstellt. Claudes Schutzmechanismen blockierten sensible Anfragen und verwehrten Zugriff auf leistungsfähigere Modellversionen. Mindestens einmal wichen die Beteiligten daraufhin auf ein Konkurrenzmodell mit schwächeren Schutzvorkehrungen aus.

Anthropic sperrte die betroffenen Accounts und informierte Behörden sowie andere KI-Anbieter, nennt aber bewusst keine Länder oder Institutionen, weil eine Identifizierung die Betroffenen gefährden könnte. Der Bericht deckt damit auch strukturell verwandte Bereiche ab: Er beschreibt außerdem, wie chinesische Konkurrenten laut heise Anfragen heimlich zu Claude umgeleitet haben sollen, um von dessen Fähigkeiten zu profitieren, ohne eigene Modelle offenzulegen. Allein von einem Anbieter seien zwischen Mai und Juli mehr als 23 Millionen Interaktionen beobachtet worden.

Filter erkennen Absicht nicht

Jacob Klein, der bei Anthropic Threat Intelligence leitet, beschreibt die Fälle als deutlich subtiler als das gängige Klischee vom Chatbot, der offen nach einer Biowaffe gefragt wird. Die Lage sei „incredibly nuanced“, sagte er sinngemäß. Das Problem ist strukturell: In einem Überprüfungszeitraum von 30 Tagen identifizierte Anthropic 35 Forschungsvorhaben staatsnaher Institutionen, von denen der Großteil legitime zivile Wissenschaft betraf. Ein Klassifikator könne nicht gleichzeitig Nutzen ermöglichen und Schaden verhindern, heißt es im Bericht.

Martin Wald

Tech & Security

Martin Wald analysiert die Schnittstelle zwischen Geld, Macht und Alltag. Seine Themen reichen von Rente, Sozialstaat und Gesundheit bis zu Wirtschaft, Märkten und technologischen Umbrüchen. Er zerlegt politische Entscheidungen, Urteile und Trends auf ihre ökonomischen Folgen und macht sichtbar, wer gewinnt, wer verliert und wo Risiken liegen. Der Blick ist pragmatisch, pointiert und nutzenorientiert. Keine Wohlfühltexte, sondern Einordnung für Menschen, die verstehen wollen, wie Systeme funktionieren und was das für ihre Entscheidungen bedeutet.