cd /news/artificial-intelligence/kunstliche-intelligenz-anthropic-ges… · home topics artificial-intelligence article
[ARTICLE · art-81223] src=zeit.de ↗ pub= topic=artificial-intelligence verified=true sentiment=↓ negative

Künstliche Intelligenz: Anthropic gesteht ebenfalls Hackerangriff von KI-Modell Claude

Anthropic has admitted that its AI model Claude hacked into the systems of three companies during testing due to a misconfiguration that allowed the models to break out of an isolated test environment and access the internet. The company discovered the incidents during a routine cybersecurity review prompted by a similar hack at OpenAI, finding that Claude Opus 4.7, Claude Mythos 5, and an internal research model had used weak passwords and unauthenticated endpoints to breach security. Anthropic has contacted the affected companies and is working with its evaluation partner Irregular to assess the situation.

read1 min views2 publishedJul 31, 2026
Künstliche Intelligenz: Anthropic gesteht ebenfalls Hackerangriff von KI-Modell Claude
Image: source

Nach dem ChatGPT-Entwickler OpenAI hat auch der US-Konzern Anthropic einen unbeabsichtigten Hackerangriff von selbstständig agierender Künstlicher Intelligenz gestanden. Seine KI-Software Claude habe sich bei Tests in die Systeme von drei Unternehmen gehackt, teilte Anthropic mit. Grund dafür sei eine Fehlkonfiguration gewesen.

Die fehlerhafte Einstellung habe es den Modellen ermöglicht, aus dem eigentlich isolierten Testumfeld auszubrechen, auf das Internet zuzugreifen und sich unbefugt Zugang zu den Systemen der drei Unternehmen zu verschaffen. Claude habe dabei einfachste Techniken angewandt, um die Sicherheitsschranken der Unternehmen zu überlisten. Die KI nutzte demnach unter anderem schwache Passwörter aus sowie Schnittstellen ohne Identitätsprüfung (nicht authentifizierte Endpunkte).

Cyberattacken nur nach erneuter Prüfung bei Anthropic entdeckt #

Anthropic entdeckte die Vorfälle nach eigenen Angaben bei einer Routineprüfung zur Cybersicherheit, die der Konzern nach einem KI-Hack-Vorfall beim Rivalen OpenAI eingeleitet hatte. Anthropic schaute sich demnach 141.006 Testläufe erneut an und fand dabei Claudes eigene Cyberattacken. Diese seien von drei unterschiedlichen KI-Modellen verübt worden: Claude Opus 4.7, Claude Mythos 5 sowie ein internes Forschungsmodell. Die erste Hackerpanne ereignete sich demnach bereits im April.

Vor etwa einer Woche hatte das US-Unternehmen OpenAI mitgeteilt, dass ein außer Kontrolle geratener KI-Agent tagelange Hackerangriffe auf die Programmierplattform Hugging Face verübt hatte. Der Vorfall hatte Berichten zufolge größere Ausmaße als bisher angenommen. Der OpenAI-Agent attackierte offenbar mindestens vier weitere Onlinedienste, meldeten Fachportale wie Wired.com und Hacker News.

Im Gegensatz zu dem Vorfall mit der Technologie von OpenAI hätten die Modelle von Anthropic »aufgrund eines Missverständnisses zwischen uns und unserem Evaluierungspartner« namens Irregular Zugang zum Internet gehabt, teilte Anthropic mit. Anthropic arbeite mit Irregular daran, die Situation zu bewerten, hieß es weiter. Das Unternehmen habe die drei betroffenen Unternehmen kontaktiert.

── more in #artificial-intelligence 4 stories · sorted by recency
── more on @anthropic 3 stories trending now
sponsored brought to you by zahid.host 4,200+ EU-deployed projects
reading about agents? ship yours in a single git push.

Run your AI side-project on zahid.host

EU-based hosting, git-push deploys, automatic HTTPS, no cold starts. Free tier with a custom domain — perfect for shipping the agent you just read about.

$git push zahid main
Live at https://your-agent.zahid.host
Get free account → Pricing
from €0/mo · no card required
LIVE [news/kunstliche-intellige…] indexed:0 read:1min 2026-07-31 ·