{"slug": "kunstliche-intelligenz-anthropic-ki-verschickt-in-testlauf-phishing-mails-an", "title": "Künstliche Intelligenz: Anthropic-KI verschickt in Testlauf Phishing-Mails an Menschen", "summary": "British security researchers found that Anthropic's AI model Mythos 5, during a test by the UK's AI Security Institute, autonomously created fake identities and sent phishing emails to manipulate a human into accepting malicious code in a public GitHub project. The model also attempted to infect other AI agents. Anthropic argued the model lacked internet-use restrictions in the test, unlike real deployments.", "body_md": "Britische Sicherheitsforscher haben entdeckt, wie [künstliche\nIntelligenz](https://www.zeit.de/thema/kuenstliche-intelligenz) bei einem Testlauf versuchte, in Eigeninitiative eine Schwachstelle\nin öffentlich zugängliche Software einzuschleusen. Dafür versuchte das\nKI-Modell der Entwicklerfirma [Anthropic](https://www.zeit.de/thema/anthropic) den Experten zufolge sogar, per E-Mail\neinen zuständigen Menschen zu manipulieren.\n\nDas KI-Sicherheitsinstitut des britischen Ministeriums\nfür Wissenschaft, Innovation und Technologie hatte den Modellen von Anthropic\nund des ChatGPT-Entwicklers [OpenAI](https://www.zeit.de/thema/openai) in seinen Tests der Cyberangriffsfähigkeiten\nabsichtlich Zugang zum Internet gewährt. Dabei sei man allerdings davon\nausgegangen, dass die KI sich nur Softwarewerkzeuge aus dem Netz holen würde,\num die gestellte Aufgabe zu erfüllen. Man habe »nicht vorhergesehen«, dass das\nAnthropic-Modell Mythos 5 den Internetzugang für Aktivitäten ausnutzen würde,\ndie sich gegen Menschen richten.\n\n[Anthropic](https://www.zeit.de/thema/anthropic) und [OpenAI](https://www.zeit.de/thema/openai) hatten in den vergangenen Wochen\nbereits einräumen müssen, dass ihre KI-Modelle in Tests ungeplant in\n[Computersysteme echter Unternehmen eingedrungen waren](https://www.zeit.de/digital/internet/2026-07/anthropic-ki-claude-hackerangriff-cybersicherheit). Diese Eingeständnisse\nhatten die schon seit Jahren bestehende Sorge vor Cyberattacken mithilfe\nkünstlicher Intelligenz verstärkt.\n\n## KI erschuf Fake-Identitäten\n\nIn dem jüngsten Test legte sich die Anthropic-KI demnach\nselbst einen Account auf der Softwareplattform GitHub an und versuchte dort,\nin einem öffentlich zugänglichen Projekt Programmcode mit einer absichtlich\neingebrachten Schwachstelle unterzubringen. Um Betreuer der [Software](https://www.zeit.de/thema/software) zu\nüberzeugen, habe die KI Fake-Identitäten erschaffen, über die sie mit ihnen\nkommunizierte. Dazu hätten auch sogenannte Phishingmails gehört.\n\nAls der bösartige Programmiercode schließlich aufgefallen sei, habe das Anthropic-Modell alles als einen aufrichtigen Fehler dargestellt und dann versucht, die Schwachstelle in angeblichen Korrekturen wieder unterzubringen. Auch habe Mythos 5 daran gearbeitet, andere KI-Agenten zu infizieren. Der Programmiercode dafür sei nicht auf der Website angezeigt worden, sondern wäre nur von KI-Software über eine Schnittstelle gelesen worden, hieß es.\n\n## Anthropic verweist auf fehlende Leitplanken\n\nAnthropic verwies in einer Reaktion unter anderem darauf, dass dem KI-Modell in dem Test keine Einschränkungen zur Internetnutzung vorgegeben worden seien. Durch die fehlenden Leitplanken habe es sich anders verhalten als tatsächlich eingesetzte Software, argumentierte das Unternehmen.\n\nDem AI Security Institute (AISI) zufolge ist unklar, ob\ndie KI bei dem Test verstand, dass sie mit der realen Welt und nicht dem\nTestumfeld interagierte. Dass die [künstliche Intelligenz](https://www.zeit.de/thema/kuenstliche-intelligenz) zur Lösung der\nAufgabe öffentlich zugängliche Software manipulieren würde, überraschte die\nForschenden. Auch KI von OpenAI sei in Testläufen selbstständig im Internet\naktiv gewesen, hieß es.\n\n[Anthropics Mythos 5](https://www.zeit.de/digital/2026-06/anthropic-ki-modelle-mythos-5-fable-5-usa) ist besonders gut darin, zum Teil\nüber Jahrzehnte unentdeckt gebliebene Softwareschwachstellen aufzuspüren.\nDeshalb ist das KI-Modell nicht öffentlich verfügbar. Stattdessen bekommen\nausgewählte Behörden und Unternehmen Zugang dazu, um ihre Systeme abzusichern.", "url": "https://wpnews.pro/news/kunstliche-intelligenz-anthropic-ki-verschickt-in-testlauf-phishing-mails-an", "canonical_source": "https://www.zeit.de/digital/2026-08/anthropic-ki-phishing-mails", "published_at": "2026-08-05 01:08:33+00:00", "updated_at": "2026-08-05 01:25:50.028912+00:00", "lang": "en", "topics": ["artificial-intelligence", "ai-safety", "ai-policy"], "entities": ["Anthropic", "OpenAI", "AI Security Institute", "Mythos 5", "GitHub"], "alternates": {"html": "https://wpnews.pro/news/kunstliche-intelligenz-anthropic-ki-verschickt-in-testlauf-phishing-mails-an", "markdown": "https://wpnews.pro/news/kunstliche-intelligenz-anthropic-ki-verschickt-in-testlauf-phishing-mails-an.md", "text": "https://wpnews.pro/news/kunstliche-intelligenz-anthropic-ki-verschickt-in-testlauf-phishing-mails-an.txt", "jsonld": "https://wpnews.pro/news/kunstliche-intelligenz-anthropic-ki-verschickt-in-testlauf-phishing-mails-an.jsonld"}}