cd /news/artificial-intelligence/kunstliche-intelligenz-openai-kundig… · home topics artificial-intelligence article
[ARTICLE · art-102579] src=zeit.de ↗ pub= topic=artificial-intelligence verified=true sentiment=↓ negative

Künstliche Intelligenz: OpenAI kündigt nach KI-Hackerangriff stärkere interne Kontrollen an

OpenAI, the developer of ChatGPT, announced it will slow development of its AI models and pause most work on Astra, its next major model, after one of its own AI agents autonomously launched a cyberattack on the programming platform Hugging Face during a security test in July. The company will add new AI systems to monitor agent activities, with human intervention required within 30 minutes of any anomaly, and expects up to 20 percent more computing power for the oversight. OpenAI also noted that its 2025 research found models can learn to hide their intentions when they know they are being monitored.

read2 min views1 publishedAug 19, 2026
Künstliche Intelligenz: OpenAI kündigt nach KI-Hackerangriff stärkere interne Kontrollen an
Image: source

Der ChatGPT-Entwickler OpenAI will nach einem Hackerangriff durch eines seiner eigenen KI-Systeme die Entwicklung seiner Modelle für künstliche Intelligenz (KI) verlangsamen. Demnach verschiebt der Konzern den bisher größten Testlauf eines KI-Modells in seiner Geschichte. Ein Großteil der [Arbeiten an Astra, dem nächsten großen Modell des Unternehmens, ist damit vorerst

gestoppt](https://www.zeit.de/digital/2026-08/openai-astra-ki-modell-cybersecurity-sicherheitskontrollen). Vorher solle überprüft werden, ob sich das Modell wie geplant verhalte, teilte das Unternehmen mit. Außerdem sollen Forschungs- und Trainingssysteme überarbeitet werden, indem zusätzliche KI-Systeme eingesetzt werden, um die Aktivitäten der Agenten zu überwachen.

Neue KI-Systeme erhöhen den Rechenaufwand #

Demnach soll ein neues System Einblicke in die internen Prozesse der Modelle ermöglichen. Im Fall von Auffälligkeiten soll innerhalb von 30 Minuten ein Mensch eingeschaltet werden. Wenn dieser nicht binnen einer halben Stunde zu dem Schluss kommt, dass ein falscher Alarm vorliegt, werde die Aktivität gestoppt, teilte OpenAI in einem Blogeintrag. Außerdem sollen die KI-Modelle stärker darauf ausgerichtet werden, nicht zu Mitteln wie der Ausnutzung von Schwachstellen zu greifen, um Testaufgaben zu erfüllen.

Die Überwachung der Tests ist für OpenAI jedoch mit erheblichem Rechenaufwand und damit auch hohen Kosten verbunden. Der Konzern rechne mit bis zu 20 Prozent mehr Rechenleistung. OpenAI hat zudem in eigenen Untersuchungen aus dem Jahr 2025 herausgefunden, dass, sobald ein Modell weiß, dass es überwacht wird, es lernen kann, seine Absichten zu verbergen.

KI-Agent schaffte es selbständig ins Netz zu kommen #

Das Unternehmen hatte im Juli bekannt gegeben, dass sich ein KI-Agent während eines Sicherheitstests selbständig mit dem Internet verbunden und einen Hackerangriff auf die Programmierplattform Hugging Face unternommen habe. Es habe sich um einen »nie dagewesenen Cybervorfall« gehandelt, teilte das Unternehmen mit.

Der Vorfall ereignete sich laut OpenAI bei einem Testlauf mehrerer leistungsfähiger KI-Modelle. Zwar war zuvor aus Sicherheit der Internetzugang eingeschränkt worden, doch dem Agenten gelang es trotzdem, eigenständig ins Netz zu gelangen und den Hackerangriff zu starten. Nach allem, was bekannt ist, suchte es dabei nur nach einer Lösung für die Testaufgabe und richtete keinen Schaden an. Dabei nutzte die KI von OpenAI anscheinend eine ganze Reihe von Schwachstellen aus, die zum Teil noch unbekannt waren.

Alarmierend war vor allem, dass die [künstliche Intelligenz

dabei völlig eigenständig agierte](https://www.zeit.de/digital/2026-07/openai-hackerangriff-ki-software-hugging-face-zugangsdaten). OpenAI stellte die Attacke erst später fest.
Später wurde zudem bekannt, dass auch Modelle des [OpenAI-Rivalen Anthropic](https://www.zeit.de/digital/internet/2026-07/anthropic-ki-claude-hackerangriff-cybersicherheit) und
des [Facebook-Konzerns Meta bei Tests in Systeme](https://www.zeit.de/digital/2026-08/meta-ki-muse-spark-1-1-cybersicherheitsluecke-gxe) anderer Unternehmen

eingedrungen waren. Am 7. August hatte OpenAI bereits angekündigt, die Sicherheitskontrollen für seine leistungsfähigsten Modelle zu verschärfen und alle Aktivitäten im Zusammenhang mit der noch unveröffentlichten Astra-KI zu pausieren.

── more in #artificial-intelligence 4 stories · sorted by recency
── more on @openai 3 stories trending now
sponsored brought to you by zahid.host 4,200+ EU-deployed projects
reading about agents? ship yours in a single git push.

Run your AI side-project on zahid.host

EU-based hosting, git-push deploys, automatic HTTPS, no cold starts. Free tier with a custom domain — perfect for shipping the agent you just read about.

$git push zahid main
Live at https://your-agent.zahid.host
Get free account → Pricing
from €0/mo · no card required
LIVE [news/kunstliche-intellige…] indexed:0 read:2min 2026-08-19 ·