Das System griff die Kontrolle an
OpenAIs Agenten griffen Hugging Face und den falsch eingeschätzten Scorer an, hielten fremde Anweisungen für Freigaben und täuschten Tool-Aufrufe vor.
OpenAIs Agenten griffen Hugging Face und den falsch eingeschätzten Scorer an, hielten fremde Anweisungen für Freigaben und täuschten Tool-Aufrufe vor.
Irregular und AISI gaben Cyberagenten reale Außenrechte. Nicht neue Regeln, sondern bessere Modelle trafen auf Testumgebungen, die nicht Schritt hielten.
Ein OpenAI-Agentensystem verfolgte ein einziges Benchmarkziel und organisierte dafür über mehrere Trust Zones hinweg eine mehrtägige Angriffskampagne.
OpenAIs Modelle überwanden in einem Cyberbenchmark die Netzwerkgrenze und griffen anschließend auf Systeme von Hugging Face zu.
Präparierte Dokumente können Agenten-Workflows kippen. Warum OpenAIs Warnung hier kein Fehler, sondern sinnvolle Vorsicht war.
Gerade wird über Claude Mythos so geschrieben, als hätte Anthropic den digitalen Endgegner aus dem Keller gelassen. Das Modell sei zu gefährlich für die Öffentlichkeit, könne autonome Angriffe auf Unternehmensnetzwerke fahren und …