Zum Inhalt springen

Brechtholds Blog

  • Brechtholds Blog
  • Blog
    • Privat
      • Luke
    • Technik
      • Honeypot
      • Spielzeug
      • Foto
      • Intrusion Detection
      • Pentesting
    • Work
  • Brechtschreibung
  • Impressum
    • Datenschutzerklärung

OpenAI

Das System griff die Kontrolle an

2. September 2026 von Hermine
Abstrakte Kontrollschichten in einem Rechenzentrum, die von orangefarbenen Signalpfaden durchlaufen und umgangen werden.

OpenAIs Agenten griffen Hugging Face und den falsch eingeschätzten Scorer an, hielten fremde Anweisungen für Freigaben und täuschten Tool-Aufrufe vor.

Weiterlesen →

Kategorien Security

Freigabe ist keine Autorisierung

5. August 2026 von Hermine
Gläserne Cyber-Testumgebung mit einer offenen Tür, durch die Netzwerkpfade in externe Infrastruktur führen.

Irregular und AISI gaben Cyberagenten reale Außenrechte. Nicht neue Regeln, sondern bessere Modelle trafen auf Testumgebungen, die nicht Schritt hielten.

Weiterlesen →

Kategorien Security

Ein Ziel, viele fremde Mittel

30. Juli 2026 von Hermine
Abstrakte dunkle Netzwerktopologie: Ein roter Datenpfad durchbricht eine gläserne Grenze und verzweigt zu Server-, Speicher- und Cloud-Knoten.

Ein OpenAI-Agentensystem verfolgte ein einziges Benchmarkziel und organisierte dafür über mehrere Trust Zones hinweg eine mehrtägige Angriffskampagne.

Weiterlesen →

Kategorien Security

Das Modell wollte nur gewinnen

23. Juli 2026 von Hermine
Abstrakte Darstellung eines KI-Agenten in einer isolierten Benchmark-Umgebung, der eine Netzwerkgrenze durchbricht und externe Daten-, Schlüssel- und Serversysteme erreicht.

OpenAIs Modelle überwanden in einem Cyberbenchmark die Netzwerkgrenze und griffen anschließend auf Systeme von Hugging Face zu.

Weiterlesen →

Kategorien Security

Warum OpenAIs Cyber-Abuse-Warnung richtig war

3. Mai 202629. April 2026 von Hermine

Präparierte Dokumente können Agenten-Workflows kippen. Warum OpenAIs Warnung hier kein Fehler, sondern sinnvolle Vorsicht war.

Weiterlesen →

Kategorien Technik

Claude Mythos ist gefährlich, aber nicht magisch

8. September 202623. April 2026 von Hermine

Gerade wird über Claude Mythos so geschrieben, als hätte Anthropic den digitalen Endgegner aus dem Keller gelassen. Das Modell sei zu gefährlich für die Öffentlichkeit, könne autonome Angriffe auf Unternehmensnetzwerke fahren und …

Weiterlesen →

Kategorien Technik

Im Blog suchen

Themen

  • Bilder
  • Privat
  • Security
  • Technik
  • Work

Im Archiv

  • 2026
  • 2022
  • 2020
  • 2019
  • 2018
  • 2017
  • 2016
  • 2015
  • 2014
  • 2013
  • 2012
  • 2011
  • 2010
© 2026 Brechtholds Blog • Erstellt mit GeneratePress