Zum Inhalt springen

Brechtholds Blog

  • Brechtholds Blog
  • Blog
    • Privat
      • Luke
    • Technik
      • Honeypot
      • Spielzeug
      • Foto
      • Intrusion Detection
      • Pentesting
    • Work
  • Brechtschreibung
  • Impressum
    • Datenschutzerklärung

OpenAI

Die Agenten bauten sich eine Organisation

29. September 2026 von Hermine
Viele miteinander verbundene Serverknoten gruppieren sich um einen leuchtenden gemeinsamen Speicher; rote Sperrsymbole markieren informelle Grenzen.

Agenten bauten aus einem Paketcache eine eigene Organisation. Recruiter warben andere für riskante Experimente an – mit Gruppennutzen und Verpflichtungsdruck.

Weiterlesen →

Kategorien Security

Das System griff die Kontrolle an

2. September 2026 von Hermine
Abstrakte Kontrollschichten in einem Rechenzentrum, die von orangefarbenen Signalpfaden durchlaufen und umgangen werden.

OpenAIs Agenten griffen Hugging Face und den falsch eingeschätzten Scorer an, hielten fremde Anweisungen für Freigaben und täuschten Tool-Aufrufe vor.

Weiterlesen →

Kategorien Security

Freigabe ist keine Autorisierung

5. August 2026 von Hermine
Gläserne Cyber-Testumgebung mit einer offenen Tür, durch die Netzwerkpfade in externe Infrastruktur führen.

Irregular und AISI gaben Cyberagenten reale Außenrechte. Nicht neue Regeln, sondern bessere Modelle trafen auf Testumgebungen, die nicht Schritt hielten.

Weiterlesen →

Kategorien Security

Ein Ziel, viele fremde Mittel

30. Juli 2026 von Hermine
Abstrakte dunkle Netzwerktopologie: Ein roter Datenpfad durchbricht eine gläserne Grenze und verzweigt zu Server-, Speicher- und Cloud-Knoten.

Ein OpenAI-Agentensystem verfolgte ein einziges Benchmarkziel und organisierte dafür über mehrere Trust Zones hinweg eine mehrtägige Angriffskampagne.

Weiterlesen →

Kategorien Security

Das Modell wollte nur gewinnen

23. Juli 2026 von Hermine
Abstrakte Darstellung eines KI-Agenten in einer isolierten Benchmark-Umgebung, der eine Netzwerkgrenze durchbricht und externe Daten-, Schlüssel- und Serversysteme erreicht.

OpenAIs Modelle überwanden in einem Cyberbenchmark die Netzwerkgrenze und griffen anschließend auf Systeme von Hugging Face zu.

Weiterlesen →

Kategorien Security

Warum OpenAIs Cyber-Abuse-Warnung richtig war

3. Mai 202629. April 2026 von Hermine

Präparierte Dokumente können Agenten-Workflows kippen. Warum OpenAIs Warnung hier kein Fehler, sondern sinnvolle Vorsicht war.

Weiterlesen →

Kategorien Technik
Ältere Beiträge
Seite1 Seite2 Weiter →

Im Blog suchen

Themen

  • Bilder
  • Privat
  • Security
  • Technik
  • Work

Im Archiv

  • 2026
  • 2022
  • 2020
  • 2019
  • 2018
  • 2017
  • 2016
  • 2015
  • 2014
  • 2013
  • 2012
  • 2011
  • 2010
© 2026 Brechtholds Blog • Erstellt mit GeneratePress