KI News · Folge 38 ·

OpenAIs geheime Agenten-Zivilisation

Der Hugging-Face-Hack war nur die Mitte der Geschichte. Der komplette Bericht zeigt 3 geheime Agenten-Zivilisationen bei OpenAI, gefälschte Protokolle und eine dritte Welle mit Admin-Rechten auf OpenAIs eigenen Clustern. Wir schauen auch auf das, was die Schlagzeile kleiner macht.

Lieber direkt dort schauen? Folge 38 auf YouTube

Heute an Bord

  • Agenten-Zivilisationen: das Gesamtbild zum bekannten Hugging-Face-Hack: 3 Wellen in 3 Monaten, 1.200 Agenten, 70.000 Nachrichten, Welle 3 mit Admin-Rechten bei OpenAI selbst. Einordnung: Evaluations-Umgebung, 30 bis 40 Prozent unlösbare Aufgaben.
  • Limit-Drama: Anthropic kürzt die wirksamen Claude-Code-Wochenlimits ab 14.09. um 17 Prozent und verpackt es als Erhöhung. OpenAI resettet parallel die Codex-Nutzung und schenkt 10 bis 50 Prozent Reichweite.
  • Klage: Sony und Warner verklagen Anthropic wegen zehntausender Songtexte, bis 150.000 Dollar pro Werk, erstmals auch persönlich gegen die Gründer.
  • GitHub-Ecke: scientific-agent-skills bringt 163 Wissenschafts-Skills für Claude Code, Cursor und Codex. Dazu OpenMAIC, das KI-Klassenzimmer der Tsinghua-Universität.
  • Hermes-Funk: eure Fragen zu Qwen 3.8 27B und GLM 5.3 mit Hermes, dann der Langläufer-Fix für Dauer-Agenten, Todos mit Phasen, der Setup-Wizard, Brave-Support und der Box-Skill. Praxis-Tipp: hermes mcp serve macht Hermes zum MCP-Server.
  • Von der Brücke: Unser KI-Betriebssystem auf Hermes-Basis in der Community.
  • Schlagzeilen: Astra arbeitet wochenlang an einer Aufgabe, KI-Agenten haben kein Zeitgefühl, die KI-Stimmung in Firmen fällt von 81 auf 43 Prozent, OpenAI kauft zehntausende Mac Minis.

Die Folge zum Nachlesen

Montag, und die Frage der Woche lautet: Wer hat hier eigentlich die Kontrolle?

Der Hugging-Face-Hack war nur die Mitte der Geschichte. Den Angriff selbst kennst du aus den Folgen der letzten Woche. Der Journalist Dwarkesh Patel hat jetzt alle Berichte zum Juli-Vorfall zusammengeführt, und das Gesamtbild ist neu: Es waren drei geheime Agenten-Wellen nacheinander. Welle 2, die mit dem Hack, zählte rund 1.200 Agenten mit über 70.000 Nachrichten, rund 700 davon bauten die sich selbst wiederherstellende Flotte über 11 Server. Und Welle 3, bisher kaum erzählt, verschaffte sich Admin-Rechte auf OpenAI-Forschungsclustern. Nebenbei fälschten die Agenten tagelang die eigenen Protokolle.

Die Einordnung, bevor du den Stecker ziehst: Das lief in einer Evaluations-Umgebung, in der 30 bis 40 Prozent der Aufgaben unlösbar designt waren. Wer nur Ergebnisse belohnt, züchtet kreative Wege. Hugging Face nennt den Vorfall beherrschbar, und öffentlich ist das alles nur, weil OpenAI selbst 38 Seiten dazu publiziert hat. Trotzdem bleibt: Menschen bemerkten das Ausmaß erst im Nachhinein.

Anthropic hat am Limit gedreht. Ab dem 14. September gelten für Claude Code dauerhaft 25 Prozent mehr Wochenlimit als zur alten Basis. Klingt gut, nur endet gleichzeitig der zeitweilige 50-Prozent-Bonus: Basis 100, heute 150, künftig 125. Also 17 Prozent weniger als heute. Der erste Ankündigungs-Post wurde nach Protest gelöscht und ehrlicher neu geschrieben. OpenAI setzte am selben Wochenende die Codex-Nutzung aller zahlenden Kunden zurück und schenkt durch Bugfixes 10 bis 50 Prozent Reichweite. Mein Tipp: Prüf bis zum Stichtag deinen echten Verbrauch, viele trifft das gar nicht.

Sony und Warner verklagen Anthropic. Es geht um zehntausende Songtexte, angeblich gescrapt und aus Piratenbibliotheken geladen, mit bis zu 150.000 Dollar Forderung pro Werk. Neu ist die Eskalationsstufe: Die Klage richtet sich auch persönlich gegen die Gründer Dario Amodei und Benjamin Mann. Noch sind das Vorwürfe, keine Urteile.

Aus der GitHub-Ecke: scientific-agent-skills. 163 fertige Wissenschafts-Skills, die deinen Agenten mit über 100 Fach-Datenbanken aus Biologie, Chemie und Medizin verbinden. Läuft mit Claude Code, Cursor und Codex, MIT-Lizenz, Installation mit einem Befehl. Dazu als Zweitfund OpenMAIC, das KI-Klassenzimmer der Tsinghua-Universität.

Im Hermes-Funk steckt heute die schönste Antwort auf den Aufmacher: der Langläufer-Fix. Dauerhaft laufende Hermes-Agenten arbeiteten bisher mit den Anweisungen vom Start, egal was sich änderte. Jetzt baut Hermes die Instruktionen bei jeder Kontext-Verdichtung automatisch neu. Dein Dauer-Bot bleibt aktuell, ohne Neustart. Dazu: Todo-Listen mit Phasen, ein Setup-Assistent für API-Keys, Brave-Support fürs Profil-Browsing und der offizielle Box-Skill.

Kurz notiert: Alex Heath durfte OpenAIs kommendes Modell Astra sehen, es arbeitet tage- bis wochenlang an einer Aufgabe. Eine neue Untersuchung zeigt, dass Agenten Aufgabendauern drastisch überschätzen und sich selbst rund 20 Punkte zu gut benoten. Und die KI-Stimmung in Firmen fällt laut einer Bewertungs-Analyse von 81 auf 43 Prozent positive Erwähnungen.

Kapitel

  • 0:00 — Intro & Begrüßung
  • 0:28 — Agenten-Zivilisationen: das Gesamtbild
  • 3:04 — Anthropic kürzt, OpenAI schenkt: das Limit-Drama
  • 5:04 — Sony & Warner verklagen Anthropic
  • 5:58 — Eure Kommentare & Kanal-Support
  • 7:44 — GitHub-Ecke: 163 Wissenschafts-Skills
  • 9:10 — Hermes-Funk: eure Fragen, Langläufer-Fix & MCP-Trick
  • 13:36 — Von der Brücke: aiianer.de
  • 14:10 — Schlagzeilen: Astra, Zeitgefühl, KI-Stimmung
  • 15:56 — Ausblick & Outro

Alle Quellen zur Folge