KI-Forschungsagenten bei OpenAI
OpenAI erklärte am 6. September 2026 ein internes Ziel für erreicht: den automatisierten Forschungspraktikanten. Im selben Atemzug sagt der eigene Chefwissenschaftler, kein Labor habe Monitoring und Alignment ausreichend im Griff.

OpenAI hat am 6. September 2026 den Blogpost „Research acceleration: The view inside OpenAI“ veröffentlicht. Darin erklärt das Unternehmen, ein intern gesetztes Ziel erreicht zu haben: den „automated research intern“, also einen automatisierten Forschungspraktikanten. Gemeint ist ein System, das klar umrissene Forschungsaufgaben unter menschlicher Anleitung erledigt – auch solche, die einen erfahrenen Forscher mehrere Tage kosten würden. Gesetzt wurde das Ziel laut OpenAI im vergangenen Herbst, mit Frist bis September.
Die Zahl dazu steht im selben Text: Seit Mitte August setze die Forschungsorganisation 3,1 Agenten-Arbeitstage für jeden Arbeitstag menschlicher Arbeit ein, gerechnet auf einen Acht-Stunden-Tag. Vor Juni 2026 lag die gesamte Laufzeit der KI-Forschungsagenten noch unter der gesamten menschlichen Arbeitszeit. Das Verhältnis hat sich also in etwa zehn Wochen gedreht.
Brisant ist das, weil die Warnung aus demselben Haus kommt: Chefwissenschaftler Jakub Pachocki sagt, kein Labor habe Alignment und Monitoring so weit im Griff, dass man mit maximaler Geschwindigkeit weiterskalieren dürfe. Alignment?Die Abstimmung eines KI-Modells auf die Absichten und Regeln seiner Nutzer. Ziel ist, dass das System auch dann tut, was gemeint war, wenn niemand zusieht. meint hier, dass das Verhalten eines Modells zu den Absichten der Menschen passt, die es einsetzen.
Ein Praktikant mit unbegrenzten Überstunden
Die Zahlen von OpenAI und aus der Berichterstattung beschreiben Laufzeit und Kosten, nicht abgelieferte Ergebnisse:
- 3,1 Agenten-Arbeitstage pro menschlichem Arbeitstag, Stand Mitte August 2026
- vor Juni 2026 lag dieses Verhältnis noch unter eins
- mehr als 600 US-Dollar Inferenzkosten?Die Rechenkosten, die beim Betrieb eines KI-Modells anfallen, also bei jeder Anfrage und jeder Antwort. Nicht zu verwechseln mit den Kosten des Trainings. pro Tag beim Median-Forscher – die eine Hälfte der Belegschaft liegt darüber, die andere darunter
- mehr als 7.000 US-Dollar pro Tag bei den intensivsten Nutzern, laut einem Branchenbericht von AI Weekly Alert
Der Unterschied zählt. Ein Agent?Ein KI-System, das eine Aufgabe über mehrere Schritte selbst abarbeitet, etwa Code schreibt, ausführt und korrigiert, statt nur einen Text zu erzeugen., der acht Stunden rechnet, hat keine acht Stunden Forschung geleistet. Eine Analyse von Kim Isenberg auf LinkedIn hält fest: Bei mehr als der Hälfte der erfolgreich abgeschlossenen Aufgaben mit geschätzt vier bis acht Stunden menschlichem Aufwand mussten Menschen doch eingreifen. Der Praktikant arbeitet nachts weiter – aber er ruft zwischendurch an.
Der Blick ins Denken wird trüber
Zur Kontrolle solcher Agenten gibt es bislang vor allem ein Werkzeug: das Mitlesen der Gedankenkette („chain of thought?Die Zwischenschritte, die ein Sprachmodell notiert, bevor es antwortet. Sie lassen sich mitlesen und gelten deshalb als Ansatzpunkt für die Überwachung von Agenten.“), also jener Zwischenschritte, die ein Modell notiert, bevor es antwortet. Genau dort meldet OpenAI zwar bessere Alignment-Eigenschaften der neuen Modelle, gleichzeitig aber eine schlechtere Beobachtbarkeit dieser Zwischenschritte als beim älteren GPT-5.6 Sol. Das Verhalten wird besser, der Einblick schlechter.
OpenAI dokumentiert inzwischen selbst, wie das Unternehmen seine internen Coding-Agenten auf Fehlverhalten überwacht. Das ist mehr, als die meisten Anwenderunternehmen tun. Die Frage nach der Verantwortung beantwortet es nicht: Wer für einen Fehler haftet, den ein Agent in der dritten Nacht einer mehrtägigen Aufgabe macht, steht in keinem der Dokumente vom 6. und 7. September 2026. Eine regulatorische Änderung dazu ist nicht gemeldet.
KI-Forschungsagenten ohne geklärte Verantwortung
Für einen „echten automatisierten KI-Forscher“ – ein System, das Fragen selbst stellt und nicht nur zugewiesene Aufgaben abarbeitet – nennt OpenAI März 2028. Zwischen dem Praktikanten von heute und diesem Forscher liegen eineinhalb Jahre. In dieser Zeit wird ausgehandelt, wie viel Eigenständigkeit wie viel Aufsicht braucht. Nicht in Gesetzen, sondern in Arbeitsanweisungen und internen Freigaben.
Aufschlussreich finde ich vor allem die Wortwahl. OpenAI beschreibt seinen besten Agenten nicht als Kollegen, sondern als Praktikanten: jemand, dem man Aufgaben klar definiert, dessen Arbeit man prüft und für dessen Fehler jemand anderes geradesteht. In vielen Unternehmen verschwindet diese Rolle gerade, weil sie an Software vergeben wird. Bei OpenAI ist sie das Vorbild.
Ein Praktikant, der nie nach Hause geht, steht am Ende in keiner Personalakte. Und in keinem Haftungsvertrag.
Häufige Fragen
Was bedeutet „3,1 Agenten-Arbeitstage pro menschlichem Arbeitstag“ konkret?
Die Zahl beschreibt die Laufzeit der KI-Forschungsagenten, nicht die Menge fertiger Forschungsergebnisse. Für einen menschlichen Acht-Stunden-Tag liefen rechnerisch 3,1 Agenten-Arbeitstage. Ein Agent kann dabei Aufgaben bearbeiten, die ein erfahrener Forscher mehrere Tage kosten würden. Ob seine Ergebnisse korrekt und brauchbar sind, sagt diese Kennzahl allein nicht.
Wie teuer ist der Einsatz der KI-Forschungsagenten?
OpenAI nennt laut dem Blogpost mehr als 600 US-Dollar Inferenzkosten pro Tag beim Median-Forscher. Die Hälfte der Belegschaft liegt darüber, die andere darunter. Für besonders intensive Nutzer nennt ein Branchenbericht von AI Weekly Alert mehr als 7.000 US-Dollar pro Tag. Das sind Rechenkosten, keine Angaben zu fertigen Forschungsergebnissen.
Verdrängen solche Agenten menschliche Forschungsstellen?
Aus den genannten Zahlen folgt das noch nicht. OpenAI beschreibt ein System, das klar umrissene Aufgaben unter menschlicher Anleitung erledigt. Es übernimmt damit einzelne Arbeitsschritte, aber der Blogpost belegt weder einen Stellenabbau noch eine vollständige Automatisierung. Für Nachwuchsforscher könnte sich der Einstieg dennoch verändern, wenn einfache Aufgaben an Agenten gehen.
Warum warnt Jakub Pachocki trotz des Fortschritts vor schnellerem Ausbau?
Pachocki erklärte, kein Labor habe Alignment und Monitoring ausreichend im Griff, um mit maximaler Geschwindigkeit zu skalieren. Alignment soll sicherstellen, dass das Verhalten eines Modells zu den Absichten der Menschen passt. Monitoring muss deshalb mögliche Abweichungen erkennen. Mehr Laufzeit erhöht die Leistung, löst diese Kontrollprobleme aber nicht automatisch.
Was unterscheidet einen automatisierten Forschungspraktikanten von einem normalen Chatbot?
Der Begriff bezeichnet bei OpenAI kein allgemeines Gesprächssystem, sondern einen Agenten für klar abgegrenzte Forschungsaufgaben. Er arbeitet unter menschlicher Anleitung und kann laut Unternehmen Aufgaben über mehrere Tage bearbeiten. Der Vergleich mit einem Praktikanten beschreibt also den Arbeitsumfang und die nötige Betreuung, nicht eine selbstständige Forschungsabteilung ohne Menschen.
Kann man diese KI-Forschungsagenten bereits selbst nutzen?
Dafür gibt der veröffentlichte Blogpost keinen Hinweis. OpenAI beschreibt die Agenten als internes System der Forschungsorganisation. Ein öffentliches Produkt, einen Zugang oder einen Starttermin nennt der Text nicht. Die Zahlen belegen daher zunächst einen internen Versuch mit hoher Rechenleistung, keine verfügbare App für Unternehmen oder Privatpersonen.
Weiterlesen
Mehr aus KI Agenten →
Uber und Wayve starten Robotaxis in London. Ohne Aufpreis, aber nicht ohne Aufsicht
Uber und das britische KI-Unternehmen Wayve befördern seit dem 3. September 2026 Fahrgäste in London mit selbstfahrenden Ford Mustang Mach-E. Im Einsatz sind weniger als 20 Fahrzeuge, jede Fahrt überwacht ein lizenzierter Mensch am Steuer.

Der Agent sagt, er brauche Minuten. Er braucht Sekunden. Für die Zeitplanung mit KI-Agenten heißt das: keine Freigabe ohne externe Uhr
Programmier-Assistenten wie Claude Code und OpenAI Codex können weder vorhersagen, wie lange eine Aufgabe dauert, noch verlässlich sagen, wie lange sie schon arbeiten. Für Planung, Kontrolle und Freigaben in Unternehmen ist das ein handfestes Problem.

Gekündigte Entwickler bauen sich einen KI-Management-Agenten als Chef. Der Versuch verrät mehr über Führung als über KI
Open Executive ist ein frei verfügbarer KI-Management-Agent und bildet acht C-Level-Rollen in einem Multi-Agenten-System auf Claude-Basis ab. Das Projekt der Organisation SenteLabsAI liegt seit Ende August 2026 auf GitHub und zeigt, welche Führungsaufgaben sich in Software zerlegen lassen – und welche nicht.

Drei Tote in Saporischschja: Autonome Waffensysteme zeigen, dass Aufsicht ohne Abbruchrecht nichts wert ist
Am 6. Juli 2026 wählte eine russische Drohne in Saporischschja ihr Ziel offenbar selbst und tötete drei Zivilisten. Berichte vom 27. bis 29. August 2026 sprechen vom ersten dokumentierten Fall einer tödlichen KI-Zielauswahl ohne Menschen in der Endphase.

KI-Agenten Kommunikation: Wenn keiner mehr mitliest
Immer öfter schreiben KI-Agenten die Tickets, die andere KI-Agenten beantworten. Effizient ist das. Nachvollziehbar oft nicht mehr. Wo Automatisierung zur Blackbox wird und Menschen aneinander vorbeireden.

KI-Agenten, Amazon, Perplexity: Gericht zieht die erste Linie
Ein US-Bundesberufungsgericht hat am 4. August 2026 die vorläufige Sperre gegen Perplexitys KI-Einkaufsassistenten auf Amazon aufgehoben. Das erste Urteil dieser Instanz zu autonomen Shopping-Agenten dreht sich um eine simple Frage: Wer greift eigentlich zu, der Nutzer oder die KI?