Ein Modell verbessert sich selbst, indem ein zweites seine Ausgaben bewertet – solche Prüfmodelle heißen im Englischen verifiers. Die stillschweigende Annahme: besserer Prüfer …
Modelle & Architektur · 28. Juli 2026 · Reihe #1
Sichergestellte Erkenntnisse aus der KI-Forschung

Kann ein Modell ein anderes zuverlässig bewerten? Die Arbeiten dieser Reihe prüfen diese Annahme – sie halten nicht, was der Aufbau unterstellt, und je genauer man hinsieht, desto mehr verschiebt sich die Frage vom Prüfer auf das Prüfen selbst.
Ein Modell verbessert sich selbst, indem ein zweites seine Ausgaben bewertet – solche Prüfmodelle heißen im Englischen verifiers. Die stillschweigende Annahme: besserer Prüfer …
Modelle & Architektur · 28. Juli 2026 · Reihe #1
Nachdenken kostet. Jedes Wort, das ein Modell vor seiner Antwort produziert, wird bezahlt – in Rechenzeit, in Geld, in Wartezeit des Nutzers. Also trainiert man Modelle darauf, sich …
Modelle & Architektur · 30. Juli 2026 · Reihe #2
Ein Agent, der eine Aufgabe in dreißig Schritten erledigt, soll unterwegs bewertet werden und nicht erst am Ende. Dafür baut man ein zweites Modell, das jeden Schritt benotet – …
Modelle & Architektur · 1. August 2026 · Reihe #3
Ein Deep-Research-Agent zerlegt eine Frage, sucht, liest, verdichtet Zwischenstände und schreibt am Ende einen Bericht. Zwischen der ersten Suche und dem letzten Absatz liegen viele …
Agenten & Werkzeuge · 13. August 2026 · Reihe #4