Ein Sprachmodell zeigt seine Antwort, nicht den Weg dorthin. Teil eins dieser Reihe handelte davon, dass sich eine Selbstauskunft nur prüfen lässt, wenn man die Antwort vorher kennt …
Modelle & Architektur · 11. August 2026 · Reihe #2
Sichergestellte Erkenntnisse aus der KI-Forschung
Ein Sprachmodell zeigt seine Antwort, nicht den Weg dorthin. Teil eins dieser Reihe handelte davon, dass sich eine Selbstauskunft nur prüfen lässt, wenn man die Antwort vorher kennt …
Modelle & Architektur · 11. August 2026 · Reihe #2
Sprachmodelle äußern sich über ihr Inneres. Sie sagen, sie hätten etwas übersehen, sie seien unsicher, sie hätten das eigentlich anders gemeint. Ob davon irgendetwas stimmt, ist im …
Modelle & Architektur · 11. August 2026 · Reihe #1
Wer heute einen Roboterarm aus menschlichen Vorführungen lernen lässt, lässt ihn selten Schritt für Schritt handeln. Die Steuerung sagt aus einer einzigen Beobachtung gleich eine ganze …
Modelle & Architektur · 8. August 2026
Die Frage, wie stark eine On-Policy-Destillation die Gewichte eines Modells umschreibt, hat im Sommer 2026 zwei Gruppen gleichzeitig beschäftigt. Diese hier sitzt in Nanjing und bei …
Modelle & Architektur · 6. August 2026 · Reihe #2
Ein fertig vortrainiertes Sprachmodell wird auf drei Arten nachgeschärft. Beim überwachten Nachtrainieren lernt es aus fremden Musterlösungen. Beim Verstärkungslernen erzeugt es eigene …
Modelle & Architektur · 6. August 2026 · Reihe #1
Es gibt einen Streit darüber, was Verstärkungslernen mit einem Sprachmodell eigentlich anstellt. Die eine Seite sagt: Es schärft nur, was das Modell ohnehin schon bevorzugt hat. Die …
Modelle & Architektur · 3. August 2026
Die Aufgabe ist so klein, dass man zögert, sie eine Aufgabe zu nennen: Gegeben sind n Bits und eine Nummer. Ausgegeben werden soll das Bit an dieser Stelle. Nachschlagen, mehr nicht.
Modelle & Architektur · 2. August 2026
Ein Agent, der eine Aufgabe in dreißig Schritten erledigt, soll unterwegs bewertet werden und nicht erst am Ende. Dafür baut man ein zweites Modell, das jeden Schritt benotet – …
Modelle & Architektur · 1. August 2026 · Reihe #3
Nachdenken kostet. Jedes Wort, das ein Modell vor seiner Antwort produziert, wird bezahlt – in Rechenzeit, in Geld, in Wartezeit des Nutzers. Also trainiert man Modelle darauf, sich …
Modelle & Architektur · 30. Juli 2026 · Reihe #2
Die Autoren stellen ihre Frage selbst, und sie ist unangenehm: Wenn ein Modell Medaillen-Niveau in Olympiade-Mathematik erreicht, warum sollte man ihm dann nicht zutrauen, eine …
Modelle & Architektur · 29. Juli 2026
Ein Modell verbessert sich selbst, indem ein zweites seine Ausgaben bewertet – solche Prüfmodelle heißen im Englischen verifiers. Die stillschweigende Annahme: besserer Prüfer …
Modelle & Architektur · 28. Juli 2026 · Reihe #1