Wer heute einen Roboterarm aus menschlichen Vorführungen lernen lässt, lässt ihn selten Schritt für Schritt handeln. Die Steuerung sagt aus einer einzigen Beobachtung gleich eine ganze …
Modelle & Architektur · 8. August 2026
Sichergestellte Erkenntnisse aus der KI-Forschung
Wer heute einen Roboterarm aus menschlichen Vorführungen lernen lässt, lässt ihn selten Schritt für Schritt handeln. Die Steuerung sagt aus einer einzigen Beobachtung gleich eine ganze …
Modelle & Architektur · 8. August 2026
Die Frage, wie stark eine On-Policy-Destillation die Gewichte eines Modells umschreibt, hat im Sommer 2026 zwei Gruppen gleichzeitig beschäftigt. Diese hier sitzt in Nanjing und bei …
Modelle & Architektur · 6. August 2026 · Reihe #2
Ein fertig vortrainiertes Sprachmodell wird auf drei Arten nachgeschärft. Beim überwachten Nachtrainieren lernt es aus fremden Musterlösungen. Beim Verstärkungslernen erzeugt es eigene …
Modelle & Architektur · 6. August 2026 · Reihe #1
Es gibt einen Streit darüber, was Verstärkungslernen mit einem Sprachmodell eigentlich anstellt. Die eine Seite sagt: Es schärft nur, was das Modell ohnehin schon bevorzugt hat. Die …
Modelle & Architektur · 3. August 2026
Zwei Verbesserungen, jede für sich unstrittig. Man kann einen Agenten mit bestärkendem Lernen auf seine Aufgabe trainieren. Und man kann ihm ein Gedächtnis anbauen, das Erfahrungen …
Agenten & Werkzeuge · 2. August 2026
Ein Agent, der eine Aufgabe in dreißig Schritten erledigt, soll unterwegs bewertet werden und nicht erst am Ende. Dafür baut man ein zweites Modell, das jeden Schritt benotet – …
Modelle & Architektur · 1. August 2026 · Reihe #3
Der übliche Einwand gegen Deep Learning als Hirnmodell lautet: Ein Neuron, das viele Synapsen von der Muskulatur entfernt sitzt, kann unmöglich erfahren, welchen Anteil es am Fehler …
NeuroAI · 31. Juli 2026
Die Gründungsannahme der Weltmodelle ist bequem: Wer gezwungen wird, die Zukunft vorherzusagen, muss sich die Physik seiner Umgebung aneignen. Alles Weitere ist dann eine Frage der …
Wahrnehmung & Weltmodelle · 31. Juli 2026
Nachdenken kostet. Jedes Wort, das ein Modell vor seiner Antwort produziert, wird bezahlt – in Rechenzeit, in Geld, in Wartezeit des Nutzers. Also trainiert man Modelle darauf, sich …
Modelle & Architektur · 30. Juli 2026 · Reihe #2
Ein Modell verbessert sich selbst, indem ein zweites seine Ausgaben bewertet – solche Prüfmodelle heißen im Englischen verifiers. Die stillschweigende Annahme: besserer Prüfer …
Modelle & Architektur · 28. Juli 2026 · Reihe #1