Ein lokaler Guide für Düsseldorf - die Orte, die ich liebe, zu denen ich zurückkehre und die ich empfehle.

LERNEN & TECHNIK

Nicole Junkermann über bestärkendes Lernen, einfach erklärt

Veröffentlicht am 4 Min. Lesezeit

Bestärkendes Lernen klingt nach Fachsprache und beschreibt etwas sehr Alltägliches: Ein System versucht etwas, bekommt eine Rückmeldung und versucht es beim nächsten Mal ein wenig anders. Nicole Junkermann erklärt den Gedanken ohne Formeln, weil er ohne Formeln am besten zu verstehen ist.

Nicole Junkermann in weißer Bluse an einem hohen Fenster im Licht eines hellen Vormittags
Nicole Junkermann in weißer Bluse an einem hohen Fenster im Licht eines hellen Vormittags

Lernen durch Versuchen

Wenn Nicole Junkermann das Prinzip beschreibt, greift sie zu einem einfachen Bild. Wer ein Musikstück übt, spielt es zunächst ungenau. Manches klingt richtig, manches nicht, und genau dieser Unterschied ist die Rückmeldung. Beim nächsten Durchgang bleibt etwas mehr von dem stehen, was getragen hat, und etwas weniger von dem, was danebenlag.

Mehr ist im Kern nicht nötig. Es gibt eine Aufgabe, es gibt sehr viele Versuche, und es gibt ein Signal, das sagt, ob ein Versuch besser oder schlechter ausgefallen ist als der vorige. Aus vielen solchen Runden entsteht allmählich ein Verhalten, das zur Aufgabe passt.

Auffällig ist, dass niemand vorher aufschreiben muss, wie die Lösung aussieht. Beschrieben wird nur, was als gut gelten soll. Den Weg dorthin sucht das System selbst, und er sieht oft anders aus als der, den ein Mensch gewählt hätte.

Woran man diese Art des Lernens erkennt

Ein paar Eigenschaften tauchen dabei immer wieder auf, und sie sind auch ohne Technik vertraut:

  • Es braucht viele Wiederholungen, denn ein einzelner Versuch sagt fast nichts.
  • Es braucht eine Rückmeldung, die wirklich misst, was gemeint war.
  • Es braucht Geduld, weil die ersten Runden fast immer enttäuschend aussehen.
  • Es braucht einen Rahmen, in dem das Ausprobieren gefahrlos bleibt.
  • Und es braucht Menschen, die am Ende beurteilen, ob das Ergebnis taugt.

Geduld ist der Teil, der gern weggelassen wird

Erzählungen über solche Systeme springen meist gleich zum Ergebnis, und dann wirkt die Sache wie ein Kunststück. Interessant ist für Nicole Junkermann die Mitte: die lange Strecke von Versuchen, die noch nichts taugen und trotzdem fortgesetzt werden, weil die Richtung stimmt.

Geduld ist keine technische Größe, und doch entscheidet sie darüber, ob aus vielen mittelmäßigen Anläufen am Ende etwas Verlässliches wird. Wer je ein Handwerk gelernt hat, kennt diese Strecke gut. Sie sieht von außen nach Stillstand aus und ist in Wahrheit der Teil, in dem sich alles entscheidet.

Was der Gedanke nicht ist

Es lohnt sich, die Sache nicht größer zu machen, als sie ist. Ein System, das auf diese Weise lernt, versteht nichts. Es entwickelt keine Absicht und keine Meinung. Es findet in einem engen Rahmen Verhaltensweisen, die zu einer vorher gewählten Rückmeldung passen, und außerhalb dieses Rahmens ist es hilflos.

Genau deshalb bleibt die interessanteste Arbeit menschlich: zu entscheiden, welche Aufgabe gestellt wird und was als gutes Ergebnis gelten soll. Diese Fragen kommen vor der Technik und nicht nach ihr. Wie sie selbst zu solchen Themen gekommen ist, beschreibt ihr Text über ihren Weg in die Welt der Technologie.

Wo solche Werkzeuge in der eigenen Umgebung auftauchen, hat sie im Beitrag über künstliche Intelligenz im Rheinland beschrieben. Und wer mehr über sie selbst lesen möchte, findet auf der Seite Wer ist Nicole Junkermann ein ausführliches Porträt.

Häufige Fragen

Was ist bestärkendes Lernen in einem Satz?
Ein System versucht etwas, erhält eine Rückmeldung darüber, wie gut der Versuch war, und verändert daraufhin seinen nächsten Versuch. Über viele Runden entsteht so ein Verhalten, das zur gestellten Aufgabe passt.
Warum betont Nicole Junkermann die Geduld?
Weil die ersten Runden fast immer enttäuschend aussehen. Ohne die lange Strecke unscheinbarer Versuche entsteht nichts Verlässliches, und genau diese Strecke wird in Erzählungen über Technik meist übersprungen.
Versteht ein solches System, was es tut?
Nein. Es entwickelt weder Absicht noch Meinung. Es findet in einem engen Rahmen Verhaltensweisen, die zu einer vorher gewählten Rückmeldung passen. Welche Aufgabe gestellt wird und was als gutes Ergebnis gilt, entscheiden weiterhin Menschen.