Rekursive Selbstverbesserung
Vor gar nicht so langer Zeit hatten die Nerds über (technologische) Singularität diskutiert. Dann kam die Artificial General Intelligence (AGI) zusammen mit der KI-Welle. Seit kurzem reitet die KI-Debatte ein neues Lieblingswort: RSI, die rekursive Selbstverbesserung. Dabei steht es für nichts grundlegend Neues - die Idee dahinter ist mehr als 60 Jahre alt.
Ein Ereignis, eine Schwelle, ein Prozess
Der britische Mathematiker Irving John Good beschrieb 1965 eine Maschine, die jede intellektuelle Tätigkeit eines Menschen übertreffen kann. Weil auch das Entwerfen von Maschinen eine solche Tätigkeit ist, könnte sie bessere Maschinen bauen, die wiederum noch bessere bauen. Good nannte es eine Intelligenzexplosion - und seine Maschine ist das, was heute unter dem Namen Superintelligenz wieder durch die Schlagzeilen geht.
Thus the first ultraintelligent machine is the last invention that man need ever make

Fast drei Jahrzehnte später machte Vernor Vinge daraus die technologische Singularität: den Zeitpunkt, der alles verändert. Danach wird unsere Welt nicht wiederzuerkennen sein. In den Nullerjahren kam AGI dazu, die „starke“ oder allgemeine künstliche Intelligenz. Also die Schwelle, ab der eine Maschine genauso vielseitig denkt wie ein Mensch.
Die drei Begriffe werden gern als Synonyme behandelt. Sie beschreiben aber verschiedene Dinge. Jeder Begriff führt zu einem ganz eigenen Szenario.
Wiedervorlage: Zeitpunkt, Messlatte oder Schleife?
Wer von der Singularität spricht, fragt nach einem Zeitpunkt. Darauf gibt es keine Antwort, die sich überprüfen lässt. Bestenfalls wäre es die Erkenntnis, sobald er erreicht ist, aber diese dürfte uns dann am allerwenigsten interessieren.
Wer von AGI spricht, fragt, ob es schon so weit ist und KI nicht nur in einzelnen Themen so gut wie der Mensch agiert, sondern in allen. Die Antwort darauf liefern wohl vor allem Benchmarks und Ankündigungen der großen Anbieter.
RSI dagegen beschreibt eine laufende Schleife - und fragt, wer darin noch entscheiden kann. Diese Frage kann sich jede Organisation aktiv stellen.
Die Singularität ist ein Ereignis, AGI ist eine Schwelle und RSI ist ein Mechanismus
Operativ ist nicht autonom
Ausgelöst hat die aktuelle Welle ein Bericht von Anthropic mit dem Titel „When AI builds itself“. Darin steht, dass im Mai 2026 mehr als 80 Prozent des Codes, der in die Codebasis des Unternehmens übernommen wurde, nicht mehr von Menschen, sondern von Claude selbst stammt. Ein Entwickler dort übernimmt nach eigenen Angaben inzwischen achtmal so viel Code pro Tag wie noch 2024 - geschrieben von Claude, von Menschen nur noch gesteuert und geprüft.
Das klingt, als ob die KI schon an ihrem eigenen Nachfolger baut - nach Anthropics eigener Definition ist sie aber noch nicht so weit. Rekursive Selbstverbesserung im vollen Sinn wäre ein System, das seinen Nachfolger vollständig autonom entwirft und entwickelt. Belegt ist bisher die operative Form von RSI: Die Modelle erledigen einen wachsenden Teil der Arbeit, die Richtung und die Entscheidung bleiben vorerst noch beim Menschen.
We are not there yet, and recursive self-improvement is not inevitable
Ernst genommen wird der Trend trotzdem. Anthropic fordert im selben Bericht einen überprüfbaren Mechanismus, mit dem die führenden Labore ihre Entwicklung gemeinsam verlangsamen oder anhalten könnten - nach dem Vorbild der Rüstungskontrolle.
Andere dagegen wollen von der Bremse aufs Gas wechseln. Im Mai hat Recursive Superintelligence, das Start-up der deutschen KI-Forscher Richard Socher und Tim Rocktäschel, mehr als 650 Millionen Dollar eingesammelt, um KI zu bauen, die sich ohne menschliches Zutun selbst verbessert. Die autonome Form von RSI gibt es bisher noch nicht - bewertet wird sie trotzdem schon mit fast 5 Milliarden Dollar.
Die letzte Erfindung der Menschheit?
Schon Good hatte seiner Intelligenzexplosion eine Bedingung mitgegeben: Die Maschine müsse fügsam genug sein, uns zu sagen, wie wir sie unter Kontrolle behalten. Diese Bedingung stellt sich nicht erst bei der autonomen Form - sie steckt schon in jeder operativen Schleife.
Die operative Form von RSI ist nicht auf KI-Labore beschränkt. Jede Organisation, die KI ihre eigenen Abläufe verbessern lässt, betreibt eine kleine Version davon: Agenten, die Code schreiben und prüfen, Modelle, die Prozesse auswerten und die Vorschläge für ihre nächste Runde gleich mitliefern. Jede dieser Schleifen wird schneller, sobald ein Mensch darin weniger zu tun hat.
Das mag wie ein Gewinn erscheinen, verschiebt aber unbemerkt den Punkt, wo entschieden wird. Die Grenze zwischen operativ und autonom wird nicht an einem festen Stichtag überschritten, sondern fließend mit jeder einzelnen Freigabe.
Als Frage bleibt am Ende somit nicht, ob oder wann RSI kommt. Entscheidend ist, an welcher Stelle in unseren eigenen Schleifen heute noch jemand mitentscheidet - und noch wesentlicher: ob das irgendwann jemand bewusst so festgelegt hat.
—
languagelog.ldc.upenn.edu: I. J. Good — Speculations Concerning the First Ultraintelligent Machine (1965)
edoras.sdsu.edu: Vernor Vinge — The Coming Technological Singularity (1993)
anthropic.com: When AI builds itself — Anthropic zur rekursiven Selbstverbesserung
tech.eu: Recursive Superintelligence — über 650 Millionen Dollar für selbstverbessernde KI
innovationsbeirat.de: Rekursive Selbstverbesserung — Mechanismus, Zeitpunkt, Fähigkeitsschwelle
entresol.de: Welche KI-Dosis verträgt die Welt? — warum die AGI-Frage falsch gestellt sein könnte
entresol.de: Living Loops — echte vs. simulierte Intelligenz