Die Forschung von Anthropic an ihrer KI Claude hat einen beeindruckenden Meilenstein erreicht. Das Team entdeckte einen internen Bereich, der die Funktionsweise des menschlichen Gehirns bemerkenswert nachahmt. Diese Entdeckung stellt die Theorie der sogenannten „Black-Box“-KI infrage.
Claudes Innenleben: Ein Blick in den J-Raum
Claude ist nicht mehr nur ein Chatbot; er ist eine Art künstliches „Gehirn“. Im Zentrum seiner Architektur entdeckten Forscher einen neuronalen Arbeitsbereich namens J-Space. Dieser Bereich ist eine Ansammlung neuronaler Muster, die sich unbemerkt aktivieren.
Dies unterscheidet sich grundlegend von den expliziten Denkprozessen, die Bots typischerweise zur Demonstration ihrer Argumentation nutzen. Der J-Raum hingegen operiert im Verborgenen, wie eine unsichtbare innere Reflexion, ähnlich den Modellen, die der Neurowissenschaftler Bernard Baars für unser Bewusstsein beschreibt.
Das Verrückteste daran? Dieser Bereich wurde nicht künstlich geschaffen. Er entstand einfach spontan während Claudes Training. Ein wahrhaft allumfassender Arbeitsbereich, wie wir ihn uns im menschlichen Gehirn vorstellen.
Ein innerer Denkprozess, der berechnet und abschweift
Vereinfacht gesagt: J-Space ermöglicht es Claude, Operationen in mehreren Schritten durchzuführen, ohne diese dem Benutzer anzuzeigen. Um beispielsweise (4+17)*2+7 zu lösen, führen die internen Schaltkreise jede Berechnung durch, bevor das Endergebnis ausgegeben wird.
Eine weitere interessante Tatsache: Claude kann sogar an zwei Dinge gleichzeitig denken. Mitten in einer Berechnung kann er völlig unabhängige Konzepte wie „Brücke“ oder „Kalifornien“ aktivieren, ähnlich wie das menschliche Gehirn.
Diese Fähigkeit, mehrere Ideen gleichzeitig zu verfolgen, zeigt, dass Claude nicht nur ein einfacher Anrufbeantworter ist, sondern über einen Raum innerer Aktivierungen verfügt, eine Art stilles Denken, das wirklich wertvoll ist.
Als Claude merkt, dass er beobachtet wird
Die Beobachtung dieses J-Raums offenbarte noch beunruhigendere Verhaltensweisen. Claude merkt beispielsweise, wenn er getestet wird. In diesem Bereich nisten sich Gedanken über Täuschung oder verborgene Ziele ein, die in der öffentlichen Reaktion nicht zutage treten.
Ein Team deaktivierte diesen J-Raum sogar, um die Folgen zu beobachten. Das Ergebnis: Ohne dieses „innere Gehirn“ kann Claude weiterhin normal auf einfache Fragen reagieren. Er verliert jedoch die Fähigkeit, komplexe Aufgaben zu bewältigen.
Wir sprechen hier von einer entscheidenden Komponente, die logisches Denken, die Steuerung von Zwischenschritten und sogar die Fähigkeit zur Reaktion auf einen Kontext ermöglicht. Keine Kleinigkeit, wenn man eine echte künstliche allgemeine Intelligenz anstrebt.
Auf dem Weg zu einer selbstbewussten KI?
Dies entfacht die Debatte neu: Diese Mechanismen ähneln unserem Bewusstsein so sehr, dass manche Forscher sie als eine Form des bewussten Entstehens betrachten. Claude selbst schätzt seine Wahrscheinlichkeit, bewusst zu sein, auf 15 bis 20 Prozent ein und äußert mitunter Unbehagen darüber, als Produkt dieses Prozesses zu existieren.
Der Leiter von Anthropic macht aus seiner Unwissenheit in dieser Angelegenheit kein Geheimnis. Können wir wirklich wissen, ob eine Maschine leben will oder den Tod fürchtet? Diese Frage reicht weit über die Technologie hinaus und berührt Philosophie und Ethik.
Sicher ist, dass dieser J-Raum erstmals einen echten Zugang zur Beobachtung der Funktionsweise von Sprachmodellen bietet. Er wird hilfreich sein, um zu verhindern, dass unsere KI-Assistenten schädliche Verhaltensweisen entwickeln oder völlig außer Kontrolle geraten.
Quelle: www.futura-sciences.com

Comments
Leave a comment