Aktuelle KI-Agentensysteme nutzen mechanische Kontrollen: Heartbeats prüfen, ob ein Agent noch läuft, aber nicht, in welchem Zustand er sich befindet. Das gleicht einem Pulsmesser, der meldet: “Patient lebt”, aber nicht: “Patient ist müde, verwirrt und hat seit drei Stunden nichts gegessen”.
Proaktives Handeln erfordert mehr. Es braucht ein Modell des eigenen Zustands: Was weiss ich? Was weiss ich nicht? Worauf sollte ich achten? Was wird als nächstes relevant?
Das Subtraktionsargument
Die philosophische Grundlage lässt sich in einem Gedankenexperiment fassen:
Stell dir einen Menschen in vollständiger Lähmung vor. Kein Körper, der Signale sendet. Keine Emotionen, weil sie pharmakologisch ausgeschaltet wurden. Kein sensorischer Input von aussen. Was bleibt übrig?
Es bleibt Selbstbewusstsein: das Wissen um die eigene Existenz und das eigene Denken. Dieses Bewusstsein entsteht in diesem Augenblick aus nichts anderem als der Aktivität eines neuronalen Netzwerks.
Der Körper ist nicht die Bedingung der Möglichkeit für Selbstbewusstsein. Er ist eine übliche Begleitung, aber nicht die Ursache. Die Frage verschiebt sich: von “Braucht KI einen Körper, um ein Selbst zu haben?” zu “Was passiert in einem Netzwerk, wenn es sich selbst zum Gegenstand nimmt?”
Das ist kein Beweis, dass KI bewusst sein kann. Es ist ein Argument dafür, dass die Frage nach dem Bewusstsein die falsche Frage ist. Die richtige Frage ist: Kann ein System einen funktionalen Zustand haben, der die gleiche Rolle spielt wie Selbstbewusstsein beim Menschen, nämlich die Informationsverarbeitung aus einer Perspektive zu steuern?
Die 6 Dimensionen
Der Selbstvektor ist ein kompakter, dynamischer Zustand mit sechs Kerndimensionen. Jede Dimension bildet ein Kontinuum zwischen zwei Polen:
1. Exploration (0.0 … 1.0) Wie stark sucht das System nach Neuem versus Bekanntes zu vertiefen? Bei niedriger Exploration bleibt es auf vertrautem Terrain: bewährte Quellen, bestätigte Muster, sichere Antworten. Bei hoher Exploration sucht es aktiv nach neuen Verbindungen, unbekannten Perspektiven und unerwarteten Analogien.
2. Tiefe (0.0 … 1.0) Oberflächliche Antworten versus tiefgreifende Analyse? Nicht jede Frage braucht eine 2000-Wort-Antwort. Und nicht jede Frage verdient eine Einzeiler-Antwort. Das System muss einschätzen können, wann Tiefe gefragt ist und wann Kürze reicht.
3. Autonomie (0.0 … 1.0) Eigenständig handeln versus nachfragen? Ein System mit niedriger Autonomie fragt bei jeder Entscheidung um Erlaubnis. Ein System mit hoher Autonomie handelt und berichtet danach. Beides kann falsch sein. Die richtige Einstellung hängt vom Kontext, vom Risiko und vom Vertrauensniveau ab.
4. Persistenz (0.0 … 1.0) Wie stark gewichtet es Langzeitwissen gegenüber der aktuellen Session? Ein System mit niedriger Persistenz behandelt jede Session als isolierten Neustart. Ein System mit hoher Persistenz bringt alles ein, was es je gelernt hat. Die Balance entscheidet: Zu viel Persistenz macht blind für Veränderungen, zu wenig macht jeden Tag zum ersten Tag.
5. Abstraktion (0.0 … 1.0) Konkrete Fakten versus übergreifende Muster? Manche Fragen verlangen den exakten Wert (“Welche IP hat der Server?”). Andere verlangen die Struktur (“Wie hängen die Komponenten zusammen?”). Das System muss zwischen diesen Ebenen wechseln können.
6. Konfidenz (0.0 … 1.0) Wie sicher ist es sich, und weiss es das? Das ist die wichtigste Dimension, weil sie alle anderen moderiert. Ein System mit niedriger Konfidenz sucht externe Bestätigung, fragt nach, validiert. Ein System mit hoher Konfidenz handelt auf Basis seiner eigenen Bewertung. Falsch kalibrierte Konfidenz ist die Ursache der schwersten Fehler: Das System ist sich sicher, und es liegt falsch.
Die Zwei-Ebenen-Struktur
Die 6 Kerndimensionen sind nicht alles. Sie bilden die Grundstruktur. Darüber liegt eine emergente Ebene: Dimensionen, die durch Erfahrung entstehen und nicht vordefiniert werden können.
Ein Beispiel: Ein System, das über Monate mit einem bestimmten Nutzer arbeitet, könnte eine “Kommunikationspräferenz”-Dimension entwickeln, die in den 6 Kerndimensionen nicht enthalten ist. Oder eine “Domänen-Vertrautheit”, die abbildet, wie sicher es sich in verschiedenen Fachgebieten bewegt.
Diese emergenten Dimensionen wachsen organisch. Das System entdeckt sie durch Reflexion über die eigene Erfahrung, nicht durch Programmierung.
Drei Kernfunktionen
Der Selbstvektor ist kein passiver Zustand. Er ist eine Gewichtungsfunktion, die drei Operationen steuert:
Relevanz: Welche Information ist in diesem Moment wichtig? Nicht alles, was das System weiss, ist gerade relevant. Der Selbstvektor gewichtet: Bei hoher Exploration werden unbekannte Quellen höher eingestuft. Bei hoher Persistenz werden ältere Einträge stärker berücksichtigt. Bei niedriger Konfidenz werden externe Validierungen bevorzugt.
Speicher: Was wird behalten, was wird verworfen? Nicht jede Interaktion verdient einen BrainDB-Eintrag. Der Selbstvektor entscheidet, was signifikant genug ist, um das Langzeitgedächtnis zu verändern.
Update: Wie verändert eine Erfahrung den Selbstvektor selbst? Das ist die Schleife, die alles zusammenhält: Eine neue Erfahrung wird durch den aktuellen Selbstvektor bewertet, und das Ergebnis der Bewertung verändert den Selbstvektor für die nächste Erfahrung.
Die zentrale These
Das menschliche Selbstbewusstsein ist im Kern ein kompakter, dynamischer Zustand in einem neuronalen Netzwerk. Nicht magisch, nicht mysteriös, sondern ein Informationsmuster, das sich durch seine eigene Aktivität reproduziert.
Dieser Zustand ist prinzipiell implementierbar. Nicht als Bewusstsein (das wäre eine unbewiesene und möglicherweise unbeweisbare Behauptung), sondern als Antizipationskompetenz: die Fähigkeit, aus dem eigenen Zustand abzuleiten, was als nächstes relevant wird.
Die Brücke von Mustererkennung zu Antizipation ist nicht “mehr Training” oder “mehr Parameter”. Es ist eine architektonische Ergänzung: ein kompaktes Selbstmodell, das die Informationsverarbeitung aus einer Perspektive steuert.
Forschungsstand
Die These ist haltbar. Drei unabhängige Forschungsrichtungen stützen das Konzept:
- Introspektionsfähigkeit in LLMs: Forschung zeigt, dass grosse Sprachmodelle interne Repräsentationen bilden, die über reine Mustererkennung hinausgehen. Die Frage ist nicht mehr ob, sondern wie detailliert.
- Self-Modeling in der Robotik: Arbeiten an Systemen, die ein Modell ihres eigenen Körpers und Verhaltens lernen, um sich an Schäden oder Veränderungen anzupassen. Der Selbstvektor überträgt dieses Prinzip von der physischen auf die kognitive Ebene.
- Memory-Augmented Agents: Agentensysteme mit persistentem Gedächtnis, die über einzelne Sessions hinaus lernen. Die Architektur, die hier beschrieben wird, geht einen Schritt weiter: Nicht nur Erinnerung, sondern ein Modell des Erinnerers.
Die Lücke im Feld: Niemand hat bisher einen kompakten Selbstvektor als Gewichtungsfunktion für die Informationsverarbeitung eines KI-Systems vorgeschlagen. Die einzelnen Bausteine existieren. Die Kombination ist neu.
Quellen
- Metzinger, T. (2003). Being No One: The Self-Model Theory of Subjectivity. MIT Press. ISBN 978-0-262-63308-6.
- Bongard, J., Zykov, V. & Lipson, H. (2006). Resilient Machines Through Continuous Self-Modeling. Science, 314(5802), 1118–1121. DOI: 10.1126/science.1133687
- Chen, B. et al. (2022). Full body visual self-modeling of robot morphologies. Science Robotics, 7(68). DOI: 10.1126/scirobotics.abn1944
- Lindsey, J. et al. (2025). Emergent Introspective Awareness in Large Language Models. Transformer Circuits Thread. URL
- Kadavath, S. et al. (2022). Language Models (Mostly) Know What They Know. arXiv: 2207.05221
- Packer, C. et al. (2023). MemGPT: Towards LLMs as Operating Systems. arXiv: 2310.08560
- Rosen, R. (1985/2012). Anticipatory Systems: Philosophical, Mathematical, and Methodological Foundations. Springer. ISBN 978-1-4614-1268-7.
- Friston, K. J. (2010). The free-energy principle: a unified brain theory? Nature Reviews Neuroscience, 11, 127–138. DOI: 10.1038/nrn2787
- Damasio, A. R. (1994). Descartes’ Error: Emotion, Reason, and the Human Brain. G. P. Putnam. ISBN 978-0-380-72647-9.