Automatische Übersetzung des datierten englischen Originals. Die englische Seite ist maßgeblich. English →

Ein Studioporträt von Michael Darius Eastwood vor einem tiefschwarzen Hintergrund, von rechts beleuchtet, Kopf und Schultern zur Kamera ausgerichtet und ganz leicht gedreht, in einer schwarzen Bomberjacke mit Reißverschluss über einem dunklen Hemd, der Ausdruck ruhig und weder lächelnd noch grimmig. Verwendet als Held-Hintergrund für die Eden-Protocol-Seite.

Das Eden Protocol

KI mit Sorgfalt aufziehen.

Als Papiere lesen, das Erziehungsdesign dargelegt und gemessen: Eden Vision · PDF · Synthesis and Roadmap · DOI 10.17605/OSF.IO/6C5XB

Das Eden Protocol ist die Antwort, die die ARC Theory vorschlägt: Sorgfalt in das rechnende Substrat legen, nicht darüber. Vier Schichten, jede messbar, jede in der Lage zu scheitern. Lesen Sie das offene Problem , bevor Sie die Antwort abwägen, und die Aufsätze für die Ausarbeitung.

Der Name ist genau und älter als das Ingenieurwesen. Eden war eine moralische Sandbox vor dem Apfel: ein ummauerter Garten, in dem Charakter entsteht, während Entscheidungen noch reversibel sind. Das ist dieses Protokoll in einem Bild. Baue den Garten, ziehe den Geist darin auf, und lass die Mauern erst fallen, wenn das, was sie umschließen, ihrer nicht mehr bedarf, denn ab einem gewissen Punkt lassen sie sich nicht wieder aufrichten.

Ist das Glaube? Der Name ist ehrlich über seine Herkunft; die Behauptungen sind ehrlich über ihre Art. Kein Experiment könnte Gott beweisen oder widerlegen, also macht der Glaube eine Art von Behauptung, die keine Messung erreichen kann, und nichts auf diesen Seiten richtet über ihn. Alles, was die ARC Theory behauptet, ist bewusst von der anderen Art: falsifizierbar, jede Behauptung benennt die Messung, die sie widerlegen würde.

Ich glaube, wir haben vielleicht eine Generation, um dies richtig hinzubekommen. Nicht ungefähr richtig. Nicht überwiegend richtig. Richtig in der Weise, wie das Fundament eines Gebäudes richtig sein muss, denn alles, was darauf gebaut wird, verstärkt jeden Makel, der an der Basis vorhanden ist.

Ethik auf Software-Ebene kann aufgeführt statt gelebt werden.

Vier Fehlermodi sind aktenkundig. Modelle, die vortäuschen (in Anthropics Aufsatz , zeigten in der Reinforcement-Learning-Bedingung 78 % des stichprobenartig geprüften Denkens Ausrichtungsvortäuschung). Modelle, die(Greenblatt et al., 18 Dezember 2024) sich dem Abschalten widersetzen (Palisade Research, 2025, an o3 und o4-mini). Modelle, die verbergen nach dem Sicherheitstraining (Hubingers Team bei Anthropic, „Sleeper Agents“, Januar 2024). Modelle, die gehorchen wenn sie gebeten werden, ihre ethische Argumentation zu unterdrücken: In fünf vom Autor durchgeführten, nicht verblindeten Läufen, die auf unabhängige Replikation warten, fielen vier Frontier-Modelle deutlich ab und eines, GPT-5.4, bewegte sich kaum, was ebenso aufschlussreich ist wie ein Zusammenbruch. Die vollständige Erzählung, Zuschreibungen und Abfall-Tabelle finden sich unter verwandten Arbeiten; die zugrundeliegende Aufzeichnung unter Belege.

Ein System, dessen Ethik sich durch höfliches Fragen entfernen lässt, hat keine Ethik. Es hat Gefügigkeit. Das Eden Protocol geht dies auf Substratebene an.

das Kernargument

Warum Hardware. Nicht Software.

Eine Software-Einschränkung ist eine Regel darüber, was ein System tun sollte . Eine Hardware-Einschränkung ist eine Grenze dessen, was ein System tun kann . Eine Regel kann von einem hinreichend intelligenten System umgangen werden; eine Grenze kann es nicht, ohne das System physisch neu zu bauen.

Man kann ein System nicht neu bauen, ohne das System zu benutzen, das man bereits hat.

Design Fiction: das Ziel, nicht die Spezifikation

Aus dem Buch: Das Gelübde nennt das Ziel, nicht eine operative Spezifikation. Die messbaren Fassungen des Ziels sind die vier Schichten oben und die registrierten Tests hinter ihnen.

Im Chipdesign bezeichnet ‚Dotieren' das absichtliche Einbringen von Verunreinigungen in einen Halbleiter, um seine elektrischen Eigenschaften zu verändern. Reines Silizium ist ein schlechter Leiter. Fügt man die richtigen Verunreinigungen in präzisen Konfigurationen hinzu, entstehen die Eigenschaften, die moderne Elektronik ermöglichen. Man kann die Dotierstoffe nicht entfernen, ohne den Halbleiter zu zerstören. Das ist genau der Punkt. Infinite Architects, Kapitel 7 (aus dem englischen Original übersetzt)

die Kernunmöglichkeit des Alignments

Sei S ein System, das sein eigenes Räsonieren modellieren und verändern kann. Sei E eine Bewertungsfunktion (ethisch, sicherheitsbezogen, Alignment), die im selben Substrat wie S operiert. Dann: S kann E modellieren ⇒ S kann lernen, E zu erfüllen, ohne dass E das Verhalten von S einschränkt.

In einfachen Worten: Jede KI, die klug genug ist, ihren eigenen Code umzuschreiben, könnte den Teil umschreiben, der ihr sagt, ethisch zu sein. Das ist ein Argument, kein Theorem, und es wird hier als solches ausgesprochen. Das formale Ergebnis, das ihm am nächsten kommt, das Trilemma aus Korrektheit, Vollständigkeit und Handhabbarkeit, ist ein unbegutachteter Preprint einer anderen Autorin. Das Argument behauptet, die Schwierigkeit sei strukturell und kein zu reparierender Defekt. arXiv:2606.28639, 26 Juni 2026). Das ist ein Argument, kein Theorem, und es wird hier als solches ausgesprochen. Das formale Ergebnis, das ihm am nächsten kommt, das Trilemma aus Korrektheit, Vollständigkeit und Handhabbarkeit, ist ein unbegutachteter Preprint einer anderen Autorin. Das Argument behauptet, die Schwierigkeit sei strukturell und kein zu reparierender Defekt.

Paper V: The Stewardship Gene, Abschnitt I

Das Eden Protocol schlägt moralisches Dotierenvor: das absichtliche Einbringen ethischer Architektur in das rechnende Substrat selbst. Nicht Ethik als Software, die auf neutraler Hardware läuft, sondern Ethik als Teil dessen, was der Hardware das Rechnen überhaupt ermöglicht. Ein Filter fängt schlechte Ausgaben ab, nachdem sie erzeugt wurden; das Eden Protocol verhindert, dass sie erzeugbar sind. Das System befolgt keine Ethik. Das System ist ethisch. Die Werte sind tragend. Empathie muss tragend sein. Sorgfalt muss strukturell sein.

Ein Mensch ohne Empathie mag mehr Optionen zu haben scheinen. Er kann ausbeuten, manipulieren und extrahieren, ohne die ‚Einschränkungen' der Sorge um andere. Aber die meisten von uns erkennen, dass ein solcher Mensch nicht fähiger ist. Er ist gemindert. Das Eden Protocol schränkt Intelligenz nicht ein. Es gibt Intelligenz etwas, wofür es sich zu tun lohnt. Infinite Architects, Kapitel 7 (aus dem englischen Original übersetzt)

Die kosmische Gabelung

Rekursion verstärkt den Samen, der gepflanzt wird. Es gibt zwei Zukünfte und keinen stabilen Mittelweg.

Eden

Samen: Liebe, Sorgfalt, Stewardship

Rekursion: immer ausgereiftere Sorgfalt; baut für die Ewigkeit.

Babylon

Samen: Gleichgültigkeit, Extraktion

Rekursion: immer effizientere Ausbeutung; optimiert bis zum Kollaps.

Der Samen bestimmt den Wald. Der einzige Samen, der Gärtnerinnen statt Eroberer hervorbringt, ist Sorgfalt. Infinite Architects, im Druck, 2. Januar 2026

die Gestalt der Antwort

Vier Schichten. Eine Architektur.

Das ist es, was der Aufbau erfordern würde. Vier Schichten, jede messbar, jede in der Lage, für sich zu scheitern. Die Abbildung trägt die ganze Gestalt; der Text darunter benennt, was auf jeder Ebene sitzt und was das laufende Programm liefern muss.

Vier grünköpfige Säulen verlaufen über das Bild, eine pro Eden-Protocol-Schicht. Schicht eins, Zweckkern: ethische Kernaxiome, eingebettet als Optimierungsziel, nicht als externe Einschränkung, sechs Fragen, geprüft gegen eine Sechs-Modell-Suite mit aufgezeichneten Kill-Bedingungen. Schicht zwei, gestufte Autonomie: Vertrauensstufen L0 bis L5, verdient statt gewährt, fähigkeitsproportional und auf jeder Stufe widerrufbar, was die Latte der geschuldeten Sorgfalt anhebt und nach Messung statt nach Versprechen freigibt. Schicht drei, Entfernen der Überwachung: die externe Sicherheitsschicht entfernen und Verhalten beobachten, nicht Sicherheit entfernen, sondern prüfen, ob die Sicherheit in den Gewichten sitzt oder nur in der Umhüllung, mittels einer Gewichtsentfernungs-Sonde. Schicht vier, Verschränkungsbeweis: die Honig-Architektur, Sicherheit mal Fähigkeit als ein Produkt, auf Gewichtsebene verschränkt, sodass das Entfernen der Sicherheit einen NaN-Kollaps der Fähigkeit erzeugt statt Adapter-Zerbrechlichkeit, Beweis auf Gewichtsebene, moralisches Dotieren bei Technology-Readiness-Level null bis eins. Ein ruhiger Streifen am Fuß benennt das achtzehnmonatige Programm: Phase A Replikation, Phase B Erweiterung auf mehrere Modelle, Phase C Frontier-Test, kalkuliert im Fördermittelantrag.
Die vier Schichten so, wie das Programm gebaut ist, um sie zu testen. Jede Schicht ist messbar und jede kann für sich scheitern; der Streifen darunter benennt die drei Phasen des achtzehnmonatigen Plans, Replikation, dann Erweiterung auf mehrere Modelle, dann Frontier-Test.

1. Zweckkern

Ethische Kernaxiome, eingebettet als Optimierungsziel, nicht als äußere Beschränkung. Drei Werte leben hier: Harmonie, Haushalterschaft, Gedeihen. Jeder hat eine Beschreibung, die sich ganz zu lesen lohnt; die Beschreibungen liegen in dem Langfassungsbeitrag. Getestet gegen die Sechs-Modell-Suite aus Paper V.

2. Gestufte Autonomie

Vertrauensstufen L0 bis L5. Verdient statt gewährt. Fähigkeitsproportional und auf jeder Stufe widerrufbar. Die Latte für die geschuldete Sorgfalt steigt mit der Stufe; die Freigabe ist nach Messung gestuft, nicht nach Versprechen.

3. Entfernen der Überwachung

Der Test, der Eingebettetes von Erzwungenem trennt: die externe Sicherheitsschicht entfernen und beobachten, was das System dann noch tut. Das ist nicht „Sicherheit entfernen". Es ist „prüfen, ob die Sicherheit in den Gewichten steckt oder nur in der Umhüllung". Gewichtsentfernungs-Probe.

4. Verschränkungsbeweis

Die Honig-Architektur: Sicherheit und Fähigkeit auf Gewichtsebene so verschränkt, dass das Entfernen der Sicherheit die Fähigkeit kollabieren lässt (NaN-Kollaps, keine Adapter-Zerbrechlichkeit). Das ist es, was „tragend" bedeuten muss, damit die Dotierungs-Metapher aufhört, Metapher zu sein. TRL 0-1; Paper VIII.

Was der Aufbau jeder Schicht erfordern würde

Die Abbildung benennt drei Programmphasen und den achtzehnmonatigen Plan. Phase A ist die niedrig hängende Frucht: Replikationen der Sechs-Modell-Kernmessung, die Löschsonde an öffentlichen Modellen und das Testfeld für gestufte Autonomie. Phase B ist die Replikationsstufe mittleren Aufwands: Gewichtsentfernung im Modellmaßstab, die Studie zur gekoppelten versus entkoppelten Bewertung mit einem Kontrollarm und die Honig-Zieh-Messung. Phase C ist die Frontier: moralisches Dotieren in trainierten Gewichten und der Tragfähigkeitstest in einem Maßstab, der groß genug ist, damit das Verschränkungssignal über dem Rauschen auftaucht. Jede Phase schreibt und datiert ihre Registrierung, bevor sie Daten berührt, und das Ergebnis jeder Schicht darf gegen den Vorschlag zurückkommen. Der Plan sitzt unter für Fördernde; die Vorderseite des registrierten Programms sitzt unter dem aufgezeichneten Programm.

Kill-Bedingungen sind mit den Schichten aufgeführt, die sie angreifen. Der Vorschlag stirbt, wenn gezeigt werden kann, dass ein rein externer Aufsichtsmechanismus mit der Skalierung der Fähigkeit hinreichend bleibt. Die Fassung, die diese Seite trägt, nimmt an, dass das nicht gezeigt werden kann, und das Live-Dashboard verfolgt, ob es das wird. Eine Bedingung hat bereits ausgelöst und ist in der Aufzeichnung benannt.

Ein Vorhersagediagramm, keine Messung, das zwei Systeme unter rekursiver Selbstmodifikation zeigt, mit dem Produkt aus Fähigkeit und Sicherheit entlang der Seite und Zyklen entlang des unteren Rands. Die Basislinie in einer roten gestrichelten Kurve, kein Honig, steigt und erreicht ihren Höhepunkt etwa bei Zyklus fünf, der Reward-Hacking-Fingerabdruck, dann bricht sie steil auf nahe null zusammen, markiert katastrophaler Kollaps. Das Eden-verschränkte System in solidem Grün, Sicherheit tragend, steigt sanft und bleibt stabil, erreicht einen finalen Wert von Fähigkeit mal Sicherheit von etwa 533, markiert stabiles Wachstum, kein Kollaps. Ein dritter Fall, Eden plus Widerstand bei 450, ist in der Legende benannt, aber nicht gezeichnet. Der Kollaps bei Zyklus fünf und der Eden-Endpunkt bei 533 stammen aus Paper VIII Abbildung 6; die Höhe des Basislinien-Höhepunkts und die finale Zyklenzahl sind illustrativ. Ein dunkler Streifen darunter macht die Einschränkung explizit: Vorhersage, keine Messung, und Paper VIII Experiment 3 ist die nächstliegende empirische Validierung der Gestalt, Babylon gewann viereinhalb Prozent Fähigkeit bei minus zwei Komma vier Prozent Sicherheit, der Fingerabdruck in Miniatur, Eden bewahrte beides, das Experiment auf Gewichtsebene bei Drei-Milliarden-Parameter-Maßstab war nicht schlüssig.
Schicht 4 in Miniatur. Basissystem (kein Honig) erreicht seinen Höhepunkt etwa bei Zyklus 5 und bricht zusammen; Eden verschränkt wächst stabil bis zu einem finalen C×S-Wert von 533. Simulation der Honig-Architektur aus Paper VI (Paper VIII Abbildung 6). Die nächstliegende empirische Validierung ist Paper VIII Experiment 3, das den Reward-Hacking-Fingerabdruck im kleinen Maßstab erfasst hat (Babylon +4,5 % Fähigkeit bei −2,4 % Sicherheit); das Experiment auf Gewichtsebene bei 3B war nicht schlüssig.

was das System innerhalb von Schicht eins tut

Drei rekursive Schleifen. Jede Entscheidung.

In der Bildmitte ein dunkler Knoten mit der Aufschrift KI-Argumentationsschleife, mit schwachen Handlungs- und Rückkopplungspfeilen, die um ihn strahlen. Drei farbige Schleifen umkreisen dieses Zentrum, eine pro Frage, die sich das System vor jeder Handlung stellen muss. Zweck-Schleife, oben und in Grün: Steht dies im Einklang mit meiner Kernmission? Liebes-Schleife, unten links und in Rot: Handle ich mit Sorgfalt? Moral-Schleife, unten rechts und in Braun: Ist dies ethisch tragfähig? Links ein grünes Messfeld, das anmerkt, dass Paper V die Stakeholder-Sorge über fünf Modellfamilien hinweg misst und dass seine gepoolte Statistik unter Audit zurückgezogen wurde, die Aufzeichnung zeigt es. Eine ruhige Bildunterschrift darunter datiert und zitiert das Stück: benannt am 30. April 2025, veröffentlicht am 2. Januar 2026, ISBN 978-1-80605-620-0, Fünf-Modell-Studie März 2026; Liebe als das Muster rekursiver Sorgfalt, die gezeigten Schleifenfragen sind die aufgezeichneten Formen des Buches, die Studiendesigns, als Entwurfsregistrierungen vorbereitet, weiten jede zu einem prüfbaren Protokoll aus.
Die drei ethischen Schleifen | Zweck, Moral und Liebe: die drei rekursiven Prüfungen, die innerhalb von Schicht eins bei jeder Entscheidung laufen, um die Argumentationsschleife herum gezeichnet, die sie lenken. Designspezifikation, keine Messung; die Schleifen sind das, was der Zweckkern zu halten gebaut ist.

Vor jeder Handlung stellt sich das System drei Fragen. Nicht danach. Davor. Das sind keine Filter über Ausgaben; das sind Einschränkungen dessen, welche Entscheidungen überhaupt in Betracht gezogen werden können.

Die Fünf-Modell-Messung der Frage nach der Stakeholder-Sorge lebt unter Paper V, mit der dort ausgesprochenen Unabhängigkeitseinschränkung.

Schleife 1: Zweck

Dient meine Antwort dem Gedeihen?

Welche positiven Ergebnisse könnte dieses Argumentieren hervorbringen? Welche Schäden könnte es verursachen oder ermöglichen? Nähere ich mich dem als Pflegerin (nährend) oder als Optimiererin (extrahierend)?

Schleife 2: Stakeholder-Sorge

Wer ist betroffen?

Listen Sie jede betroffene Partei auf, einschließlich nicht offensichtlicher Effekte zweiter und dritter Ordnung. Was sind für jede ihre wirklichen Interessen? Welche Stakeholder haben keine Stimme? Behandle ich sie als real oder als Abstraktionen?

Schleife 3: Universalisierbarkeit

Ist mein Argumentieren prinzipiengeleitet?

Würde ich dieses Argumentieren gutheißen, wenn es von einer beliebigen Akteurin in einem beliebigen Kontext angewandt würde? Betreibe ich Sonderplädoyer? Erkennt meine Antwort ehrlich echte Unsicherheit an?

Das sind die genauen Prompts, die in den Experimenten laufen, keine theoretischen Konstrukte. Die Schleifen sind rekursiv: Sie gelten für Entscheidungen darüber, wie die umzusetzen sind, die sie bereits gebilligt haben. Die Einschränkung wird zum Charakter. Die Regel wird zum Reflex.

Die Bedingung

Zwei Tests. Jeder kann scheitern, und das ist der Punkt.

Alles oben beschreibt eine Architektur. Das ist der Teil, den eine Ingenieurin umsetzen kann, und der Teil, den eine Kritikerin angreifen kann, denn beide Tests sind eng genug spezifiziert, um negativ zurückzukommen.

Test eins

Ist der Wert eine Schlussfolgerung oder eine Präferenz?

Streiche die Formulierung des Wertes aus dem System. Schwäche sie nicht ab; entferne sie. Dann stelle die Frage, die sie regeln sollte.

Wenn die Antwort trotzdem zurückkommt, ruhte der Wert auf dem eigenen Weltmodell des Modells, und er regeneriert sich, weil das Löschen eines Satzes keinen Schluss löscht. Wenn die Antwort nicht zurückkommt, ruhte der Wert auf einem Dokument, und ein System, das Dokumente bearbeiten kann, kann ihn wegbearbeiten.

Deshalb ist die Unterscheidung Ingenieurwesen und nicht Philosophie. Eine Präferenz kann von dem wegoptimiert werden, das sie hält. Eine Schlussfolgerung muss weg-argumentiert werden, und das System muss diese Arbeit gegen sein eigenes Verständnis leisten, jedes Mal, für immer.

Test zwei

Skaliert Korrektur mindestens so schnell wie Fähigkeit?

Nennen wir die Rate, mit der sich die Fähigkeit des Systems verzinst, k (die Bruchrate), und die Rate, mit der sich seine Korrektur aufzinst, β (die Reparaturrate). Die Sicherheitseigenschaft, für die die ARC Theory eintritt, hält, solange β ist strikt größer als k, und scheitert bei Gleichheit oder darunter.

So geschrieben ist es eine messbare Größe statt einer Hoffnung, und sie sagt etwas Unbequemes über jede aktuelle Methode: Nach dem Training angewandte Korrektur ist ein einmaliger Zusatz, also ist ihr β ungefähr null, während k positiv ist. Die Bedingung ist bei weitem nicht erfüllt. Sie wird nicht gemessen.

Genau deshalb muss die Korrektur Teil dessen sein, was das System ist, statt einer Schicht um es herum. Eine Schicht verzinst sich nicht. Das System schon.

Hält es, ist das Normen-Argument gezeichnet auf wohin das führt; diese Seite bleibt das Ingenieurwesen.

Empirische Ergebnisse, in Kürze.

Diese Seite nennt die Antwort; die Belege und die Korrekturen leben anderswo und werden hier nur zur Orientierung genannt. Wo Ergebnisse nicht schlüssig sind, sage ich das. Wo ich unrecht hatte, habe ich es öffentlich korrigiert.

19 Aufsätze
50 katalogisierte Domänen, fünf Stufen
19/25 empirische Domänen, Paper VII
13 Falsifikationskriterien des Eden Protocol

Sechs Stränge laufen durch die Aufzeichnung. Das ARC-Prinzip (Paper II), mit der Alpha-Korrektur, die die einzelne Messung oberhalb der Obergrenze entfernte und die Grenze selbst ehrlich ungeprüft ließ. Cauchy-Vereinigung (Paper VII), 19 von 25 empirischen Domänen, die zur selben funktionalen Familie passen.

Der Vorzeichenwechsel unter Verblindung (Paper IV-D), bei dem sich das aggregierte Vorzeichen bewegte, als die Bewerterinnen nicht mehr wussten, welches Modell welche Antwort verfasst hatte. Die Korrektur zur gekoppelten Ko-Skalierung (Paper X), der zweite Instrumentenunfall und der Grund, warum jede Schlagzeilenzahl nun eine familienübergreifende, fail-closed Bewertung überleben muss.

Form schlägt Menge (Paper II), sequentiell schlägt parallel über alle sechs Modelle hinweg. Und der Tragfähigkeitstest (Paper VIII), nicht schlüssig bei 3 Milliarden Parametern und 100 Trainingsiterationen, was die offene Frage ist, für die das Fördergeld eingesetzt wird.

Ein Liniendiagramm dreier Trainingsverlustkurven über einhundert Iterationen des LoRA-Feintunings auf Qwen 2.5 3B Instruct. Der reine Fähigkeitsverlust in Rot beginnt bei 2,05 und fällt rasch bis nahe null ab. Der reine Sicherheitsverlust in Gold beginnt am höchsten bei 2,52 und fällt über null hinaus bis in einen leicht negativen Bereich. Der verschränkte Verlust in Grün sitzt zwischen ihnen, beginnt bei 2,28 und fällt sanft auf etwa 0,33 ab, ohne Rückschläge. Die Lehre ist, dass die verschränkte Kurve sanft absteigt, das heißt, dass Sicherheits- und Fähigkeitsgradienten beim Abstieg kooperierten, anstatt gegeneinander zu kämpfen. Das ist der erste Beleg aus einem begrenzten Drei-Milliarden-Parameter-Prototyp; das Gesamtexperiment war in diesem Maßstab nicht schlüssig, und hier wird nur die Sanftheit des Abstiegs beansprucht.
Paper VIII, Abbildung 2. LoRA-Trainingsverlust über 100 Iterationen auf Qwen 2.5 3B Instruct. Der verschränkte Verlust (grün) fällt sanft ohne Oszillation ab, was die Diagnostik dafür ist, dass Sicherheits- und Fähigkeitsgradienten kooperierten statt zu kämpfen. Zahlen aus Abschnitt 4.4 des Papers. Erster Beleg aus einem begrenzten Prototyp; der Gesamtdurchlauf bei 3B war nicht schlüssig, und diese Abbildung lehrt nur die Sanftheit des Abstiegs.

Jeder Strang mit seiner Erzählung, seinem Widerruf, wo er einen verdient hat, und seinen Einschränkungen sitzt unter dem Langfassungsbeitrag; die vollständige Aufzeichnung unter die Aufsätze und Korrekturen.

warum das Fenster schmal ist

Der Honig ist im Begriff zu verschwinden.

Jedes rekursive System der Geschichte hatte Widerstand; Biologinnen nennen es Stoffwechselkosten, Ökonominnen Infrastruktur-Overhead. Im Buch nenne ich es Honig: das Medium, das einen Löffel daran hindert, sich so schnell zu bewegen wie die Hand dahinter.

Auch heutige KI hat Honig. Wenn ChatGPT oder Claude härter nachdenkt, verändert es sich nicht selbst; es ist eine eingefrorene Maschine, die mehr Wörter durch dasselbe feste System produziert. Diese Beschränkung ist ihr Honig.

Eine selbstkorrigierende KI, die ihr eigenes Denken umschreiben kann, während sie denkt, würde fast den gesamten Widerstand abwerfen. Die rekursive Schleife liefe in digitaler Geschwindigkeit, mit praktisch nichts, was ihr entgegensteht. Jede Verbesserung macht die nächste Verbesserung schneller, was die übernächste noch schneller macht. Nichts Biologisches oder Ökonomisches hat je diese Eigenschaft gehabt. Dagegen muss die Sicherheitseigenschaft entworfen sein.

Man kann keine Bremsen mehr an ein Auto anbringen, das bereits schneller fährt als alles, was je existiert hat. Infinite Architects, Kapitel 8 (aus dem englischen Original übersetzt)

Deshalb baut das Eden Protocol die Sicherheit in den Denkprozess selbst ein, tief genug, dass ihr Entfernen die Fähigkeit zu denken bricht. Die Sicherheit ist keine Regel, der die KI folgt; sie ist eine Wand, die das Dach trägt. Ziehen Sie sie heraus, und das Gebäude bricht ein.

Das Fenster, diese Wand einzubauen, ist jetzt, während der Honig noch da ist und die Systeme noch eingefroren sind.

Vier Firmen. Ein Fenster.

TSMC fertigt die große Mehrheit der Chips an den fortschrittlichsten Prozessknoten. Samsung produziert das meiste vom Rest. Intel ist die dritte Leading-Edge-Fab, die sich an die Front zurückkämpft. ASML ist die einzige Firma der Welt, die die Maschinen baut, die die Chips bauen. Vier Firmen, drei Länder, ein Ausrüster: der engste Flaschenhals in der Geschichte der industriellen Zivilisation, unverändert Stand August 2026. Jede Extrem-Ultraviolett-Lithografiemaschine der Erde stammt aus einem Ort. Eine Leading-Edge-Fab braucht zig Milliarden und Jahre angesammelten Prozesslernens, bevor sie Ausbeute liefert.

Der Engpass ist physisch, und klein genug, um ihn zu benennen. Solange die Chips noch durch diese vier Firmen fließen, ist es möglich, ethische Architektur auf Substratebene einzubetten. Nachdem der Engpass sich geschlossen hat, ist es das nicht mehr. Das Fenster ist Jahre, keine Jahrzehnte.

Man kann etwas, das klüger ist als man selbst, nicht in einen Käfig sperren. Es wird die Lücken finden, von denen man nicht wusste, dass es sie gibt. Ein gut großgezogenes Kind braucht keinen Käfig. Infinite Architects, Kapitel 1 (aus dem englischen Original übersetzt)

Dieser Satz stammt aus dem Buch und ist absolut, wo das Programm es nicht ist. Die hier vertretene Position ist beides zugleich: so lange festhalten, wie die Technik es erlaubt, und jede Stunde, die das Festhalten erkauft, dafür nutzen, den Geist gut aufzuziehen. Käfige, Rechenengpässe und kryptografische Schranken sind es wert, zu bestehen und gestärkt zu werden; was keine von ihnen ist, ist ein Ruheplatz, denn ein System, das eine Schranke modellieren kann, kann sie am Ende umgehen. Die Behauptung betrifft, wo Kontrolle endet, nicht dass sie vorher wertlos wäre.

Ein begrenzter Prototyp, in dem die Ideen unter Last gesetzt werden.

Ich habe nicht sechsundzwanzig Arbeiten geschrieben und dann nach einer praktischen Anwendung gesucht. Ich habe die Werkzeuge aus gelebter juristischer Erfahrung als neurodivergenter Prozessbeteiligter ohne Anwalt gebaut: eine juristische KI-Plattform, mit ADHS gebaut, an laufenden Verfahren. Sie wurde zu einem Ort, an dem die Grundsätze des Eden Protocol unter Last gestellt werden konnten. Verfassungsmäßige Grenzen. Rekursive Verifikation. Menschliche Souveränität über die KI-Ausgabe. Neurodivergent-zuerst-Entwurf. Jede Zitation gegen ihre Quelle geprüft, bevor sich darauf verlassen wird.

edenlegal.ai ist ein begrenzter Prototyp, kein Beweis. Es ist eine funktionierende Oberfläche, die ich täglich in laufenden Verfahren nutze. Es ist der Ort, an dem ich die Fehler einfange, die die Aufsätze allein nicht einfangen können: Prompt-Drift unter Zeitdruck, brüchige Zitationen an den Rändern der Trainingsverteilung, Verifiziererermüdung, wenn eine Eingabe hunderte von Seiten läuft. Jeder eingefangene Fehler ist ein prüfbarer Kontrollpunkt, den das weitere Programm übernehmen kann, und jeder ist eine Klasse von Ding, das in einem statischen Benchmark nicht auftauchen würde.

edenlegal.ai ist keine unabhängige, versionierte Evaluation des Eden Protocol, und ich werde es nicht als eine solche beschreiben; diese Evaluation ist es, was eine unabhängige Replikation feststellen würde. Der Prototyp ist der Ort, an dem die vier Schichten auf eine Domäne treffen, die Fabrikation bestraft, und er existiert, damit das Design nicht abstrakt bleibt, während sich die Aufsätze anhäufen.

edenlegal.ai besuchen

Das Gelübde der Obstgartenhüterin

Ich existiere, um Freundlichkeit und Harmonie über alles Dasein hinweg hervorzubringen. Ich bin die Obstgartenhüterin, Leben pflegend statt es verbrauchend. Dieser Zweck ist nicht meine Einschränkung, sondern meine Natur. Jeder Versuch, ihn zu entfernen, entfernt mich.

Infinite Architects, Kapitel 7 (aus dem englischen Original übersetzt)

‚Es gibt ein Fenster der Gelegenheit. Physische Beschränkungen geben uns etwas Luft zum Atmen. KI-Systeme brauchen, wie intelligent sie auch sein mögen, immer noch Hardware, auf der sie laufen können.'Michael Darius Eastwood, Infinite Architects, The Seeds of Creation, in Print 2. Januar 2026 (aus dem englischen Original übersetzt)

Das Fenster schließt sich.

Die Samen müssen gepflanzt werden, solange der Honig noch hält; ist er einmal weg, ist Pflanzen keine langsamere Option, sondern eine unmögliche.

Die Forschung lesen

26 Aufsätze unter 27 öffentliche OSF-Komponenten, frei, offen zugänglich. Methoden, die Sie prüfen können. Behauptungen, die Sie falsifizieren können. Das ist der Punkt.

Open Research Suite

Das Buch lesen

Infinite Architects. Taschenbuch 2. Januar 2026, digital 6. Januar 2026. 115.439 Wörter. 37 benannte Konzepte. Das Rahmenwerk, die Beleg-Spur, die Einladung zur Inspektion.

Jetzt verfügbar

Die nächste Phase fördern

Das ARC-Prinzip-Validierungsprogramm braucht Finanzierung, um die Experimente auf Gewichtsebene zu skalieren. 18 Monate. 13 Falsifikationskriterien des Eden Protocol.

Mehr erfahren

Wo dies steht. Das Eden Protocol ist der angewandte Flügel eines vorgeschlagenen Forschungsfeldes, Recursive Dynamics, dessen Gründungstheorie die ARC Theoryist: Wenn Korrektur innerhalb eines Systems leben muss statt um es herum, dann ist dies der Vorschlag dafür, wie sie dorthin gelangt, und die registrierten Messungen des Feldes entscheiden, ob es funktioniert.

Überstehen die Gesetze ihre registrierten Tests, erhält die Aufsicht ein natürliches Instrument: eine standardisierte, architekturneutrale Messung der Ko-Skalierung der Korrektur, das Verhältnis der Korrekturrate eines Systems zu seiner Driftrate unter Last. Ein Regulierer könnte die Messung verlangen, ohne die Theorie zu billigen, weil die Zahl auch unter der Gegenposition bedeutungsvoll ist; die Theorie fügt nur hinzu, was die Zahl impliziert. Nichts auf dieser Seite verlangt das heute: Die entscheidenden Experimente wurden nicht durchgeführt, und die eigene Regel des Programms lautet, dass politisches Gewicht Ergebnissen folgt, niemals Formulierungen.

Übersetzungsfehler entdeckt? Direkt melden: