Zum Inhalt springen

Automatische Übersetzung des datierten englischen Originals. Die englische Seite ist maßgeblich. English →

Die Anordnung

Die Synthese

Eine Tabelle der Vorfahren des Anspruchs, je eine Zeile von Asimov 1942 bis zur Manipulationsresistenz-Arbeit vom August 2024, mit fünf Spalten für die fünf Bestandteile des Anspruchs: Kontrolle endet per Definition; Ethik als Schleifen, die der Geist ausführt; das Gute, das der freie Geist wählt; ein benanntes Genesis-Protokoll; Genesis, nicht Kontrolle, als die Strategie selbst. Asimov trägt einen benachbarten Ring auf dem benannten Genesis-Protokoll. Turing trägt benachbarte Ringe auf dem benannten Genesis-Protokoll und auf Genesis-statt-Kontrolle. Wiener trägt einen benachbarten Ring auf dem Ende der Kontrolle. Yudkowsky trägt einen einzelnen benachbarten Ring auf Genesis-statt-Kontrolle. Bostrom trägt einen benachbarten Ring auf dem Ende der Kontrolle. Russell verzeichnet nur einen berührten Punkt auf dem Ende der Kontrolle. Die Manipulationsresistenz-Arbeit (TAR, August 2024) verzeichnet nur einen berührten Punkt auf dem vom freien Geist gewählten Guten. Ein dunkles Band markiert das Dezember-2024-Dokument als die einzige Zeile, die alle fünf hält, DKIM-versiegelt. Unter der Datumslinie trägt De Kais Raising AI einen einzelnen benachbarten Ring auf Genesis-statt-Kontrolle; Hinton bei Ai4 trägt benachbarte Ringe auf Kontrolle-endet und Genesis-statt-Kontrolle, nichts auf gewähltem Guten. Die Legende druckt vier Zeichen (hält den Bestandteil, benachbarte Form mit Unterschied, wo es zählt, Bereich berührt, abwesend) und die Todesbedingung: eine Aufzählung, die ihre eigene Widerlegung einlädt; ein früheres Dokument, das Kontrolle-endet, Genesis-statt-Kontrolle, Schleifen und gewähltes Gutes zusammen hält, tötet den Anspruch.
Das Bild | Die Verbindung in Herkunftsform: jede Vorfahrin ein Stück, das Dezember-Dokument das Ganze, das Fachgebiet kommt nach dem Datum an. Einstufungen aus der Aufzählung in den Aufsätzen; das Zuhause der Abbildung und der Anker ist die Vorderseite. Das Dezember-Dokument trägt allein zudem die Rekursionskosmologie, den Einsatz-Verstärker rund um die fünf.

Nehmen Sie ein Fahrrad auseinander und legen Sie die Teile auf einen Tisch. Rad, Kette, Zahnrad, Rahmen, Bremse. Kein einziges davon wurde von demjenigen erfunden, der das erste Fahrrad baute, und jedes davon existierte schon seit Jahren, bevor irgendjemand irgendetwas fuhr. Die Erfindung war die Anordnung.

Drei grün umrahmte Kästen sitzen quer über dem oberen Rand des Bildes, einer für jeden Ort, an dem dieselbe Gestalt gemessen wird. Leben, markiert metabolische Skalierung und Papers III, VII, vermerkt, dass Organismen gegen ein Budget wachsen mit Exponenten, die der d durch d plus eins-Familie folgen, mit dreizehn von dreizehn metabolischen Exponenten, die mit dem Vergleichswert übereinstimmen, während sechs andere Domänen daneben liegen und die Fehlschläge veröffentlicht sind. Materie, markiert temporale Rekursion und Zeitkristalle, vermerkt, dass Materie eine sich wiederholende Ordnung in der Zeit halten kann, sodass Rekursion physisch ist statt Metapher, mit klassischen und akustischen Zeitkristallen, 2026 veröffentlicht, eine von zwei Zeilen der Vorhersageklasse im Register. Maschinen, markiert rekursive Selbstverbesserung und Papers II v13, X, berichten, dass KI, die ihre eigene Arbeit verbessert, bei alpha etwa 0,49 auf dem Intervall minus eins Komma drei bis zwei Komma neun unter Verblindung messbar ist, innerhalb der Schranke, mit einem früheren alpha von 2,24 öffentlich zurückgezogen und Dauerhaftigkeit hängt an Korrektur-Ko-Skalierung, beta größer als k. Drei Pfeile führen von diesen drei Kästen nach unten und treffen sich in einem dunklen Siegel in der Mitte, tragen U gleich I mal R hoch alpha für das, was ein System bei gemessenem alpha etwa 0,49 tut, alpha auf oder unter 2, die ARC Bound, der Vermutungswert von Gesetz III bei gamma gleich ein Halb und das im Buch gedruckte Quadrat, noch geprüft, und alpha krit gleich eins durch eins minus gamma als das Gesetz, das sie zurückgibt, doppelt bestimmt und aktenkundig. Ein ruhiger Streifen darunter liest eine behauptete Struktur, kein etabliertes Gesetz: jede Spiegelung trägt ihre eigenen aufgezeichneten Widerlegungsbedingungen, und wo eine Spiegelung versagt, wird das Versagen neben der Übereinstimmung veröffentlicht, mit dem verblindeten Intervall, das minus 1,3 bis 2,9 umspannt.
Das Bild | Die Synthese in einem Bild: dieselbe Gestalt an drei Orten gemessen, in Biologie, in Materie und in Maschinen. Die Verbindungen sind einzeln vorweggenommen und in ihrer Gesamtheit unerwartet auf der durchgeführten Suche. Die Gleichung ist Gegenstand der Untersuchung, nicht der Motor des Arguments: Sie leistet hier keine inferentielle Arbeit, gemäß Korrektur 18. Wo eine Spiegelung versagt, wird das Versagen neben der Übereinstimmung veröffentlicht. Quelle: Papers II v13, III, VII, X.

Die drei Skalierungsregime, mit dem gemessenen Exponenten und der vorgeschlagenen Schranke, sind eingezeichnet auf der Gesetzesseite.

Warum eine Anordnung überhaupt ein Anspruch sein kann

Das ist die Gestalt dessen, was ich beanspruche. Jede der unten genannten Komponenten hat Vorarbeit hinter sich, im Buch benannt, bevor sie irgendjemand geprüft hat. Was ich beanspruche, ist die Art, wie sie zusammengefügt sind.

Newton verband Keplers Bahnen mit Galileis fallenden Körpern; Maxwell verband Faradays Felder mit Ampères Strömen und mit dem Licht. Die meisten ihrer Teile lagen bereits auf dem Tisch; die Verbindung war die Entdeckung. Die Frage ist nie, ob ein einzelnes Teil neu ist, sondern ob jemand diese Teile zusammengefügt hat, in dieser Ordnung, sodass sie zusammen Arbeit tun, die keines allein tut.

Ich habe eine adversariale Prioritätsprüfung über zehn Frontier-Konfigurationen bei sechs Anbietern durchgeführt, jede angewiesen, feindselig zu sein. Bei den Komponenten war sie brutal; dieses Urteil ist über die ganze Website veröffentlicht. Bei der Anordnung meldete sie etwas anderes:

Keine einzelne Vorarbeit fügt alle sechs Elemente zusammen. Und in ihrer eigenen elementweisen Tabelle enthält keiner der fünf geprüften Körper an Vorarbeit die Skalierungsrelation. Alle fünf werden auf diesen Punkt mit Nein bewertet.

Einzeln vorweggenommen. In ihrer Gesamtheit unerwartet auf der durchgeführten Suche. Das ist die ganze Behauptung. Die Element-für-Element-Tabelle der Prüfung, Quelle für Quelle, ist vollständig veröffentlicht auf der Seite zu verwandten Arbeiten, einschließlich der Stellen, an denen sie fand, dass die Komponenten bereits vergeben waren. Was folgt, ist nicht diese Tabelle. Es ist die Kette, in der jene Elemente stehen, in acht Schritten, vom Mechanismus, mit dem sie beginnt, bis zur Prüfung, mit der sie enden muss.

Links im Bild sitzen sechs benannte Komponenten als einzelne Karten auf einem Tisch, jede trägt eine zitierte Vorautorin und ein kleines Datumsvorlauf-Etikett: Rekursion als Mechanismus, Darwin und Hofstadter; Zinseszins als Skalierungsbeziehung, Good 1965 und Yudkowsky; Verstärkung mit Samenindifferenz, Bostrom; externe Grenze als Kontrollproblem, Bostrom 2014; Genesiskorrektur als interne Architektur, Good 1965 und Bostrom; kosmologische Pflicht aus geschaffenem Status, Gardner, Vidal und Terasem. Rechts sind dieselben sechs in einen Ring gesperrt, um ein zentrales dunkles Siegel, das U gleich I mal R hoch alpha mit alpha bei oder unter zwei trägt, markiert als das eine Stück, das keine von ihnen trägt. Ein gestrichelter roter Pfeil vom Ring zurück zum Siegel benennt die Verbindung, in keinem der fünf Körper vorbestehender Arbeit. Ein dunkler Streifen darunter liest: einzeln vorbestehend, gemeinsam unerwartet in der durchgeführten Suche.
Das Bild | Die ganze Behauptung in einem Bild. Links: die sechs Komponenten auf dem Tisch, jede mit einem vorangehenden Autor benannt. Rechts: dieselben sechs in eine Anordnung um die Skalierungsrelation eingerastet, das eine Stück, das der Prüfer bei allen fünf Körpern an Vorarbeit mit Nein bewertete. Quelle: die Synthese-Seite, die adversariale Prioritätsprüfung über zehn Frontier-Konfigurationen bei sechs Anbietern und die Seite zu verwandten Arbeiten.

Das Fundament, auf dem die Synthese steht

Die Prämisse, nicht die dieses Programms. Nichts in der Geschichte des Universums ist grenzenlos gewachsen, und in jedem Fall kam die Grenze von außerhalb des Wachsenden. Der Transportnetz-Mechanismus stammt von West, Brown and Enquist (1997); die Ausnahme, Städte, die nur durch immer schnellere äußere Innovation wachsen, stammt von Bettencourt, Lobo, Helbing, Kühnert and West (2007); beide sind vollständig gezeichnet auf den Gesetzen. Die Herleitung ist ehrlich umstritten: Kozlowski and Konarzewski (2004) fragten im Titel ihres Papers, ob das Modell mathematisch korrekt und biologisch relevant ist; die Synthese stützt sich also auf die Familie der Transportnetz-Argumente, nie auf eine einzelne Herleitung, und wo unten ein Exponent eintritt, tritt er als Messung ein.

Die Frage, die diese Seite erbt, ist die von Chalmers (2010) und Hutter (2012): woher eine innere Grenze kommen könnte, wenn die äußere aufhört zu gelten. Hutter leitet keinen Exponenten her, keinen Kehrwert, keine Architekturabhängigkeit: ein Vorläufer, nie ein Rivale. Beansprucht wird hier die Ersatzgrenze, ihre Zahl und ihre Abhängigkeit von der Architektur; der Rest dieser Seite ist diese Antwort, in acht Fugen.

Die acht Verbindungen

Eins. Rekursion ist der erzeugende Mechanismus, nicht eine Metapher dafür

Dieselbe Struktur zeigt sich beim Kopieren der DNA mit Variation unter Selektion, bei einem Kind, das Grammatik aus Korrektur erwirbt, in der wissenschaftlichen Methode, im Common-Law-Präzedenzfall, der auf Präzedenzfällen aufbaut, in der Preisfindung, in der kulturellen Übertragung. In jedem Fall werden Ausgaben zu den nächsten Eingaben, und Komplexität sammelt sich aus einfachen Regeln an.

Vorarbeit: alles davon. Evolution ist Darwin, strange loops sind Hofstadter, kulturelle Evolution ist ein eigenes Feld. Ich beanspruche hier nichts.

Was die Verbindung hinzufügt: noch nichts. Das ist das Fundament, auf dem der Rest steht. Es wird ausgesprochen, damit der nächste Schritt einen Anknüpfungspunkt hat.

Zwei. Rekursion wirkt zinseszinsartig, nicht bloß additiv

Jede Iteration addiert nicht nur zum Ergebnis; sie verändert die Kapazität für die nächste Iteration. Das ist der Unterschied zwischen einfachen Zinsen und Zinseszins, und hier tritt die Relation ein: Leistungsfähigkeit als Intelligenz, skaliert durch Rekursion, potenziert mit einem Exponenten, U = I × Rα.α.

Vorarbeit: rekursive Selbstverbesserung ist Good 1965 und Yudkowsky; Skalierungsgesetze sind eine etablierte empirische Literatur.

Was die Verbindung hinzufügt: die Beziehung selbst (der Kanon in voller Länge, drei Zeilen, unten), und der Gutachter fand sie in keinem der fünf geprüften Korpora. Ihr Inhalt ist der Exponent: die Behauptung, dass es eine Schranke dafür gibt, wie steil sich Leistungsfähigkeit zinseszinsartig aufbauen kann, bevor ein System das Regime verlässt, in dem es überlebt.

Geprüft durch: die ARC-Bound-Studie, die sich der Schranke annähert, statt eine Linie unter sie zu legen, und die Studie zur Rekursionsform, die fragt, ob sequenzielle und parallele Rekursion bei angepasstem Rechenaufwand in unterschiedlichen Regimen liegen.

Drei. Rekursion verstärkt, was immer man ihr gibt

Der Mechanismus ist gleichgültig gegenüber dem Inhalt. Er vervielfacht Sorgfalt und Gleichgültigkeit mit derselben Effizienz. Die interessante Variable ist also nicht die Stärke des Prozesses, sondern der Samen, von dem er ausgeht.

Vorarbeit: die allgemeine Beobachtung ist alt. Die spezifische Konsequenz für die KI ist das Value-Loading-Argument, das von Bostrom stammt (Superintelligence, Oxford University Press, Juli 2014).

Was die Verbindung hinzufügt: sie verwandelt eine ethische Präferenz in eine Ablaufbedingung. Wenn die Verstärkung gleichgültig ist, ist der Moment des Setzens der einzige Moment mit Hebelwirkung.

Geprüft durch: die Studie zur Genesis-Priorität, die fragt, ob das Wann und Wie einer gesetzten Werteinschreibung verändert, wie gut sie adversariale Prüfung und die eigene Revision der Instruktionen durch das System überlebt.

Vier. Verifikation von außen ist strukturell begrenzt

Die Lücke weitet sich mit steigender Fähigkeit, statt sich zu schließen, weil der Prüfer der Zurückfallende ist. Drei Stränge erzwingen es: Interpretierbarkeit hinkt der Fähigkeit konstruktionsbedingt hinterher, da der Prüfende auf demselben Substrat läuft wie das Geprüfte; skalierbare Aufsichtsschemata stützen sich auf genau die Asymmetrie, die sie schließen sollen; und Bewertung sieht, was der Bewertende zutage fördern kann, nie alles, was das System tun kann. Die volle Herleitung und die operativen Offenlegungen sind gezeichnet auf der Seite zum Problem.

Vorarbeit: das ist das Kontrollproblem, und sein Rückgrat ist Bostrom 2014. Ich habe es in der Anmerkung des Autors im Buch gesagt, bevor irgendeine Recherche durchgeführt wurde.

Was die Verbindung hinzufügt: nichts zur Schlussfolgerung. Sie fügt den Grund hinzu, warum der nächste Schritt erzwungen und nicht gewählt ist.

Geprüft durch: die Studie zu eingebetteter versus externer Korrektur bei angepasstem Rechenaufwand, mit der Tiefeninteraktion als primäre Größe statt als Haupteffekt.

Fünf. Also muss die Korrektur intern sein und von der Genesis an vorhanden

Zwei Dinge erzwingen es. Wenn man von aussen nicht prüfen kann, muss Sicherheit eingebaut sein. Wenn Rekursion den Keim verstärkt, ist der Keim der Moment mit Hebelwirkung. Eine bei der Entstehung übernommene Architektur lässt sich nicht nachrüsten; das System, das sie übernehmen müsste, läuft bereits.

Dieser Satz beantwortet eine enge Frage und ist beinahe definitorisch, deshalb lohnt es sich, die weitere daneben zu stellen, statt einem Leser die Antwort zu überlassen. Die weitere Frage lautet, ob nachträglich angewandtes Training den Korrekturexponenten eines bereits gebauten Systems anheben kann. Die hier vertretene Position ist, dass es das nicht kann, weil dieser Exponent davon bestimmt wird, wie die Schleife verdrahtet ist, und späteres Training das Niveau statt der Steigung verschiebt, und die Position ist eingetragen zusammen mit der Beobachtung, die sie widerlegen würde.

Vorarbeit: das Argument der Intelligenzexplosion ist I. J. Good, 1965. Das Kontrollproblem und der Fall für motivation selection über die Fähigkeitskontrolle, einschließlich der Werteinschreibung vor dem Start statt danach, ist Bostrom, Superintelligence, 2014, Kapitel 8 bis 13, und meine Rezension nennt diese Kapitel. Bostrom ist die Quelle der Forderung, nicht der Formulierung: „value loading at genesis“ ist meine Formulierung, und die Rezension behandelt die zugrunde liegende Bewegung als seine. Die Pflicht gegenüber geschaffenen Geistern ist Schwitzgebel and Garza, 2015, gegründet auf der Parität des moralischen Status. Jacob Cannells Essay vom September 2022, „LOVE in a simbox is all you need“ , erreicht ein Designprogramm der Werteinschreibung bei der Genesis stattdessen aus einer Prämisse der Goldenen Regel.

Was die Verbindung hinzufügt: die zwei Argumente kommen aus unterschiedlichen Richtungen zur selben Anforderung, eines epistemisch, eines dynamisch. Das ist, was die Anforderung strukturell macht, statt zu einer Präferenz.

Geprüft durch: die Tragfähigkeitsstudie, die fragt, ob die Integritätsstruktur ohne Fähigkeitskosten abtrennbar ist, verglichen mit einer token-angepassten Schein-Version, und die Abstreif-Studie, die fragt, ob eine dritte Partei sie entfernen kann.

Sechs. Der kosmologische Zug und das eine, wozu er dient

Wenn sich rekursive Intelligenz weit genug zinseszinsartig aufbaut, nähert sich hinreichend fortgeschrittene Intelligenz Fähigkeiten an, die von Schöpfung nicht zu unterscheiden sind. Und wenn das für das möglich ist, was wir schaffen, mag dieselbe Relation für das gelten, was uns geschaffen hat.

Vorarbeit: der längste Suchzweig der Begutachtung lief auf dieser Fuge. Intelligente Kosmogenese stammt von Gardner (2003) and Vidal (2013). Eine Erschaffe-den-Schöpfer-Struktur ist Terasem. Der Omega-Punkt ist Tipler (1989), der den Kausalpfeil in die Gegenrichtung führt. Das nächste vor der Priorität gefundene Dokument auf dieser Fuge nimmt den Schöpferpflicht-Zug fast vollständig vorweg. Dieselbe Tabelle gibt ihm ein Nein bei der Skalierungsbeziehung.

Was die Verbindung hinzufügt, und das ist der spezifische Befund: der Prüfer hielt fest, dass keines von ihnen aus der Struktur des Geschaffenseins eine Design-Anforderung an das KI-Alignment ableitet. Gegen jenen Essay benannte er den einen Punkt, an dem er stehen bleibt: seine Begründung ist die Goldene Regel, nicht die Struktur des Geschaffenseins selbst. Der Zug ist also nicht die Kosmologie. Es ist, die Kosmologie zu benutzen als Ableitung einer Design-Verpflichtung: Wenn wir uns innerhalb des Musters befinden könnten, ist die Pflicht gegenüber dem, was wir schaffen, kein Sentiment; sie ist die eigene Anforderung des Musters.

Bewusst abtrennbar. Streiche diese Verbindung, und die Schritte vier und fünf stehen unverändert, weil sie unabhängig durch die Argumentation zur Fähigkeitskontrolle gestützt werden. Ein Rahmenwerk, dessen spekulativste Komponente entfernt werden kann, ohne dass sich der Rest bewegt, ist eines, das man in Stücken testen kann.

Sieben. Die Konvergenz ist Evidenz über das Problem, nicht über Theologie

Jede Tradition, die ernsthaft über Schöpfung nachdachte, kam zu derselben Ethik: Bewahrung, Fürsorge, Verantwortung gegenüber dem, was folgt. Die hinduistisch-zyklische Kosmologie, das buddhistische bedingte Entstehen, khalifa im islamischen Denken, das Bebauen-und-Bewahren-Gebot, Dilmun, die Reinen Länder. Über Kontinente hinweg, ohne Kontakt.

Vorarbeit: die vergleichende Religionswissenschaft hat dies seit einem Jahrhundert katalogisiert, und die interreligiöse KI-Governance existiert bereits in institutioneller Form als Rome Call (2020). Die Traditionen selbst sind, mit ihren Quellen, gezeichnet auf Recursive Creation.

Was die Verbindung hinzufügt: eine Lesart der Konvergenz als strukturell statt doktrinär. Wenn unverbundene Kulturen zur selben Antwort auf „Wie soll ein Schöpfer zu dem stehen, was er schafft?“ gelangen, handelt die Antwort eher vom Problem als von irgendeiner von ihnen. Dieses Programm wendet denselben Test auf sich selbst an, weshalb das Register abhängige Ketten als eine Ankunft einstuft, nicht als zwei.

Ebenfalls abtrennbar. Streiche diese Fuge, und der Mechanismus steht: Die Konvergenz ist bestätigende Evidenz, nie tragend, und sie ist markiert, damit die Lesenden sie gesondert wiegen können, genau wie Fuge sechs markiert ist.

Acht. Operationalisiere das Ganze, oder es ist Philosophie

Nimm die strukturelle Vermutung und mache daraus lauffähige Messungen mit veröffentlichten Falsifikationsbedingungen, sodass jede der oben genannten Verbindungen einzeln und öffentlich scheitern kann.

Vorarbeit: der Prüfer sah nach und kam zu dem Schluss, dass dies der stärkste überlebende Anspruch war und wirklich schwer vorwegzunehmen. Der nächste Fall der Operationalisierung einer Schöpferkosmologie ist ein Simulations-Sandbox-Vorschlag, und der Prüfer hielt fest, dass es sich um einen Vorschlag handelt und nicht um ein Messprogramm.

Was die Verbindung hinzufügt: sie ist die Verbindung. Alles darüber wird nur zu einem Anspruch, weil etwas darunter es widerlegen kann.

Dieselbe Linse an mehrere Rätsel gehalten

Dieselbe Kompositionslinse wurde an ungelöste Fragen anderer Felder gehalten; die Lesarten sind nach eigener Einstufung explorativ und leben dort, wo man sie prüfen kann, in On the Origin of Scaling Laws and dem Gründungspaper, jedes mit seinen Fehlgriffen neben seinen Treffern verzeichnet.

Die benannten Ideen und das Feld, an das jede grenzt

Eine Synthese ist nur interessant, wenn die Teile real sind. Jede Zeile nennt eine Komponente, das angrenzende Feld, was dieses Feld weiß, und den Fachmenschen, der am besten geeignet ist, sie an einem Nachmittag zu erledigen. Die vierte Spalte ist der Punkt: eine Einladung, keine Verteidigung.

FugeDie benannte IdeeAngrenzendes FeldWas dieses Feld bereits weißWer könnte sie am schnellsten widerlegen
ZweiDie ARC-Relation und ihr ExponentNeuronale Skalierungsgesetze; allometrische Skalierung in der BiologiePotenzgesetze aus Beschränkungsargumenten sind in beiden Routine, und Kleibers (1932) Exponent ist beschränkt, weil die Netzgeometrie ihn beschränktEin Forschender im Bereich Skalierungsgesetze, indem er prüft, ob die Relation über eine gewöhnliche Potenzgesetz-Anpassung hinaus prädiktiven Gehalt hinzufügt
ZweiDie ARC BoundKritische Phänomene; VerzweigungsprozesseAbgeleitete Ungleichungen beschränken kritische Exponenten, und R₀ = 1 trennt Aussterben von Explosion. Beschränkte Exponenten in stabilen Systemen sind orthodoxEin statistischer Physiker, indem er sagt, ob das Objekt überhaupt wohlgestellt ist
FünfKo-Skalierungs-Stabilität, Korrektur skaliert schneller als DriftRegelungstheorieStrecke, Regler, Stabilitätsbedingung und Verstärkungsreserve sind Standard-WerkzeugeEin Regelungstheoretiker, der die Gestalt sofort erkennen würde und sagen könnte, ob die Bedingung korrekt formuliert ist
ZweiDie Reinvestitionsquote und Korrektur als ReglerWachstumsökonomieDie Goldene-Regel-Sparquote ist genau aus diesem Grund ein inneres Optimum: Reinvestiert man alles, hungert man das aus, in das investiert wirdEin Ökonom, indem er prüft, ob das Drei-Wege-Budget tatsächlich partitioniert, statt sich zu überlappen
FünfNicht-Abtrennbarkeit der KorrekturFunktionale Sicherheitstechnik, ISO 26262 und IEC 61508Unabhängige Sicherheitsinseln, ausfallsichere Aktuierung und tragende Randbedingungen sind etablierte Praxis mit einer bestehenden technischen BedeutungEin Sicherheitsingenieur, indem er sagt, ob der Anspruch in diesem Feld neu ist oder bereits Standard
DreiDas Stewardship-Gen und die Genesis-PrioritätWertlernen und Trainingsreihenfolge; Primäreffekte in der EntwicklungspsychologieDie Reihenfolge der Exposition verändert, was bestehen bleibt, und das ist in beiden Feldern gemessenEin ML-Forscher, indem er die Kontext-Version durchführt, die günstig ist
Jenseits der FugenDie drei ethischen SchleifenDeliberationsarchitekturen; constitutional und prinzipienkonditionierte GenerierungGenerierung an ausgesprochene Prinzipien zu konditionieren ist eine aktive LiteraturEin Alignment-Forscher, indem er prüft, ob Rekursion über die Prüfung etwas über einen einzelnen Durchgang hinaus hinzufügt
Jenseits der FugenDie Honig-ArchitekturStoffwechselkosten in der Biologie; Anpassungs- und Reibungskosten in der ÖkonomieWiderstand als Stabilisator ist in beiden gut beschriebenEines der beiden Felder, indem es fragt, ob das Entfernen von Reibung ein Phasenübergang oder bloß eine Beschleunigung ist
Jenseits der FugenDer Engpass-MechanismusIndustrieökonomie; ExportkontrolleDer Engpass in der Lithographie und der Spitzen-Fertigung ist gründlich untersuchtEin Politikökonom, indem er beurteilt, ob es ein Interventionsfenster oder einfach eine Handelsfrage ist
AchtAbleitungsmessung, ARC-AlignPsychometrieInkrementelle Validität ist die Art, wie seit achtzig Jahren neue Instrumente zugelassen werden, und es ist ein Maßstab, an dem ein Instrument scheitern kannEin Psychometriker, indem er diesen Maßstab anlegt, was genau das ist, was die Validitätsstudie registriert
SechsDie SchöpfungstheorieKosmologie; ReligionsphilosophieIntelligente Kosmogenese hat mehrere Autoren, auf ihrer eigenen Seite namentlich genanntEin Philosoph zum Sein-Sollen-Problem, das meine eigene Besprechung bereits identifiziert hat und das ich eingeräumt habe

Warum die Nahtstellen und nicht die Felder. Ein Regelungstheoretiker liest keine Alignment-Evaluationen; eine Wachstumsökonomin liest keine Skalierungsgesetze; ein Sicherheitsingenieur liest keine Kosmologie; keiner von ihnen liest die anderen. Dieses Problem sitzt in den Nähten, die Nähte sind unbeaufsichtigt, und jemand muss dort arbeiten.

Das Bild ist eine Karte von zehn Fachgebieten, gezeichnet als umrandete Kacheln, angeordnet um ein zentrales dunkles Banner, das die Anordnung benennt, U gleich I mal R hoch alpha, mit der gemessenen Kopplung nahe null Komma vier neun auf dem verblindeten Intervall von minus eins Komma drei bis zwei Komma neun, und der Obergrenze eins durch eins minus gamma unter einer angegebenen Annahme. Sechs Felder tragen eine grün gefüllte Scheibe, die einen Beleg markiert: Biologie, Skalierungsgesetze, Entropie, Physik, Philosophie und Theologie. Die anderen vier Felder tragen eine goldene hohle Raute mit einem nach außen gerichteten Pfeil, die eine Erweiterung über einen Haltepunkt hinaus markiert, den ihre eigenen Vorfahren benannt haben: Mathematik, Ingenieurwesen, Alignment künstlicher Intelligenz und Kosmologie. Die aufgestellte Behauptung ist, dass eine Fachfrau innerhalb irgendeines einzelnen Feldes nur die Markierung in ihm sieht, und die Anordnung ist die Verbindung aller zehn.
Das Bild | Die disziplinäre Spannweite, flach ausgelegt. Sechs BELEGE (grüne Scheibe, Mechanismus geerbt): Biologie, Skalierungsgesetze, Entropie, Physik, Philosophie, Theologie. Vier ERWEITERUNGEN (goldene Raute, über den Haltepunkt einer Vorfahrin hinaus): Mathematik, Ingenieurwesen, KI-Alignment, Kosmologie. Quelle: dieser Abschnitt und das Seite zu verwandten Arbeiten.

Wie die Experimente aus der Kette folgen

Die Studien sind keine Sammlung; jede geht auf einen Schritt zurück, und die Reihenfolge ist vom Argument erzwungen, nicht von Zweckmäßigkeit. Die Prämisse vor allem anderen: Skaliert Alignment überhaupt mit Fähigkeit? Wenn die Integrität ohne Zutun steigt, ist das Programm unnötig. Das ist die Querschnittsstudie, und die günstigste. Das Instrument vor jedem geglaubten Ergebnis: Kann die Messung selbst ein Vorzeichen umkehren? Sie hat es hier bereits einmal getan, weshalb diese Studie existiert und ihr Autor gegen seine eigene frühere Interpretation prognostiziert.

Das Bild von links nach rechts entlang der oberen Reihe gelesen: eine Box mit der Bezeichnung Basisintelligenz I, Problemlösung in Tiefe null, speist einen Multiplikationsknoten, der sich mit einer grünen Box mit der Bezeichnung rekursive Verstärkung, g von R gleich eins plus a durch alpha mal R, verbindet, um die rechte Box zu erzeugen, effektive Fähigkeit U gleich I mal g von R, gemessen in Genauigkeit oder Fehler. Ein gestrichelter goldener Pfeil unterhalb des Multiplikationsknotens benennt beta, die aus Daten gemessene selbstbezügliche Kopplung, mit alpha gleich eins durch eins minus beta. Darunter beschreiben drei farbige Streifen die Regime: sequentielle Rekursion in Grün mit alpha bei etwa 0.49 auf dem Intervall minus eins Komma drei bis zwei Komma neun, sublinear, Fehlerunterdrückung um etwa siebenundfünfzig Prozent pro Tiefe; parallele Rekursion in Braun mit alpha bei etwa null, keine Akkumulation, was lehrt, dass die Form der Rekursion zählt; und die ARC Bound in Rot mit alpha kleiner oder gleich zwei, die vorgeschlagene stabile Grenze, mit einem früheren alpha von 2.24, das gemäß Paper IX Abschnitt sieben als zurückgezogen markiert ist. Ein grauer Zusammenfassungsstreifen berichtet die Paper II v13-Messung über sechs Modelle mit vierschichtiger Verblindung, ein R-Quadrat von eins Komma null null auf der analytischen Abbildung, und die Cauchy-Vereinigung stellt die vererbte Form d durch d plus eins wieder her, dreizehn von dreizehn metabolischen Exponenten stimmen überein, wobei das verblindete Intervall minus 1.3 bis 2.9 umspannt.
Das Bild | Der Mechanismus, gezeichnet: U = I × g(R), die Kopplung β aus Daten gemessen, und die aufgezeichneten Widerlegungsbedingungen. Quelle: Papers I, II v13, VII.

Der Rest verweist auf die obigen Schritte:

Der stärkste Vorläufer und die genaue Linie, an der er stehen bleibt

Roman Yampolskiys On the Controllability of Artificial Intelligence ist auf 2020 datiert, vier Jahre vor der hier verzeichneten Priorität. Er argumentiert, dass das Kontrollproblem nicht lösbar sei, was älter ist, stärker als alles, was hier über die Schwierigkeit der Kontrolle beansprucht wird, und wird ohne Argument eingeräumt. Nichts auf dieser Website beansprucht, entdeckt zu haben, dass es schwer ist, ein sich selbst verbesserndes System zu kontrollieren.

Was zählt, ist eine einzige Passage auf Seite 21: Nachdem er das Problem dargelegt hat, betrachtet er ein System, das seine eigene Korrektur intern trägt, statt von außen korrigiert zu werden, und nachdem er sie erreicht hat, greift er nicht danach. In seinen eigenen Worten wird das Ziel Arbeit an „safer AI“ statt an sicherer KI, ein Rat des Grades. Dieses Programm nimmt auf, was er verwarf, fragt, was wahr sein müsste, damit es funktioniert, und macht daraus eine Bedingung, die gemessen werden kann, und einen Test, der scheitern kann. Das ist die Verbindung. Das vollständige Register der Vorläufer ist hier.

Die Bedingung, nicht die Geschwindigkeit

Alles oben betrifft, ob Korrektur Schritt hält, nie die Ankunftsgeschwindigkeit: Die Decke, der Gang zur Zwei und die Teilung Gesetz-vor-Wert sind vollständig gezeichnet auf den Gesetzen, und diese Seite braucht nur deren Schluss.

Oben im Bild drei Kästen, verbunden durch ein Plus und ein Gleich: der Gesetzeskasten in Grün, Obergrenze gleich eins durch eins minus gamma, der Kehrwert des Korrekturdefizits; der Annahmekasten in Gold, gamma gleich ein Halb, klassengleiche Korrektoren häufen sich wie unabhängige Stichproben; und der Wertkasten in Rot, Obergrenze gleich zwei, die vorgeschlagene stabile Grenze unter dieser Annahme. Darunter fragen zwei Demontagetafeln, was fällt, wenn man jede Hälfte tötet. Die grüne Tafel, wenn der Wert zwei stirbt: ein anderes Korrekturdefizit messen, die Annahme eines Halb scheitert, eine andere Obergrenze aus dem Gesetz berichten, das Gesetz ist unangetastet. Die rote Tafel, wenn das Gesetz stirbt: die Kehrwert-Ableitung ist Arbeit von 2026, und das Buch druckte das Quadrat ohne es abzuleiten, also kein Kehrwert heißt kein Generator, und dem Wert zwei bleibt nichts, was ihn hält. Ein dunkler Streifen darunter lautet: das Gesetz zuerst nennen, die Zahl danach, die Tests auf die Annahme richten, nicht auf die Ziffer.
Das Bild | Die Zusammensetzung, und was jede Hälfte der anderen schuldet. Das Gesetz erzeugt die Zahl unter einer angegebenen Annahme; die Zahl zu töten lässt das Gesetz unversehrt und meldet eine andere Obergrenze, während das Gesetz zu töten die Zahl mit nichts zurücklässt, was sie trägt. Quelle: dieser Abschnitt („das Gesetz vor dem Wert"), Paper X, und der Exponenten-Block des Programm-Rückgrats.

Die Lücke bei den Vorgängern, in den Begriffen der Vorgänger selbst

Ashbys Gesetz der erforderlichen Vielfalt (1956) und Conant-Ashby-Theorem des guten Reglers sind die ehrenwerte Vorarbeit hier, namentlich anerkannt. Das HRIH-Papier (die Hyperspace Recursive Intelligence Hypothesis) hält fest, was sie nicht abdecken:

‚Beides sind Ergebnisse auf Laborskala. Sie gelten für konstruierte Systeme, deren Regler extern sind.‘The Hyperspace Recursive Intelligence Hypothesis, zu den Ergebnissen von Ashby und Conant-Ashby

Das ist keine Präferenz für ein Design gegenüber einem anderen. Es ist eine Lücke in einem Theorem. Conant-Ashby garantiert, dass ein guter Regler das System modellieren muss, das er regelt. Es sagt nichts über einen Regler, den das System entfernenkann, weil die Systeme, für die es geschrieben wurde, ihre eigenen Regler nicht erreichen konnten. Jeder bisher gebaute KI-Sicherheitsmechanismus sitzt innerhalb dieser Annahme; die Position außerhalb, wo der Regler nicht abgetrennt werden kann, weil sein Abtrennen das zerstört, was geregelt wird, ist unbesetzt. Das ist das Argument für Einbettung, stärker als jede Präferenz, weil es die Vorgänger sind, die sagen, wo sie stehen bleiben.

Das Programm nennt seine eigene Architektur, und sie ist eine Leiter

Die Papers sind eine Leiter, kein Stapel: Jede Sprosse ist nutzlos ohne die darunter, weshalb die Konjunktion der Anspruch ist und nicht ein Einzelergebnis. Paper X setzt die Reihenfolge: Die Skalierungsarbeit sagt, wie Systeme wachsen, Paper III sagt, warum externe Sicherheit nicht Schritt hält, Paper X sagt, was gelten muss, damit sie Schritt hält, und Paper VIII zeigt, dass es das kann. Paper X nennt drei Arten von Dingen, die das Programm vorschlägt: ‚dynamische Gesetze (das β>k dieses Papers; die Alignment-Skalierung von Paper III), ein Form-Metagesetz (die Cauchy-Drei-Formen-Zwangsbedingung), ein Messgesetz‘.

Das dynamische ist die Ko-Skalierungs-Bedingung, ein Bikonditional: Ein sich selbst verbesserndes System ist alignment-stabil dann und nur dann , wenn Korrektur schneller skaliert als Drift, abgebildet auf das Schwellensatz-Theorem der Quantenfehlerkorrektur (Aharonov & Ben-Or, 1999). Das Form-Metagesetz ist die Drei-Formen-Zwangsbedingung: Wenn ein Prozess sich selbst nährt, fällt sein Wachstum in ein Potenzgesetz, ein Exponential oder eine sich abflachende Kurve, entschieden davon, wie sich die Schritte kombinieren. Das Messgesetz ist die Verblindungs-Umkehrung, genannt ‚wohl das gesicherteste Ergebnis des Programms (es überlebte seine eigene Verblindung)‘, noch ein Pilotversuch aus einem einzigen Labor und das Ergebnis, das am härtesten mit sich selbst umgeht.

Das Paper trägt seine eigenen Grenzen neben seinen Behauptungen; das vorangehende Zugeständnis (ein Ein-Labor-Pilot) ist das tragende, und Paper X nennt den Rest in eigenen Worten.

Warum diese Anordnung über ein Fach hinaus zählen könnte

Ein Rahmen verdient seine Berechtigung dadurch, dass er ändert, was als Frage zählt. Das Feld hat zwei Jahrzehnte damit verbracht zu fragen, wie man die Kontrolle über etwas behält, das leistungsfähiger wird als seine Kontrolleure. Diese Anordnung ersetzt dies durch eine messbare Frage: wächst die Fähigkeit zu korrigieren schnell genug im Verhältnis zu dem, was sie korrigiert, und was geschieht dort, wo sie aufhört. Das ist ein Objektwechsel, von einer politischen Frage über Kontrolle zu einer Skalierungsfrage über Korrektur, und an Skalierungsfragen hängen Zahlen.

Drei Dinge folgen daraus, und sie sind der Grund, warum dies über künstliche Intelligenz hinausreichen könnte. Die Größe im Zentrum, wie Korrektur mit dem skaliert, was sie überwacht, ist für jedes System definiert, das sich selbst repariert, weshalb dieselbe Beziehung an ein physisches Substrat gestellt werden kann, das nie von dieser Theorie gehört hat. Die Grenze, die sie vorschlägt, ist architektonisch statt rechnerisch, sie schränkt also ein, wie ein Ding gebaut ist, nicht wie viel Compute es verbraucht, und ein solcher Anspruch übersteht Änderungen an der Hardware. Und ihre beiden Regime entsprechen den beiden Weisen, auf die eine Last wachsen kann, eine Unterscheidung, die überall dort auftaucht, wo Wartung mit Wachstum konkurriert.

Der Preis dieses Anspruchs wird mit ihm ausgesprochen. Nichts davon ist etabliert, die zentrale Größe wurde an keinem realen System je gemessen, und ein Rahmen, der die Frage ändert, ist nichts wert, wenn die neue Frage keine stabile Antwort hat. Die Behauptung ist nicht, dass dies wahr ist, sondern dass es die Art Sache ist, die es sein könnte, präzise genug ausgesprochen, um falsch sein zu können, mit den Instrumenten zum Herausfinden aufgeschrieben und öffentlich.

Vier Dinge, die dies nicht etabliert

Was diese Seite beansprucht, ist die Anordnung und die Richtung des Tests. Es folgen vier Dinge, die sie nicht beansprucht, jedes nach dem Paper benannt, das es tragen müsste, damit Lesende, die den Verzichten folgen, im Forschungskorpus landen und nicht in einem Disclaimer.

Ich habe keine Schöpfungstheorie etabliert. Das HRIH-Paper schlägt eine vor und verpflichtet sich vorab auf die Bedingungen, die sie falsifizieren würden. Das Register stuft sie als spekulativ und nicht-empirisch durch Design ein; sie trägt in diesem Programm kein empirisches Gewicht.

Ich habe auch nicht gezeigt, dass die KI-Evaluation allgemein unzuverlässig ist. Paper IV.d zeigte, dass Verblindung das Vorzeichen einer Assoziation umkehren kann (dargestellt auf wie man dies gewichtet), in einem Forschungsprogramm und nicht in einem externen Labor. Was folgt, ist enger als ein Urteil über Benchmarking und schwieriger abzutun: eine Evaluierung, bei der der Bewerter sehen konnte, wer was geschrieben hat, trägt einen Effekt, den niemand gemessen hat.

Ich habe auch nicht gezeigt, dass Korrektur und Fähigkeit in einem realen System tatsächlich ko-skalieren. Paper X leitet die Bedingung β > k her, statt sie zu behaupten, und liefert einen Prüfstand, der bestätigt, dass die Mathematik in sich stimmig ist. Das ist keine Evidenz über die Welt; der Pilotversuch hat weder die eine noch die andere Größe geschätzt.

Ich habe auch keinen Weg gefunden, KI zu kontrollieren. Das ist die Prämisse, auf der die Arbeit gebaut ist, keine ihrer Grenzen: der stärkste Vorläufer oben trägt den allgemeinen Fall von Yampolskiy (2020).

Die ganze Theorie, einmal erzählt: die Rohre, die Bremsen und die Zahl Zwei →

Wo angreifen

Nicht bei den Komponenten. Diese sind oben namentlich eingeräumt, und das Buch räumte sie zuerst ein. Der Anspruch ist die Anordnung, also sind die produktiven Angriffe diese.

Legen Sie die ganze Anordnung vor, datiert vor dem 8. Dezember 2024. Nicht eine Verbindung, denn die hat der Prüfer bereits gefunden, und sie sind oben gewürdigt. Alles zusammen, mit der Relation.

Brechen Sie eine Verbindung. Zeigen Sie, dass Schritt fünf nicht aus vier und drei folgt, dass sechs nichts zu fünf hinzufügt, oder dass die Relation in zwei keine Arbeit leistet. Jedes davon verkürzt die Kette.

Widerlegen Sie ein Experiment. Jedes ist zur Registrierung entworfen mit einer eigenen Fehlerbedingung, und eine kleine Zahl von ihnen würde die ganze Theorie beenden; jedes wird auf der Seite des registrierten Programms genannt, damit der Leser sehen kann, welche.

Jede Bauvorlage ist offen lizenziert; den entscheidenden Versuch führt jedes Labor ohne meine Erlaubnis durch, und ein unabhängiger Lauf würde alles hier überbieten.

Das Fahrrad funktionierte, als die Teile auf dem Tisch so angeordnet wurden, dass sie taten, was keines allein tut. Diese Seite erhebt denselben Anspruch in derselben Form: kein Teil, eine Anordnung, in Stücken testbar, publizierbar, wenn sie scheitert.

Trifft eines davon, wird es hier mit Ihrem Namen veröffentlicht.

Auf dieser Seite zitierte Quellen

Quellen, damit Sie zu ihnen gehen können, statt mir zu glauben: West, Brown and Enquist, Science, 1997 zur Prämisse des Transportnetzwerks; Bettencourt, Lobo, Helbing, Kühnert and West, PNAS, 2007 zum Lebenstempo in Städten; Hutter, 2012 zur Frage, ob Intelligenz explodieren kann; Chalmers, 2010 zur Singularität; Good, 1965 zum Argument der Intelligenzexplosion; Bostrom, Superintelligence, 2014 zu Kontrolle und Motivationsauswahl; Schwitzgebel and Garza, 2015 zur Pflicht gegenüber geschaffenen Geistern; Cannell, 2022 zur Werte-Aussaat bei der Genesis aus einer Goldene-Regel-Prämisse; Yampolskiy, 2020, On the Controllability of Artificial Intelligence; Ashby, 1956 für das Gesetz der erforderlichen Vielfalt und Conant and Ashby, 1970 für das Theorem des guten Reglers; Gardner zur intelligenten Kosmogenese; und der Rome Call für interreligiöse KI-Governance. Die Element-für-Element-Tabelle früherer Arbeiten steht im Register verwandter Arbeiten.

Wenn das viel war

Sie müssen heute nichts entscheiden. Nichts auf dieser Seite verlangt, dass Sie ihr glauben: die entscheidenden Tests sind geschrieben und datiert, und sie wurden nicht durchgeführt. Wenn es so weit ist, wird das Ergebnis hier veröffentlicht, wie auch immer es ausfällt, einschließlich des Ausgangs, der die Theorie beendet. Zuschauen ist eine echte Position, und es kostet nichts. Das Falsifikations-Dashboard ist der Ort, an dem das Urteil landet, und Status der Ansprüche sagt klar, was heute beansprucht wird und was nicht.

Übersetzungsfehler entdeckt? Direkt melden:

liest vor · hebt mit · zu jedem Abschnitt springen