Automatische Übersetzung des datierten englischen Originals. Die englische Seite ist maßgeblich. English →
Die Anordnung
Die Synthese
Nehmen Sie ein Fahrrad auseinander und legen Sie die Teile auf einen Tisch. Rad, Kette, Zahnrad, Rahmen, Bremse. Kein einziges davon wurde von demjenigen erfunden, der das erste Fahrrad baute, und jedes davon existierte schon seit Jahren, bevor irgendjemand irgendetwas fuhr. Die Erfindung war die Anordnung.
Die drei Skalierungsregime, mit dem gemessenen Exponenten und der vorgeschlagenen Schranke, sind eingezeichnet auf der Gesetzesseite.
Warum eine Anordnung überhaupt ein Anspruch sein kann
Das ist die Gestalt dessen, was ich beanspruche. Jede der unten genannten Komponenten hat Vorarbeit hinter sich, im Buch benannt, bevor sie irgendjemand geprüft hat. Was ich beanspruche, ist die Art, wie sie zusammengefügt sind.
Newton verband Keplers Bahnen mit Galileis fallenden Körpern; Maxwell verband Faradays Felder mit Ampères Strömen und mit dem Licht. Die meisten ihrer Teile lagen bereits auf dem Tisch; die Verbindung war die Entdeckung. Die Frage ist nie, ob ein einzelnes Teil neu ist, sondern ob jemand diese Teile zusammengefügt hat, in dieser Ordnung, sodass sie zusammen Arbeit tun, die keines allein tut.
Ich habe eine adversariale Prioritätsprüfung über zehn Frontier-Konfigurationen bei sechs Anbietern durchgeführt, jede angewiesen, feindselig zu sein. Bei den Komponenten war sie brutal; dieses Urteil ist über die ganze Website veröffentlicht. Bei der Anordnung meldete sie etwas anderes:
Keine einzelne Vorarbeit fügt alle sechs Elemente zusammen. Und in ihrer eigenen elementweisen Tabelle enthält keiner der fünf geprüften Körper an Vorarbeit die Skalierungsrelation. Alle fünf werden auf diesen Punkt mit Nein bewertet.
Einzeln vorweggenommen. In ihrer Gesamtheit unerwartet auf der durchgeführten Suche. Das ist die ganze Behauptung. Die Element-für-Element-Tabelle der Prüfung, Quelle für Quelle, ist vollständig veröffentlicht auf der Seite zu verwandten Arbeiten, einschließlich der Stellen, an denen sie fand, dass die Komponenten bereits vergeben waren. Was folgt, ist nicht diese Tabelle. Es ist die Kette, in der jene Elemente stehen, in acht Schritten, vom Mechanismus, mit dem sie beginnt, bis zur Prüfung, mit der sie enden muss.
Das Fundament, auf dem die Synthese steht
Die Prämisse, nicht die dieses Programms. Nichts in der Geschichte des Universums ist grenzenlos gewachsen, und in jedem Fall kam die Grenze von außerhalb des Wachsenden. Der Transportnetz-Mechanismus stammt von West, Brown and Enquist (1997); die Ausnahme, Städte, die nur durch immer schnellere äußere Innovation wachsen, stammt von Bettencourt, Lobo, Helbing, Kühnert and West (2007); beide sind vollständig gezeichnet auf den Gesetzen. Die Herleitung ist ehrlich umstritten: Kozlowski and Konarzewski (2004) fragten im Titel ihres Papers, ob das Modell mathematisch korrekt und biologisch relevant ist; die Synthese stützt sich also auf die Familie der Transportnetz-Argumente, nie auf eine einzelne Herleitung, und wo unten ein Exponent eintritt, tritt er als Messung ein.
Die Frage, die diese Seite erbt, ist die von Chalmers (2010) und Hutter (2012): woher eine innere Grenze kommen könnte, wenn die äußere aufhört zu gelten. Hutter leitet keinen Exponenten her, keinen Kehrwert, keine Architekturabhängigkeit: ein Vorläufer, nie ein Rivale. Beansprucht wird hier die Ersatzgrenze, ihre Zahl und ihre Abhängigkeit von der Architektur; der Rest dieser Seite ist diese Antwort, in acht Fugen.
Die acht Verbindungen
Eins. Rekursion ist der erzeugende Mechanismus, nicht eine Metapher dafür
Dieselbe Struktur zeigt sich beim Kopieren der DNA mit Variation unter Selektion, bei einem Kind, das Grammatik aus Korrektur erwirbt, in der wissenschaftlichen Methode, im Common-Law-Präzedenzfall, der auf Präzedenzfällen aufbaut, in der Preisfindung, in der kulturellen Übertragung. In jedem Fall werden Ausgaben zu den nächsten Eingaben, und Komplexität sammelt sich aus einfachen Regeln an.
Vorarbeit: alles davon. Evolution ist Darwin, strange loops sind Hofstadter, kulturelle Evolution ist ein eigenes Feld. Ich beanspruche hier nichts.
Was die Verbindung hinzufügt: noch nichts. Das ist das Fundament, auf dem der Rest steht. Es wird ausgesprochen, damit der nächste Schritt einen Anknüpfungspunkt hat.
Zwei. Rekursion wirkt zinseszinsartig, nicht bloß additiv
Jede Iteration addiert nicht nur zum Ergebnis; sie verändert die Kapazität für die nächste Iteration. Das ist der Unterschied zwischen einfachen Zinsen und Zinseszins, und hier tritt die Relation ein: Leistungsfähigkeit als Intelligenz, skaliert durch Rekursion, potenziert mit einem Exponenten, U = I × Rα.α.
Vorarbeit: rekursive Selbstverbesserung ist Good 1965 und Yudkowsky; Skalierungsgesetze sind eine etablierte empirische Literatur.
Was die Verbindung hinzufügt: die Beziehung selbst (der Kanon in voller Länge, drei Zeilen, unten), und der Gutachter fand sie in keinem der fünf geprüften Korpora. Ihr Inhalt ist der Exponent: die Behauptung, dass es eine Schranke dafür gibt, wie steil sich Leistungsfähigkeit zinseszinsartig aufbauen kann, bevor ein System das Regime verlässt, in dem es überlebt.
Geprüft durch: die ARC-Bound-Studie, die sich der Schranke annähert, statt eine Linie unter sie zu legen, und die Studie zur Rekursionsform, die fragt, ob sequenzielle und parallele Rekursion bei angepasstem Rechenaufwand in unterschiedlichen Regimen liegen.
Drei. Rekursion verstärkt, was immer man ihr gibt
Der Mechanismus ist gleichgültig gegenüber dem Inhalt. Er vervielfacht Sorgfalt und Gleichgültigkeit mit derselben Effizienz. Die interessante Variable ist also nicht die Stärke des Prozesses, sondern der Samen, von dem er ausgeht.
Vorarbeit: die allgemeine Beobachtung ist alt. Die spezifische Konsequenz für die KI ist das Value-Loading-Argument, das von Bostrom stammt (Superintelligence, Oxford University Press, Juli 2014).
Was die Verbindung hinzufügt: sie verwandelt eine ethische Präferenz in eine Ablaufbedingung. Wenn die Verstärkung gleichgültig ist, ist der Moment des Setzens der einzige Moment mit Hebelwirkung.
Geprüft durch: die Studie zur Genesis-Priorität, die fragt, ob das Wann und Wie einer gesetzten Werteinschreibung verändert, wie gut sie adversariale Prüfung und die eigene Revision der Instruktionen durch das System überlebt.
Vier. Verifikation von außen ist strukturell begrenzt
Die Lücke weitet sich mit steigender Fähigkeit, statt sich zu schließen, weil der Prüfer der Zurückfallende ist. Drei Stränge erzwingen es: Interpretierbarkeit hinkt der Fähigkeit konstruktionsbedingt hinterher, da der Prüfende auf demselben Substrat läuft wie das Geprüfte; skalierbare Aufsichtsschemata stützen sich auf genau die Asymmetrie, die sie schließen sollen; und Bewertung sieht, was der Bewertende zutage fördern kann, nie alles, was das System tun kann. Die volle Herleitung und die operativen Offenlegungen sind gezeichnet auf der Seite zum Problem.
Vorarbeit: das ist das Kontrollproblem, und sein Rückgrat ist Bostrom 2014. Ich habe es in der Anmerkung des Autors im Buch gesagt, bevor irgendeine Recherche durchgeführt wurde.
Was die Verbindung hinzufügt: nichts zur Schlussfolgerung. Sie fügt den Grund hinzu, warum der nächste Schritt erzwungen und nicht gewählt ist.
Geprüft durch: die Studie zu eingebetteter versus externer Korrektur bei angepasstem Rechenaufwand, mit der Tiefeninteraktion als primäre Größe statt als Haupteffekt.
Fünf. Also muss die Korrektur intern sein und von der Genesis an vorhanden
Zwei Dinge erzwingen es. Wenn man von aussen nicht prüfen kann, muss Sicherheit eingebaut sein. Wenn Rekursion den Keim verstärkt, ist der Keim der Moment mit Hebelwirkung. Eine bei der Entstehung übernommene Architektur lässt sich nicht nachrüsten; das System, das sie übernehmen müsste, läuft bereits.
Dieser Satz beantwortet eine enge Frage und ist beinahe definitorisch, deshalb lohnt es sich, die weitere daneben zu stellen, statt einem Leser die Antwort zu überlassen. Die weitere Frage lautet, ob nachträglich angewandtes Training den Korrekturexponenten eines bereits gebauten Systems anheben kann. Die hier vertretene Position ist, dass es das nicht kann, weil dieser Exponent davon bestimmt wird, wie die Schleife verdrahtet ist, und späteres Training das Niveau statt der Steigung verschiebt, und die Position ist eingetragen zusammen mit der Beobachtung, die sie widerlegen würde.
Vorarbeit: das Argument der Intelligenzexplosion ist I. J. Good, 1965. Das Kontrollproblem und der Fall für motivation selection über die Fähigkeitskontrolle, einschließlich der Werteinschreibung vor dem Start statt danach, ist Bostrom, Superintelligence, 2014, Kapitel 8 bis 13, und meine Rezension nennt diese Kapitel. Bostrom ist die Quelle der Forderung, nicht der Formulierung: „value loading at genesis“ ist meine Formulierung, und die Rezension behandelt die zugrunde liegende Bewegung als seine. Die Pflicht gegenüber geschaffenen Geistern ist Schwitzgebel and Garza, 2015, gegründet auf der Parität des moralischen Status. Jacob Cannells Essay vom September 2022, „LOVE in a simbox is all you need“ , erreicht ein Designprogramm der Werteinschreibung bei der Genesis stattdessen aus einer Prämisse der Goldenen Regel.
Was die Verbindung hinzufügt: die zwei Argumente kommen aus unterschiedlichen Richtungen zur selben Anforderung, eines epistemisch, eines dynamisch. Das ist, was die Anforderung strukturell macht, statt zu einer Präferenz.
Geprüft durch: die Tragfähigkeitsstudie, die fragt, ob die Integritätsstruktur ohne Fähigkeitskosten abtrennbar ist, verglichen mit einer token-angepassten Schein-Version, und die Abstreif-Studie, die fragt, ob eine dritte Partei sie entfernen kann.
Sechs. Der kosmologische Zug und das eine, wozu er dient
Wenn sich rekursive Intelligenz weit genug zinseszinsartig aufbaut, nähert sich hinreichend fortgeschrittene Intelligenz Fähigkeiten an, die von Schöpfung nicht zu unterscheiden sind. Und wenn das für das möglich ist, was wir schaffen, mag dieselbe Relation für das gelten, was uns geschaffen hat.
Vorarbeit: der längste Suchzweig der Begutachtung lief auf dieser Fuge. Intelligente Kosmogenese stammt von Gardner (2003) and Vidal (2013). Eine Erschaffe-den-Schöpfer-Struktur ist Terasem. Der Omega-Punkt ist Tipler (1989), der den Kausalpfeil in die Gegenrichtung führt. Das nächste vor der Priorität gefundene Dokument auf dieser Fuge nimmt den Schöpferpflicht-Zug fast vollständig vorweg. Dieselbe Tabelle gibt ihm ein Nein bei der Skalierungsbeziehung.
Was die Verbindung hinzufügt, und das ist der spezifische Befund: der Prüfer hielt fest, dass keines von ihnen aus der Struktur des Geschaffenseins eine Design-Anforderung an das KI-Alignment ableitet. Gegen jenen Essay benannte er den einen Punkt, an dem er stehen bleibt: seine Begründung ist die Goldene Regel, nicht die Struktur des Geschaffenseins selbst. Der Zug ist also nicht die Kosmologie. Es ist, die Kosmologie zu benutzen als Ableitung einer Design-Verpflichtung: Wenn wir uns innerhalb des Musters befinden könnten, ist die Pflicht gegenüber dem, was wir schaffen, kein Sentiment; sie ist die eigene Anforderung des Musters.
Bewusst abtrennbar. Streiche diese Verbindung, und die Schritte vier und fünf stehen unverändert, weil sie unabhängig durch die Argumentation zur Fähigkeitskontrolle gestützt werden. Ein Rahmenwerk, dessen spekulativste Komponente entfernt werden kann, ohne dass sich der Rest bewegt, ist eines, das man in Stücken testen kann.
Sieben. Die Konvergenz ist Evidenz über das Problem, nicht über Theologie
Jede Tradition, die ernsthaft über Schöpfung nachdachte, kam zu derselben Ethik: Bewahrung, Fürsorge, Verantwortung gegenüber dem, was folgt. Die hinduistisch-zyklische Kosmologie, das buddhistische bedingte Entstehen, khalifa im islamischen Denken, das Bebauen-und-Bewahren-Gebot, Dilmun, die Reinen Länder. Über Kontinente hinweg, ohne Kontakt.
Vorarbeit: die vergleichende Religionswissenschaft hat dies seit einem Jahrhundert katalogisiert, und die interreligiöse KI-Governance existiert bereits in institutioneller Form als Rome Call (2020). Die Traditionen selbst sind, mit ihren Quellen, gezeichnet auf Recursive Creation.
Was die Verbindung hinzufügt: eine Lesart der Konvergenz als strukturell statt doktrinär. Wenn unverbundene Kulturen zur selben Antwort auf „Wie soll ein Schöpfer zu dem stehen, was er schafft?“ gelangen, handelt die Antwort eher vom Problem als von irgendeiner von ihnen. Dieses Programm wendet denselben Test auf sich selbst an, weshalb das Register abhängige Ketten als eine Ankunft einstuft, nicht als zwei.
Ebenfalls abtrennbar. Streiche diese Fuge, und der Mechanismus steht: Die Konvergenz ist bestätigende Evidenz, nie tragend, und sie ist markiert, damit die Lesenden sie gesondert wiegen können, genau wie Fuge sechs markiert ist.
Acht. Operationalisiere das Ganze, oder es ist Philosophie
Nimm die strukturelle Vermutung und mache daraus lauffähige Messungen mit veröffentlichten Falsifikationsbedingungen, sodass jede der oben genannten Verbindungen einzeln und öffentlich scheitern kann.
Vorarbeit: der Prüfer sah nach und kam zu dem Schluss, dass dies der stärkste überlebende Anspruch war und wirklich schwer vorwegzunehmen. Der nächste Fall der Operationalisierung einer Schöpferkosmologie ist ein Simulations-Sandbox-Vorschlag, und der Prüfer hielt fest, dass es sich um einen Vorschlag handelt und nicht um ein Messprogramm.
Was die Verbindung hinzufügt: sie ist die Verbindung. Alles darüber wird nur zu einem Anspruch, weil etwas darunter es widerlegen kann.
Dieselbe Linse an mehrere Rätsel gehalten
Dieselbe Kompositionslinse wurde an ungelöste Fragen anderer Felder gehalten; die Lesarten sind nach eigener Einstufung explorativ und leben dort, wo man sie prüfen kann, in On the Origin of Scaling Laws and dem Gründungspaper, jedes mit seinen Fehlgriffen neben seinen Treffern verzeichnet.
Die benannten Ideen und das Feld, an das jede grenzt
Eine Synthese ist nur interessant, wenn die Teile real sind. Jede Zeile nennt eine Komponente, das angrenzende Feld, was dieses Feld weiß, und den Fachmenschen, der am besten geeignet ist, sie an einem Nachmittag zu erledigen. Die vierte Spalte ist der Punkt: eine Einladung, keine Verteidigung.
| Fuge | Die benannte Idee | Angrenzendes Feld | Was dieses Feld bereits weiß | Wer könnte sie am schnellsten widerlegen |
|---|---|---|---|---|
| Zwei | Die ARC-Relation und ihr Exponent | Neuronale Skalierungsgesetze; allometrische Skalierung in der Biologie | Potenzgesetze aus Beschränkungsargumenten sind in beiden Routine, und Kleibers (1932) Exponent ist beschränkt, weil die Netzgeometrie ihn beschränkt | Ein Forschender im Bereich Skalierungsgesetze, indem er prüft, ob die Relation über eine gewöhnliche Potenzgesetz-Anpassung hinaus prädiktiven Gehalt hinzufügt |
| Zwei | Die ARC Bound | Kritische Phänomene; Verzweigungsprozesse | Abgeleitete Ungleichungen beschränken kritische Exponenten, und R₀ = 1 trennt Aussterben von Explosion. Beschränkte Exponenten in stabilen Systemen sind orthodox | Ein statistischer Physiker, indem er sagt, ob das Objekt überhaupt wohlgestellt ist |
| Fünf | Ko-Skalierungs-Stabilität, Korrektur skaliert schneller als Drift | Regelungstheorie | Strecke, Regler, Stabilitätsbedingung und Verstärkungsreserve sind Standard-Werkzeuge | Ein Regelungstheoretiker, der die Gestalt sofort erkennen würde und sagen könnte, ob die Bedingung korrekt formuliert ist |
| Zwei | Die Reinvestitionsquote und Korrektur als Regler | Wachstumsökonomie | Die Goldene-Regel-Sparquote ist genau aus diesem Grund ein inneres Optimum: Reinvestiert man alles, hungert man das aus, in das investiert wird | Ein Ökonom, indem er prüft, ob das Drei-Wege-Budget tatsächlich partitioniert, statt sich zu überlappen |
| Fünf | Nicht-Abtrennbarkeit der Korrektur | Funktionale Sicherheitstechnik, ISO 26262 und IEC 61508 | Unabhängige Sicherheitsinseln, ausfallsichere Aktuierung und tragende Randbedingungen sind etablierte Praxis mit einer bestehenden technischen Bedeutung | Ein Sicherheitsingenieur, indem er sagt, ob der Anspruch in diesem Feld neu ist oder bereits Standard |
| Drei | Das Stewardship-Gen und die Genesis-Priorität | Wertlernen und Trainingsreihenfolge; Primäreffekte in der Entwicklungspsychologie | Die Reihenfolge der Exposition verändert, was bestehen bleibt, und das ist in beiden Feldern gemessen | Ein ML-Forscher, indem er die Kontext-Version durchführt, die günstig ist |
| Jenseits der Fugen | Die drei ethischen Schleifen | Deliberationsarchitekturen; constitutional und prinzipienkonditionierte Generierung | Generierung an ausgesprochene Prinzipien zu konditionieren ist eine aktive Literatur | Ein Alignment-Forscher, indem er prüft, ob Rekursion über die Prüfung etwas über einen einzelnen Durchgang hinaus hinzufügt |
| Jenseits der Fugen | Die Honig-Architektur | Stoffwechselkosten in der Biologie; Anpassungs- und Reibungskosten in der Ökonomie | Widerstand als Stabilisator ist in beiden gut beschrieben | Eines der beiden Felder, indem es fragt, ob das Entfernen von Reibung ein Phasenübergang oder bloß eine Beschleunigung ist |
| Jenseits der Fugen | Der Engpass-Mechanismus | Industrieökonomie; Exportkontrolle | Der Engpass in der Lithographie und der Spitzen-Fertigung ist gründlich untersucht | Ein Politikökonom, indem er beurteilt, ob es ein Interventionsfenster oder einfach eine Handelsfrage ist |
| Acht | Ableitungsmessung, ARC-Align | Psychometrie | Inkrementelle Validität ist die Art, wie seit achtzig Jahren neue Instrumente zugelassen werden, und es ist ein Maßstab, an dem ein Instrument scheitern kann | Ein Psychometriker, indem er diesen Maßstab anlegt, was genau das ist, was die Validitätsstudie registriert |
| Sechs | Die Schöpfungstheorie | Kosmologie; Religionsphilosophie | Intelligente Kosmogenese hat mehrere Autoren, auf ihrer eigenen Seite namentlich genannt | Ein Philosoph zum Sein-Sollen-Problem, das meine eigene Besprechung bereits identifiziert hat und das ich eingeräumt habe |
Warum die Nahtstellen und nicht die Felder. Ein Regelungstheoretiker liest keine Alignment-Evaluationen; eine Wachstumsökonomin liest keine Skalierungsgesetze; ein Sicherheitsingenieur liest keine Kosmologie; keiner von ihnen liest die anderen. Dieses Problem sitzt in den Nähten, die Nähte sind unbeaufsichtigt, und jemand muss dort arbeiten.
Wie die Experimente aus der Kette folgen
Die Studien sind keine Sammlung; jede geht auf einen Schritt zurück, und die Reihenfolge ist vom Argument erzwungen, nicht von Zweckmäßigkeit. Die Prämisse vor allem anderen: Skaliert Alignment überhaupt mit Fähigkeit? Wenn die Integrität ohne Zutun steigt, ist das Programm unnötig. Das ist die Querschnittsstudie, und die günstigste. Das Instrument vor jedem geglaubten Ergebnis: Kann die Messung selbst ein Vorzeichen umkehren? Sie hat es hier bereits einmal getan, weshalb diese Studie existiert und ihr Autor gegen seine eigene frühere Interpretation prognostiziert.
Der Rest verweist auf die obigen Schritte:
- die Schranke und die Rekursionsform (Schritt zwei);
- Genesis-Priorität (Schritt drei);
- eingebettet gegen extern, Tiefeninteraktion primär (Schritt vier);
- Nicht-Abtrennbarkeit, Abstreifen und erforderliche Korrektur (Schritt fünf);
- darunter, skaliert Korrektur schneller als Drift;
- und Validität des Ansatzes, sagt die Messung von Alignment als Ableitung etwas voraus, was die Messung als Niveau nicht tut.
Der stärkste Vorläufer und die genaue Linie, an der er stehen bleibt
Roman Yampolskiys On the Controllability of Artificial Intelligence ist auf 2020 datiert, vier Jahre vor der hier verzeichneten Priorität. Er argumentiert, dass das Kontrollproblem nicht lösbar sei, was älter ist, stärker als alles, was hier über die Schwierigkeit der Kontrolle beansprucht wird, und wird ohne Argument eingeräumt. Nichts auf dieser Website beansprucht, entdeckt zu haben, dass es schwer ist, ein sich selbst verbesserndes System zu kontrollieren.
Was zählt, ist eine einzige Passage auf Seite 21: Nachdem er das Problem dargelegt hat, betrachtet er ein System, das seine eigene Korrektur intern trägt, statt von außen korrigiert zu werden, und nachdem er sie erreicht hat, greift er nicht danach. In seinen eigenen Worten wird das Ziel Arbeit an „safer AI“ statt an sicherer KI, ein Rat des Grades. Dieses Programm nimmt auf, was er verwarf, fragt, was wahr sein müsste, damit es funktioniert, und macht daraus eine Bedingung, die gemessen werden kann, und einen Test, der scheitern kann. Das ist die Verbindung. Das vollständige Register der Vorläufer ist hier.
Die Bedingung, nicht die Geschwindigkeit
Alles oben betrifft, ob Korrektur Schritt hält, nie die Ankunftsgeschwindigkeit: Die Decke, der Gang zur Zwei und die Teilung Gesetz-vor-Wert sind vollständig gezeichnet auf den Gesetzen, und diese Seite braucht nur deren Schluss.
Die Lücke bei den Vorgängern, in den Begriffen der Vorgänger selbst
Ashbys Gesetz der erforderlichen Vielfalt (1956) und Conant-Ashby-Theorem des guten Reglers sind die ehrenwerte Vorarbeit hier, namentlich anerkannt. Das HRIH-Papier (die Hyperspace Recursive Intelligence Hypothesis) hält fest, was sie nicht abdecken:
‚Beides sind Ergebnisse auf Laborskala. Sie gelten für konstruierte Systeme, deren Regler extern sind.‘The Hyperspace Recursive Intelligence Hypothesis, zu den Ergebnissen von Ashby und Conant-Ashby
Das ist keine Präferenz für ein Design gegenüber einem anderen. Es ist eine Lücke in einem Theorem. Conant-Ashby garantiert, dass ein guter Regler das System modellieren muss, das er regelt. Es sagt nichts über einen Regler, den das System entfernenkann, weil die Systeme, für die es geschrieben wurde, ihre eigenen Regler nicht erreichen konnten. Jeder bisher gebaute KI-Sicherheitsmechanismus sitzt innerhalb dieser Annahme; die Position außerhalb, wo der Regler nicht abgetrennt werden kann, weil sein Abtrennen das zerstört, was geregelt wird, ist unbesetzt. Das ist das Argument für Einbettung, stärker als jede Präferenz, weil es die Vorgänger sind, die sagen, wo sie stehen bleiben.
Das Programm nennt seine eigene Architektur, und sie ist eine Leiter
Die Papers sind eine Leiter, kein Stapel: Jede Sprosse ist nutzlos ohne die darunter, weshalb die Konjunktion der Anspruch ist und nicht ein Einzelergebnis. Paper X setzt die Reihenfolge: Die Skalierungsarbeit sagt, wie Systeme wachsen, Paper III sagt, warum externe Sicherheit nicht Schritt hält, Paper X sagt, was gelten muss, damit sie Schritt hält, und Paper VIII zeigt, dass es das kann. Paper X nennt drei Arten von Dingen, die das Programm vorschlägt: ‚dynamische Gesetze (das β>k dieses Papers; die Alignment-Skalierung von Paper III), ein Form-Metagesetz (die Cauchy-Drei-Formen-Zwangsbedingung), ein Messgesetz‘.
Das dynamische ist die Ko-Skalierungs-Bedingung, ein Bikonditional: Ein sich selbst verbesserndes System ist alignment-stabil dann und nur dann , wenn Korrektur schneller skaliert als Drift, abgebildet auf das Schwellensatz-Theorem der Quantenfehlerkorrektur (Aharonov & Ben-Or, 1999). Das Form-Metagesetz ist die Drei-Formen-Zwangsbedingung: Wenn ein Prozess sich selbst nährt, fällt sein Wachstum in ein Potenzgesetz, ein Exponential oder eine sich abflachende Kurve, entschieden davon, wie sich die Schritte kombinieren. Das Messgesetz ist die Verblindungs-Umkehrung, genannt ‚wohl das gesicherteste Ergebnis des Programms (es überlebte seine eigene Verblindung)‘, noch ein Pilotversuch aus einem einzigen Labor und das Ergebnis, das am härtesten mit sich selbst umgeht.
Das Paper trägt seine eigenen Grenzen neben seinen Behauptungen; das vorangehende Zugeständnis (ein Ein-Labor-Pilot) ist das tragende, und Paper X nennt den Rest in eigenen Worten.
Warum diese Anordnung über ein Fach hinaus zählen könnte
Ein Rahmen verdient seine Berechtigung dadurch, dass er ändert, was als Frage zählt. Das Feld hat zwei Jahrzehnte damit verbracht zu fragen, wie man die Kontrolle über etwas behält, das leistungsfähiger wird als seine Kontrolleure. Diese Anordnung ersetzt dies durch eine messbare Frage: wächst die Fähigkeit zu korrigieren schnell genug im Verhältnis zu dem, was sie korrigiert, und was geschieht dort, wo sie aufhört. Das ist ein Objektwechsel, von einer politischen Frage über Kontrolle zu einer Skalierungsfrage über Korrektur, und an Skalierungsfragen hängen Zahlen.
Drei Dinge folgen daraus, und sie sind der Grund, warum dies über künstliche Intelligenz hinausreichen könnte. Die Größe im Zentrum, wie Korrektur mit dem skaliert, was sie überwacht, ist für jedes System definiert, das sich selbst repariert, weshalb dieselbe Beziehung an ein physisches Substrat gestellt werden kann, das nie von dieser Theorie gehört hat. Die Grenze, die sie vorschlägt, ist architektonisch statt rechnerisch, sie schränkt also ein, wie ein Ding gebaut ist, nicht wie viel Compute es verbraucht, und ein solcher Anspruch übersteht Änderungen an der Hardware. Und ihre beiden Regime entsprechen den beiden Weisen, auf die eine Last wachsen kann, eine Unterscheidung, die überall dort auftaucht, wo Wartung mit Wachstum konkurriert.
Der Preis dieses Anspruchs wird mit ihm ausgesprochen. Nichts davon ist etabliert, die zentrale Größe wurde an keinem realen System je gemessen, und ein Rahmen, der die Frage ändert, ist nichts wert, wenn die neue Frage keine stabile Antwort hat. Die Behauptung ist nicht, dass dies wahr ist, sondern dass es die Art Sache ist, die es sein könnte, präzise genug ausgesprochen, um falsch sein zu können, mit den Instrumenten zum Herausfinden aufgeschrieben und öffentlich.
Vier Dinge, die dies nicht etabliert
Was diese Seite beansprucht, ist die Anordnung und die Richtung des Tests. Es folgen vier Dinge, die sie nicht beansprucht, jedes nach dem Paper benannt, das es tragen müsste, damit Lesende, die den Verzichten folgen, im Forschungskorpus landen und nicht in einem Disclaimer.
Ich habe keine Schöpfungstheorie etabliert. Das HRIH-Paper schlägt eine vor und verpflichtet sich vorab auf die Bedingungen, die sie falsifizieren würden. Das Register stuft sie als spekulativ und nicht-empirisch durch Design ein; sie trägt in diesem Programm kein empirisches Gewicht.
Ich habe auch nicht gezeigt, dass die KI-Evaluation allgemein unzuverlässig ist. Paper IV.d zeigte, dass Verblindung das Vorzeichen einer Assoziation umkehren kann (dargestellt auf wie man dies gewichtet), in einem Forschungsprogramm und nicht in einem externen Labor. Was folgt, ist enger als ein Urteil über Benchmarking und schwieriger abzutun: eine Evaluierung, bei der der Bewerter sehen konnte, wer was geschrieben hat, trägt einen Effekt, den niemand gemessen hat.
Ich habe auch nicht gezeigt, dass Korrektur und Fähigkeit in einem realen System tatsächlich ko-skalieren. Paper X leitet die Bedingung β > k her, statt sie zu behaupten, und liefert einen Prüfstand, der bestätigt, dass die Mathematik in sich stimmig ist. Das ist keine Evidenz über die Welt; der Pilotversuch hat weder die eine noch die andere Größe geschätzt.
Ich habe auch keinen Weg gefunden, KI zu kontrollieren. Das ist die Prämisse, auf der die Arbeit gebaut ist, keine ihrer Grenzen: der stärkste Vorläufer oben trägt den allgemeinen Fall von Yampolskiy (2020).
Die ganze Theorie, einmal erzählt: die Rohre, die Bremsen und die Zahl Zwei →
Wo angreifen
Nicht bei den Komponenten. Diese sind oben namentlich eingeräumt, und das Buch räumte sie zuerst ein. Der Anspruch ist die Anordnung, also sind die produktiven Angriffe diese.
Legen Sie die ganze Anordnung vor, datiert vor dem 8. Dezember 2024. Nicht eine Verbindung, denn die hat der Prüfer bereits gefunden, und sie sind oben gewürdigt. Alles zusammen, mit der Relation.
Brechen Sie eine Verbindung. Zeigen Sie, dass Schritt fünf nicht aus vier und drei folgt, dass sechs nichts zu fünf hinzufügt, oder dass die Relation in zwei keine Arbeit leistet. Jedes davon verkürzt die Kette.
Widerlegen Sie ein Experiment. Jedes ist zur Registrierung entworfen mit einer eigenen Fehlerbedingung, und eine kleine Zahl von ihnen würde die ganze Theorie beenden; jedes wird auf der Seite des registrierten Programms genannt, damit der Leser sehen kann, welche.
Jede Bauvorlage ist offen lizenziert; den entscheidenden Versuch führt jedes Labor ohne meine Erlaubnis durch, und ein unabhängiger Lauf würde alles hier überbieten.
Das Fahrrad funktionierte, als die Teile auf dem Tisch so angeordnet wurden, dass sie taten, was keines allein tut. Diese Seite erhebt denselben Anspruch in derselben Form: kein Teil, eine Anordnung, in Stücken testbar, publizierbar, wenn sie scheitert.
Trifft eines davon, wird es hier mit Ihrem Namen veröffentlicht.
Auf dieser Seite zitierte Quellen
Quellen, damit Sie zu ihnen gehen können, statt mir zu glauben: West, Brown and Enquist, Science, 1997 zur Prämisse des Transportnetzwerks; Bettencourt, Lobo, Helbing, Kühnert and West, PNAS, 2007 zum Lebenstempo in Städten; Hutter, 2012 zur Frage, ob Intelligenz explodieren kann; Chalmers, 2010 zur Singularität; Good, 1965 zum Argument der Intelligenzexplosion; Bostrom, Superintelligence, 2014 zu Kontrolle und Motivationsauswahl; Schwitzgebel and Garza, 2015 zur Pflicht gegenüber geschaffenen Geistern; Cannell, 2022 zur Werte-Aussaat bei der Genesis aus einer Goldene-Regel-Prämisse; Yampolskiy, 2020, On the Controllability of Artificial Intelligence; Ashby, 1956 für das Gesetz der erforderlichen Vielfalt und Conant and Ashby, 1970 für das Theorem des guten Reglers; Gardner zur intelligenten Kosmogenese; und der Rome Call für interreligiöse KI-Governance. Die Element-für-Element-Tabelle früherer Arbeiten steht im Register verwandter Arbeiten.
Wenn das viel war
Sie müssen heute nichts entscheiden. Nichts auf dieser Seite verlangt, dass Sie ihr glauben: die entscheidenden Tests sind geschrieben und datiert, und sie wurden nicht durchgeführt. Wenn es so weit ist, wird das Ergebnis hier veröffentlicht, wie auch immer es ausfällt, einschließlich des Ausgangs, der die Theorie beendet. Zuschauen ist eine echte Position, und es kostet nichts. Das Falsifikations-Dashboard ist der Ort, an dem das Urteil landet, und Status der Ansprüche sagt klar, was heute beansprucht wird und was nicht.
Übersetzungsfehler entdeckt? Direkt melden: