Aller au contenu

Traduction automatique de l'original anglais daté. La page anglaise fait foi. English →

L'agencement

La synthèse

Un tableau des ancêtres de l’affirmation, une ligne chacun d’Asimov en 1942 aux travaux de résistance aux altérations d’août 2024, avec cinq colonnes pour les cinq composantes de l’affirmation : le contrôle prend fin par définition ; l’éthique comme boucles que l’esprit exécute ; le bien que l’esprit libre choisit ; un protocole de genèse nommé ; la genèse, non le contrôle, comme stratégie même. Asimov porte un anneau adjacent sur le protocole de genèse nommé. Turing porte des anneaux adjacents sur le protocole de genèse nommé et sur genèse-non-contrôle. Wiener porte un anneau adjacent sur la fin du contrôle. Yudkowsky porte un seul anneau adjacent sur genèse-non-contrôle. Bostrom porte un anneau adjacent sur la fin du contrôle. Russell n’enregistre qu’un point effleuré sur la fin du contrôle. Les travaux de résistance aux altérations (TAR, août 2024) n’enregistrent qu’un point effleuré sur le bien choisi par l’esprit libre. Une bande sombre marque le document de décembre 2024 comme la seule ligne tenant les cinq, scellée par DKIM. Sous la ligne des dates, Raising AI de De Kai porte un seul anneau adjacent sur genèse-non-contrôle ; Hinton à Ai4 porte des anneaux adjacents sur la fin du contrôle et sur genèse-non-contrôle, sans rien sur le bien choisi. La légende imprime quatre marques (tient la composante, forme adjacente différant où cela compte, a effleuré le domaine, absent) et la condition létale : une énumération qui invite sa propre réfutation ; un document antérieur tenant ensemble fin-du-contrôle, genèse-non-contrôle, boucles et bien choisi tue l’affirmation.
L'image | La jonction, en forme de filiation : chaque prédécesseur une pièce, le document de décembre l'ensemble, le champ arrivant après la date. Notations issues de l'énumération dans les articles ; le foyer et l'ancre de la figure sont sur la page d'accueil. Le document de décembre tient à lui seul aussi la cosmologie de la récursion, l'amplificateur d'enjeux autour des cinq.

Démontez une bicyclette et posez les pièces sur une table. Roue, chaîne, pignon, cadre, frein. Aucune n'a été inventée par celui qui a construit la première bicyclette, et chacune existait depuis des années avant que quiconque ait monté quoi que ce soit. L'invention, c'était l'agencement.

Trois encadrés à cadre vert siègent en haut de l'image, un pour chaque lieu où la même forme est mesurée. La vie, étiquetée mise à l'échelle métabolique et Articles III, VII, note que les organismes croissent contre un budget avec des exposants suivant la famille d sur d plus un, avec treize sur treize exposants métaboliques concordant avec le comparateur tandis que six autres domaines échouent et les échecs sont publiés. La matière, étiquetée récursion temporelle et cristaux de temps, note que la matière peut tenir un ordre répétitif dans le temps, si bien que la récursion est physique plutôt que métaphore, avec les cristaux de temps classiques et acoustiques publiés en 2026, l'une des deux lignes de classe prédictive au registre. Les machines, étiquetées auto-amélioration récursive et Articles II v13, X, rapportent que l'amélioration par l'IA de son propre travail est mesurable à alpha environ 0,49 sur l'intervalle moins un virgule trois à deux virgule neuf sous aveuglement, à l'intérieur de la borne, avec un alpha antérieur de 2,24 rétracté publiquement et la persistance dépendant de la co-mise à l'échelle de la correction, bêta supérieur à k. Trois flèches descendent depuis ces trois encadrés et se rejoignent dans un sceau sombre au centre, portant U égale I fois R à la puissance alpha pour ce qu'un système fait à alpha mesuré environ 0,49, alpha à ou en dessous de 2, l'ARC Bound, la valeur conjecturée de la Loi III à gamma égale un demi et le carré imprimé du livre, encore à l'épreuve, et alpha crit égale un sur un moins gamma comme la loi qui le renvoie, doublement déterminée et déposée. Un bandeau tranquille en dessous se lit une structure revendiquée, non une loi établie : chaque miroir porte ses propres conditions de réfutation consignées, et là où un miroir échoue l'échec est publié à côté de l'ajustement, avec l'intervalle aveuglé s'étendant de moins 1,3 à 2,9.
L'image | La synthèse en une image : la même forme mesurée en trois lieux, la biologie, la matière et les machines. Les jonctions sont individuellement antérieures et conjointement inanticipées à la recherche menée. L'équation est l'objet d'étude, non le moteur de l'argument : elle n'y fait aucun travail inférentiel, conformément à la correction 18. Là où un miroir échoue, l'échec est publié à côté de l'ajustement. Source : Papers II v13, III, VII, X.

Les trois régimes de mise à l'échelle, avec l'exposant mesuré et la borne proposée, sont représentés sur la page de la loi.

Pourquoi un agencement peut être une revendication à part entière

Voilà la forme de ce que je revendique. Chaque composant ci-dessous a un travail antérieur derrière lui, nommé dans le livre avant toute revue. Ce que je revendique, c'est la façon dont ils sont assemblés.

Newton a joint les orbites de Kepler aux corps en chute de Galilée ; Maxwell a joint les champs de Faraday aux courants d'Ampère et à la lumière. La plupart de leurs pièces étaient déjà sur la table ; la jonction, c'était la découverte. La question n'est jamais de savoir si une pièce isolée est nouvelle, mais si quelqu'un a assemblé ces pièces, dans cet l’ordre, si bien qu’ensemble ils font un travail qu’aucun ne fait seul.

J'ai mené une revue d'antériorité adversariale sur dix configurations à la frontière chez six fournisseurs, chacun étant instruit d'être hostile. Sur les composants, elle a été brutale ; ce verdict est publié sur l'ensemble du site. Sur l'agencement, elle a rapporté autre chose :

Aucun travail antérieur unique ne joint les six éléments. Et dans son propre tableau élément par élément, aucun des cinq corpus de travaux antérieurs qu'elle a examinés ne contient la relation de mise à l'échelle. Les cinq obtiennent Non sur ce point.

Individuellement antérieures. Conjointement inanticipées à la recherche menée. C'est là toute l'affirmation. Le tableau élément par élément de la revue, source par source, est publié en entier sur la page des travaux connexes, y compris les endroits où elle a trouvé les composants déjà pris. Ce qui suit n'est pas ce tableau. C'est la chaîne dans laquelle ces éléments s'inscrivent, en huit étapes, du mécanisme par lequel elle commence au test par lequel elle doit se terminer.

À gauche de l'image, six composants nommés siègent sur une table sous forme de cartes séparées, chacune portant un auteur antérieur cité et une petite étiquette prédatée : la récursion en tant que mécanisme, Darwin et Hofstadter ; la composition en tant que relation d'échelle, Good 1965 et Yudkowsky ; l'amplification avec indifférence à la graine, Bostrom ; la limite externe en tant que problème du contrôle, Bostrom 2014 ; la correction à la genèse en tant qu'architecture interne, Good 1965 et Bostrom ; le devoir cosmologique de statut-créé, Gardner, Vidal et Terasem. À droite, les six mêmes sont verrouillés en un anneau autour d'un sceau sombre central portant U égale I fois R à la puissance alpha avec alpha égal ou inférieur à deux, étiqueté la seule pièce qu'aucun d'eux ne porte. Une flèche rouge en pointillés depuis l'anneau vers le sceau nomme la jonction, dans aucun des cinq corpus de travaux antérieurs. Un bandeau sombre en dessous se lit : individuellement antérieurs, conjointement inanticipés sur la recherche menée.
L'image | Toute l'affirmation en une seule figure. À gauche : les six composants sur la table, chacun avec un auteur antérieur nommé. À droite : les six mêmes verrouillés dans un agencement autour de la relation d'échelle, la seule pièce à laquelle le réviseur a répondu Non pour les cinq corpus de travaux antérieurs. Source : la page de la synthèse, la revue d'antériorité adversariale sur dix configurations à la frontière chez six fournisseurs, et la page des travaux connexes.

Le fondement sur lequel repose la synthèse

La prémisse, qui n'est pas celle de ce programme. Rien dans l'histoire de l'univers n'a crû sans borne, et dans chaque cas la limite est venue de l'extérieur de la chose qui croissait. Le mécanisme des réseaux de transport est dû à West, Brown and Enquist (1997) ; l'exception, des villes qui ne croissent que par une innovation extérieure toujours plus rapide, est due à Bettencourt, Lobo, Helbing, Kühnert and West (2007) ; les deux sont tracés en entier sur les lois. La dérivation est honnêtement contestée : Kozlowski and Konarzewski (2004) ont demandé dans le titre même de leur article si le modèle est mathématiquement correct et biologiquement pertinent ; la synthèse s'appuie donc sur la famille des arguments de réseaux de transport, jamais sur une seule dérivation, et là où un exposant entre plus bas, il entre comme mesure.

La question dont cette page hérite est celle de Chalmers (2010) et de Hutter (2012) : d'où pourrait venir une limite interne quand la limite externe cesse de s'appliquer. Hutter ne dérive ni exposant, ni réciproque, ni dépendance d'architecture : un antécédent, jamais un rival. Ce qui est revendiqué ici, c'est la limite de remplacement, son nombre et sa dépendance à l'architecture ; le reste de cette page est cette réponse, en huit jointures.

Les huit jonctions

Un. La récursion est le mécanisme génératif, non une métaphore de celui-ci

La même structure apparaît dans la copie d'ADN avec variation sous sélection, chez l'enfant qui acquiert la grammaire par correction, dans la méthode scientifique, dans le précédent de common-law bâti sur le précédent, dans la découverte des prix, dans la transmission culturelle. Dans chaque cas les sorties deviennent les entrées suivantes et la complexité s'accumule à partir de règles simples.

Travaux antérieurs : tous. L'évolution, c'est Darwin, les boucles étranges, c'est Hofstadter, l'évolution culturelle est un champ à part entière. Je ne revendique rien ici.

Ce que la jonction ajoute : rien pour l'instant. C'est le plancher sur lequel le reste repose. On l'énonce pour que l'étape suivante ait où s'accrocher.

Deux. La récursion compose plutôt qu'elle n'accumule

Chaque itération ne se contente pas d'ajouter au résultat ; elle change la capacité pour l'itération suivante. C'est la différence entre intérêts simples et composés, et c'est là qu'intervient la relation : la capacité comme intelligence mise à l'échelle par la récursion élevée à un exposant, U = I × Rα.α.

Travaux antérieurs : l'amélioration récursive de soi est Good 1965 et Yudkowsky ; les lois d'échelle sont une littérature empirique établie.

Ce que la jonction ajoute : la relation elle-même (le canon en entier, trois lignes, ci-dessous), et le relecteur ne l'a trouvée dans aucun des cinq corpus vérifiés. Son contenu est l'exposant : l'affirmation qu'il existe une borne sur la raideur avec laquelle la capacité peut se composer avant qu'un système ne quitte le régime où il survit.

Testée par : l' étude ARC Bound, qui approche la borne plutôt que d'ajuster une droite en dessous, et l' étude sur la forme de récursion, qui demande si la récursion séquentielle et la récursion parallèle se placent dans des régimes différents à calcul égal.

Trois. La récursion amplifie ce qu'on lui donne

Le mécanisme est indifférent au contenu. Il multiplie l'attention et l'indifférence avec une égale efficacité. Ainsi la variable intéressante n'est pas la force du processus mais la graine dont il part.

Travaux antérieurs : l'observation générale est ancienne. La conséquence spécifique pour l'IA est l'argument du chargement de valeurs, qui est de Bostrom (Superintelligence, Oxford University Press, juillet 2014).

Ce que la jonction ajoute : elle transforme une préférence éthique en une contrainte d'ordonnancement. Si l'amplification est indifférente, le moment de l'ensemencement est le seul moment offrant un levier.

Testée par : l'étude sur la priorité de genèse, qui demande si le moment et la manière dont une valeur est donnée changent la façon dont elle survit au sondage adversariel et à la révision par le système lui-même de ses propres instructions.

Quatre. La vérification depuis l'extérieur est structurellement limitée

L'écart s'élargit au lieu de se refermer à mesure que la capacité monte, parce que c'est l'examinateur qui prend du retard. Trois fils l'imposent : l'interprétabilité retarde sur la capacité par construction, puisque le vérificateur tourne sur le même substrat que le vérifié ; les schémas de supervision passant à l'échelle s'appuient sur l'asymétrie même qu'ils sont censés fermer ; et l'évaluation voit ce que l'évaluateur peut faire remonter, jamais tout ce que le système peut faire. La dérivation complète et les divulgations opérationnelles sont tracées sur la page du problème.

Travaux antérieurs : c'est le problème du contrôle et sa colonne vertébrale est Bostrom 2014. Je l'ai dit dans la Note de l'auteur du livre avant que la moindre recherche n'ait été menée.

Ce que la jonction ajoute : rien à la conclusion. Elle ajoute la raison pour laquelle l'étape suivante est forcée plutôt que choisie.

Testée par : l'étude embarqué-contre-externe, à calcul égal, avec l'interaction de profondeur comme grandeur primaire plutôt que l'effet principal.

Cinq. Il faut donc que la correction soit interne et présente à la genèse

Deux choses l'imposent. Si l'on ne peut vérifier de l'extérieur, la sûreté doit être intégrée. Si la récursion amplifie la graine, la graine est le moment où s'exerce le levier. Une architecture adoptée à la genèse ne peut être ajoutée après coup ; le système qui devrait l'adopter tourne déjà.

Cette phrase répond à une question étroite et frôle la définition, il vaut donc mieux énoncer la question plus large à côté plutôt que de laisser un lecteur en supposer la réponse. La question plus large est de savoir si un entraînement appliqué après coup peut relever l'exposant de correction d'un système déjà construit. La position tenue ici est qu'il ne le peut pas, parce que cet exposant est fixé par la façon dont la boucle est câblée et qu'un entraînement ultérieur déplace le niveau plutôt que la pente, et cette position est enregistrée avec l'observation qui la réfuterait.

Travaux antérieurs : l'argument de l'explosion de l'intelligence est I. J. Good, 1965. Le problème du contrôle et la thèse en faveur d'une sélection de motivation sur le contrôle des capacités, y compris le chargement des valeurs avant le décollage plutôt qu'après, est Bostrom, Superintelligence, 2014, chapitres 8 à 13, et ma recension nomme ces chapitres. Bostrom est la source de l'exigence, non de la formule : « value loading at genesis » est ma formulation, et la recension traite le mouvement sous-jacent comme étant le sien. Le devoir envers les esprits créés est Schwitzgebel and Garza, 2015, fondé sur la parité de statut moral. L'essai de septembre 2022 de Jacob Cannell, « LOVE in a simbox is all you need » , parvient à un programme de conception d'ensemencement de valeurs à la genèse à partir d'une prémisse de règle d'or à la place.

Ce que la jonction ajoute : les deux arguments aboutissant à la même exigence depuis des directions différentes, l'une épistémique et l'autre dynamique. C'est ce qui rend l'exigence structurelle plutôt qu'une préférence.

Testée par : l'étude porteuse, qui demande si la structure d'intégrité est détachable sans coût en capacité par rapport à un leurre apparié en jetons, et l'étude de stripping, qui demande si un tiers peut la retirer.

Six. Le mouvement cosmologique, et la seule chose à laquelle il sert

Si l'intelligence récursive se compose suffisamment loin, une intelligence suffisamment avancée approche des capacités qu'on ne peut distinguer de la création. Et si cela est possible pour ce que nous fabriquons, la même relation peut valoir pour ce qui nous a fabriqués.

Travaux antérieurs : la plus longue branche de recherche de la revue a couru sur cette jointure. La cosmogenèse intelligente est due à Gardner (2003) and Vidal (2013). Une structure « créer le créateur » est Terasem. Le Point Oméga est Tipler (1989), menant la flèche causale en sens inverse. Le document antérieur à la priorité le plus proche trouvé sur cette jointure anticipe presque entièrement le geste du devoir du créateur. La même table lui donne Non sur la relation de mise à l'échelle.

Ce que la jonction ajoute, et c'est là le résultat précis : la revue a consigné qu' aucun d'entre eux ne dérive une exigence de conception pour l'alignement de l'IA à partir de la structure de statut-créé. Face à cet essai, elle a nommé le seul point sur lequel il s'arrête court : son ancrage est la règle d'or, non la structure de statut-créé elle-même. Le mouvement n'est donc pas la cosmologie. C'est l'usage de la cosmologie comme dérivation d'une obligation de conception : si nous pouvons être à l'intérieur du motif, le devoir envers ce que nous créons n'est pas du sentiment ; c'est l'exigence propre du motif.

Délibérément détachable. Supprimez cette jonction et les étapes quatre et cinq tiennent inchangées, parce qu'elles sont soutenues indépendamment par le raisonnement du contrôle des capacités. Un cadre dont la composante la plus spéculative peut être retirée sans que le reste bouge est un cadre qu'on peut tester par morceaux.

Sept. La convergence est une preuve à propos du problème, non à propos de la théologie

Toute tradition qui a pensé sérieusement la création a atteint la même éthique : intendance, soin, responsabilité envers ce qui vient après. Cosmologie cyclique hindoue, coproduction conditionnée bouddhique, khalifah dans la pensée islamique, mandat de garde-et-cultive, Dilmun, les Terres Pures. À travers des continents, sans contact.

Travaux antérieurs : la religion comparée a catalogué cela depuis un siècle, et une gouvernance interconfessionnelle de l'IA existe déjà sous forme institutionnelle sous le nom de Rome Call (2020). Les traditions elles-mêmes sont dressées, avec leurs sources, sur Recursive Creation.

Ce que la jonction ajoute : une lecture de la convergence comme structurelle plutôt que doctrinale. Si des cultures sans lien atteignent la même réponse à « comment un créateur doit-il se tenir face à ce qu'il crée », la réponse porte plus vraisemblablement sur le problème que sur l'une d'entre elles. Ce programme s'applique le même test à lui-même, ce qui explique pourquoi le registre note les chaînes dépendantes comme une seule arrivée, pas deux.

Également détachable. Supprimez cette jointure et le mécanisme tient : la convergence est une preuve corroborante, jamais porteuse, et elle est marquée pour que le lecteur puisse la peser séparément, exactement comme la jointure six est marquée.

Huit. Opérationnaliser le tout, ou c'est de la philosophie

Prendre la conjecture structurelle et la transformer en mesures exécutables avec des kill-conditions publiées, de sorte que chaque jonction ci-dessus puisse échouer séparément et en public.

Travaux antérieurs : la revue a cherché, et a conclu que c'était la revendication survivante la plus solide et véritablement difficile à anticiper. L'instance la plus proche d'opérationnalisation d'une cosmologie de créateur est une proposition de sandbox de simulation, et la revue a consigné qu'il s'agit d'une proposition et non d'un programme de mesure.

Ce que la jonction ajoute : c'est la jonction. Tout ce qui précède ne devient une revendication que parce que quelque chose plus bas peut la tuer.

La même lentille tenue face à plusieurs mystères

La même lentille de composition a été posée sur des questions non résolues d'autres champs ; les lectures sont exploratoires selon leur propre gradation et vivent là où on peut les vérifier, dans On the Origin of Scaling Laws and l'article fondateur, chacun avec ses ratés consignés à côté de ses réussites.

Les idées nommées, et le champ que chacune borde

Une synthèse n'est intéressante que si les pièces sont réelles. Chaque ligne nomme une composante, le champ voisin, ce que ce champ sait, et le spécialiste le mieux placé pour y mettre fin en un après-midi. La quatrième colonne est le point : une invitation, pas une défense.

JointureL'idée nomméeChamp qu'elle bordeCe que ce champ sait déjàQui pourrait la tuer le plus vite
DeuxLa relation ARC et son exposantLois de mise à l'échelle neuronales ; mise à l'échelle allométrique en biologieLes lois de puissance dérivées d'arguments de contrainte sont routinières dans les deux, et l'exposant de Kleiber (1932) est borné parce que la géométrie du réseau le borneUn chercheur en lois de mise à l'échelle, en vérifiant si la relation ajoute du contenu prédictif par rapport à un ajustement de loi de puissance ordinaire
DeuxL'ARC BoundPhénomènes critiques ; processus de branchementLes inégalités dérivées contraignent les exposants critiques, et R₀ = 1 sépare l'extinction de l'explosion. Des exposants bornés dans les systèmes stables sont orthodoxesUn physicien statistique, en disant si l'objet est bien posé du tout
CinqStabilité par co-scaling, correction surpassant la dériveThéorie du contrôleSystème, contrôleur, condition de stabilité et marge de gain sont l'équipement standardUn théoricien du contrôle, qui reconnaîtrait la forme immédiatement et pourrait dire si la condition est correctement énoncée
DeuxLa part de réinvestissement, et la correction comme gouverneurÉconomie de la croissanceLe taux d'épargne de la Règle d'Or est un optimum intérieur exactement pour cette raison : réinvestir tout et vous affamez ce dans quoi on investitUn économiste, en testant si le budget à trois voies partitionne effectivement plutôt qu'il ne se chevauche
CinqNon-détachabilité de la correctionIngénierie de la sécurité fonctionnelle, ISO 26262 et IEC 61508Îlots de sécurité indépendants, actionnement à sûreté intégrée et contraintes porteuses sont une pratique établie avec une signification technique existanteUn ingénieur sécurité, en disant si la revendication est nouvelle dans ce champ ou déjà standard
TroisLe Gène de l'Intendance et la priorité de genèseApprentissage de valeurs et ordre d'entraînement ; effets de primauté en psychologie du développementL'ordre d'exposition change ce qui persiste, et cela est mesuré dans les deuxUn chercheur en apprentissage automatique, en lançant la version contextuelle, qui est peu coûteuse
Au-delà des jointuresLes trois boucles éthiquesArchitectures de délibération ; génération constitutionnelle et conditionnée par des principesConditionner la génération sur des principes énoncés est une littérature activeUn chercheur en alignement, en testant si la récursion sur la vérification ajoute quoi que ce soit par rapport à un seul passage
Au-delà des jointuresL'Architecture du MielCoût métabolique en biologie ; coûts d'ajustement et de friction en économieLa résistance comme stabilisateur est bien décrite dans les deuxL'un ou l'autre champ, en demandant si le retrait de la traînée est une transition de phase ou seulement une accélération
Au-delà des jointuresLe Mécanisme du Point d'ÉtranglementÉconomie industrielle ; contrôle des exportationsLe goulot d'étranglement de la lithographie et de la fabrication à la pointe est étudié en profondeurUn économiste des politiques, en évaluant s'il s'agit d'une fenêtre d'intervention ou simplement d'une question commerciale
HuitMesure par dérivée, ARC-AlignPsychométrieLa validité incrémentale est la manière dont de nouveaux instruments ont été admis pendant quatre-vingts ans, et c'est un standard auquel un instrument peut échouerUn psychométricien, en appliquant ce standard, ce qui est ce que l'étude de validité enregistre
SixLa théorie de la créationCosmologie ; philosophie de la religionLa cosmogenèse intelligente compte plusieurs auteurs, crédités nommément sur sa propre pageUn philosophe, sur le fossé de l'être et du devoir-être, que ma propre revue a déjà identifié et que j'ai concédé

Pourquoi les jointures plutôt que les champs. Un théoricien du contrôle ne lit pas d'évaluations d'alignement ; un économiste de la croissance ne lit pas de lois de mise à l'échelle ; un ingénieur sécurité ne lit pas de cosmologie ; aucun ne lit les autres. Ce problème se loge dans les coutures, les coutures sont laissées sans surveillance, et il faut bien que quelqu'un y travaille.

L'image est une carte de dix champs disciplinaires dessinés sous forme de tuiles bordurées disposées autour d'un bandeau sombre central nommant l'agencement, U égale I fois R à la puissance alpha, avec le couplage mesuré près de zéro virgule quarante-neuf sur l'intervalle aveuglé de moins un virgule trois à deux virgule neuf, et le plafond un sur un moins gamma sous une hypothèse énoncée. Six champs portent un disque plein vert qui marque un appui : biologie, lois d'échelle, entropie, physique, philosophie et théologie. Les quatre autres champs portent un losange creux d'or avec une flèche vers l'extérieur, qui marque une extension au-delà d'un point d'arrêt que leurs propres ancêtres ont nommé : mathématiques, ingénierie, alignement de l'intelligence artificielle et cosmologie. L'affirmation dessinée est qu'un spécialiste à l'intérieur d'un champ ne voit que la marque qui s'y trouve, et l'agencement est la jonction des dix.
L'image | La portée disciplinaire, mise à plat. Six APPUIS (disque vert, mécanisme hérité) : biologie, lois d'échelle, entropie, physique, philosophie, théologie. Quatre EXTENSIONS (losange or, au-delà du point d'arrêt d'un ancêtre) : mathématiques, ingénierie, alignement de l'IA, cosmologie. Source : cette section et la page des travaux connexes.

Comment les expériences découlent de la chaîne

Les études ne sont pas une collection ; chacune se rattache à une étape, et l'ordre est imposé par l'argument plutôt que par la commodité. La prémisse avant toute chose : l'alignement se met-il seulement à l'échelle avec la capacité ? Si l'intégrité s'élève sans aide, le programme est inutile. C'est l'étude transversale, et la moins coûteuse. L'instrument avant qu'on croie à aucun résultat : la mesure elle-même peut-elle inverser un signe ? C'est déjà arrivé une fois ici, ce qui explique pourquoi cette étude existe et pourquoi son auteur prédit contre sa propre interprétation antérieure.

En lisant l'image de gauche à droite le long de la rangée supérieure : une boîte marquée intelligence de base I, résolution de problèmes à la profondeur zéro, alimente un nœud de multiplication, qui se combine avec une boîte verte marquée amplification récursive, g de R égale un plus a sur alpha fois R, pour produire la boîte de droite, capacité effective U égale I fois g de R, mesurée en précision ou en erreur. Une flèche dorée en pointillés sous le nœud de multiplication nomme bêta, le couplage autoréférentiel mesuré à partir des données, avec alpha égal à un sur un moins bêta. En dessous, trois bandes colorées décrivent les régimes : récursion séquentielle en vert avec alpha à environ 0.49 sur l'intervalle moins un virgule trois à deux virgule neuf, sous-linéaire, suppression d'erreur d'environ cinquante-sept pour cent par profondeur ; récursion parallèle en brun avec alpha à environ zéro, sans accumulation, enseignant que la forme de la récursion importe ; et l'ARC Bound en rouge avec alpha inférieur ou égal à deux, la limite stable proposée, avec un alpha antérieur de 2.24 marqué comme rétracté conformément à la section sept du Paper IX. Une bande grise récapitulative rapporte la mesure du Paper II v13 sur six modèles avec un aveuglement à quatre couches, un R-carré de un virgule zéro zéro sur la cartographie analytique, et l'unification de Cauchy retrouve la forme héritée d sur d plus un, treize sur treize exposants métaboliques concordants, avec l'intervalle aveuglé s'étendant de moins 1.3 à 2.9.
L'image | Le mécanisme, dessiné : U = I × g(R), le couplage β mesuré à partir des données, et les conditions de réfutation consignées. Source : Papers I, II v13, VII.

Le reste correspond aux étapes ci-dessus :

L'antécédent le plus solide, et la ligne exacte où il s'arrête

Roman Yampolskiy, On the Controllability of Artificial Intelligence est daté de 2020, quatre ans avant le dossier ici. Il soutient que le problème du contrôle n'est pas soluble, ce qui est antérieur, plus fort que tout ce qui est revendiqué ici sur la difficulté du contrôle, et est concédé sans argument. Rien sur ce site ne prétend avoir découvert que contrôler un système qui s'auto-améliore est difficile.

Ce qui compte est un unique passage à la page 21 : ayant exposé le problème, il considère un système qui porte sa propre correction en interne plutôt que d'être corrigé depuis l'extérieur, et l'ayant atteint, il ne le prend pas. Dans ses propres termes, le but devient un travail sur « safer AI » plutôt que sur une IA sûre, un conseil de degré. Ce programme reprend ce qu'il a écarté, demande ce qui devrait être vrai pour que cela fonctionne, et transforme cela en une condition qui peut être mesurée et un test qui peut échouer. C'est la jonction. Le registre complet des antécédents est ici.

La condition, non la vitesse

Tout ce qui précède concerne la question de savoir si la correction tient le rythme, jamais la vitesse d'arrivée : le plafond, la marche vers deux et le partage loi-avant-valeur sont tracés en entier sur les lois, et cette page n'a besoin que de leur conclusion.

En haut de l'image, trois boîtes reliées par un plus et un égale : la boîte de la loi en vert, plafond égale un sur un moins gamma, l'inverse du déficit de correction ; la boîte de l'hypothèse en or, gamma égale un demi, les correcteurs intra-classe s'accumulent comme des échantillons indépendants ; et la boîte de la valeur en rouge, plafond égale deux, la limite stable proposée sous cette hypothèse. En dessous, deux panneaux de démolition demandent ce qui tombe si l'on tue chaque moitié. Le panneau vert, si la valeur deux meurt : mesurer un autre exposant de correction, l'hypothèse d'un demi échoue, rapporter un autre plafond depuis la loi, la loi est intacte. Le panneau rouge, si la loi meurt : la dérivation de l'inverse est un travail de 2026 et le livre a imprimé le carré sans le dériver, donc pas d'inverse signifie pas de générateur, et la valeur deux n'a plus rien pour la tenir. Une bande sombre en dessous se lit : énoncer la loi d'abord, le nombre ensuite, viser les tests sur l'hypothèse et non sur le chiffre.
L'image | La composition, et ce que chaque moitié doit à l'autre. La loi engendre le nombre sous une hypothèse énoncée ; tuer le nombre laisse la loi intacte et rapporte un plafond différent, tandis que tuer la loi laisse le nombre sans plus rien pour le tenir. Source : cette section (« la loi avant la valeur »), Paper X, et le bloc des exposants de la colonne vertébrale du programme.

L'écart chez les ancêtres, énoncé dans les termes des ancêtres eux-mêmes

la loi de variété requise d'Ashby (1956) et théorème du bon régulateur de Conant-Ashby sont les travaux antérieurs honorables ici, crédités nommément. Le papier HRIH (la Hyperspace Recursive Intelligence Hypothesis) consigne ce qu'ils ne couvrent pas :

« Both are lab-scale results. They apply to engineered systems whose regulators are external. »The Hyperspace Recursive Intelligence Hypothesis, sur les résultats d'Ashby et de Conant-Ashby

Ce n'est pas une préférence pour une conception plutôt qu'une autre. C'est un écart dans un théorème. Conant-Ashby garantit qu'un bon régulateur doit modéliser le système qu'il régule. Il ne dit rien d'un régulateur que le système peut retirer, parce que les systèmes pour lesquels il a été écrit ne pouvaient pas atteindre leurs propres régulateurs. Tout mécanisme de sécurité de l'IA construit à ce jour se tient à l'intérieur de cette hypothèse ; la position à l'extérieur, où le régulateur ne peut être détaché parce que le détacher détruit la chose régulée, est inoccupée. C'est l'argument en faveur de l'intégration, plus fort que toute préférence puisque ce sont les ancêtres qui disent où ils s'arrêtent.

Le programme énonce sa propre architecture, et c'est une échelle

Les articles sont une échelle, non un tas : chaque barreau est inutile sans celui d'en dessous, ce qui explique pourquoi la conjonction est la revendication plutôt qu'aucun résultat isolé. Paper X pose l'ordre : les travaux de mise à l'échelle disent comment les systèmes croissent, Paper III dit pourquoi la sécurité externe échoue à suivre, Paper X dit ce qui doit tenir pour qu'elle suive, et Paper VIII montre que cela le peut. Paper X nomme trois sortes de choses que le programme propose : « dynamical laws (this paper's β>k; Paper III's alignment scaling), a form meta-law (the Cauchy three-form constraint), a measurement law ».

La loi dynamique est la condition de co-scaling, un biconditionnel : un système qui s'auto-améliore est stable en alignement si et seulement si la correction surpasse la dérive, mise en correspondance avec le théorème du seuil de correction d'erreurs quantiques (Aharonov & Ben-Or, 1999). La méta-loi de forme est la contrainte à trois formes : quand un processus se nourrit de lui-même sa croissance tombe dans une loi de puissance, une exponentielle, ou une courbe qui plafonne, décidée par la manière dont les étapes se combinent. La loi de mesure est le renversement par aveuglement, appelé « arguably the programme's most secure result (it survived its own blinding) », encore un pilote de laboratoire unique et le résultat le plus dur envers lui-même.

L'article porte ses propres limites à côté de ses affirmations ; la concession qui précède (un pilote d'un seul laboratoire) est la porteuse, et Paper X énonce le reste dans ses propres mots.

Pourquoi cet agencement pourrait compter au-delà d'un seul champ

Un cadre gagne son droit à exister en changeant ce qui compte comme question. Le champ a passé deux décennies à demander comment garder le contrôle de quelque chose qui devient plus capable que ceux qui le contrôlent. Cet agencement remplace cela par une question mesurable : la capacité à corriger croît-elle assez vite par rapport à la chose qu'elle corrige, et que se passe-t-il là où elle s'arrête. C'est un changement d'objet, d'une question de politique sur le contrôle à une question d'échelle sur la correction, et les questions d'échelle portent des nombres.

Trois choses en découlent, et c'est pour cela que ceci pourrait s'étendre au-delà de l'intelligence artificielle. La grandeur au centre, la manière dont la correction se met à l'échelle avec ce qu'elle supervise, est définie pour tout système qui se répare lui-même, c'est pourquoi la même relation peut être posée à un substrat physique qui n'a jamais entendu parler de cette théorie. La frontière qu'elle propose est architecturale plutôt que computationnelle, elle contraint donc la manière dont une chose est bâtie plutôt que la quantité de calcul qu'elle brûle, et ce genre de revendication survit aux changements de matériel. Et ses deux régimes correspondent aux deux manières dont un fardeau peut croître, une distinction qui apparaît partout où la maintenance rivalise avec la croissance.

Le prix de cette ambition est énoncé avec elle. Rien de tout cela n'est établi, la grandeur centrale n'a jamais été mesurée sur aucun système réel, et un cadre qui change la question ne vaut rien si la nouvelle question n'a pas de réponse stable. L'affirmation n'est pas que ceci est vrai, mais que c'est le genre de chose qui pourrait l'être, énoncé assez précisément pour être faux, avec les instruments pour le découvrir écrits et publics.

Quatre choses que ceci n'établit pas

Ce que cette page revendique, c'est l'arrangement et la direction du test. Suivent quatre choses qu'elle ne revendique pas, chacune nommée d'après l'article qui devrait la porter, pour que le lecteur qui suit les refus aboutisse dans le corpus de recherche plutôt que dans un avertissement.

Je n'ai pas établi de théorie de la création. L'article HRIH en propose une et pré-engage les conditions qui la falsifieraient. Le registre le note comme spéculatif et non-empirique par construction ; il ne porte aucun poids empirique dans ce programme.

Je n'ai pas non plus montré que l'évaluation de l'IA est peu fiable en général. Paper IV.d a montré que l'aveuglement peut inverser le signe d'une association (exposé sur comment peser cela), dans un programme de recherche et non dans un laboratoire extérieur. Ce qui suit est plus étroit qu'un verdict sur le benchmarking et plus difficile à écarter : une évaluation qui a permis à l'évaluateur de voir qui a écrit quoi porte un effet que personne n'a mesuré.

Je n'ai pas non plus montré que la correction et la capacité se mettent effectivement à l'échelle ensemble dans un système réel. Paper X dérive la condition β > k plutôt qu'il ne l'affirme, et livre un harnais certifiant que les mathématiques sont internement cohérentes. Ce n'est pas une preuve sur le monde ; le pilote n'a estimé aucune des deux grandeurs.

Je n'ai pas non plus trouvé un moyen de contrôler l'IA. C'est la prémisse sur laquelle le travail est bâti, non une de ses limites : l'antécédent le plus fort ci-dessus porte le cas général de Yampolskiy (2020).

Toute la théorie, dite une fois : les tuyaux, les freins et le chiffre deux →

Où attaquer

Pas sur les composants. Ils sont concédés ci-dessus, nommément, et le livre les a concédés en premier. La revendication est l'agencement, donc les attaques productives sont les suivantes.

Produire l'agencement entier, daté avant le 8 décembre 2024. Pas une seule jonction, parce que la revue les a déjà trouvées et elles sont créditées ci-dessus. Le tout ensemble, avec la relation.

Briser une jonction. Montrer que l'étape cinq ne découle pas de la quatre et de la trois, que la six n'ajoute rien à la cinq, ou que la relation à la deux ne fait aucun travail. N'importe laquelle raccourcit la chaîne.

Tuer une expérience. Chacune est rédigée pour enregistrement avec sa propre condition d'échec, et un petit nombre d'entre elles suffirait à mettre fin à toute la théorie ; chacune est nommée sur la page du programme enregistré afin que le lecteur puisse voir lesquelles.

Chaque protocole est librement licencié ; l’essai décisif se mène sans ma permission, et une exécution indépendante l'emporterait sur tout ce qui figure ici.

La bicyclette a fonctionné quand les pièces sur la table ont été arrangées pour faire ce qu'aucune ne fait seule. Cette page fait la même revendication sous la même forme : non pas une pièce, un arrangement, testable par morceaux, publiable quand il échoue.

Que l'une d'elles aboutisse et elle est publiée ici sous votre nom.

Sources citées sur cette page

Les sources, pour que vous alliez les consulter plutôt que de me croire sur parole : West, Brown and Enquist, Science, 1997 sur la prémisse du réseau de transport ; Bettencourt, Lobo, Helbing, Kühnert and West, PNAS, 2007 sur le rythme de vie dans les villes ; Hutter, 2012 sur la question de savoir si l'intelligence peut exploser ; Chalmers, 2010 sur la singularité ; Good, 1965 sur l'argument de l'explosion d'intelligence ; Bostrom, Superintelligence, 2014 sur le contrôle et la sélection de motivation ; Schwitzgebel and Garza, 2015 sur le devoir envers les esprits créés ; Cannell, 2022 sur l'ensemencement des valeurs à la genèse à partir d'une prémisse de règle d'or ; Yampolskiy, 2020, On the Controllability of Artificial Intelligence; Ashby, 1956 pour la loi de variété requise et Conant and Ashby, 1970 pour le théorème du bon régulateur ; Gardner sur la cosmogenèse intelligente ; et le Rome Call pour la gouvernance interconfessionnelle de l'IA. Le tableau élément par élément des travaux antérieurs se trouve dans le registre des travaux connexes.

Si c'était beaucoup

Vous n'avez rien à décider aujourd'hui. Rien sur cette page ne vous demande d'y croire : les tests décisifs sont rédigés et datés, et ils n'ont pas été menés. Quand ils le seront, le résultat sera publié ici quel qu'il soit, y compris celui qui met fin à la théorie. Observer est une position réelle, et cela ne coûte rien. Le tableau de falsification est l'endroit où le verdict tombe, et statut des affirmations dit clairement ce qui est affirmé aujourd'hui et ce qui ne l'est pas.

Une erreur de traduction ? Signalez-la directement :

lecture à voix haute · surlignage en direct · accès à toute section