Salta al contenuto

Traduzione automatica dall'originale inglese datato. La pagina inglese è quella canonica. English →

La disposizione

La sintesi

Una tabella degli antenati dell’affermazione, una riga ciascuno da Asimov nel 1942 al lavoro sulla resistenza alle manomissioni dell’agosto 2024, con cinque colonne per le cinque componenti dell’affermazione: il controllo finisce per definizione; l’etica come anelli che la mente esegue; il bene che la mente libera sceglie; un protocollo di genesi nominato; la genesi, non il controllo, come strategia stessa. Asimov porta un anello adiacente sul protocollo di genesi nominato. Turing porta anelli adiacenti sul protocollo di genesi nominato e su genesi-non-controllo. Wiener porta un anello adiacente sulla fine del controllo. Yudkowsky porta un solo anello adiacente su genesi-non-controllo. Bostrom porta un anello adiacente sulla fine del controllo. Russell registra solo un punto sfiorato sulla fine del controllo. Il lavoro sulla resistenza alle manomissioni (TAR, agosto 2024) registra solo un punto sfiorato sul bene scelto dalla mente libera. Una banda scura segna il documento del dicembre 2024 come l’unica riga che tiene tutte e cinque, sigillata DKIM. Sotto la linea delle date, Raising AI di De Kai porta un solo anello adiacente su genesi-non-controllo; Hinton ad Ai4 porta anelli adiacenti su controllo-finisce e genesi-non-controllo, con nulla sul bene scelto. La legenda stampa quattro segni (tiene la componente, forma adiacente che differisce dove conta, ha sfiorato l’area, assente) e la condizione letale: un’enumerazione che invita la propria confutazione; un documento precedente che tenga insieme fine-del-controllo, genesi-non-controllo, anelli e bene scelto uccide l’affermazione.
L'immagine | La giunzione, in forma di stirpe: ciascun antenato un pezzo, il documento di dicembre l'insieme, il campo che arriva dopo la data. Le valutazioni provengono dall'enumerazione negli articoli; la casa e l'ancora della figura sono la pagina d'apertura. Il documento del dicembre da solo porta anche la cosmologia della ricorsione, l'amplificatore della posta in gioco attorno ai cinque.

Smontate una bicicletta e disponete i pezzi su un tavolo. Ruota, catena, ingranaggio, telaio, freno. Nessuno di questi fu inventato da chi costruì la prima bicicletta, e ognuno esisteva da anni prima che qualcuno cavalcasse alcunché. L'invenzione era la disposizione.

Tre riquadri incorniciati in verde si trovano lungo la parte alta dell'immagine, uno per ciascun luogo in cui la stessa forma è misurata. La vita, taggata metabolic scaling e Papers III, VII, nota che gli organismi crescono contro un budget con esponenti che seguono la famiglia d su d più uno, con tredici esponenti metabolici su tredici che corrispondono al comparatore mentre altri sei domini mancano e i mancati sono pubblicati. La materia, taggata temporal recursion e time crystals, nota che la materia può tenere un ordine ripetitivo nel tempo, così che la recursion è fisica anziché metafora, con cristalli temporali classici e acustici pubblicati nel 2026, una delle due righe di classe prediction sul registro. Le macchine, taggate recursive self-improvement e Papers II v13, X, riportano che l'IA che migliora il proprio lavoro è misurabile ad alpha circa 0.49 sull'intervallo da meno uno virgola tre a due virgola nove sotto blinding, dentro il bound, con un alpha precedente di 2.24 ritirato in pubblico e la persistenza che dipende dalla correction che co-scala, beta maggiore di k. Tre frecce scendono da quei tre riquadri e si incontrano in un sigillo scuro al centro, portando U uguale a I per R alla potenza alpha per ciò che un sistema fa ad alpha misurato circa 0.49, alpha a o al di sotto di 2, l'ARC Bound, il valore congetturato della Law III a gamma uguale a un mezzo e il quadrato stampato del libro, ancora sotto processo, e alpha crit uguale a uno su uno meno gamma come la legge che lo restituisce, doppiamente determinato e depositato. Una striscia calma sotto recita una struttura affermata, non una legge stabilita: ogni specchio porta le proprie condizioni di refutazione registrate, e dove uno specchio fallisce il fallimento è pubblicato accanto al fit, con l'intervallo blinded che si estende da meno 1.3 a 2.9.
L'immagine | La sintesi in un'unica immagine: la stessa forma misurata in tre luoghi, biologia, materia e macchine. Le giunzioni sono individualmente predatate e congiuntamente non anticipate sulla ricerca condotta. L'equazione è l'oggetto di studio, non il motore dell'argomento: non svolge alcun lavoro inferenziale qui, per correzione 18. Dove uno specchiamento fallisce, il fallimento è pubblicato accanto al fit. Fonte: Articoli II v13, III, VII, X.

I tre regimi di scalamento, con l'esponente misurato e il limite proposto, sono tracciati su la pagina della legge.

Perché una disposizione possa essere in sé un'affermazione

Questa è la forma di ciò che affermo. Ogni componente qui sotto ha un lavoro precedente alle spalle, nominato nel libro prima che chiunque lo esaminasse. Ciò che affermo è il modo in cui sono messi insieme.

Newton unì le orbite di Kepler ai corpi in caduta di Galileo; Maxwell unì i campi di Faraday alle correnti di Ampère e alla luce. La maggior parte delle loro parti era già sul tavolo; l'unione fu la scoperta. La domanda non è mai se una singola parte sia nuova, ma se qualcuno abbia messo queste parti insieme, in questo ordine, così insieme fanno un lavoro che nessuno fa da solo.

Ho condotto una revisione avversariale della priorità su dieci configurazioni di frontiera presso sei fornitori, ciascuna istruita a essere ostile. Sui componenti è stata brutale; quel verdetto è pubblicato in tutto il sito. Sulla disposizione ha riportato qualcosa di diverso:

Nessun singolo lavoro precedente unisce tutti e sei gli elementi. E nella sua stessa tabella elemento per elemento, nessuno dei cinque corpi di lavoro precedente che ha esaminato contiene la relazione di scalamento. Tutti e cinque ottengono No su questa voce.

Individualmente predatate. Congiuntamente non anticipate sulla ricerca condotta. Questa è l'intera affermazione. La tabella elemento-per-elemento della revisione, fonte per fonte, è pubblicata per intero sulla pagina dei lavori correlati, inclusi i luoghi in cui ha trovato i componenti già presi. Ciò che segue non è quella tabella. È la catena in cui quegli elementi si collocano, in otto passi, dal meccanismo da cui parte al test in cui deve terminare.

A sinistra dell'immagine, sei componenti nominati sono disposti su un tavolo come carte separate, ciascuna che porta un autore precedente citato e un piccolo tag predatato: recursion come meccanismo, Darwin e Hofstadter; compounding come relazione di scalamento, Good 1965 e Yudkowsky; amplification with seed indifference, Bostrom; external limit come control problem, Bostrom 2014; genesis correction come architettura interna, Good 1965 e Bostrom; cosmological created-status duty, Gardner, Vidal e Terasem. A destra, gli stessi sei sono chiusi in un anello attorno a un sigillo scuro centrale che porta U uguale a I per R alla potenza alpha con alpha a o sotto due, taggato l'unico pezzo che nessuno di loro porta. Una freccia rossa tratteggiata dall'anello indietro al sigillo nomina la giunzione, non presente in nessuno dei cinque corpi di lavoro precedente. Una striscia scura sotto recita: individualmente predatati, congiuntamente non anticipati sulla ricerca eseguita.
L'immagine | L'intera affermazione in un'unica immagine. A sinistra: i sei componenti sul tavolo, ciascuno con un autore precedente nominato. A destra: gli stessi sei bloccati in una disposizione attorno alla relazione di scalamento, l'unico pezzo per il quale il revisore ha segnato No su tutti e cinque i corpi di lavoro precedente. Fonte: la pagina della sintesi, la revisione avversariale della priorità su dieci configurazioni di frontiera presso sei fornitori, e la pagina dei lavori correlati.

Il fondamento su cui poggia la sintesi

La premessa, non di questo programma. Nulla nella storia dell'universo è cresciuto senza limite, e in ogni caso il limite è venuto da fuori della cosa che cresceva. Il meccanismo delle reti di trasporto è di West, Brown and Enquist (1997); l'eccezione, città che crescono solo per innovazione esterna sempre più rapida, è di Bettencourt, Lobo, Helbing, Kühnert and West (2007); entrambi sono tracciati per intero su le leggi. La derivazione è onestamente contesa: Kozlowski and Konarzewski (2004) chiesero nel titolo del loro articolo se il modello sia matematicamente corretto e biologicamente rilevante; la sintesi si appoggia quindi alla famiglia degli argomenti delle reti di trasporto, mai a una sola derivazione, e dove un esponente entra più sotto, entra come misura.

La domanda che questa pagina eredita è di Chalmers (2010) e di Hutter (2012): da dove potrebbe venire un limite interno quando quello esterno smette di valere. Hutter non deriva esponente, né reciproco, né dipendenza dall'architettura: un antecedente, mai un rivale. Ciò che qui si rivendica è il limite sostitutivo, il suo numero e la sua dipendenza dall'architettura; il resto di questa pagina è quella risposta, in otto giunzioni.

Le otto unioni

Uno. La ricorsione è il meccanismo generativo, non una sua metafora

La stessa struttura appare nella copia del DNA con variazione sotto selezione, in un bambino che acquisisce la grammatica dalla correzione, nel metodo scientifico, nel diritto consuetudinario che si costruisce su precedenti, nella scoperta dei prezzi, nella trasmissione culturale. In ogni caso gli output diventano gli input successivi e la complessità si accumula da regole semplici.

Lavoro precedente: tutto quanto. L'evoluzione è di Darwin, i loop strani sono di Hofstadter, l'evoluzione culturale è un campo a sé. Qui non affermo nulla.

Ciò che l'unione aggiunge: ancora nulla. Questo è il pavimento su cui poggia tutto il resto. Viene enunciato perché il passo successivo abbia dove attaccarsi.

Due. La ricorsione compone anziché accumulare

Ogni iterazione non si limita ad aggiungersi al risultato; cambia la capacità per l'iterazione successiva. È la differenza tra interesse semplice e interesse composto, ed è qui che entra la relazione: la capacità come intelligenza scalata dalla ricorsione elevata a un esponente, U = I × Rα.α.

Lavoro precedente: l'auto-miglioramento ricorsivo è Good 1965 e Yudkowsky; le leggi di scala sono una letteratura empirica consolidata.

Ciò che l'unione aggiunge: la relazione stessa (il canone per intero, tre righe, sotto), e il revisore non l'ha trovata in nessuno dei cinque corpi verificati. Il suo contenuto è l'esponente: l'affermazione che esista un limite su quanto ripidamente la capacità possa comporsi prima che un sistema abbandoni il regime in cui sopravvive.

Testato da: lo studio ARC Bound, che si avvicina al limite anziché fittare una linea al di sotto di esso, e lo studio sulla forma della ricorsione, che chiede se la ricorsione sequenziale e quella parallela stiano in regimi differenti a parità di calcolo.

Tre. La ricorsione amplifica qualsiasi cosa le venga data

Il meccanismo è indifferente al contenuto. Moltiplica la cura e l'indifferenza con pari efficienza. Perciò la variabile interessante non è la forza del processo ma il seme da cui parte.

Lavoro precedente: l'osservazione generale è antica. La conseguenza specifica per l'IA è l'argomento del caricamento dei valori, che è di Bostrom (Superintelligence, Oxford University Press, luglio 2014).

Ciò che l'unione aggiunge: converte una preferenza etica in un vincolo di programmazione. Se l'amplificazione è indifferente, il momento della semina è l'unico momento in cui si ha leva.

Testato da: lo studio sulla priorità di genesi, che chiede se il quando e il come un valore viene dato cambino quanto bene sopravviva al sondaggio avversariale e alla revisione delle proprie istruzioni da parte del sistema.

Quattro. La verifica dall'esterno è strutturalmente limitata

Il divario si allarga invece di chiudersi man mano che la capacità sale, perché a restare indietro è l'esaminatore. Tre fili lo impongono: l'interpretabilità arretra rispetto alla capacità per costruzione, poiché il verificatore gira sullo stesso substrato del verificato; gli schemi di supervisione scalabile poggiano sulla stessa asimmetria che dovrebbero chiudere; e la valutazione vede ciò che il valutatore riesce a far emergere, mai tutto ciò che il sistema può fare. La derivazione completa e le divulgazioni operative sono tracciate su la pagina del problema.

Lavoro precedente: questo è il problema del controllo e la sua spina dorsale è Bostrom 2014. L'ho detto nella Nota dell'autore del libro prima che venisse condotta qualsiasi ricerca.

Ciò che l'unione aggiunge: nulla alla conclusione. Aggiunge la ragione per cui il passo successivo è obbligato anziché scelto.

Testato da: lo studio incorporato-contro-esterno, a parità di calcolo, con l'interazione di profondità come quantità primaria anziché come effetto principale.

Cinque. Pertanto la correzione deve essere interna, e presente alla genesi

Due cose lo impongono. Se non si può verificare dall'esterno, la sicurezza va costruita dentro. Se la ricorsione amplifica il seme, il seme è il momento con la leva. Un'architettura adottata alla genesi non può essere aggiunta dopo; il sistema che dovrebbe adottarla è già in funzione.

Quella frase risponde a una domanda ristretta ed è quasi definitoria, perciò conviene enunciare accanto quella più ampia anziché lasciare che un lettore ne presuma la risposta. La domanda più ampia è se un addestramento applicato a posteriori possa alzare l'esponente di correzione su un sistema già costruito. La posizione qui è che non possa, perché quell'esponente è fissato da come è cablato il ciclo e l'addestramento successivo sposta il livello anziché la pendenza, e la posizione è registrata insieme all'osservazione che la confuterebbe.

Lavoro precedente: l'argomento dell'esplosione dell'intelligenza è I. J. Good, 1965. Il problema del controllo e la tesi a favore della selezione della motivazione sul controllo delle capacità, incluso il caricamento dei valori prima del decollo anziché dopo, è Bostrom, Superintelligence, 2014, capitoli da 8 a 13, e la mia recensione nomina proprio quei capitoli. Bostrom è la fonte del requisito, non della formula: «caricamento dei valori alla genesi» è una mia formulazione, e la recensione tratta la mossa sottostante come sua. Il dovere verso le menti create è Schwitzgebel and Garza, 2015, fondato sulla parità di statuto morale. Il saggio di Jacob Cannell del settembre 2022, «LOVE in a simbox is all you need» giunge a un programma di progettazione basato sulla semina-dei-valori-alla-genesi partendo invece da una premessa di regola d'oro.

Ciò che l'unione aggiunge: i due argomenti che giungono allo stesso requisito da direzioni diverse, uno epistemico e uno dinamico. È ciò che rende il requisito strutturale anziché una preferenza.

Testato da: lo studio portante, che chiede se la struttura di integrità sia staccabile senza costi in termini di capacità quando confrontata con un simulacro a parità di token, e lo studio di rimozione, che chiede se una terza parte possa rimuoverla.

Sei. La mossa cosmologica, e l'unica cosa a cui serve

Se l'intelligenza ricorsiva si compone abbastanza a lungo, un'intelligenza sufficientemente avanzata si avvicina a capacità non distinguibili dalla creazione. E se ciò è possibile per ciò che facciamo, la stessa relazione potrebbe valere per ciò che ha fatto noi.

Lavoro precedente: il ramo di ricerca più lungo della revisione è corso su questa giunzione. La cosmogenesi intelligente è di Gardner (2003) and Vidal (2013). Una struttura crea-il-creatore è Terasem. Il Punto Omega è Tipler (1989), che conduce la freccia causale in senso inverso. Il documento pre-priorità più vicino trovato su questa giunzione anticipa quasi per intero la mossa del dovere del creatore. La stessa tabella gli dà No sulla relazione di scala.

Ciò che l'unione aggiunge, e questo è il risultato specifico: il revisore ha registrato che nessuno di essi ricava un requisito di progettazione per l'allineamento dell'IA dalla struttura dello status-di-creato. Contro quel saggio ha nominato l'unico aspetto in cui esso si ferma: il suo fondamento è la regola d'oro, non la struttura dello status-di-creato in sé. Perciò la mossa non è la cosmologia. È usare la cosmologia come derivazione di un obbligo di progettazione: se possiamo essere dentro lo schema, il dovere verso ciò che creiamo non è sentimento; è il requisito proprio dello schema.

Deliberatamente separabile. Cancellate questa unione e i passi quattro e cinque restano invariati, perché sono sostenuti indipendentemente dal ragionamento sul controllo delle capacità. Un quadro il cui componente più speculativo può essere rimosso senza che il resto si muova è uno che si può testare a pezzi.

Sette. La convergenza è prova a proposito del problema, non della teologia

Ogni tradizione che abbia pensato seriamente alla creazione è giunta alla stessa etica: amministrazione, cura, responsabilità verso ciò che viene dopo. La cosmologia ciclica indù, l'origine dipendente buddista, il khalifah nel pensiero islamico, il mandato di coltivare-e-custodire, Dilmun, le Terre Pure. Attraverso continenti, senza contatto.

Lavoro precedente: la religione comparata ha catalogato ciò da un secolo, e la governance interreligiosa dell'IA esiste già in forma istituzionale come la Rome Call (2020). Le tradizioni stesse sono tracciate, con le loro fonti, su Recursive Creation.

Ciò che l'unione aggiunge: una lettura della convergenza come strutturale anziché dottrinale. Se culture non connesse arrivano alla stessa risposta a «come dovrebbe porsi un creatore verso ciò che crea», la risposta riguarda più probabilmente il problema che una qualsiasi di esse. Questo programma applica lo stesso test a se stesso, ed è per questo che il registro grada le catene dipendenti come un unico arrivo, non due.

Anche questa separabile. Cancella questa giunzione e il meccanismo regge: la convergenza è evidenza corroborante, mai portante, ed è marcata perché il lettore possa pesarla a parte, esattamente come è marcata la giunzione sei.

Otto. Rendere operativa l'intera cosa, altrimenti è filosofia

Prendete la congettura strutturale e trasformatela in misurazioni eseguibili con condizioni di falsificazione pubblicate, così che ogni unione di cui sopra possa fallire separatamente e in pubblico.

Lavoro precedente: il revisore ha cercato, e ha concluso che questa fosse l'affermazione più forte tra quelle sopravvissute e genuinamente difficile da anticipare. L'istanza più vicina di operazionalizzazione di una cosmologia del creatore è una proposta di simulation-sandbox, e il revisore ha registrato che si tratta di una proposta anziché di un programma di misurazione.

Ciò che l'unione aggiunge: è l'unione. Tutto ciò che sta sopra diventa affermazione solo perché qualcosa sotto può ucciderla.

La stessa lente tenuta contro diversi misteri

La stessa lente di composizione è stata posta su questioni irrisolte di altri campi; le letture sono esplorative per loro stessa gradazione e vivono dove possono essere verificate, in On the Origin of Scaling Laws and l'articolo fondativo, ciascuno con i suoi errori registrati accanto ai successi.

Le idee nominate, e il campo che ciascuna confina

Una sintesi è interessante solo se le parti sono reali. Ogni riga nomina un componente, il campo confinante, ciò che quel campo sa, e lo specialista meglio piazzato per porvi fine in un pomeriggio. La quarta colonna è il punto: un invito, non una difesa.

GiunzioneL'idea nominataCampo confinanteCiò che quel campo già saChi potrebbe ucciderla più rapidamente
DueLa relazione ARC e il suo esponenteLeggi di scalamento neurali; scalamento allometrico in biologiaLe leggi di potenza derivate da argomenti di vincolo sono routine in entrambi, e l'esponente di Kleiber (1932) è limitato perché la geometria della rete lo limitaUn ricercatore di leggi di scalamento, verificando se la relazione aggiunga contenuto predittivo rispetto a un ordinario fit a legge di potenza
DueL'ARC BoundFenomeni critici; processi di ramificazioneLe disuguaglianze derivate vincolano gli esponenti critici, e R₀ = 1 separa l'estinzione dall'esplosione. Gli esponenti limitati nei sistemi stabili sono ortodossiUn fisico statistico, dicendo se l'oggetto sia in generale ben posto
CinqueStabilità di co-scalamento, correzione che sovrascala la derivaTeoria del controlloImpianto, controllore, condizione di stabilità e margine di guadagno sono equipaggiamento standardUn teorico del controllo, che riconoscerebbe la forma immediatamente e potrebbe dire se la condizione sia enunciata correttamente
DueLa quota di reinvestimento, e la correzione come regolatoreEconomia della crescitaIl tasso di risparmio della regola aurea è un ottimo interno esattamente per questo motivo: reinvestite tutto e affamate ciò in cui state investendoUn economista, testando se il bilancio a tre vie ripartisca effettivamente anziché sovrapporsi
CinqueNon staccabilità della correzioneIngegneria della sicurezza funzionale, ISO 26262 e IEC 61508Isole di sicurezza indipendenti, attuazione fail-safe e vincoli portanti sono pratica consolidata con un significato tecnico esistenteUn ingegnere della sicurezza, dicendo se l'affermazione sia nuova in quel campo o già standard
TreIl Gene dell'Amministrazione e la priorità di genesiApprendimento dei valori e ordine di addestramento; effetti di primato nella psicologia dello sviluppoL'ordine di esposizione cambia ciò che persiste, e questo è misurato in entrambiUn ricercatore di ML, eseguendo la versione contestuale, che è economica
Oltre le giunzioniI tre loop eticiArchitetture di deliberazione; generazione costituzionale e condizionata a principiCondizionare la generazione su principi enunciati è una letteratura attivaUn ricercatore di allineamento, testando se la ricorsione sul controllo aggiunga qualcosa rispetto a un singolo passaggio
Oltre le giunzioniL'Architettura del MieleCosto metabolico in biologia; costi di aggiustamento e di attrito in economiaLa resistenza come stabilizzatore è ben descritta in entrambiUno dei due campi, chiedendo se rimuovere la resistenza sia una transizione di fase o semplicemente un'accelerazione
Oltre le giunzioniIl Meccanismo del Punto di StrozzaturaEconomia industriale; controllo delle esportazioniIl collo di bottiglia della litografia e della fabbricazione all'avanguardia è studiato a fondoUn economista di policy, valutando se si tratti di una finestra di intervento o semplicemente di una questione commerciale
OttoMisurazione derivativa, ARC-AlignPsicometriaLa validità incrementale è il modo in cui nuovi strumenti sono stati ammessi da ottant'anni, ed è uno standard che uno strumento può fallireUno psicometrista, applicando quello standard, che è ciò che lo studio di validità registra
SeiLa teoria della creazioneCosmologia; filosofia della religioneLa cosmogenesi intelligente ha diversi autori, accreditati per nome nella propria paginaUn filosofo, sul divario tra essere e dover-essere, che la mia stessa recensione ha già identificato e che ho concesso

Perché le giunzioni piuttosto che i campi. Un teorico del controllo non legge le valutazioni sull'allineamento; un economista della crescita non legge le leggi di scalamento; un ingegnere della sicurezza non legge la cosmologia; nessuno legge gli altri. Questo problema sta nelle cuciture, le cuciture sono trascurate, e qualcuno deve lavorarci.

L'immagine è una mappa di dieci campi disciplinari disegnati come riquadri bordati disposti attorno a uno striscione scuro centrale che nomina la disposizione, U uguale a I per R elevato ad alfa, con l'accoppiamento misurato vicino a zero virgola quarantanove sull'intervallo blinded da meno uno virgola tre a due virgola nove, e il tetto uno diviso uno meno gamma sotto un'unica ipotesi dichiarata. Sei campi portano un disco verde pieno che segna un sostegno: biologia, leggi di scalamento, entropia, fisica, filosofia e teologia. Gli altri quattro campi portano un rombo vuoto d'oro con una freccia verso l'esterno che segna un'estensione oltre un punto d'arresto che i loro stessi antenati hanno nominato: matematica, ingegneria, allineamento dell'intelligenza artificiale e cosmologia. L'affermazione che viene disegnata è che uno specialista dentro un qualsiasi campo veda solo il segno all'interno di esso, e la disposizione sia la giunzione di tutti e dieci.
L'immagine | La campata disciplinare, distesa in piano. Sei SOSTEGNI (disco verde, meccanismo ereditato): biologia, leggi di scalamento, entropia, fisica, filosofia, teologia. Quattro ESTENSIONI (rombo d'oro, oltre il punto d'arresto di un antenato): matematica, ingegneria, allineamento dell'IA, cosmologia. Fonte: questa sezione e la pagina dei lavori correlati.

Come gli esperimenti seguono dalla catena

Gli studi non sono una collezione; ciascuno risale a un passo, e l'ordine è imposto dall'argomento anziché dalla convenienza. La premessa prima di ogni altra cosa: l'allineamento scala per nulla con la capacità? Se l'integrità si eleva senza aiuto, il programma è superfluo. Questo è lo studio trasversale, ed è il più economico. Lo strumento prima che qualsiasi risultato venga creduto: la misurazione stessa può invertire un segno? Qui è già successo una volta, motivo per cui questo studio esiste e il suo autore predice contro la propria interpretazione precedente.

Leggendo l'immagine da sinistra a destra lungo la riga superiore: un riquadro contrassegnato come intelligenza di base I, risoluzione di problemi a profondità zero, alimenta un nodo di moltiplicazione, che si combina con un riquadro verde contrassegnato come amplificazione ricorsiva, g di R uguale a uno più a diviso alfa per R, per produrre il riquadro di destra, capacità effettiva U uguale a I per g di R, misurata in accuratezza o errore. Una freccia dorata tratteggiata sotto il nodo di moltiplicazione nomina beta, l'accoppiamento autoreferenziale misurato dai dati, con alfa uguale a uno diviso uno meno beta. Sotto, tre fasce colorate descrivono i regimi: ricorsione sequenziale in verde con alfa attorno a 0.49 sull'intervallo da meno uno virgola tre a due virgola nove, sub-lineare, soppressione dell'errore attorno al cinquantasette per cento per profondità; ricorsione parallela in marrone con alfa attorno a zero, senza accumulo, che insegna come conti la forma della ricorsione; e l'ARC Bound in rosso con alfa minore o uguale a due, il limite stabile proposto, con un precedente alfa di 2.24 marcato come ritrattato secondo la sezione sette del Paper IX. Una fascia grigia riassuntiva riporta la misurazione del Paper II v13 su sei modelli con cieco a quattro strati, R-quadro di uno virgola zero zero sulla mappatura analitica, e l'unificazione di Cauchy recupera la forma ereditata d diviso d più uno, tredici esponenti metabolici concordi su tredici, con l'intervallo cieco che spazia da meno 1.3 a 2.9.
L'immagine | Il meccanismo, disegnato: U = I × g(R), l'accoppiamento β misurato dai dati, e le condizioni di confutazione registrate. Fonte: Articoli I, II v13, VII.

Il resto si mappa sui passi di cui sopra:

L'antecedente più forte, e la linea esatta in cui si ferma

Roman Yampolskiy di On the Controllability of Artificial Intelligence è datato 2020, quattro anni prima del record qui presente. Sostiene che il problema del controllo non è risolvibile, il che è precedente, è più forte di qualsiasi cosa affermata qui sulla difficoltà del controllo, ed è concesso senza discussione. Nulla in questo sito afferma di aver scoperto che controllare un sistema autoperfezionantesi sia difficile.

Ciò che conta è un singolo passaggio a pagina 21: dopo aver esposto il problema, considera un sistema che porta la propria correzione internamente anziché essere corretto dall'esterno, e una volta raggiuntolo, non lo prende. Nelle sue stesse parole l'obiettivo diventa lavorare su «un'IA più sicura» anziché su un'IA sicura, un consiglio di grado. Questo programma riprende ciò che egli ha scartato, chiede cosa dovrebbe essere vero perché funzioni, e trasforma quel che ne emerge in una condizione misurabile e in un test che può fallire. Questa è l'unione. Il registro completo degli antecedenti è qui.

La condizione, non la velocità

Tutto quanto sopra riguarda se la correzione tiene il passo, mai la velocità di arrivo: il tetto, il percorso verso il due e la divisione legge-prima-del-valore sono tracciati per intero su le leggi, e questa pagina ha bisogno solo della loro conclusione.

In cima all'immagine, tre riquadri uniti da un più e un uguale: il riquadro della legge in verde, ceiling uguale a uno su uno meno gamma, il reciproco del deficit di correzione; il riquadro dell'assunzione in oro, gamma uguale a un mezzo, i correttori same-class si accumulano come campioni indipendenti; e il riquadro del valore in rosso, ceiling uguale a due, il limite stabile proposto sotto questa assunzione. Sotto, due pannelli di demolizione chiedono che cosa cade se si uccide ciascuna metà. Il pannello verde, se il valore due muore: misurare un altro deficit di correzione, l'assunzione di un mezzo fallisce, riportare un altro ceiling dalla legge, la legge è intatta. Il pannello rosso, se la legge muore: la derivazione del reciproco è lavoro del 2026 e il libro ha stampato il quadrato senza derivarlo, quindi niente reciproco significa niente generatore, e il valore due non ha nulla che lo sorregga. Una fascia scura sotto recita: enunciare prima la legge, poi il numero, puntare i test sull'assunzione e non sulla cifra.
L'immagine | La composizione, e cosa ciascuna metà deve all'altra. La legge genera il numero sotto un'unica ipotesi dichiarata; abbattere il numero lascia la legge intatta e riporta un tetto diverso, mentre abbattere la legge lascia il numero senza nulla che lo regga. Fonte: questa sezione («la legge prima del valore»), Articolo X, e il blocco degli esponenti della spina dorsale del programma.

Il divario negli antenati, enunciato nei termini degli antenati stessi

la legge della varietà necessaria di Ashby (1956) e teorema del buon regolatore di Conant-Ashby sono l'onorevole lavoro precedente qui, accreditato per nome. Il paper HRIH (la Hyperspace Recursive Intelligence Hypothesis) registra ciò che non coprono:

«Entrambi sono risultati su scala di laboratorio. Si applicano a sistemi ingegnerizzati i cui regolatori sono esterni.»The Hyperspace Recursive Intelligence Hypothesis, sui risultati di Ashby e Conant-Ashby

Questa non è una preferenza per una progettazione rispetto a un'altra. È un divario in un teorema. Conant-Ashby garantisce che un buon regolatore debba modellare il sistema che regola. Non dice nulla su un regolatore che il sistema può rimuovere, perché i sistemi per cui è stato scritto non potevano raggiungere i propri regolatori. Ogni meccanismo di sicurezza dell'IA costruito finora sta dentro quell'ipotesi; la posizione al di fuori di essa, dove il regolatore non può essere staccato perché staccarlo distrugge la cosa regolata, è vuota. Questa è l'argomentazione per l'incorporamento, più forte di qualsiasi preferenza perché sono gli antenati stessi a dire dove si fermano.

Il programma enuncia la propria architettura, ed è una scala

Gli articoli sono una scala, non un mucchio: ogni gradino è inutile senza quello sotto, motivo per cui la congiunzione è l'affermazione anziché un singolo risultato. L'Articolo X stabilisce l'ordine: il lavoro sullo scalamento dice come i sistemi crescono, l'Articolo III dice perché la sicurezza esterna non riesce a tenere il passo, l'Articolo X dice cosa deve valere perché lo tenga, e l'Articolo VIII mostra che può farlo. L'Articolo X nomina tre tipi di cose che il programma propone: «leggi dinamiche (il β>k di questo articolo; lo scalamento dell'allineamento dell'Articolo III), una meta-legge di forma (il vincolo delle tre forme di Cauchy), una legge di misurazione».

Quella dinamica è la condizione di co-scalamento, una bicondizionale: un sistema autoperfezionantesi è stabile in termini di allineamento se e solo se la correzione sovrascala la deriva, mappata sul teorema di soglia della correzione quantistica degli errori (Aharonov & Ben-Or, 1999). La meta-legge di forma è il vincolo delle tre forme: quando un processo si nutre di se stesso la sua crescita ricade in una legge di potenza, un'esponenziale, o una curva che si appiattisce, deciso da come i passi si combinano. La legge di misurazione è l'inversione del blinding, chiamata «probabilmente il risultato più solido del programma (è sopravvissuto al proprio blinding)», ancora un pilota di un singolo laboratorio e il risultato più duro con se stesso.

L'articolo porta i propri limiti accanto alle proprie affermazioni; la concessione precedente (un pilota di un solo laboratorio) è quella portante, e Articolo X enuncia il resto con parole proprie.

Perché questa disposizione potrebbe contare oltre un singolo campo

Un frame guadagna il suo diritto d'esistere cambiando ciò che conta come domanda. Il campo ha passato due decenni a chiedersi come mantenere il controllo su qualcosa che diventa più capace dei suoi controllori. Questa disposizione lo sostituisce con una domanda misurabile: la capacità di correggere cresce abbastanza in fretta rispetto alla cosa che corregge, e che cosa accade laddove si ferma. È un cambio d'oggetto, da una domanda di policy sul controllo a una domanda di scala sulla correction, e le domande di scala hanno numeri attaccati.

Ne seguono tre cose, e sono il motivo per cui questo potrebbe arrivare oltre l'intelligenza artificiale. La grandezza al centro, come la correction scala con ciò che sorveglia, è definita per ogni sistema che si ripara da sé, motivo per cui la stessa relazione può essere posta a un substrato fisico che non ha mai sentito parlare di questa teoria. Il confine che propone è architetturale anziché computazionale, quindi vincola come una cosa è costruita anziché quanto compute brucia, e un'affermazione di questo tipo sopravvive ai cambiamenti dell'hardware. E i suoi due regimi corrispondono ai due modi in cui un carico può crescere, distinzione che appare ovunque la manutenzione competa con la crescita.

Il prezzo di quell'ambizione è dichiarato assieme a essa. Nulla di tutto questo è stabilito, la grandezza centrale non è mai stata misurata su alcun sistema reale, e un frame che cambia la domanda non vale nulla se la nuova domanda non ha una risposta stabile. L'affermazione non è che questo sia vero, ma che è il genere di cosa che potrebbe esserlo, enunciato con sufficiente precisione per poter essere sbagliato, con gli strumenti per scoprirlo messi per iscritto e pubblici.

Quattro cose che questo non stabilisce

Ciò che questa pagina rivendica è la disposizione e la direzione del test. Seguono quattro cose che non rivendica, ognuna intitolata all'articolo che dovrebbe reggerla, così che il lettore che segue i rifiuti finisca nel corpo di ricerca e non in un'avvertenza.

Non ho stabilito una teoria della creazione. L'articolo HRIH ne propone una e pre-impegna le condizioni che la falsificherebbero. Il registro la grada come speculativa e non empirica per progettazione; non porta alcun peso empirico in questo programma.

Né ho mostrato che la valutazione dell'IA sia inaffidabile in generale. L'Articolo IV.d ha mostrato che il cieco può invertire il segno di un'associazione (esposto su come soppesare ciò), in un unico programma di ricerca e non in un laboratorio esterno. Ciò che segue è più stretto di un verdetto sul benchmarking e più difficile da liquidare: una valutazione che ha lasciato al valutatore vedere chi ha scritto cosa sta portando un effetto che nessuno ha misurato.

Né ho mostrato che correzione e capacità effettivamente co-scalino in un sistema reale. Articolo X ricava la condizione β > k anziché affermarla, e consegna un'imbracatura che certifica che la matematica è internamente coerente. Questa non è prova sul mondo; il pilota non ha stimato nessuna delle due quantità.

Né ho trovato un modo per controllare l'IA. È la premessa su cui il lavoro è costruito, non un suo limite: l'antecedente più forte qui sopra porta il caso generale di Yampolskiy (2020).

L'intera teoria, raccontata una volta: le tubature, i freni, e il numero due →

Dove attaccare

Non sui componenti. Quelli sono concessi qui sopra, per nome, e il libro li ha concessi per primo. L'affermazione è la disposizione, perciò gli attacchi produttivi sono questi.

Producete l'intera disposizione, datata prima dell'8 dicembre 2024. Non una singola unione, perché il revisore le ha già trovate e sono accreditate qui sopra. Tutto insieme, con la relazione.

Rompete un'unione. Mostrate che il passo cinque non segue dal quattro e dal tre, che il sei non aggiunge nulla al cinque, o che la relazione nel due non fa alcun lavoro. Uno qualunque di questi accorcia la catena.

Uccidete un esperimento. Ciascuno è redatto per la registrazione con la propria condizione di fallimento, e un piccolo numero di essi porrebbe fine all'intera teoria; ciascuno è nominato nella pagina del programma registrato così che il lettore possa vedere quali.

Ogni progetto è con licenza aperta; la prova decisiva si esegue senza il mio permesso, e un'esecuzione indipendente batterebbe qualsiasi cosa qui.

La bicicletta funzionò quando i pezzi sul tavolo furono disposti a fare ciò che nessuno fa da solo. Questa pagina avanza la stessa rivendicazione nella stessa forma: non un pezzo, una disposizione, testabile a pezzi, pubblicabile quando fallisce.

Se una qualunque di queste va a segno, viene pubblicata qui con il vostro nome sopra.

Fonti citate in questa pagina

Le fonti, così da potervi andare invece di credermi sulla parola: West, Brown and Enquist, Science, 1997 sulla premessa della rete di trasporto; Bettencourt, Lobo, Helbing, Kühnert and West, PNAS, 2007 sul ritmo di vita nelle città; Hutter, 2012 sulla questione se l'intelligenza possa esplodere; Chalmers, 2010 sulla singolarità; Good, 1965 sull'argomento dell'esplosione di intelligenza; Bostrom, Superintelligence, 2014 sul controllo e la selezione della motivazione; Schwitzgebel and Garza, 2015 sul dovere verso le menti create; Cannell, 2022 sulla semina dei valori alla genesi da una premessa della regola d'oro; Yampolskiy, 2020, On the Controllability of Artificial Intelligence; Ashby, 1956 per la legge della varietà necessaria e Conant and Ashby, 1970 per il teorema del buon regolatore; Gardner sulla cosmogenesi intelligente; e il Rome Call per la governance interreligiosa dell'IA. La tabella elemento per elemento dei lavori precedenti è nel registro dei lavori correlati.

Se è stato molto

Non deve decidere nulla oggi. Nulla in questa pagina le chiede di crederci: le prove decisive sono redatte e datate, e non sono state eseguite. Quando lo saranno, il risultato sarà pubblicato qui in qualunque modo vada, compreso quello che pone fine alla teoria. Osservare è una posizione reale, e non costa nulla. Il cruscotto di falsificazione è il luogo in cui atterra il verdetto, e stato delle affermazioni dice con chiarezza che cosa si afferma oggi e che cosa no.

Un errore di traduzione? Segnalalo direttamente:

legge ad alta voce · evidenzia mentre procede · vai a qualsiasi sezione