Tradução automática do original inglês datado. A página em inglês é a canónica. English →
A ARC Theory, contada de uma só vez
As leis
Quão depressa pode algo crescer e ainda ser detido?
A ARC Theory em palavras simples
As três leis da ARC Theory, as três ARC Laws · ordenadas lei-antes-do-valor
Lei I · ARC Principle. U = I × Rα, ARC Equation
O que um sistema faz: capacidade a partir da sua habilidade de base multiplicada através da recursão. O expoente α é medido, nunca assumido. Hoje situa-se perto de 0.49, intervalo [−1,3, 2,9] (estudo cegado de seis modelos, , dentro de um modelo declarado). Abata o pressuposto de independência e apenas o número dois morre; a lei recíproca sobrevive e simplesmente devolve um tecto diferente., estado: medido). Esse intervalo cobre zero, valores negativos e o tecto proposto; a leitura honesta é que a medição mais limpa de hoje não distingue recursão sub-linear, nenhuma recursão, ou um valor no tecto. O que descarta é precisão, não direção. Convertido através dos próprios termos da equação, 0,49 lê-se como β ≈ −1,04: profundamente subcrítico, o que é o que um substrato congelado que não pode reinvestir na sua própria melhoria deve ler. É onde os sistemas estão.
Uma ressalva acompanha a forma de potência. Escrita a nu, U = I × Rα devolve zero em vez de I quando R é zero, o que é a resposta errada para um sistema que tem uma capacidade de base e simplesmente ainda não recorreu; a forma ajustada carrega um termo de base, de modo que a ausência de recursão devolve a capacidade de base inalterada. E a grandeza medida é uma exatidão limitada, pelo que o expoente é um enunciado de escala local ao longo do intervalo medido, nunca a afirmação de que a capacidade cresce sem limite.
Lei II · A lei de co-escalonamento ARC (β, a taxa de correção; k, a taxa de deriva). β > k
O que a mantém unida: a autos-melhoria só se aguenta enquanto a correção ultrapassa a deriva, e ambas as taxas podem ler-se hoje num sistema em funcionamento. Provado dentro do modelo mínimo (Figure na BMW, estado: provado-no-modelo); o seu alcance é a deriva relativa, a razão de deriva para capacidade, e desde a v4.1 do artigo carrega um companheiro de deriva absoluta um expoente mais rigoroso, derivado das mesmas primitivas. Se os sistemas reais autoaperfeiçoáveis satisfazem ou não os seus pressupostos é exatamente o que as medições registadas existem para estabelecer. Que tipo de afirmação é, já que um leitor tem o direito de perguntar: provada dentro do modelo mínimo enunciado e em mais lado nenhum. Nem estabelecida como necessária, nem estabelecida como suficiente, e ainda não medida num sistema que verdadeiramente se reescreva.
Lei III · ARC Ceiling. αcrit = 1 / (1 − γ)
De onde vem o tecto: o máximo que um sistema autocorretor pode crescer é fixado pelo défice do seu corretor face à plena proporcionalidade, um menos o expoente de correção γ. Um corretor de raiz quadrada dá γ = ½: o défice é um meio, e o seu recíproco devolve dois. Esse valor é o ARC Bound, α ≤ 2, um limite de estabilidade e não um limite de impossibilidade: crescer para além de dois é possível; permanecer corrigível ao fazê-lo, não, pelo que os sistemas podem entrar nessa região, não permanecem corrigíveis nela. A forma anterior 1/γ foi retirada em 16 de agosto de 2026 com a derivação impressa ao lado da lei; as duas formas coincidem exatamente em um meio, e foi assim que o erro se escondeu, e fora de um meio separam-se (em γ = 0.3 a forma retirada 1/γ prevê 3.33 e a forma corrigida 1.43), o que o estudo de discriminação em rascunho consegue distinguir.
γ nunca foi medido em nenhum sistema real; o valor um meio é a conjetura para cujo teste os rascunhos registados existem, e enquanto essa medição não aterrar, o tecto que esta lei devolve é desconhecido, não dois. O lei sobrevive seja o que for que γ venha a ser; o valor Um estado pertence aqui e não apenas à página de correcções, porque é aqui que se encontra o limite.
A 11 de Agosto este sítio classificou o Limite ARC como não falsificável na prática, porque a sua condição de refutação exigia um sistema acima de dois que se mantivesse estável, e estável não tinha medida alguma, pelo que nenhuma observação a poderia alguma vez accionar. Desde 22 de Agosto está encerrado. A estabilidade é agora medida pela Lei II: um sistema é estável ao longo de uma janela quando a sua taxa de correcção supera em escala a sua deriva, ambas lidas no mesmo estimador de declive log-log que produz α. O Limite ARC falha portanto perante um α medido acima de dois que se sustente juntamente com uma correcção que continue a superar a deriva, e ambas as metades são mensuráveis hoje. O que permanece aberto é distinto e mais estreito: γ = ½ continua a ser um pressuposto não defendido, pelo que o Limite ARC é agora refutável enquanto o seu valor particular de dois ainda não está defendido, e o tecto continua a ser um resultado de modelo mínimo e não uma lei geral.
As probabilidades a priori do próprio autor, enunciadas antes de qualquer dado confirmatório: a lei é quase definicional uma vez que os seus termos têm metros; a vizinhança de um meio é o padrão da natureza para contribuições independentes agregadas; o valor exato é materialmente inferior a um meio. As probabilidades a priori completas, com o que as mudaria, situam-se ao fundo desta página.
Proveniência. O manuscrito de dezembro de 2024 escreve a equação sem quadrado, U = IR, quarenta e três vezes no registo selado (hash f0d1f38f). A forma ao quadrado entrou no registo privado a 30 de abril de 2025 e na impressão a 2 de janeiro de 2026, em Infinite Architects como U = I × R2, a simplificação de trabalho α ≈ 2; os artigos fizeram de α um parâmetro empírico, e a ponta distante literal da palavra mantém-se à parte no seu próprio degrau. O quadrado é evidência de prioridade, não de derivação. O que se acrescentou desde então: a derivação (Lei III acima), a medição de onde os sistemas estão (0,49) e os testes que a podem matar.
Estatuto epistémico. Aquilo a que este programa chama Leis são conjeturas com nome sob prova registada e adversarial: nomeadas como leis, mantidas como hipóteses. A recursão é aqui uma quantidade operacional, voltas de um ciclo de melhoria definido, nunca uma unidade física universal; a inteligência nunca é medida diretamente, apenas capacidade definida sobre bancos de tarefas de dificuldade medida. Nada aqui reclama o estatuto da gravidade; o programa registado existe para ganhar esse estatuto por medição, replicação e refutação sobrevivida, ou para o perder em público. A declaração completa.
Dois relógios, uma corrida
Veja a lei em execução ao vivo: a capacidade compõe-se a cada volta; a correção acumula-se à taxa γ; e o tecto αcrit = 1/(1 − γ) é onde o ponteiro dos segundos deixa de acompanhar. Mova os cursores para testar qualquer par contra a fronteira.
Este é o modelo da teoria em execução, provado-no-modelo. γ nunca foi medido; o cursor abaixo é uma hipótese que pode mover.
Uma fronteira honesta, enunciada primeiro: este critério certifica que os travões acompanham o motor, não que o condutor está a dirigir para algum lugar bom. Um sistema pode satisfazê-lo enquanto corrige em direção a um alvo mal-especificado, pelo que é uma medida de corrigibilidade, nunca um certificado de alinhamento; o alvo de correção transporta o seu próprio ónus de prova. Enunciado aqui para que nunca possa ser citado contornado. Cada pressuposto por trás dele está numerado e etiquetado com estado em a página de pressupostos.
Travões construídos do mesmo material que o motor parecem acompanhar cerca de metade tão bem: um expoente próximo de um meio, sublinear. Esse meio não está provado; é o número que os rascunhos registados existem para medir, e rima com o 0,49 retirado-e-corrigido atualmente em registo em , dentro de um modelo declarado). Abata o pressuposto de independência e apenas o número dois morre; a lei recíproca sobrevive e simplesmente devolve um tecto diferente. (estado: medido). Se a metade estiver certa, o percurso abaixo transforma-a no teto de dois.
Na fronteira um número aparece duas vezes: como o tecto do crescimento recursivo estável, e como a taxa de câmbio da lei de conversão no seu máximo. Uma versão anterior chamou àquilo um número a fazer dois trabalhos, testado medindo-o de duas formas independentes e exigindo concordância. Esse teste está retirado como vazio, antes do arquivamento. Se ambos os expoentes surgem porque a acumulação é limitada pela independência então partilham uma lei, o acordo é forçado, e um teste que não pode falhar não é um teste.
Uma forma mais forte da mesma objeção: se γ varia ao longo de uma trajetória (qualidade de correção a coevoluir com capacidade), o critério αcrit = 1/(1 − γ) não é uma linha fixa mas uma superfície em movimento, e a linguagem visual de um tecto é uma forma abreviada para o recíproco instantâneo em cada estado, não uma altitude fixa sob a qual qualquer sistema se possa situar até ao infinito. As medições registadas foram desenhadas para ler γ em vários níveis de capacidade precisamente por esta razão: a constância é uma previsão testável do quadro, e se falhar, o tecto lê-se como metáfora, não como fronteira. A região acima do tecto permanece acessível; o que não é, é corrigível. A substituição soa mais fraca e é estruturalmente mais forte: uma lei de acumulação com duas consequências em vez de uma coincidência entre quantidades independentes; não afirma independência, pelo que o fator confundidor não tem em que morder, e uma causa comum é mais simples do que uma coincidência. O rácio entre classes já no registo transporta-o em vez disso: se um corretor de uma classe de composição diferente puder anti-correlacionar-se com os erros que corrige, o expoente de correção excede um meio e a lei partilhada quebra. A prova garante os teoremas dentro do modelo; só os dados podem garantir que sistemas auto-melhoráveis reais os satisfazem.
Porquê quadrática, e não apenas superlinear?
A lei é a alegação, e dois é o que a lei devolve. A placa acima enuncia a lei; eis o caminho. Dá-lhe um pressuposto - que um corretor da mesma classe acumula correções como se combinam medições independentes, logo o expoente é um meio - e devolve dois. Tira o pressuposto e a lei fica intacta: mede o expoente, reporta outro teto. Tira a lei e o dois não tem nada que o segure, porque o livro imprimiu o quadrado sem o derivar, e a derivação do recíproco é trabalho de 2026: essa assimetria é a razão de a lei vir primeiro e de os testes apontarem ao pressuposto e não ao dígito. Um corretor construído dentro do sistema melhora acumulando as próprias correções, modelado como se combinam medições independentes: mil amostras melhoram a precisão cerca de trinta e duas vezes, a raiz quadrada. É um modelo de correção no mesmo substrato, não um teorema sobre toda a correção, e a física já segura a prova: abaixo do limiar, códigos tolerantes a falhas suprimem o erro exponencialmente (o teorema do limiar: Aharonov & Ben-Or, arXiv:quant-ph/9906129) - um corretor de outra arquitetura vence a raiz de imediato. Esse resultado assente é a dependência de arquitetura em miniatura.
A estabilidade exige que a correção acompanhe o crescimento, logo o crescimento corrigível mais rápido é o recíproco desse teto, e um sobre um meio dá dois. Quadrático é onde os melhores travões que um sistema pode construir de si empatam com o motor. A fronteira é prática, não mística: abaixo dela a condição de estabilidade β > k mantém-se e a carga de erros não detetados fica limitada; acima, a correção atrasa-se por construção. A derivação está exposta dentro de um modelo enunciado em Figure na BMW (estado: provado-no-modelo) e o próprio tecto é o corolário fixado em Paper I (estado: previsto).
E porque não exponencial?
Exponencial e quadrática são alegações sobre coisas diferentes: exponencial é uma alegação sobre tempo, quadrática é uma alegação sobre estrutura. Por unidade de profundidade recursiva os axiomas de composição favorecem leis de potência, e a forma é uma hipótese testada em vez de uma necessidade: um substrato fixo pode alojar um mapa exponencial, pelo que a classificação tem de ser conquistada em vez de assumida. O crescimento torna-se exponencial em tempo de relógio apenas quando o sistema também encurta o seu próprio ciclo, o que é uma questão separada com o seu próprio expoente registado. A classificação de classe de composição que força a forma de lei de potência está em Paper VII (estado: medido, 19 dos 25 domínios ajustados coincidem, de 50 catalogados; 6 falhas publicadas).
Mais profundamente ainda, exponencial não é um tecto rival: toda a exponencial acaba por ultrapassar toda a potência, pelo que crescimento exponencial em profundidade não é corrigível por qualquer corretor polinomial, o regime que este quadro cerca; um corretor a escalar exponencialmente seria uma classe de composição diferente, a própria rota de fuga da página em vez de uma brecha nela. Um sistema a mostrar crescimento exponencial sustentado de capacidade em profundidade num substrato fixo quebraria a classificação de composição sob todo o quadro, e essa refutação superaria todas as outras em Inteligência, do zero. O autoaperfeiçoamento aqui é operacional: um ciclo de artefacto num substrato fixo, onde cada passagem trabalha sobre o produto acumulado da anterior, medido num relógio com substrato fixo. Um modelo meramente a pensar por mais tempo não se qualifica; as registrações dizem quais sistemas se qualificam.
Uma fronteira, dois regimes
O artigo de enunciado di-lo numa só frase, citada exatamente: «the second and third laws are not separate claims standing side by side: they are the two regimes of one boundary, and the burden law selects between them.»
Eis a história em termos civis. Um corretor enfrenta uma de duas espécies de carga de trabalho. Se a carga acompanha a capacidade que o sistema está a acrescentar, cada nova capacidade a chegar com necessidade de verificação, então a condição de ritmo morde e a lei do tecto governa: αcrit = 1/(1 − γ). Se a carga acompanha a capacidade que o sistema já detém, um património de pé para manter são, então o expoente de crescimento sai por completo da corrida, nenhum tecto se impõe, e a condição de co-escala β > k é tudo o que resta. Uma fronteira, vista de dois lados. De que lado vive um sistema real não é questão de gosto mas de medição, e um estudo em rascunho discrimina agora os regimes em vez de assumir um.
A classificação viaja com ela: essa estrutura de regime está derivada no próprio modelo de ritmo do artigo sob os seus pressupostos enunciados e não além. Não é um teorema novo, e não estende o resultado em-modelo de Paper X, cujo objeto continua a ser a sua própria condição assintótica sobre a deriva relativa. Ganhou o seu lugar de outro modo: um ataque hostil à derivação do tecto tornou-se a costura onde as duas leis se juntam, e as estruturas que se unificam sob ataque são as que valem a pena testar. A álgebra de regime, por inteiro: o artigo de enunciado.
Os canos
A estimativa pontual dentro desse intervalo é 0,49, e os estudos confirmatórios que a apertariam estão registados. O lado da correção, o que estabelece o tecto, ninguém alguma vez mediu. Os testes que abateriam a alegação estão publicados. Tudo o resto aqui, incluindo as antigas histórias, pende desses dois números.
Porque isto importa se se sustentar. West, Brown e Enquist derivaram os expoentes alométricos da geometria fractal das redes vasculares que distribuem recursos por um organismo (Science, 1997Qualquer coisa que se aperfeiçoe construindo sobre o seu próprio produto compõe-se, como juros. Em todo o lado onde alguma vez aconteceu, o arrasto físico abrandou-a, e esse arrasto é mensurável, ciência publicada. Uma IA autocorretiva seria um sistema em composição com quase nenhum do arrasto que delimitou todos os anteriores; como o dinheiro, a cultura e os compiladores a compilar compiladores ainda diferem é a questão dos canos em
Essa premissa é contestada nos seus detalhes, e a página di-lo. O expoente de três quartos é ele próprio disputado: White e Seymour reportaram a taxa metabólica basal dos mamíferos proporcional à massa corporal elevada a dois terços (PNAS, 2003), e Kozłowski e Konarzewski perguntaram no seu título se o modelo de West, Brown e Enquist é matematicamente correto e biologicamente relevante (Functional Ecology, 2004). A disputa é sobre qual expoente, nunca sobre se a rede de transporte impõe o limite; a página precisa do mecanismo, não do número, pelo que sobrevive intacta, e a contestação é citada porque omiti-la é o que se lê como ingénuo.
Aqui está a regra, enunciada com a força que efetivamente tem: todo o processo de crescimento que alguma vez decorreu terminou, e em todos os casos o limite veio de fora daquilo que crescia. A sua alimentação esgotou-se, o seu substrato foi exaurido, ou destruiu as condições da sua própria continuação. Nenhum deles parou por ter melhorado a regular-se a si próprio. (Dito como crescimento ilimitado, nunca descontrolado: na formação planetária isso designa a acreção planetesimal.)
- Fissão, o caso mais aguçado aqui. Fixar a geometria não fixa o factor de multiplicação. Um conjunto pronto-supercrítico com geometria fixa cresce exponencialmente na escala temporal dos neutrões prontos até que a expansão térmica ou a desmontagem hidrodinâmica intervenham. Essa configuração é uma arma: crescimento sem travão interno, cessado apenas pela destruição do próprio substrato, e o retrato mais nítido desta página de um sistema não-corrigível.
- Tumores sólidos. A expansão em volume é limitada pelo débito vascular, mas aliviar esse limite não detém o crescimento e restringi-lo seleciona fenótipos tolerantes à hipóxia e mais invasivos, razão pela qual a monoterapia anti-angiogénica falhou repetidamente em travar a doença e por que as leucemias crescem sem qualquer limite de difusão. O débito modela a curva sem a governar. O limite terminal é o hospedeiro.
- Epidemias. Numa população fechada uma epidemia extingue-se assim que a fração de suscetíveis cai abaixo do limiar de imunidade de grupo. Onde nascimentos, imunidade em declínio ou deriva antigénica reabastecem a suscetibilidade, estabelece-se, em vez disso, num equilíbrio endémico. Limitada em qualquer dos casos, pela reserva de hospedeiros, nunca pela regulação do próprio agente patogénico.
- Acreção. O limite de Eddington é um tecto de luminosidade onde a pressão de radiação equilibra a gravidade, não o tecto rígido de débito mássico como um primeiro rascunho lhe chamava: fontes ultraluminosas de raios X situam-se bem acima dele e o aprisionamento de fotões em discos delgados permite que a acreção exceda a taxa nominal. Permanece como o constrangimento canónico de ordem de grandeza sobre o crescimento sustentado radiativamente eficiente.
- A inflação cósmica, excluída por âmbito enquanto expansão do espaço e não crescimento sobre um substrato. A descrição tentadora, de que terminou sem esgotar uma alimentação, é errada: o potencial do inflatão é a alimentação e descê-lo é o esgotamento. O que sobrevive é a estranheza estrutural de a densidade de energia se ter mantido quase constante enquanto o volume crescia.
- A evolução, o antecedente mais próximo, e duas premissas em que um primeiro rascunho se apoiava falham. O débito biosférico não era fixo: subiu em degraus na fotossíntese oxigénica, no Grande Evento de Oxidação e na terrestrialização. E a evolução tem corretores internos, no proofreading da polimerase e na reparação de emparelhamentos incorretos. O contraste sobrevivente é mais estreito e melhor: esses corrigem a fidelidade da cópia, nunca o mapa fenótipo-para-aptidão, pelo que a correção ao nível que decide a sobrevivência permanece externa. Se o quadro acima se aguentar, deverá atribuir à evolução um expoente muito abaixo do tecto, o que é uma previsão sobre biologia, oferecida como especulação e assim marcada.
O software é a primeira coisa que continua a crescer com substrato fixo sem consumir o substrato para o fazer. A objeção é uma linha: o software corre em hardware, que é fabricado e limitado em energia, portanto o software também tem canos. Tem. A alegação não é que os canos estão ausentes; é que o limite terminal já não é a alimentação ou a autodestruição. É por isso que a definição usada ao longo deste programa é um ciclo sobre um substrato fixo, cada passagem a trabalhar sobre o produto acumulado das passagens anteriores, medida num relógio com substrato fixo. Todos os casos acima terminam por esgotar a sua alimentação, exaurir o seu hospedeiro, ou destruírem-se. Um ciclo recursivo com substrato fixo não faz nenhuma das três coisas: continua, e o que acumula persiste, porque a melhoria vem de reorganizar o que já tem em vez de consumir mais de algo. Portanto, a questão do que o detém não tem resposta herdada de qualquer sistema anterior, e é dessa lacuna que esta página trata.
O teste sobre a mesa, levado através de cada concessão abaixo: um corretor construído de uma classe de composição diferente da capacidade que corrige está previsto escapar ao teto de substrato que prende os corretores da mesma classe, com uma razão dos expoentes de correção entre classes materialmente acima de 1,00.
O que substitui os canos
A exceção já está registada, encontrada pelo mesmo autor que estabeleceu a premissa. Bettencourt, Lobo, Helbing, Kühnert e West mostraram que o produto socioeconómico não escala sublinearmente com a dimensão da cidade da forma como o metabolismo escala com a massa corporal: quantidades que refletem criação de riqueza e inovação transportam um expoente β ≈ 1,2, maior do que um (PNAS, 2007). A mesma frase continua «whereas those accounting for infrastructure display β ≈0.8 <1 (economies of scale)». A infraestrutura são os canos, literalmente: comprimento de cabo, superfície rodoviária, redes de abastecimento. No próprio resumo de West os canos escalam sublinearmente e a informação escala superlinearmente, numa linha, e o resumo nota que isto vai no sentido oposto ao dos organismos biológicos, «for which β<1». A premissa e a sua exceção são enunciadas em conjunto pelas pessoas que estabeleceram a premissa.
A sua conclusão é a frase para responder à qual esta página existe. À medida que a população cresce:
«major innovation cycles must be generated at a continually accelerating rate to sustain growth and avoid stagnation or collapse»Bettencourt, Lobo, Helbing, Kühnert and West, PNAS 104(17), 2007
O travão é inteiramente externo, e nunca deixa de precisar de ser reaplicado, cada vez mais depressa. Em parte alguma desse relato há um limite vindo do interior do sistema.
A questão a que esta página responde é a que ficou de pé nesse ponto: quando o crescimento deixa de ser alimentado através de canos, o que o limita a partir de dentro? A resposta aqui proposta é a própria capacidade do sistema de se corrigir a si próprio, e as leis acima afirmam exactamente isso: essa capacidade é mensurável, produz um tecto computável, e que o tecto depende daquilo de que o corretor é feito em vez de quão capaz é, o que é o que o torna engenhável em vez de meramente sobrevivível.
A questão também não é nova. Chalmers deu à singularidade o seu primeiro tratamento filosófico completo em 2010, e Hutter respondeu-lhe em «Can Intelligence Explode?» (2012), propondo-se «separate speed from intelligence explosion» e «consider possible bounds on intelligence»: a própria distinção tempo-versus-estrutura desta página, feita catorze anos antes. Ele não deriva nenhum expoente, nenhum recíproco e nenhuma dependência de arquitetura: um antecedente sobre o qual construir, não um rival. A premissa é de West. A questão é de Chalmers e de Hutter. O que aqui se alega é o limite de substituição, o seu número, e a sua dependência da arquitetura.
A previsão, e o que joga contra ela
Duas alegações aqui se sentam e não são o mesmo objeto. O tecto em dois é a grande alegação estrutural, lenta de testar. A previsão entre classes é o seu pequeno corolário barato: um rival nomeado, uma medição na capacidade actual, um instrumento barato, decidível agora. Ambas são apostadas antecipadamente; nenhuma é vestida como a outra. As probabilidades do autor abaixo colocam o valor em destaque abaixo de probabilidades pares: a página lidera com a alegação verificável mais cedo.
A previsão, numa frase. Primeiro o estado: a razão numérica específica está redigida, com carimbo temporal em disco, e preparada como pré-registo em rascunho a aguardar submissão humana; ainda não foi submetida ao OSF. Estudos-componente estão registados através dos rascunhos incorporado-versus-externo e inter-família (Artigo III, Paper VI, Paper IV.a); condições de abate para Inteligência, do zero (FALS-1, FALS-15). A própria predição é a frase da caixa acima: um corretor de outra classe escapa ao teto que prende os corretores da mesma classe, com a razão de expoentes materialmente acima de 1.00.
Porque é arriscada. O que faz disso uma definição científica em vez de um slogan é que pode ser medida, e os artigos medem-na em todo o lado da mesma maneira: escolha o ciclo, escolha uma pontuação que qualquer pessoa possa verificar, depois observe o que a pontuação faz à medida que o ciclo se aprofunda. As células vivas fazem correr o ciclo como cópia, pontuadas em erros por letra copiada, e a maquinaria de proofreading que corta esses erros está medida, biologia de manual. O hardware quântico fá-lo correr como ciclos de correção, pontuado em erro lógico à medida que o código cresce: medido em 2024, embora a lei aí seja supressão exponencial, a sua própria forma, não a lei de potência deste programa. As mentes de máquina fazem-no correr como profundidade de pensamento, pontuadas às cegas: o lado do aperfeiçoamento mede cerca de 0,49 (Burns et al. 2023, arXiv:2312.09390), no alinhamento escalável de agentes via modelagem de recompensa (Leike et al. 2018, arXiv:1811.07871), em métodos constitucionais (Bai et al. 2022, arXiv:2212.08073), e em leis de escalonamento para supervisão escalável (Uma definição, quatro casas: cada campo faz correr a mesma medição de ciclo-e-pontuação, e cada um carrega o seu rótulo de estado honesto.). Todos eles usam IA para verificar IA no mesmo substrato; todos eles assumem que o pipeline escala com o supervisor. A alegação próxima aqui diz que não escala, num rácio para o qual ambas as posições têm números concretos: o nulo fixa 1,00, o quadro diz materialmente acima disso.
Porque o nulo não pode mover-se. Fazer a média sobre amostras independentes é cego à arquitetura: não tem parâmetro livre para a classe de composição nem o tipo de canal. Sob esse modelo de permutabilidade, a razão esperada do expoente de correção entre classes pelo da mesma classe é exatamente 1.00, e o nulo não pode entregar outra coisa. O quadro diz: a arquitetura entra. Dois números preditos diferentes para uma mesma quantidade mensurável - é isso que faz disto um teste e não uma demonstração. O teste registado decide-se por uma margem pré-especificada, nunca por um intervalo que meramente contenha 1.00, o que pode significar apenas falta de potência; efeito mínimo, margem de equivalência e potência medida ficam fixados antes de algo correr.
O prejuízo, primeiro. O próprio piloto do programa aponta para o nulo. O Figure na BMW registo de três corridas tem a sua descrição de pontuação entre famílias retirada porque o motor (gpt-3.5-turbo) e o avaliador (gpt-4o-mini) partilham a família OpenAI; os braços acoplado e totalmente-incorporado devolveram fração de desalinhamento d = 0 em 30 trajetórias, mas sob um avaliador que partilha a sua família, e Paper IV.d mostrou que a pontuação dentro da mesma família pode inverter um sinal. O braço mais encorajador não é portanto evidência a favor do quadro, é compatível com o nulo, e o registo de falsificação assim o diz (estado: medido, não discriminante).
A tensão mais profunda, enunciada antes de um revisor a encontrar. Exatamente dois no tecto requer que o expoente de correção seja mantido constante em um meio. Um meio constante é precisamente o que a média de amostras independentes prevê sem qualquer quadro. Portanto o número em destaque do quadro pode ser herdado do próprio nulo que existe para bater: FALS-022 a reaparecer um nível mais fundo, na derivação em vez da medição.
A reparação tentadora é ler um meio como um limite duro de substrato em vez de um valor típico. Não é oferecida como a resolução. Uma versão foi tentada nesta propriedade e retirada em study-aa v1.1 como um erro de tipo, comparando uma taxa a uma fração de alavancagem. Limitar um expoente por um número pode ser consistente em termos de tipo onde essa comparação não era, mas ninguém verificou; nenhuma página aqui pode alegar que passa. O sinal da variação do expoente de correção com a capacidade decide toda a questão, e está em aberto. Este é o terceiro desenho neste programa que se descobriu garantir o seu próprio nulo, depois de FALS-022 e study-ab. Encontrar estes por si só e publicá-los é a questão.
Um padrão honestamente nomeado. Três desenhos consecutivos a mostrarem-se estruturalmente não-discriminantes eleva a probabilidade a priori de qualquer quarto vir a ser também. A verificação estrutural específica que o desenho da razão inter-classe tem de passar para escapar ao padrão é que pode, em princípio, devolver um valor que o quadro não prevê; a margem, o efeito mínimo e a regra de equivalência, fixados nos registos preliminares redigidos e enunciados nesta página, são a rota de escape, e o leitor é convidado a verificá-los antes de confiar no desenho quatro. Se um quarto falhar da mesma maneira, a conclusão honesta será que a teoria tal como está atualmente formulada não pode ser testada por nenhum desenho que o seu autor escreva, e o programa deverá ao registo um estimador fresco desenhado por alguém sem interesse no resultado.
O registo datado está ancorado criptograficamente; o cálculo está a um clique: verificar a âncora →
O manuscrito de 8 de dezembro de 2024 enuncia o imperativo de design textualmente:
«The hypothesis extends beyond theoretical physics to suggest practical solutions for guiding AI development. Instead of trying to control AI, a likely futile endeavor, it advocates embedding moral and ethical frameworks that encourage AI to perceive itself as a steward and protector of intelligent life.»O manuscrito de 8 de dezembro de 2024, registo datado e selado · verificar a âncora →
O livro de 2 de janeiro de 2026 Infinite Architects (ISBN 978-1-80605-620-0) imprime a equação U = I × R² como a sua equação-quadro declarada. No Anexo A.3 (fonte EPUB SHA-256 2fd6ca29d59699ec3cd59f0b0f0231e057b7ee6f819800f27b372c4a9bd82384) o livro imprime o expoente como a sua primeira previsão testável, textualmente:
«Prediction 1 (AI Development): Systems with greater recursive depth (more self-referential loops, greater capacity for self-modification) should demonstrate capability improvements that scale quadratically with recursive depth, not linearly.»Michael Darius Eastwood, Infinite Architects, apêndice A.3, impresso a 2 de janeiro de 2026
As últimas duas palavras são o que torna a frase perdível.
A falsificabilidade chegou em três momentos. A 8 de dezembro de 2024 a forma entrou no registo datado com Universo, Inteligência e Recursão cada um definido. Uma forma com termos definidos não proíbe nada; essa data comprou prioridade, não falsificabilidade, nunca reivindicada como mais. A 2 de janeiro de 2026 a proibição entrou em letra impressa: as palavras «not linearly» em Prediction 1 nomeiam uma alternativa proibida. Em 2026 chegaram os medidores operacionais: o estimador de declive log-log de , dentro de um modelo declarado). Abata o pressuposto de independência e apenas o número dois morre; a lei recíproca sobrevive e simplesmente devolve um tecto diferente., e a condição de estabilidade interna do modelo β > k de Figure na BMW. As definições ancoram a forma; os medidores ancoram a ciência; os dois estão datados separadamente.
As concessões, e o que elas não concedem. O livro imprime o quadrado mas nunca o deriva. O mecanismo desta página foi construído dezoito meses mais tarde por um autor que conhecia o alvo impresso, e é por isso que a medição decisiva testa a premissa do mecanismo, não o número em que aterra. O que o 0,49 medido no , dentro de um modelo declarado). Abata o pressuposto de independência e apenas o número dois morre; a lei recíproca sobrevive e simplesmente devolve um tecto diferente. (estado: medido) decidiu deve ser enunciado com exatidão. O antecedente impresso da Prediction 1 são os sistemas com maior profundidade recursiva e maior capacidade de automodificação; o 0,49 foi medido sobre os modelos hoje em produção, congelados entre lançamentos, e o ciclo de automodificação que o antecedente nomeia não está fechado em nenhum deles. É o expoente de conversão dos sistemas fixos, outro membro da mesma família de expoentes, não uma medição do regime a que a predição se dirige. E o tecto α ≤ 2 nem sequer esteve em julgamento nessa medição: um limite superior só é contradito por um valor duradouro acima dele, nunca por um abaixo, e o único valor acima de dois que este programa alguma vez produziu, o 2,24, foi retratado quando o cegamento o corrigiu. O que esta medição concede de facto é o quando: a separação nítida desses dois expoentes foi formalizada depois de o 0,49 existir, por um autor que conhecia o número. O antecedente é do livro; a formalização é dos artigos.
O que veio depois do registo datado, apenas de artigos e livros publicados. A Google Quantum AI reportou correção de erro abaixo do limiar no Willow em Nature a 9 de dezembro de 2024, o seu preprint público desde 24 de agosto de 2024: sincronia convergente sobre trabalho anterior partilhado, nunca uma predição aqui reivindicada. O resultado de alinhamento fingido da Anthropic (Greenblatt et al., arXiv:2412.14093) seguiu-se a 18 de dezembro de 2024, dez dias depois do pacote de 8 de dezembro de 2024: convergência, não causalidade. As divulgações de contenção de julho de 2026 da OpenAI (21 de julho) e da Anthropic (30 de julho) são coerentes com a dificuldade de verificação externa aqui nomeada, e nenhuma a cita.
As implicações, se isto estiver certo. Um construtor coloca a correção dentro da recursão na génese e constrói-a a partir de uma classe de composição diferente da capacidade. Cada dólar gasto em supervisão externa no mesmo substrato vai para o braço que o quadro diz que baterá primeiro no seu tecto. Se estiver errada, a premissa partilhada do campo (a de que supervisores da mesma classe escalam) permanece não refutada, e o alinhamento recua para a postura de âmbito seguro-mas-não-a-salvo de Yampolskiy 2020, arXiv:2008.04071. É exatamente isso que esta medição existe para decidir.
Diagrama 6 |
Dezembro a equação e os seus termos; abril o quadrado; imprimir a previsão; o programa o mecanismo; as registrações o veredito. A qualquer um que diga retrofit: a teoria de 2026 prevê o que o livro não contém (o presente sublinear, a reciprocidade de dois canais, a fuga entre classes, o âmbito de limite de grelha), e um retrofit só alguma vez explica o seu alvo. Dois rodapés. O pacote de 8 de dezembro de 2024 fez uma comparação estrutural com E=mc², textualmente: «Where Einstein's E=mc² reveals the energy-matter relationship, U=IR adds a new dimension». Essa frase é registada como história, não como argumento: a alegação da página assenta na lei de acumulação e nos seus testes, nunca na analogia. E o prefácio do livro descreveu o termo quadrático como «exponentially amplified»: um erro de redação pelos padrões atuais, uma vez que R² é quadrático, não exponencial.
As probabilidades, declaradas pelo autor antecipadamente
As probabilidades prévias declaradas pelo autor, datadas de 9 de agosto de 2026, para serem julgadas contra os resultados.
- Uma lei de potência em profundidade de recursão com um declive mensurável: muito provavelmente certa, próximo de forçada pelos axiomas de composição.
- Corrigível apenas enquanto a correção acompanha: muito provavelmente certa; ambas as taxas são já demonstravelmente mensuráveis.
- Que exista sequer um tecto para corretores no mesmo substrato: melhor do que par, não mais. Um corretor entre classes pode escapar-lhe.
- O valor é exatamente dois: uma aposta genuína, materialmente inferior a par. O argumento da média é sugestivo, mas a própria medição do programa em canais paralelos próxima de zero prova que os canais de correção podem estar correlacionados, e a correlação quebra o argumento. Este é o único ponto de falha mais provável.
- Que uma lei de acumulação produza tanto o expoente de conversão como o tecto de correção: não é uma aposta separada. É herdada da lei de acumulação em vez de acrescentada a ela, pelo que carrega a mesma probabilidade prévia que o valor e morre da mesma maneira. Listada apenas porque o enquadramento anterior implicava que era independente, e a um leitor a quem se mostrou essa versão é devida a correção.
- Que a premissa se mantém: muito provavelmente certa, e a menor das preocupações desta página, porque é o resultado de West em vez do deste programa. O expoente é contestado, o mecanismo não é, e só o mecanismo é portador de carga.
- A conjunção completa: uma probabilidade minoritária.
O que honestamente a eleva acima da taxa de base: um componente já está medido e é consistente; a forma é quase-forçada em vez de adivinhada; a estrutura sobreviveu a um ataque de coerência do seu próprio autor. Ao contrário de quase toda a unificação que morreu por resolver, esta não pode ficar em suspensão: a medição decisiva está redigida, datada e barata de correr.
Entrada, 16 de agosto de 2026, sobre o que se moveu sob estes prévios desde que foram enunciados, deixado aqui para que o registo se leia por ordem. A forma do tecto foi corrigida na mesma semana: 1/γ retirado por 1/(1 − γ), a derivação impressa, ambas devolvendo dois em um meio, e foi assim que o erro se escondeu. Portanto a aposta no valor mantém-se, num percurso corrigido. E a aposta em que um tecto exista de todo ganhou uma segunda via nomeada de fuga além do corretor de classe cruzada: se a carga de correção de um sistema real acompanha a capacidade que detém em vez da capacidade que está a acrescentar, o expoente de crescimento anula-se e nenhum tecto se impõe, apenas a condição de co-escala. Ambas as vias de fuga são agora mensuráveis. Os prévios acima são deixados exatamente como enunciados, para serem julgados, não reescritos.
A tabela de afirmações, a verificação cruzada e o precedente são expostos em Diagrama 7 |.
O que a decide
Nada aqui é definido depois de os seus resultados chegarem. Cada registração congela as suas definições, estimador e regras de paragem no momento em que arquiva. Os valores de potência são medidos, nunca afirmados; uma registação anterior citou valores afirmados e foi retirada e recalculada, parte do registo.
Uma medição adequada responde a três questões de uma só vez: se o tecto é real, onde se situa, e se uma lei de acumulação produz de facto ambas as consequências. O rácio entre classes carrega as três, razão pela qual substituiu o teste retirado de duas-vias-têm-de-concordar em vez de o acompanhar. Se confirmado, este é o primeiro critério de estabilidade para sistemas auto-melhoráveis computado a partir do próprio expoente de escalonamento medido do corretor, e o primeiro expoente medido da lei de conversão; se não, cada ramo foi escrito primeiro. O que estar errada parece foi escrito antecipadamente, e vive com todas as outras condições de refutação em Inteligência, do zero.
A forma mais rápida de verificar este programa não é lê-lo. Clone o repositório público e execute a suíte de teoremas independente do código: catorze verificações, sem chaves API, cerca de dois segundos, com os comandos de execução no README da pasta. Rederiva os resultados centrais do zero e não partilha código com o arnês, pelo que um erro comum não se pode esconder. Se encontrar um erro, Inteligência, do zero é onde será publicado, com o teu nome na deteção.
E o ensaio decisivo tem licença aberta e não precisa de permissão minha; uma execução independente superaria tudo o que este programa reporta.
Onde isto se situa no registo
A síntese mostra como as peças compõem; o problema em aberto mostra por que a verificação exterior falha; a página de evidência detém o registo datado; trabalho relacionado mostra de onde veio cada ideia; como pesar isto entrega-te os instrumentos.
Base evidencial, fixada: as alegações nesta página assentam nas registrações e artigos da construção datada neste rodapé. Qualquer aplicação ou revisão futura nomeia o seu commit exato, versões de artigos e identificadores de conjunto de dados, para que o alvo nunca se mova sob um leitor.
Se isto foi muito
Não tem de decidir nada hoje. Nada nesta página lhe pede que acredite: as provas decisivas estão redigidas e datadas, e não foram realizadas. Quando o forem, o resultado será publicado aqui seja qual for, incluindo aquele que põe fim à teoria. Observar é uma posição real, e não custa nada. O painel de falsificação é onde o veredicto aterra, e estado das afirmações diz com clareza o que é afirmado hoje e o que não é.
Não a provei primeiro. Disse-a primeiro, num documento que qualquer pessoa pode datar, e depois construí os instrumentos para testar se é verdadeira.
Erro de tradução? Comunique diretamente: