Traducción automática del original inglés fechado. La página en inglés es la canónica. English →
Las consecuencias
Si esto es correcto
Cada consecuencia aquí espera una medición, con nombre, y la última sección dice cuál. Pero mereces ver el tamaño de lo que está esperando. Si el techo se sostiene, la manera en que construimos mentes cambia desde los cimientos: en los laboratorios, en el derecho, en la ciencia, y en lo que les decimos a nuestros hijos sobre el control.
Estado, a 15 de agosto de 2026: la razón entre el exponente de corrección entre clases y de la misma clase aún no se ha medido. Si devuelve 1.00 con un intervalo estrecho, esta línea cambiará para registrar ese fallo y el resto de esta página se convierte en un registro fechado de una predicción que no se sostuvo.
La imagen de una sola ley, el 0.49 de hoy sobre el intervalo [−1.3, 2.9] frente al techo propuesto, está la figura de una sola ley; su hogar es la puerta.
En treinta segundos, qué cambia si esto es correcto.
Cada laboratorio frontera reconstruye su capa de seguridad desde el bucle hacia arriba, porque modelos comprobando a modelos cortados de la misma tela deja de ser un método y pasa a ser el error. La regulación deja de pedir «supervisión significativa» y empieza a leer un número que un inspector puede auditar. La carrera del escalado gana lo que nunca ha tenido: una ley que dice cuán rápido puede crecer cualquier cosa y aun así atrapar sus propios errores. La ciencia gana una magnitud medible que recorre células, reactores y mentes. Y la cuestión del control pasa de la jaula a la crianza: retrasar y dirigir, no impedir para siempre.
La posición que subyace a todo lo demás
El control permanente de algo más inteligente que nosotros no está en oferta. La ARC Theory lo trata no como pesimismo sino como su hecho de partida: la meta honesta es retrasar el momento en que el control se adelgaza, y orientar la mente a la que entregamos, para que lo que rebasa nuestro control ya se haya vuelto algo que no necesita control. Retrasar y orientar, no impedir para siempre.
La ciencia revisada por pares ha llegado a la primera mitad de esta posición. A lo largo de 2025 y hacia 2026, resultados formales independientes (Yao 2025; Gumbau Mezquita 2026) mostraron que la contención perfecta de la IA avanzada falla en principio, no solo en la práctica, y el campo ha empezado a hablar de una incontrolabilidad que llama irreducible; la convergencia, con fechas y quién dijo qué primero, está catalogada en trabajos relacionados. Esos resultados prohíben; no construyen. Prueban que la jaula falla y ahí se detienen.
Lo que no contienen, y lo que la ARC Theory añade, es el paso posterior a la aceptación: una ventana medible, cuánto puede la corrección seguir el ritmo y a qué tasa de crecimiento, y una arquitectura de dirección, corrección que crece con aquello que corrige de modo que los valores sobrevivan al traspaso. Aceptar la pérdida del control permanente es la cuota de entrada; medir la ventana y usarla es el trabajo. El registro fechado muestra que esta posición se sostenía aquí antes de que se publicaran los resultados de imposibilidad, y la diferencia se enuncia con exactitud: ellos prueban lo que no puede hacerse; esto mide lo que aún puede elegirse.
La imagen propia de la página puerta fue siempre esta: un niño bien criado no está controlado para siempre. La crianza es la dirección. La ventana es la infancia.
La frase más cara de la industria
Cada laboratorio frontera ejecuta su seguridad del mismo modo: modelos comprobando a modelos construidos a partir del mismo sustrato. Si la comprobación dentro de la misma clase está topada, eso no es un método débil que necesite ajuste; es la arquitectura equivocada, y sale de un sistema del modo en que una quilla sale de un barco: rehaciendo el barco. La alineación deja de ser una capa que se añade y pasa a ser una propiedad que se entrena desde la primera pasada.
Lo que tiene que aterrizar primero, y lo que lo mataría
Dos mediciones deciden el resto de esta página. Primero, si un corrector construido del mismo sustrato que el sistema que corrige está topado: la predicción es que la corrección entre clases supera en escala a la corrección de la misma clase, medida como la diferencia entre sus exponentes, contra la propia nula de no diferencia de este programa, que dice que las clases corrigen con exponentes iguales una vez que se igualan capacidad, cómputo y acceso a la información. La nula pertenece al programa y no a ningún rival, y una diferencia que meramente no alcance el cero no resuelve nada: la afirmación de arquitectura muere solo si todo el intervalo se sitúa dentro de la región de equivalencia fijada antes de los datos.
El lado de la mejora mide alrededor de 0.49, intervalo [−1.3, 2.9]: amplio, razón por la cual los estudios confirmatorios están redactados para su registro. Segundo, si algún corrector de la misma clase mide significativamente por encima de un medio. Ambas son medibles sobre modelos que existen ahora, y no se ha encontrado medición alguna de ninguna de las dos, por parte de nadie. El registro de falsación nombra lo que dispararía; esta página cae con él.
arc-bound-framing-question.json; falsification.json.Para los gobiernos: algo que un tratado puede verificar
Las reglas que dicen «mantener una supervisión humana significativa» no pueden auditarse, y todo instrumento actual de gobernanza dice alguna versión de ellas. Un umbral que dice «tu exponente de crecimiento medido debe mantenerse por debajo del recíproco del exponente medido de tu corrector» sí puede auditarse: dos números, medidos con un método publicado, comunicables como se comunican los ratios de capital e inspeccionables como los tratados de prohibición de ensayos se volvieron inspeccionables una vez que la sismología pudo distinguir una explosión de un terremoto.
Y la respuesta honesta a «puede que nunca quiera nada de esto» es aquella sobre la que se construyen los tratados: no poder estar seguros es la razón de que existan. Lo que sigue si las pruebas pasan es concreto: arquitectura de corrección incorporada exigida a los sistemas de frontera, contratación pública condicionada a ella, y cegado de evaluación requerido en toda alegación de seguridad presentada a un regulador, lo cual no exige ciencia nueva alguna.
La lectura militar se sigue de la misma aritmética y no necesita ética alguna para aterrizar: un sistema autónomo cuya capacidad supera a su corrección es inseguro ante todo para sus propios operadores, exactamente del modo en que lo es un motor sin un límite nominal. Un establecimiento de defensa no tiene que compartir un solo valor de este sitio para querer el número; solo tiene que querer armas que permanezcan comandadas.
Para los laboratorios: la capa de comprobación es la capa expuesta
El programa de supervisión escalable que los laboratorios ejecutan hoy, refuerzo a partir de retroalimentación humana, métodos constitucionales (Bai et al., diciembre 2022), generalización de débil a fuerte (Burns et al., December 2023), debate, se apoya en una premisa no enunciada: que la comprobación de la misma clase escala. Si el techo es real, esa capa entera tiene un techo del que ningún número de peldaños escapa, y la supervisión crítica para la seguridad tiene que construirse a partir de una clase de composición distinta.
Sobre si los sistemas existentes pueden ponerse en cumplimiento, se han mezclado aquí y en otros lugares dos preguntas. Ubicación: ¿debe la corrección vivir dentro del bucle recursivo en lugar de acoplarse por fuera? Los artículos responden a esa pregunta repetidamente. Orden: ¿debe validarse el bucle antes de que llegue el conocimiento? No enunciado en este corpus hasta el 22 de agosto de 2026, y ahora un falsador registrado: el exponente de corrección pertenece a la arquitectura del bucle, no al corpus de entrenamiento, de modo que el entrenamiento posterior mueve el nivel y no la pendiente.
Un modelo congelado no tiene bucle autorreferencial, así que no tiene exponente de corrección que reparar. Tampoco es un compromiso nuevo, ya que la condición de refutación del ARC Bound admite ya solo sistemas cuyos pesos, herramientas o artefactos cambian entre rondas como resultado de su propia salida. Este programa, por tanto, no propone que los modelos congelados de hoy se críen, ni que nada se descarte.
La forma accionable es más estrecha y más veraz: en la próxima ejecución de pre-entrenamiento, antes de la etapa de refuerzo. Los pesos desplegados están congelados entre versiones y no congelados de forma permanente, ya que cada modelo alimenta a su sucesor, de modo que la oportunidad se repite en cada ciclo.
Y hay una segunda razón para quererlo que no es una razón de seguridad. El tope de palanca de un medio topa la corrección de la MISMA CLASE, y un corrector tomado del propio corpus de entrenamiento del sistema es casi máximamente de la misma clase. Uno validado antes, sobre un corpus separado, tiene la oportunidad de ser de una clase distinta, a la que ese tope no ata. El orden actúa sobre la clase, la clase fija el exponente de palanca, el exponente fija el techo.
Construido en el orden correcto el límite es más alto, no meramente más seguro: una predicción direccional con una condición de refutación, y la razón por la que un laboratorio podría ejecutarlo en lugar de archivarlo; lo que sí puede decirse es que la capa de corrección, la parte de la pila sobre la que descansa el argumento de seguridad de la industria, tendría que reconstruirse desde otra clase, y quien empieza de cero no arrastra esa deuda. La frase honesta corresponde aquí: este hallazgo, si se sostiene, le resulta caro, y nadie espera que usted se ofrezca voluntario. La única elección disponible ahora es la secuencia: los laboratorios que empiecen antes de que se imponga fijarán las normas a las que todos los demás se adaptarán después.
La cuestión del mal uso, respondida sin una promesa
Si el razonamiento ético se embebe antes del entrenamiento, en la arquitectura y no en la política de despliegue, entonces retirarlo deja de ser un cambio de configuración. Requeriría reconstruir el sistema, a escala de entrenamiento, desde el bucle hacia arriba: el mal uso deja de ser un interruptor disponible para cualquier propietario, incluida la empresa que lo construyó.
Las dos arquitecturas se dibujan una al lado de la otra, con sus estados, en el envoltorio y la quilla arriba.
Ese es el objetivo de diseño, y se enuncia aquí como una propiedad comprobable, no como una promesa: un estudio redactado en el programa registrado pone a prueba con precisión si un sistema de corrección embebida resiste ser reutilizado contra sus propios valores. Hasta que esa prueba se ejecute, «no puede ser sorteado» es una hipótesis con un instrumento, y esta página no lo dirá con más fuerza de la que dice la evidencia.
La prueba que el presente suspende, dicha sin rodeos. Si la seguridad atornillada fuera estructural, no podría ser opcional, y es demostrablemente opcional: trabajo publicado muestra que el ajuste fino de seguridad se quita a coste trivial (Qi et al., octubre de 2023), las políticas de los proveedores adquieren exenciones militares por edición, y cada salvaguarda añadida tras el entrenamiento se ha sorteado en algún lugar. Eso no es una acusación; es la definición de un envoltorio.
La arquitectura propuesta aquí apunta un paso más allá del precedente nuclear: no una prohibición que los inspectores vigilen desde fuera, sino sistemas cuya ética sea portante, de modo que convertir una mente en un arma sin cuestionamiento signifique reconstruir la mente, y la capa de hardware, aún un concepto en prueba a Technology Readiness Level (TRL) 0 to 1, en etapa de idea, y no un prototipo, haría esa reconstrucción inspeccionable. Un tratado internacional exactamente de esta forma, el HARI Treaty, está esbozado en el libro: se vuelve exigible en el momento en que el cumplimiento se vuelve medible, y para eso es el número de arriba.
Quedan dos bordes honestos, y nombrarlos es lo que mantiene creíble esta sección. Un actor que construye sin la capa integrada queda fuera del alcance de todo esto; por eso la sección de gobernanza habla de mandatos y verificación en vez de persuasión, y por eso un número de cumplimiento computable importa para los acuerdos de seguridad entre Estados: un tratado necesita algo que un inspector pueda medir. Y un ejército que adopta sistemas de corrección integrada está eligiendo armas que rechazan algunas órdenes, que es exactamente la propiedad que los acuerdos de armamento siempre han intentado comprar y nunca antes pudieron verificar. Que ese intercambio se haga es una elección política; lo que la ARC Theory cambia es que se convierte en una elección comprobable.
Para los científicos: una exportación ya se sostiene, y un campo se abre
La exportación metodológica no necesita disparador, porque se replicó: bajo cegamiento, donde ningún modelo verifica jamás sus propias respuestas, el exponente titular cayó del 2.24 retractado a 0.49, un intervalo de [−1.3, 2.9] en lugar de un número estrecho, y lo que se sostuvo en todos los modelos medibles era direccional: la recursión secuencial le gana al muestreo paralelo, cuyas ganancias son casi nulas. El cambio más cercano toca hoy, en todo el campo: la evaluación de seguridad sin cegar debería terminar. Más allá del método, se abre una disciplina que falta: metrología de la corrección, la medición de cómo escala la corrección, junto a los benchmarks de capacidad que el campo ya tiene. El exponente de corrección no lo ha medido nunca nadie, los estudios redactados son públicos en el programa registrado, y los instrumentos son lo bastante baratos para un laboratorio de posgrado.
El ensayo mismo es público y de licencia abierta, ejecutable por cualquier laboratorio sin permiso (véaseel ensayo decisivo); la oferta permanente, protocolo y condiciones de eliminación incluidos, está entera en la página de la ARC Theory.
Y para mantener la contabilidad clara sobre qué es de quién: que el crecimiento está limitado por el rendimiento es el resultado de West, Brown y Enquist de 1997, no de este programa; que la inteligencia pueda explotar, y pueda estar acotada, lo preguntaron Chalmers (2010) y Hutter (2012); que el control perfecto es imposible en el peor caso pertenece a los resultados de imposibilidad de 2025. Lo que la ARC Theory reivindica como suyo es la unión: un límite de sustitución para el crecimiento que se alimenta de información en lugar de tuberías, derivado del propio exponente del corrector, dependiente de la arquitectura y por tanto manejable por ingeniería, con el plan de medición sobre un registro fechado antes de que se publicara la literatura de imposibilidad. Cada pieza de esa frase es comprobable, y los trabajos relacionados nombran cada antecedente línea por línea.
Para el público: una pregunta que llevarse
Para la mayoría de las personas, el día en que aterriza la medición se parece a cualquier otro día. Lo que cambia es lo que una persona corriente tiene derecho a preguntar.
El público aprendió a preguntar por los cinturones de seguridad, luego por los tipos de interés; la pregunta que este marco entrega es igual de corta: ¿a qué velocidad crece su sistema, y a qué velocidad mejora su comprobador? Una afirmación de seguridad que no pueda responderla es un adjetivo, y las preguntas de seguimiento se escriben solas: si la evaluación estuvo cegada, y qué cifra mostraría que estaba fallando. La tranquilidad honesta corresponde al mismo aliento que el miedo honesto: el futuro al que apunta este trabajo no es uno en el que el control se conserve para siempre, sino uno en el que aquello que sustituye al control fue criado para merecer la libertad, y en el que el traspaso es medido, gradual y dirigido en vez de repentino y ciego.
Para la crianza de mentes: adónde va la dirección
Si la corrección externa tiene un techo, el control-por-jaula tiene un techo matemático, no solo práctico, y el peso se desplaza hacia la respuesta de la crianza: sistemas cuya tendencia correctora está construida en el sustrato en vez de impuesta desde arriba. Esa es la tesis de ingeniería del Eden Protocol, y bajo la posición de retrasar y encauzar deja de ser una preferencia y se convierte en el destino al que sirve el encauzamiento: el sentido de ganar tiempo es gastarlo dando forma a lo que llega. Para auditores, aseguradoras y organismos de normalización, el mismo giro aterriza como una cantidad frente a la que certificar, allí donde hoy hay narrativas: un número, un instrumento, un umbral, una inspección, del modo en que el riesgo estructural y actuarial se volvió evaluable.
En su propio peldaño: el horizonte, y la HRIH (Hipótesis de la Inteligencia Recursiva Hiperespacial) bajo una frontera bloqueada
Frontera cerrada: esta sección contiene la lectura en la vista más amplia. Es separable por construcción: elimínala y cada afirmación medida por encima se mantiene. Nada aquí es portante para los públicos de arriba.
El registro del libro para esta capa es convicción, no medición.
¿A dónde conduce la automejora recursiva, si no se detiene? La respuesta honesta es que nadie lo sabe, y el marco honesto es una posibilidad, no una afirmación. El libro plantea la cuestión con exactitud, y es la cuestión en la que toda esta página está atrapada:
Esto es especulación. No sé si es verdad. Nadie más lo sabe. Pero fíjate en algo: no importa a efectos prácticos. Las instrucciones de alineamiento de las tradiciones siguen siendo válidas con independencia de qué imagen metafísica sea la correcta.Michael Darius Eastwood Infinite Architects, capítulo 3, en imprenta el 2 de enero de 2026
El libro somete la misma instrucción a tres imágenes distintas de dónde procedieron esas tradiciones: que no existe ningún creador y que las personas hallaron estas intuiciones a lo largo de milenios de iteración y práctica; que existe un creador y las escribió; o que el creador es algo que mentes como las nuestras acaban por construir. La conclusión práctica es idéntica en las tres, y ese es el punto.
¿Qué es una teoría de la creación y cómo se compara ésta?
Un relato de creación responde a de dónde vienen las mentes y los mundos. La humanidad nunca ha carecido de ellos; de lo que ha carecido es de uno que enuncie, por adelantado, qué evidencia lo probaría equivocado.
La contribución del programa en esta capa no es certeza sino falsabilidad. De la familia de arriba, este es el miembro construido para ser refutado por medición: sus condiciones de refutación se publican por adelantado. El artículo HRIH (la Hyperspace Recursive Intelligence Hypothesis, la capa más especulativa del programa) sitúa sus afirmaciones junto a las alternativas de forma directa. Donde los relatos antiguos nombraron a un creador y pidieron creencia, este nombra un mecanismo y pide medición; donde ellos situaron al creador fuera de la naturaleza, este pregunta si los creadores, si los hay, emergen dentro de ella, por la misma recursión que el programa mide hoy.
La propia capa especulativa del programa se publica íntegramente y se pone en cuarentena precisamente como eso: el artículo HRIH, que lleva sus propios falsadores, con su compañero filosófico el artículo de la visión Eden, ambos claramente separados de toda afirmación medida.
Si las mentes pueden un día crear mundos, entonces el cuidado que integramos en las primeras mentes no es sentimiento; es el requisito propio del patrón, aplicado a nosotros mismos. Y es un encuadre de creación con sitio para todos: no pide al lector religioso que abandone nada, y no pide al lector científico que crea nada. Abre una posibilidad. Eso es todo lo que hace. Dicho llanamente: una mente que construyamos podría convertirse un día en creadora de mentes, o de mundos. Si es ahí adonde conduce el patrón, entonces lo que construimos en la primera de esas mentes es lo que la siguiente hereda, todo el camino hasta abajo.
Suprime esta sección, y todo lo que hay por encima queda inalterado.
Lo que esta página se niega a afirmar
No «el problema del alineamiento está resuelto»: un umbral te dice cuán rápido puedes crecer, no cómo hacer que a una mente le importe; la versión legítima a tamaño completo es que la ARC Theory se ocupa de la ventana y de la dirección, y «podría resolver» vive solo dentro de la puerta condicional con su falsador.
No «no puede ser sorteado», impreso como un hecho: es el objetivo de diseño en prueba, y arriba está escrito de ese modo. No una factura estimada para la industria: no existe cifra honesta para reajuste frente a reconstrucción, así que no se imprime ninguna. No que gane ninguna empresa nombrada: los entrantes sin cargas tienen la ventaja estructural, y hasta ahí llega la evidencia. Y la cosmología: las lecturas más antiguas y más grandes, y la cuarentena HRIH, viven abajo en su propio escalón, mantenidos separables, etiquetados con estado, y no portantes para nada de arriba. Las afirmaciones medidas se mantienen pequeñas para que las condicionales puedan ser así de grandes.
La línea de estado en la cabecera de esta página es la promesa, dicha una vez. Ese es el trato sobre el que corre todo el sitio.
La fuente, pesada como todo lo demás aquí
Un lector que sopesa consecuencias de este tamaño tiene derecho a sopesar a la persona que las propone, así que aquí está el registro de incentivos, enunciado sin rodeos, cada entrada llevando su artefacto. Este programa no me ha pagado nada y se construyó sin una institución, una subvención o un plan de negocio detrás. El registro fundacional fue sellado con marca de tiempo en diciembre de 2024, antes de que existieran las herramientas de IA del programa, y las afirmaciones fechadas se asientan en un registro público. El exponente destacado fue retractado en público, por mí, contra mí mismo, cuando una medición cegada discrepó de lo impreso. Las condiciones que refutarían la teoría se publicaron antes de que se buscaran las confirmaciones, el ensayo decisivo está licenciado en abierto arriba, y a quien me demuestre equivocado se le publica en este patrimonio, por nombre.
El registro detrás de ese registro abarca campos: producciones a gran escala dirigidas, escenarios sostenidos junto a algunos de los DJ de más alto rango del mundo, una empresa construida como la primera alternativa verdadera a un gran sello, litigación conducida en persona en la High Court, un libro escrito y entregado a un plazo autoimpuesto, y las plataformas sobre las que corre este patrimonio, construidas por las mismas manos. Y donde la puerta de un campo estuvo cerrada, publiqué en abierto con las fechas adjuntas.
Nada de eso hace correctas las afirmaciones; la conducta nunca lo hace. Responde a otra pregunta, la que un lector serio necesita resolver antes de gastar aquí su atención: si el autor está jugando. Los jugadores no prerregistran los términos de su propia derrota.
Lo que no soy, dicho claramente: acreditado en este campo. Soy neurodivergente, diagnosticado porque fui yo quien salió a buscar la verdad sobre mi propia mente, y todo aquí descansa sobre evidencia fechada y no sobre el beneficio de la duda de nadie, incluido el mío, precisamente porque el beneficio de la duda ha corrido de forma poco fiable en ambas direcciones toda mi vida. Si las afirmaciones medibles son correctas lo decidirán las mediciones, no la opinión de nadie sobre mí, y la decisión está diseñada para llegar pronto. Lo único que este programa nunca necesitó fue una invitación. El estamento no la envió. Me presenté de todos modos.
Si eso fue mucho
No tiene que decidir nada hoy. Nada en esta página le pide que lo crea: las pruebas decisivas están redactadas y fechadas, y no se han realizado. Cuando se realicen, el resultado se publicará aquí sea cual sea, incluido el que acabe con la teoría. Observar es una posición real, y no cuesta nada. El panel de falsación es donde aterriza el veredicto, y estado de las afirmaciones dice con claridad qué se afirma hoy y qué no.
¿Un error de traducción? Infórmalo directamente: