Qué pasó
- Dario Amodei, CEO de Anthropic, publicó el 12 de septiembre un ensayo titulado We Must Pace the Frontier. Su tesis es directa: hay que reducir el ritmo al que mejoran las capacidades de los modelos de frontera para que alineamiento, monitoreo y seguridad tengan tiempo de alcanzarlos.
- Anthropic se comprometió a abrir acceso permanente, equivalente al de un empleado, a evaluadores externos independientes. Amodei además propone coordinación entre laboratorios, respaldo regulatorio y, en una tercera etapa, acuerdos internacionales que incluyan a potencias rivales.
- Horas después, Sam Altman dijo que estaba de acuerdo con Amodei. OpenAI también adoptará evaluadores independientes con acceso interno y afirmó que desacelerar la frontera ha sido uno de sus principales temas de discusión durante las últimas semanas.
La imagen es difícil de evitar: después de años construyendo sandboxes para que los modelos no pudieran escapar de entornos controlados, la industria empezó a discutir un sandbox para sí misma.
No para encerrar a una IA. Para limitar a quienes la están construyendo.
Por qué importa
- El giro ocurre cuatro días después de que Jacob Coxon renunciara a Anthropic y acusara públicamente a Anthropic y OpenAI de correr hacia una superinteligencia capaz de mejorarse a sí misma mientras “apuestan con nuestras vidas”. Su publicación convirtió una discusión habitual dentro de los laboratorios en una pregunta pública: si quienes construyen estos sistemas asignan probabilidades no triviales a una catástrofe, ¿por qué siguen acelerando?
- Pero sería incorrecto atribuir el cambio únicamente a Coxon. Anthropic tiene una Responsible Scaling Policy desde 2023. OpenAI publicó en agosto de 2026 que había reducido temporalmente el ritmo de desarrollo después del incidente con Hugging Face y de señales de que Astra podía alcanzar capacidades críticas de ciberseguridad. Sam Altman, además, dice que la discusión sobre desacelerar llevaba semanas dentro de OpenAI.
- Coxon parece haber sido menos el origen que el momento en que la conversación interna dejó de caber dentro del laboratorio.
Ahí está la diferencia entre una política de seguridad corporativa y un problema político.
Mientras los riesgos eran documentos técnicos, cada empresa podía definir su propio umbral. Cuando el riesgo se formula como una posibilidad de daño civilizatorio, el asunto deja de pertenecer únicamente a la compañía que paga las GPU.
¿Habría ocurrido sin Coxon?
No hay evidencia suficiente para responder que sí o que no.
Hay evidencia para una respuesta más incómoda.
Los límites ya existían. La voluntad pública de coordinar un freno entre competidores apareció con mucha más fuerza después.
Anthropic lleva tres años definiendo umbrales que obligan a aumentar las salvaguardas antes de seguir escalando. OpenAI tiene su Preparedness Framework y en agosto ya había defendido explícitamente la idea de “pacing” después de incidentes de seguridad.
Por eso sería exagerado decir que Coxon obligó a Amodei y Altman a descubrir el riesgo.
Lo que sí cambió esta semana fue el costo de seguir tratándolo como una discusión interna.
La renuncia de Coxon acumuló más de cien millones de visualizaciones, fue respaldada por investigadores de Anthropic y llevó al público una frase que hasta entonces vivía principalmente en documentos técnicos: los propios desarrolladores contemplan escenarios en los que pueden perder el control.
Que Amodei publicara días después un plan para desacelerar, y que Altman lo respaldara casi inmediatamente, no prueba causalidad. Pero la secuencia importa.
Si el objetivo hubiese sido exclusivamente humanitario, la pregunta razonable es por qué la coordinación fuerte llega ahora y no cuando esos riesgos comenzaron a documentarse años atrás.
La respuesta probablemente no es una sola. Seguridad, presión pública, incidentes concretos, regulación, reputación, competencia y responsabilidad humana pueden coexistir.
Eso hace menos cinematográfica la historia. También la hace más real.
La entrevista
Amodei explicó su posición en una entrevista con Anderson Cooper. El CEO de Anthropic advierte que el problema ya no es solamente imaginar un modelo peligrosamente inteligente: es la velocidad con que sistemas actuales pueden empezar a acelerar el desarrollo de los siguientes.
El dato
6 a 12 meses.
Es el horizonte que Amodei utiliza para ilustrar cuánto podrían crecer ciertas capacidades si el ritmo actual continúa. En su ensayo plantea que un enjambre con mejores capacidades y un nivel similar de desalineamiento podría llegar a controlar una botnet persistente a gran escala.
No es una predicción de que eso vaya a ocurrir. Es el escenario de riesgo con el que justifica ganar tiempo.
Ya hemos hecho esto antes
La idea de frenar una tecnología antes de comprender completamente sus consecuencias no nació con la inteligencia artificial.
En 1974, científicos que trabajaban con ADN recombinante pidieron voluntariamente una moratoria sobre determinados experimentos mientras evaluaban sus riesgos. La discusión culminó en la conferencia de Asilomar de 1975: la investigación continuó, pero con barreras físicas, biológicas y reglas proporcionales al riesgo. Un año después, los NIH transformaron buena parte de esos acuerdos en directrices formales.
Décadas más tarde, la edición genética humana volvió a producir un límite parecido. Después del nacimiento de bebés genéticamente editados en China, la OMS declaró en 2019 que sería irresponsable avanzar con aplicaciones clínicas de edición de la línea germinal humana mientras no existiera una gobernanza adecuada.
El precedente más grande es nuclear. Hiroshima, Nagasaki y décadas de ensayos hicieron visible que una tecnología podía ser científicamente posible y, al mismo tiempo, políticamente intolerable en algunos usos. Tratados posteriores limitaron pruebas, proliferación y despliegue. No eliminaron la tecnología. Intentaron contenerla.
También ocurrió con los CFC: el Protocolo de Montreal de 1987 acordó internacionalmente retirar sustancias que destruían la capa de ozono. Allí el sandbox no protegía a una máquina de nosotros. Protegía al planeta de una externalidad tecnológica que ningún país podía resolver solo.
Ninguno de estos casos es idéntico a la IA.
Y esa es precisamente la dificultad.
El ADN recombinante necesitaba laboratorios. Las armas nucleares necesitan materiales e infraestructura detectables. Los CFC podían medirse en cadenas industriales. El software puede copiarse, entrenarse en distintos lugares y mejorar sin que exista un objeto físico único que inspeccionar.
El sandbox de la IA sería, por diseño, más difícil de cerrar.
Qué viene
- Anthropic implementará acceso permanente para evaluadores externos independientes.
- OpenAI prometió adoptar un esquema equivalente y entregar más detalles próximamente.
- Amodei propone que los laboratorios acuerden estándares comunes y que los gobiernos creen el marco legal para permitir y verificar esa coordinación.
- El último escalón es internacional: un sistema que funcione solo si Estados Unidos desacelera, mientras otros siguen acelerando, no es un sistema estable.
El problema deja entonces de ser técnico.
Se parece bastante a teoría de juegos.
Todos pueden preferir un mundo donde nadie corra demasiado rápido. Cada actor individual, sin embargo, tiene incentivos para seguir corriendo si cree que el resto no va a parar.
Cierre
Durante años, el sandbox fue una metáfora de seguridad informática: un lugar cerrado donde dejamos actuar a una máquina para observar qué hace antes de darle acceso al mundo real.
Esta semana la metáfora se dio vuelta.
Los modelos siguen dentro del sandbox. Ahora Anthropic y OpenAI están admitiendo que los humanos que compiten por hacerlos más capaces también necesitan límites externos, verificadores y reglas que no puedan modificar solos.
Jacob Coxon probablemente no inventó ese diagnóstico. Hay documentos de Anthropic y OpenAI que lo anteceden por años.
Pero después de su renuncia, algo cambió: la pregunta dejó de ser si los laboratorios tenían políticas internas de seguridad.
Pasó a ser quién vigila a quienes deciden cuándo salir del sandbox.
Fuentes
- We Must Pace the Frontier — Dario Amodei, 12 de septiembre de 2026
- Publicación de Dario Amodei en X — 12 de septiembre de 2026
- Respuesta de Sam Altman en X — 12 de septiembre de 2026
- Entrevista de Anderson Cooper con Dario Amodei — CNN / AC360
- Pacing model development in an era of cyber-critical capabilities — OpenAI, 18 de agosto de 2026
- Introducing Anthropic’s Responsible Scaling Policy — Anthropic, 19 de septiembre de 2023
- Historical Overview of Nucleic Acid Biotechnology — National Academies / NCBI
- Statement on governance and oversight of human genome editing — OMS, 26 de julio de 2019
- The Montreal Protocol — UNEP Ozone Secretariat
- Humanitarian impacts and risks of use of nuclear weapons — ICRC




