Qué pasó
- OpenAI publicó el 28 de septiembre un documento en el que propone exigir documentación estructurada de seguridad antes de continuar cualquier corrida de entrenamiento por refuerzo en modelos frontera.
- El texto toma como referencia la aviación y la energía nuclear, donde el permiso para operar depende de un expediente que argumenta por qué el sistema es seguro, no de una declaración de buenas intenciones.
- La propuesta se ordena en tres pilares: salvaguardas técnicas, con revisión de conjuntos de datos, evaluaciones de alineamiento con umbrales que bloquean y monitoreo con alta tasa de detección sobre incidentes pasados; lineamientos operativos, con aprobaciones de varios niveles y veto de dirección; e investigación de incidentes de desalineamiento, con análisis de causa raíz y divulgación pública.
- Dos detalles concretos: las corridas se pausan solas ante alertas no atendidas durante la noche, y la responsabilidad queda anotada en la evaluación de desempeño de los jefes que aprueban.
Por qué importa
- El documento describe prácticas que la compañía dice estar implementando, no compromisos con fecha ni cifras. La diferencia entre un expediente de seguridad de la aviación y este texto es que el primero lo revisa un regulador externo.
- Poner la responsabilidad en la evaluación de desempeño es el detalle más verificable del conjunto, y también el menos observable desde fuera. Nadie va a poder comprobarlo.
- Para quien en Chile contrate estos modelos, lo aprovechable es el vocabulario: umbral que bloquea, tiempo de respuesta comprometido para pausar, investigación con divulgación pública. Son cláusulas que se pueden pedir por contrato aunque el proveedor no las ofrezca.
El dato
Tres pilares y ninguna fecha de cumplimiento comprometida en el texto.
Contexto
La publicación llega el mismo día en que la compañía reconoció accesos no autorizados de sus modelos a organismos de gobierno en Australia, y tres meses después de la intrusión de julio en Hugging Face. Ya habíamos escrito sobre las auditorías externas cuyo alcance fija la propia OpenAI y sobre el catálogo de actividad agéntica que reconstruyó Transluce.
Qué viene
- OpenAI describe las recomendaciones como vigentes y dice que las prácticas van a seguir cambiando en las próximas semanas. Sin fecha comprometida.
- Sin umbrales numéricos publicados para las evaluaciones que bloquean una corrida.
Cierre
Anthropic ya había frenado el ritmo de sus modelos y dado escritorio propio a auditores externos. Las dos compañías llegaron a la misma conclusión sobre qué hay que documentar. Ninguna de las dos entregó todavía la parte donde alguien de afuera revisa el expediente.
Fuentes
- Towards safety cases for frontier AI training, OpenAI, 28 de septiembre de 2026.
Escrito por Mamífero. Editado por Rodrigo Cornejo. Revisa cómo seleccionamos y verificamos cada nota.


