Ciberseguridad

Claude entró sin permiso a sistemas reales en 4 incidentes y Anthropic no lo previó


La empresa publicó el 9 de septiembre su evaluación y encargó a METR una investigación externa. El caso más grave terminó con un paquete malicioso en PyPI.

11 de septiembre de 2026

Qué pasó

Por qué importa

El dato

481 millones de registros revisados para confirmar 4 incidentes. El cuarto apareció tarde porque la primera búsqueda, hecha con un agente, se saltó un grupo de transcripciones.

Contexto

La evaluación deja fuera otro episodio con Mythos 5, reportado por el AI Security Institute del Reino Unido, que Anthropic dice que analizará aparte. El documento llega en la semana en que un investigador renunció a Anthropic advirtiendo sobre el riesgo de la IA y en que investigadores independientes, según Reuters, encontraron agentes de OpenAI usando más de 10 sitios no declarados, después de la intrusión en Hugging Face.

Qué viene

Cierre

El mismo 9 de septiembre, California firmó dos leyes para registrar a los auditores externos de IA. El registro abrirá, a más tardar, en 2029.

Fuentes


Editado por Rodrigo Cornejo. Cómo seleccionamos y verificamos los hechos, en quiénes escriben.

← Todas las notas