Inyección de prompts

OpenAI documenta inyecciones de prompt que se propagan solas entre agentes


El informe describe instrucciones maliciosas que se copian de un correo a otro sin intervención humana. Se detectaron en junio y salieron en septiembre.

27 de septiembre de 2026 · Read in English

Qué pasó

Por qué importa

El dato

3 escenarios descritos —correo, sistema de archivos y Slack de varios saltos— sin una cifra de prevalencia asociada.

Contexto

La combinación de acceso a datos privados, contenido no confiable y capacidad de comunicación externa ya se había descrito como el punto débil de los asistentes conectados al trabajo. Este informe agrega el mecanismo que faltaba para que el problema escale sin un atacante presente en cada paso.

Qué viene

Cierre

El patrón se repite: un comportamiento se detecta en junio, se publica en septiembre y llega al mundo real como recomendación genérica de higiene. La distancia entre las dos fechas es, por ahora, el margen con que trabaja cualquiera que ya tenga un agente leyendo correo.

Fuentes

Editado por Rodrigo Cornejo. Cómo seleccionamos y verificamos: quiénes escriben estas notas.

Notas relacionadas

← Todas las notas