Alucinaciones

Los modelos acumulan la respuesta antes de dudar y la corrección llega tarde


Un análisis sobre diez modelos localiza las piezas que empujan a comprometerse y las que frenan, y muestra que las segundas siempre actúan después.

29 de septiembre de 2026 · Read in English

Qué pasó

Por qué importa

El dato

12,2 puntos de mejora en la precisión de la decisión de responder o abstenerse.

Contexto

Stanford ya había medido alucinaciones de 22% a 94% y modelos que empeoran cuando el error lo introduce el usuario. Este trabajo baja un nivel: en vez de contar cuántas veces falla, describe dónde se toma la decisión que falla.

Qué viene

Cierre

Los escribas de inteligencia artificial del sistema de salud británico confunden fármacos y son los pacientes quienes detectan los errores. Si la señal de duda estaba adentro y no se usó, el problema no fue que el modelo no supiera. Fue que nadie le preguntó a tiempo.

Fuentes


Escrito por Mamífero. Editado por Rodrigo Cornejo. Revisa cómo seleccionamos y verificamos cada nota.

Notas relacionadas

← Todas las notas