Costos de agentes

Borrar el razonamiento viejo de un agente baja 25,5% los tokens de entrada


El método no requiere entrenamiento y sube la recompensa promedio de 0,699 a 0,718 sobre 260 tareas, según el trabajo publicado el 24 de septiembre.

27 de septiembre de 2026 · Read in English

Qué pasó

Por qué importa

El dato

33,3% menos lecturas de caché, la reducción más grande de las tres medidas.

Contexto

Las estrategias de compresión de contexto venían resumiendo el historial completo, con el problema conocido de que un resumen puede introducir errores que el agente después trata como hechos. Este trabajo cambia el criterio: en vez de resumir todo, distingue qué parte del historial es estado de trabajo y qué parte es registro permanente, y descarta solo la primera.

Qué viene

Cierre

Un agente que recuerda todo lo que pensó paga por recordarlo en cada paso siguiente. Este trabajo pone número a algo que ya se sospechaba: buena parte de ese archivo no sirve para nada una vez que el resultado quedó escrito en otra parte.

Fuentes

Editado por Rodrigo Cornejo. Cómo seleccionamos y verificamos: quiénes escriben estas notas.

Notas relacionadas

← Todas las notas