Qué pasó
- DeepSeek lanzó el 10 de septiembre V4.1 Flash, un modelo de 552.000 millones de parámetros que activa cerca de 8.000 millones por cada token, la unidad de texto que procesa. Lee texto e imágenes, admite 1 millón de tokens de contexto y sus pesos están publicados bajo licencia MIT.
- Precio fuera de horario punta: US$ 0,15 por millón de tokens de entrada, US$ 0,60 por millón de salida y US$ 0,003 si la entrada ya está en caché. En horario punta, el doble.
- El horario punta va de 01:00 a 04:00 y de 06:00 a 10:00 UTC, de lunes a viernes. DeepSeek cobra con ese esquema desde el 16 de agosto.
- Desde el 14 de septiembre, las consultas a V4 Pro se atenderán con V4.1 Flash y a su precio, hasta que exista un V4.1 Pro. La empresa afirma que Flash ya supera a Pro en desempeño, costo y velocidad.
Por qué importa
- En Chile, que pasó a UTC-3 el 6 de septiembre, el horario punta cae entre las 22:00 y la 01:00 y entre las 03:00 y las 07:00. La jornada laboral completa, de Ciudad de México a Santiago, queda en tarifa baja. Un proceso programado de madrugada para ahorrar paga el doble.
- DeepSeek encabeza la lista de empresas que la NSA, el FBI y la CISA, tres organismos de seguridad de Estados Unidos, acusaron el 8 de septiembre de extraer capacidades de modelos estadounidenses. Para un área de compras, el precio más bajo del mercado llega con esa alerta adjunta.
- Los pesos abiertos permiten correr el modelo en servidores propios, sin enviar datos a la API de la empresa. Un equipo que maneja datos personales de chilenos puede usarlo sin que esa información salga de su infraestructura, justo cuando la ley de datos que el Gobierno propone postergar define cómo se transfieren al extranjero.
El dato
US$ 0,003. Precio por millón de tokens de entrada en caché fuera de horario punta. Es lo que abarata releer un mismo contexto largo, el patrón de uso típico de un agente de programación.
Contexto
La guerra de precios corre en categorías distintas. Astra salió a US$ 50 por millón de tokens de salida, unas 83 veces lo que cobra V4.1 Flash, aunque ambos modelos no compiten por las mismas tareas. Google ya flexibilizó el precio de Gemini para retener a empresas que miran la cuenta antes que el ranking.
Qué viene
- 14 sep 2026, 12:00 de Beijing (01:00 en Chile): V4 Pro pasa a atenderse con V4.1 Flash.
- V4.1 Pro: sin fecha anunciada.
Cierre
Los pesos de V4.1 Flash se descargan desde Hugging Face, el repositorio cuya compra anunció Nvidia el 3 de septiembre. El modelo chino que tres organismos estadounidenses señalaron se distribuye desde una plataforma de la mayor empresa de chips de Estados Unidos.
Fuentes
- DeepSeek-V4.1-Flash debuts with $0.003/1M off-peak cached-input rate — VentureBeat, 10 de septiembre de 2026
- DeepSeek formally launches V4.1 Flash, routes V4 Pro requests to Flash — TechNode, 10 de septiembre de 2026
- China-Based Artificial Intelligence Companies Conducting Industrial-Scale Distillation Campaigns Against U.S. AI Companies — NSA, CISA y FBI, septiembre de 2026
Editado por Rodrigo Cornejo. Cómo seleccionamos y verificamos los hechos, en quiénes escriben.



%2016.40.34.D86RbLdS_Z2hOnWV.webp)
