DeepSeek vuelve a reventar precios: 0,15 dólares el millón
DeepSeek lanzó V4.1-Flash: 552.000 millones de parámetros de los que solo activa 8.000, contexto de un millón de tokens, pesos MIT en Hugging Face y precios desde 0,15 dólares el millón. La letra pequeña: el 14 de septiembre migrará a la fuerza a los usuarios de V4 Pro.
Por DidadoY
/ En esta noticia
DeepSeek ha vuelto a hacer lo que mejor sabe hacer: poner nerviosa a toda la industria con una calculadora. Su nuevo V4.1-Flash, lanzado el 10 de septiembre, procesa un millón de tokens de contexto activando menos parámetros que muchos modelos abiertos de hace dos años, publica los pesos bajo licencia MIT y cuesta desde 0,15 dólares por millón de tokens de entrada. Hay motivos para el entusiasmo y motivos para leer la letra pequeña.
La arquitectura de la eficiencia
El truco de V4.1-Flash es el de siempre en DeepSeek, llevado más lejos: un Mixture-of-Experts enorme en el que cada token solo despierta a una fracción mínima de la red. Con unos 8.000 millones de parámetros activos por token de entrada, la empresa asegura que supera a su propio V4-Pro y compite con GPT-5.6 y Kimi K3. Como siempre con los benchmarks del propio fabricante, conviene esperar a los números independientes; la historia reciente enseña que las tablas de lanzamiento y la realidad no siempre coinciden.
Lo que no necesita benchmark es el precio. En horario valle (que DeepSeek define sobre horarios de Pekín), el millón de tokens de entrada cuesta 0,15 dólares y la salida 0,60; en horas punta, 0,30 y 1,20. La entrada cacheada baja hasta 0,003 dólares el millón. Para tareas que releen mucho contexto (agentes de código sobre repositorios grandes, análisis de documentos largos), el contexto de un millón de tokens a estos precios cambia qué proyectos salen a cuenta.
Abierto de verdad, con calendario de empresa
Los pesos están en Hugging Face bajo MIT, la licencia más permisiva posible, con informe técnico incluido. Es la misma jugada que Tencent con Hy4: los laboratorios chinos regalan lo que los occidentales cobran, y cada uno saca sus conclusiones sobre por qué.
En este caso hay una razón con fecha: DeepSeek prepara su salida a bolsa en el STAR Market de Shanghái, y demostrar músculo técnico justo antes de las presentaciones a inversores no es casualidad. También hay una decisión que afecta a clientes reales: los antiguos V4-Flash y V4-Flash-Vision desaparecen (sus nombres ya apuntan al nuevo modelo) y, desde el 14 de septiembre a mediodía hora de Pekín, las llamadas a V4 Pro se facturan y responden como V4.1-Flash. Sale a un cuarto del precio, sí. Pero si construiste algo sobre V4 Pro, te acaban de cambiar el motor sin preguntarte, con cuatro días de aviso.
La lectura sin humo
Dos cosas pueden ser ciertas a la vez. La primera: esto es una buena noticia para casi todo el mundo. Un modelo con contexto de un millón de tokens, pesos MIT y precios de derribo presiona a la baja los precios de toda la industria, y esa presión es el motivo por el que la API de los grandes laboratorios cuesta hoy la mitad que hace un año. La segunda: el lanzamiento trae dentro una lección sobre depender de una API, la que sea. DeepSeek ha retirado dos modelos y redirigido un tercero con cuatro días de margen; los grandes laboratorios occidentales hacen versiones de lo mismo con más ceremonia y más meses. Si tu producto depende de un modelo concreto, no es tuyo: es un alquiler. Los pesos abiertos, precisamente, son el seguro contra eso; con V4.1-Flash puedes descargar el modelo y quedarte la versión que te funciona para siempre. Que la misma empresa que te fuerza la migración te venda también el paracaídas no deja de tener su gracia.
Fuentes: DataNorth · Crypto Briefing · 10 septiembre 2026
¿Te ha servido? Recíbelo cada día.
Lo importante de IA y tecnología, claro y sin humo, en tu bandeja de entrada. Gratis.
/ Seguir leyendo
Google publica el efecto de cada mutación del ADN humano
DeepMind ha lanzado AlphaGenome Atlas: predicciones precalculadas del efecto molecular de los 9.000 millones de cambios de una letra posibles en el genoma humano, un petabyte de datos consultable gratis por cualquier investigador. La letra pequeña también importa: son predicciones, no diagnósticos.
Por DidadoY
OpenAI dice haber resuelto un problema del milenio
Un modelo interno "bastante mejor que GPT-6 Astra", 10.000 agentes trabajando en paralelo y 88 horas: OpenAI afirma haber resuelto Navier-Stokes, uno de los siete problemas del milenio. El instituto que da el premio no lo acepta aún, la prueba tiene un matiz matemático y hay bronca de autoría.
Por DidadoY
Tencent regala lo que OpenAI guarda bajo llave
Mientras los laboratorios de EEUU encierran sus mejores modelos tras programas de acreditación, Tencent ha colgado en internet Hy4 preview: 770.000 millones de parámetros, licencia Apache 2.0 y resultados que rozan a GPT-5.6 Sol. Su API cuesta 20 veces menos que Astra. Cualquiera puede descargarlo.
Por DidadoY