Serie de precios · Número 1 · 12 de agosto de 2026
La guerra de precios: qué cambian los precios bajos de DeepSeek y el recorte permanente de Claude
La capacidad fija el techo; el precio por token decide cuántas acciones de producto pueden usar esa capacidad. No es un ranking sin calidad: seguimos precios, caché, tramos de contexto y promociones que cambian la economía de las apps de IA.
Señal semanal: Claude convierte en permanente el menor precio de Sonnet 5
Claude Sonnet 5 cuesta $2 de entrada / $10 de salida frente a $3 / $15 de Sonnet 4.6: un recorte por token del 33,3%. El 10 de agosto de 2026, Anthropic actualizó el anuncio para hacerlo permanente en vez de terminarlo el 31 de agosto. El nuevo tokenizer puede generar aproximadamente 1,0–1,35 veces más tokens para el mismo texto, por lo que el recorte nominal no equivale automáticamente al de cada factura.
Precios públicos actuales de API
USD por 1 millón de tokens. Separamos entrada estándar, caché y salida. Excluimos batch, herramientas, búsqueda, almacenamiento, recargos regionales, impuestos y descuentos empresariales. Los grupos no implican capacidades iguales.
| Proveedor | Modelo | Entrada estándar | Caché | Salida | Estado | Nota de alcance |
|---|---|---|---|---|---|---|
| DeepSeek | DeepSeek V4 Flash | $0.14 | $0.0028 | $0.28 | GA | La entrada estándar es sin acierto de caché; el acierto aparece aparte. |
| OpenAI | GPT-5.6 Luna | $0.2 | $0.02 | $1.20 | GA | Las solicitudes con más de 272K tokens usan tarifas superiores de contexto largo. |
| Gemini 3.5 Flash-Lite | $0.3 | $0.03 | $2.50 | GA | Nivel estándar de pago; la salida incluye tokens de razonamiento. | |
| Anthropic | Claude Haiku 4.5 | $1 | $0.1 | $5 | GA | API global de Claude de primera parte; el acierto de caché aparece aparte. |
| DeepSeek | DeepSeek V4 Pro | $0.435 | $0.003625 | $0.87 | GA | Entrada sin acierto de caché; la API oficial admite modos con y sin razonamiento. |
| Anthropic | Claude Sonnet 5 | $2 | $0.2 | $10 | new-permanent | Anthropic hizo permanente el precio $2 entrada / $10 salida el 2026-08-10. |
| OpenAI | GPT-5.6 Terra | $2 | $0.2 | $12 | GA | Más de 272K tokens aplica 2× a entrada y 1,5× a salida. |
| Gemini 3.1 Pro Preview | $2 | $0.2 | $12 | preview | Nivel estándar de pago hasta 200K; el contexto largo cuesta más. |
DeepSeek no es un poco más barato: opera en otro orden de magnitud
DeepSeek publica V4 Pro a $0.435 de entrada y $0.87 de salida, y V4 Flash a $0.14 / $0.28. La entrada en caché baja a $0.003625 y $0.0028. Solo por precio público de token, quedan muy por debajo de los otros productos agrupados aquí.
El precio bajo no prueba la mejor economía para cada tarea. Hay que medir éxito, reintentos, latencia, disponibilidad, contexto y herramientas. Separamos los hechos de tarifa de los juicios de rendimiento.
Claude indica que la guerra llega al trabajo de frontera, no solo a modelos pequeños
Sonnet 5 reduce de forma permanente un tercio el precio por token de entrada y salida y deja la caché en $0.20. No es un recorte de toda Anthropic, pero sí una señal: el trabajo de frontera ya compite en coste unitario duradero además de capacidad.
El punto clave es cuánto baja la factura real con el nuevo tokenizer y si DeepSeek, OpenAI o Google responden con precio estándar, de caché o batch.
¿Qué apps sienten la presión?
- Wrappers delgados: La inferencia barata comprime margen y diferenciación; el producto debe demostrar valor en flujo, datos, distribución o resultados.
- Gateways y routers de IA: El arbitraje puro pierde fuerza; fiabilidad, gobierno, evaluación, cumplimiento regional y failover pasan al centro.
- Add-ons de IA en SaaS: El menor coste debilita grandes primas por asiento y empuja hacia precio por resultado, cuota o flujo completo.
- Agentes verticales y automatización: El razonamiento barato hace viables cadenas largas, reintentos y ejecución en segundo plano para más productos.
Cómo comparamos
Solo registramos precios públicos de primera parte. La tabla usa USD por 1 millón de tokens de texto y separa entrada, caché y salida. Dejamos fuera planes gratis, suscripciones, batch, medios, herramientas, búsqueda y descuentos negociados.
Los modelos no son mercancías equivalentes. La tabla observa curvas de coste, no demuestra calidad ni factura total. Contexto, tokenizer, tokens de razonamiento, escritura de caché y región pueden cambiar el coste efectivo.
Qué cuenta como cambio importante
Escaneamos semanalmente las páginas oficiales. Un disparador abre revisión y solo se publica tras verificar:
- Cambio de al menos 20% en entrada o salida estándar de un modelo seguido;
- Nuevo mínimo duradero en la gama general/frontera, o vencimiento/extensión de una promoción;
- Cambio en caché, batch o capa gratuita que mueva al menos 30% una carga representativa;
- Tokenizer, contexto largo o herramientas que inviertan la dirección aparente de la factura.
Número 1 | DeepSeek fija el ancla baja; Claude hace permanente el menor precio
12 de agosto de 2026: fijamos una base de cuatro proveedores y ocho modelos. El primer evento es la decisión de Anthropic del 10 de agosto de hacer permanente el precio por token de Sonnet 5, un 33,3% menor que la generación anterior. DeepSeek V4 Pro y Flash marcan los precios públicos estándar y de caché más bajos de esta tabla. Próximo punto: respuesta competitiva y facturas reales.
Fuentes oficiales
Los precios cambian. Conserva la fecha de verificación al citar y confirma en la página original del proveedor.
- DeepSeek API Models & Pricing — DeepSeek
- Claude Platform model pricing — Anthropic
- Introducing Claude Sonnet 5 — Anthropic
- GPT-5.6 Terra model page — OpenAI
- GPT-5.6 Luna model page — OpenAI
- Gemini Developer API pricing — Google
Serie de especiales de modelos
- Claude Academy: ¿quién asume la fluidez en IA? — Anthropic ha lanzado una escuela gratuita para aprender a trabajar con IA. Su marco declarado va más allá de los prompts e incluye delegación, juicio y divulgación. Es un recurso público relevante, y abre una pregunta más difícil: cuando quien fabrica la disrupción también emite las credenciales para adaptarse, ¿dónde termina la responsabilidad institucional y dónde empieza la individual?
- Meituan All-in AI: los costes de ejecución — Apostarlo todo a la IA es fácil de anunciar y difícil de gobernar. La factura aparece donde la urgencia estratégica se cruza con la procedencia del código, el consentimiento del comercio y los incentivos: cuanto menos tiempo queda para verificar y revertir, más cara se vuelve la velocidad. Este especial separa el registro público verificado de dos señales débiles de fuente única y analiza un problema de gobierno, no una prueba de que invertir en IA haya fracasado.
- Monetización del token de IA: el token es el nuevo dólar — En Stripe Sessions, Will Gaybrick, presidente de Tecnología y Negocio, cambió una app de demostración de una tarifa plana de $2 a $3 por millón de tokens y después transmitió pagos en stablecoins a medida que se consumía cada token. Es más que una demo de billing: el software pasa de puestos y acceso mensual a inteligencia medida, donde cada unidad de trabajo del modelo tiene precio, margen, riesgo de fraude y liquidación. Nuestra tesis es que el token se convierte en el dólar del software de IA: unidad de cuenta del trabajo de máquina, no moneda de curso legal ni sustituto del dólar estadounidense.
- Stripe × OpenRouter: donde empieza la monetización del token — Dejemos por un momento los $8.000 millones reportados. Stripe, el líder de pagos convertido en capa de checkout de internet, no eligió comprar un laboratorio sino el conmutador entre las apps de IA y cientos de modelos. Esa es la historia. Stripe apuesta a que la capa decisiva de la economía de IA no solo producirá inteligencia: la convertirá en valor intercambiable. Hoy un token LLM es una unidad de cobro. Mañana un token de IA independiente del modelo podría conservarse, transferirse y liquidarse como la generación de activos digitales abierta por BTC y ETH — no como escasez digital o gas de blockchain, sino como derecho sobre inteligencia utilizable. Axios reporta un acuerdo superior a $8.000 millones; ninguna empresa lo había confirmado públicamente en esta actualización.
- Grok Bot: xAI le da a cada agente su propio ordenador — Lanzado en beta temprana el 11 de agosto de 2026, Grok Bot convierte al agente de una ventana de chat en un compañero de equipo: cada Bot recibe un ordenador persistente en la nube, inicia sesión en tus herramientas y sigue trabajando mientras no estás. Lo usamos desde el primer día. El producto tiene pocos días y la información pública sigue siendo escasa, así que este especial prioriza las impresiones probadas y deja los datos de mecanismo en segundo plano — separando lo verificado, lo declarado por la empresa y nuestra lectura.
- Kimi: el sprint de pesos abiertos de Moonshot AI hacia la frontera — En cuatro meses, Moonshot AI publicó un modelo abierto de un billón de parámetros, lo siguió con el Kimi K3 —2,8 billones reportados—, pausó las suscripciones nuevas cuando la demanda superó la capacidad y emprendió el camino hacia la bolsa de Hong Kong. Este expediente separa lo que tiene fuente, lo declarado por la empresa y nuestra lectura.
- Zhipu (Z.ai): la primera LLM en bolsa y su apuesta por los agentes GLM — Zhipu AI llegó a los mercados públicos antes que ningún otro laboratorio de grandes modelos —cotizando en Hong Kong en enero de 2026— y pasó los meses siguientes llevando la línea GLM-5 hasta un buque insignia agéntico de pesos abiertos mientras subía precios dos veces. Este expediente reúne el registro con fuentes: los modelos, la apuesta phone-use, la economía y nuestra lectura.
- Qwen: el líder de pesos abiertos empieza a cobrar por la corona — Qwen, de Alibaba, es la familia de modelos de pesos abiertos más descargada del mundo — según la empresa, más de tres mil millones de descargas y más de la mitad del mercado open source. En agosto de 2026 publicó su mayor buque insignia, lo puso muy por debajo de las tarifas de frontera estadounidenses y, por primera vez, sometió sus pesos abiertos a una licencia de reparto de ingresos. Este expediente reúne el registro con fuentes y nuestra lectura del giro.
- DeepSeek: el ancla de precios empieza a moverse — Dieciocho meses después de que el momento R1 convirtiera la frontera a precio de céntimos en la referencia del sector, DeepSeek llevó V4-Pro a disponibilidad general — y la misma semana anunció subidas de API de hasta el 1.100% más el primer esquema pico/valle del sector. El laboratorio que ancló la guerra de precios está repreciando. Este expediente reúne el registro con fuentes y nuestra lectura.
- MiniMax: el tigre multimodal que dobló en su debut — MiniMax llegó a la bolsa de Hong Kong un día después de Zhipu y dobló su precio el primer día. Pero no cierra esta serie por la cotización, sino por la superficie de producto: donde los otros cinco expedientes cubren texto y agentes, MiniMax vende vídeo, voz y música a precios de commodity — y eso apunta la onda de choque a otra cohorte: los creadores. Este expediente reúne el registro con fuentes y nuestra lectura.
- Tributo a Manus — El especial independiente que ancla la línea del trabajo digital en este sitio.