Especial de modelo · Expediente · 15 de agosto de 2026

DeepSeek: el ancla de precios empieza a moverse

Dieciocho meses después de que el momento R1 convirtiera la frontera a precio de céntimos en la referencia del sector, DeepSeek llevó V4-Pro a disponibilidad general — y la misma semana anunció subidas de API de hasta el 1.100% más el primer esquema pico/valle del sector. El laboratorio que ancló la guerra de precios está repreciando. Este expediente reúne el registro con fuentes y nuestra lectura.

Publicado

Las cifras de 2026, con sus etiquetas

  • 1,6B parámetros de V4-Pro (billones) — Buque insignia MoE, ~49.000M activos, contexto de 1M; V4-Flash con 284B/~13B. Pesos abiertos MIT. GA el 13 de agosto de 2026.
  • +1.100% subida máxima reportada de la API — Vigente desde el 16 de agosto de 2026, según Caixin y otros; las mayores subidas caen en los niveles de caché casi gratuitos.
  • precio pico sobre valle — Ventanas pico 01:00–04:00 y 06:00–10:00 UTC; entrada cache-miss de V4-Pro a $1,32 pico / $0,66 valle, desde $0,435.
  • 99,80% uptime del chat, mayo–agosto 2026 — Página de estado de primera parte; API entre 99,73% y 99,88%. Contraste: en el lanzamiento de R1 la mayoría de peticiones chocaba con server-busy.

Del momento R1 a V4: dieciocho meses de cambio de posición

El momento R1 de DeepSeek — enero de 2025, cuando un laboratorio de Hangzhou respaldado por el fondo cuantitativo High-Flyer encabezó las tiendas de apps globales y borró unos seiscientos mil millones de dólares del valor de Nvidia en un día, según la prensa — fijó la referencia contra la que el sector aún pone precios. Desde entonces la línea siguió una sola vía: pesos abiertos bajo MIT, de la generación V3/R1 al preview de V4 en abril de 2026 y la disponibilidad general de V4-Pro el 13 de agosto.

V4-Pro suma 1,6 billones de parámetros con unos 49.000 millones activos; V4-Flash corre con 284B y ~13B activos; ambos con contexto de un millón de tokens y descargables. Entre los laboratorios open-weight-first de esta serie, DeepSeek ha sido el más consistente: sin licencia de reparto, sin checkpoints retenidos — exactamente lo que hace destacar el giro de precios de abajo.

El giro de precios: hasta un 1.100%, y el reloj entra en la tarifa

Con el GA de V4-Pro llegó el anuncio: desde el 16 de agosto los precios de la API suben — hasta un 1.100% en los niveles casi gratuitos — y entra en vigor el primer esquema pico/valle del sector, con horas pico al doble de la tarifa valle en ventanas laborales de Pekín. La entrada cache-miss de V4-Pro pasa de $0,435 a $0,66 en valle y $1,32 en pico.

Lo interesante es el precio por horas: hace explícita la restricción de cómputo en la propia tarifa. La demanda se modela con el reloj porque las GPU no se pueden estirar. Y la dirección converge con las dos subidas de Zhipu en 2026 — los laboratorios abiertos que socavaron la frontera están, uno a uno, repreciando hacia la sostenibilidad. DeepSeek es el protagonista del informe semanal de la guerra de precios de este sitio, y este cambio entra en ese ciclo de revisión en cuanto la nueva tarifa esté en vivo.

Servir bajo restricción: de server-busy a modelar la demanda

El lanzamiento de R1 es también el origen de la narrativa de capacidad que esta serie no deja de encontrar: en el pico, la mayoría de las peticiones chocaba con el muro de server-busy, según la prensa. Dieciocho meses después, la página de estado muestra el chat al 99,80% y las API entre 99,73% y 99,88% en mayo–agosto de 2026 — estabilizado, pero visiblemente sin holgura.

Tres datos, uno al lado del otro: Kimi pausó las altas de pago dos días después de K3; la transición de Manus impulsó la lógica de registro temprano; DeepSeek ahora cobra por horas. Laboratorios distintos, una misma restricción. Nuestra lectura: en este ciclo el bien escaso es la capacidad de servicio, no la calidad del modelo, y el precio se está volviendo el mecanismo de racionamiento.

En la cronología del impacto: qué significa que el ancla se mueva

Cada wrapper, router y función de IA presupuestada contra tokens casi gratuitos de DeepSeek heredó su economía del momento R1. Si el ancla se mueve — y se está moviendo, hasta un 1.100% en algunos niveles — esas estructuras de coste aguas abajo se mueven con ella. Es un insumo directo de la presión por categorías de apps que esta cronología existe para registrar.

La pregunta abierta corta en ambos sentidos: o los tokens baratos vuelven cuando la capacidad alcance, y la guerra de precios se reanuda; o el sector aprende que el suelo estuvo subvencionado todo el tiempo, y la economía de la suscripción cerrada gana un respiro que nadie presupuestó. El informe semanal de precios es donde este sitio llevará la cuenta.

Lo que este especial no afirma

Este expediente separa lo reportado con fuente de las preguntas abiertas. A fecha de publicación:

  • Los parámetros y el uptime son cifras de la empresa; el máximo del 1.100% es de prensa, pendiente de la tarifa en vivo.
  • La cifra del valor de Nvidia en el momento R1 está ampliamente reportada pero no auditada por este sitio.
  • No hemos evaluado los modelos V4 para este expediente; es un dossier con fuentes, no una reseña.
  • Los detalles pico/valle pueden cambiar tras el corte del 16 de agosto; el informe semanal sigue la tarifa viva.

Lecturas relacionadas en este sitio

  • La guerra de precios de modelos — DeepSeek es el protagonista de ese informe; el reprecio del 16 de agosto entra en su revisión semanal.
  • Expediente Zhipu — El otro laboratorio abierto que sube precios — el reprecio es un patrón, no un incidente.
  • Expediente Kimi — La restricción de capacidad desde otro ángulo: dos días y pausa de altas de pago.
  • Claude Academy: ¿quién asume la fluidez en IA? — Anthropic ha lanzado una escuela gratuita para aprender a trabajar con IA. Su marco declarado va más allá de los prompts e incluye delegación, juicio y divulgación. Es un recurso público relevante, y abre una pregunta más difícil: cuando quien fabrica la disrupción también emite las credenciales para adaptarse, ¿dónde termina la responsabilidad institucional y dónde empieza la individual?
  • Meituan All-in AI: los costes de ejecución — Apostarlo todo a la IA es fácil de anunciar y difícil de gobernar. La factura aparece donde la urgencia estratégica se cruza con la procedencia del código, el consentimiento del comercio y los incentivos: cuanto menos tiempo queda para verificar y revertir, más cara se vuelve la velocidad. Este especial separa el registro público verificado de dos señales débiles de fuente única y analiza un problema de gobierno, no una prueba de que invertir en IA haya fracasado.
  • Monetización del token de IA: el token es el nuevo dólar — En Stripe Sessions, Will Gaybrick, presidente de Tecnología y Negocio, cambió una app de demostración de una tarifa plana de $2 a $3 por millón de tokens y después transmitió pagos en stablecoins a medida que se consumía cada token. Es más que una demo de billing: el software pasa de puestos y acceso mensual a inteligencia medida, donde cada unidad de trabajo del modelo tiene precio, margen, riesgo de fraude y liquidación. Nuestra tesis es que el token se convierte en el dólar del software de IA: unidad de cuenta del trabajo de máquina, no moneda de curso legal ni sustituto del dólar estadounidense.
  • Stripe × OpenRouter: donde empieza la monetización del token — Dejemos por un momento los $8.000 millones reportados. Stripe, el líder de pagos convertido en capa de checkout de internet, no eligió comprar un laboratorio sino el conmutador entre las apps de IA y cientos de modelos. Esa es la historia. Stripe apuesta a que la capa decisiva de la economía de IA no solo producirá inteligencia: la convertirá en valor intercambiable. Hoy un token LLM es una unidad de cobro. Mañana un token de IA independiente del modelo podría conservarse, transferirse y liquidarse como la generación de activos digitales abierta por BTC y ETH — no como escasez digital o gas de blockchain, sino como derecho sobre inteligencia utilizable. Axios reporta un acuerdo superior a $8.000 millones; ninguna empresa lo había confirmado públicamente en esta actualización.
  • Grok Bot: xAI le da a cada agente su propio ordenador — Lanzado en beta temprana el 11 de agosto de 2026, Grok Bot convierte al agente de una ventana de chat en un compañero de equipo: cada Bot recibe un ordenador persistente en la nube, inicia sesión en tus herramientas y sigue trabajando mientras no estás. Lo usamos desde el primer día. El producto tiene pocos días y la información pública sigue siendo escasa, así que este especial prioriza las impresiones probadas y deja los datos de mecanismo en segundo plano — separando lo verificado, lo declarado por la empresa y nuestra lectura.
  • Kimi: el sprint de pesos abiertos de Moonshot AI hacia la frontera — En cuatro meses, Moonshot AI publicó un modelo abierto de un billón de parámetros, lo siguió con el Kimi K3 —2,8 billones reportados—, pausó las suscripciones nuevas cuando la demanda superó la capacidad y emprendió el camino hacia la bolsa de Hong Kong. Este expediente separa lo que tiene fuente, lo declarado por la empresa y nuestra lectura.
  • Zhipu (Z.ai): la primera LLM en bolsa y su apuesta por los agentes GLM — Zhipu AI llegó a los mercados públicos antes que ningún otro laboratorio de grandes modelos —cotizando en Hong Kong en enero de 2026— y pasó los meses siguientes llevando la línea GLM-5 hasta un buque insignia agéntico de pesos abiertos mientras subía precios dos veces. Este expediente reúne el registro con fuentes: los modelos, la apuesta phone-use, la economía y nuestra lectura.
  • Qwen: el líder de pesos abiertos empieza a cobrar por la corona — Qwen, de Alibaba, es la familia de modelos de pesos abiertos más descargada del mundo — según la empresa, más de tres mil millones de descargas y más de la mitad del mercado open source. En agosto de 2026 publicó su mayor buque insignia, lo puso muy por debajo de las tarifas de frontera estadounidenses y, por primera vez, sometió sus pesos abiertos a una licencia de reparto de ingresos. Este expediente reúne el registro con fuentes y nuestra lectura del giro.
  • MiniMax: el tigre multimodal que dobló en su debut — MiniMax llegó a la bolsa de Hong Kong un día después de Zhipu y dobló su precio el primer día. Pero no cierra esta serie por la cotización, sino por la superficie de producto: donde los otros cinco expedientes cubren texto y agentes, MiniMax vende vídeo, voz y música a precios de commodity — y eso apunta la onda de choque a otra cohorte: los creadores. Este expediente reúne el registro con fuentes y nuestra lectura.
  • Tributo a Manus — El especial independiente que ancla la línea del trabajo digital en este sitio.
  • Observatorio de precios de modelos — Registro continuo de los movimientos de precios de los modelos frontera.

Prueba DeepSeek

DeepSeek ofrece chat de consumo gratuito, pesos abiertos en Hugging Face y API en su plataforma.

Abrir deepseek.com

Enlace oficial — sin relación de afiliado. Si DeepSeek abre un programa de afiliados, este sitio lo divulgará.

Fuentes y límites de la evidencia

Lanzamiento y precios se anclan a anuncios de primera parte y prensa financiera; el uptime es la página de estado; las cifras de la empresa van etiquetadas.

  1. DeepSeek API docs — noticias — Canal de anuncios de primera parte, incluido el aviso de GA de V4-Pro-0813.
  2. Caixin Global — V4-Pro y subidas de hasta el 1.100% — El reporte de GA más reprecio que ancla los hechos del giro.
  3. Quartz — DeepSeek sube precios desde el 16 de agosto — Ventanas pico/valle y tarifas por nivel.
  4. Página de estado de DeepSeek — Registro de uptime de primera parte para chat y API.

Cómo citar

anti-ai.app, “DeepSeek: el ancla de precios empieza a moverse”, https://www.anti-ai.app/es/specials/deepseek/ (2026-08-15 · 2026-08-17).

Política de republicación