DeepSeek advierte sobre un aumento significativo en el precio de la API tras haber ofrecido precios más bajos que sus rivales estadounidenses
El laboratorio de Liang Wenfeng no ha publicado nuevas tarifas ni una fecha de vigencia, lo que deja a los desarrolladores incorporar un aumento indefinido en sus precios.
By Ryan Merket · Published
Primary source: Bloomberg Technology
Why it matters
DeepSeek's low rates forced rival labs to defend their inference economics. A broad increase would test whether developers chose V4-Flash for its model quality or its subsidy-sized price advantage.

Liang Wenfeng se está preparando para subir los precios en DeepSeek, poniendo a prueba si el laboratorio de Hangzhou puede convertir la demanda de desarrolladores generada por sus modelos de bajo costo en un flujo mayor de ingresos por API.
DeepSeek añadió una advertencia a su página de precios de la API diciendo que planea subir los precios en sus servicios de API "en un futuro próximo", con "un aumento significativo esperado". DeepSeek no ha declarado las nuevas tarifas ni una fecha de entrada en vigor, y dijo que el plan de precios final se fijará mediante un aviso oficial posterior. Bloomberg informó sobre el aumento planeado tarde el 5 de agosto.
El aviso introduce una incertidumbre inusualmente grande para los desarrolladores que construyeron productos alrededor de la carta de tarifas actual de DeepSeek. DeepSeek-V4-Flash cuesta $0.14 por millón de tokens de entrada cuando el prompt no se recupera de la caché, $0.0028 por millón de tokens de entrada en caché y $0.28 por millón de tokens de salida. V4-Pro cuesta $0.435, $0.003625 y $0.87, respectivamente, para las mismas tres categorías de facturación.
Esos precios permanecen vigentes al 6 de agosto. La advertencia de DeepSeek no da a los clientes ninguna base para calcular cuánto costarán las mismas cargas de trabajo después del aumento. La redacción también apunta a un reajuste general de precios de la API en lugar de un ajuste limitado a un modelo o a un tipo de token.
DeepSeek está ampliando una reversión de precios anterior
DeepSeek ya se había movido hacia cobrar más cuando la demanda es más alta. El South China Morning Post informó el 30 de junio que DeepSeek planeaba duplicar los precios de la API V4 durante dos periodos pico diarios en Beijing, citando un correo electrónico enviado a clientes. DeepSeek atribuyó esa política a la asignación de recursos y la estabilidad del servicio, según el informe.
La nueva advertencia es más amplia. La página de precios de DeepSeek describe un aumento en la "tarificación general" sin limitar el cambio a las horas pico. Aún no está claro si DeepSeek reemplazará la política anterior basada en el tiempo, añadirá tarifas base más altas debajo de ella o usará una estructura de facturación diferente.
El movimiento sigue a meses en los que Wenfeng usó el precio como un arma de distribución. DeepSeek lanzó V4 el 24 de abril, y luego introdujo su variante Flash, más rápida, en los flujos de trabajo de los desarrolladores con bajas tarifas por token, una ventana de contexto de un millón de tokens y soporte para llamadas a herramientas. Una actualización del 31 de julio añadió compatibilidad nativa con Responses API para agentes de codificación sin cambiar la arquitectura del modelo, como informó RuntimeWire.
Pruebas de referencia independientes colocaron posteriormente a V4-Flash cerca de modelos mucho más caros en inteligencia medida, mientras que producía un costo por tarea de referencia inusualmente bajo. RuntimeWire informó el 3 de agosto que Artificial Analysis midió un costo de alrededor de 3 centavos por tarea en su prueba, aproximadamente 105 veces por debajo de Claude Fable 5.
Esa comparación ayudó a que los precios de DeepSeek fueran difíciles de ignorar para laboratorios rivales. También dio a los desarrolladores una razón para tolerar el trabajo operacional involucrado en cambiar de proveedor de modelos. Un aumento sustancial reduciría ese incentivo, aunque el impacto no puede medirse hasta que DeepSeek publique la tabla de tarifas.
Las cargas de trabajo de agentes amplifican pequeños cambios de tarifa
La decisión de precio importa más para los desarrolladores que ejecutan agentes, donde una solicitud de un usuario puede producir llamadas repetidas al modelo para planificación, uso de herramientas, generación de código, pruebas y corrección. Los tokens de salida también cuestan más que los tokens de entrada sin caché bajo el calendario actual de DeepSeek, por lo que trazas de razonamiento largas y código generado pueden dominar la factura.
DeepSeek ha estado orientando V4-Flash precisamente hacia esas cargas de trabajo. La API actual soporta modos de pensamiento y sin pensamiento, salida JSON, llamadas a herramientas y una salida máxima de 384,000 tokens. El soporte de Responses API está disponible para V4-Flash pero aún no aparece listado para V4-Pro en la página de precios.
RuntimeWire examinó el problema del margen de los agentes después del recorte de precio de julio de DeepSeek: tasas por token bajas todavía pueden producir costos de inferencia significativos cuando un producto hace docenas de llamadas tras una sola acción de cliente. Un aumento general se multiplicaría a través de esos bucles y obligaría a las startups a revisar límites de uso, estrategias de caché y políticas de enrutamiento de modelos.
El descuento por aciertos de caché de DeepSeek podría volverse aún más importante. A $0.0028 por millón de tokens, la entrada en caché de V4-Flash actualmente cuesta 50 veces menos que la entrada sin caché. Los desarrolladores con prompts del sistema repetibles o contexto estable pueden, por lo tanto, proteger parte de una carga de trabajo de la tarifa completa de entrada. DeepSeek no ha dicho si esa proporción sobrevivirá al reajuste de precios.
Wenfeng se acerca más a la comercialización
Wenfeng construyó DeepSeek con recursos de High-Flyer, el fondo de cobertura cuantitativo que cofundó después de estudiar ingeniería en Zhejiang University. La operación de trading de High-Flyer utilizó machine learning y acumuló infraestructura de cómputo antes de que Wenfeng fundara DeepSeek en 2023. Ese respaldo le dio a DeepSeek espacio para priorizar la investigación sin depender inicialmente de la financiación de riesgo convencional.
Wenfeng ha enmarcado públicamente el laboratorio en torno a la investigación fundacional y la capacidad de China para originar avances en IA en lugar de seguir el trabajo de los laboratorios estadounidenses. Las publicaciones de investigación abiertas de DeepSeek respaldan esa posición: su organización de GitHub publica código de modelos y proyectos de infraestructura, con repositorios para DeepSeek-V3, DeepSeek-R1, FlashMLA y el sistema de archivos distribuido 3FS que atraen un uso sustancial por parte de desarrolladores.
La fijación de precios de la API se sitúa en el lado comercial de esa estrategia de investigación. Servir un modelo popular requiere capacidad de inferencia continua, y las tarifas agresivas se vuelven más difíciles de sostener a medida que aumenta el uso y las cargas de trabajo de agentes consumen contextos y salidas más largos. La tarificación por horas pico abordó la congestión cobrando más durante ventanas de demanda previsibles. Un aumento general le daría a DeepSeek un margen mayor sobre el uso a lo largo del día.
DeepSeek puede permitirse subir precios a la vez que preserva parte de su ventaja de costos si las tarifas finales se mantienen muy por debajo de las APIs premium competidoras. Esa es la apuesta detrás del aviso. Wenfeng usó primero precios bajos para atraer a los desarrolladores hacia los modelos de DeepSeek; ahora está probando cuánto de esa demanda permanecerá cuando el acceso cueste más.
La tabla de tarifas faltante determina si esto es una normalización o un cambio estratégico. Un aumento moderado aún dejaría a DeepSeek posicionado como un proveedor de bajo costo. Un múltiplo de los precios actuales reabriría decisiones de compra que la economía de V4-Flash de DeepSeek parecía haber resuelto hace solo unos días.