OpenRouter lista a DeepSeek V4 Pro 0813 como GA a pesar de que el aviso no cambió

OpenRouter llama al endpoint versionado un lanzamiento GA, pero el último aviso revisado de DeepSeek dijo que V4 Pro no había cambiado y no explicó el sufijo 0813.

By · Published

Primary source: OpenRouter

Why it matters

Developers can call a versioned V4 Pro endpoint with a 1-million-token context window, a 384,000-token output limit and current rates of $0.435 per million input tokens and $0.87 per million output tokens. DeepSeek has not documented what 0813 changes, leaving operators to test capability, latency and reliability before migrating production workloads.

A lone AI researcher in a densely packed data center or server room. (Oil painting in the manner of Edward Hopper)

OpenRouter listó el DeepSeek V4 Pro 0813 del fundador Liang Wenfeng como un endpoint de disponibilidad general el 12 de agosto, con una ventana de contexto de 1 millón de tokens y tarifas listadas de $0.435 por millón de tokens de entrada y $0.87 por millón de tokens de salida.

El registro de cambios del 31 de julio de DeepSeek dijo que la API V4 Pro no había cambiado y que su lanzamiento oficial seguiría pronto. La página principal de DeepSeek, capturada el mismo día que la ficha de OpenRouter, igualmente dijo que V4-Pro no había cambiado.

Los materiales suministrados establecen un nuevo endpoint versionado y una entrada de API, pero no establecen un modelo específico 0813, ni cambios post-entrenamiento, de capacidad, latencia, rendimiento o fiabilidad. DeepSeek no ha explicado el significado del sufijo 0813 en la documentación revisada.

Wenfeng fundó DeepSeek, con sede en Hangzhou, en 2023 tras cofundar y dirigir el fondo cuantitativo High-Flyer, que ha estado asociado con y financiado al desarrollador de IA. Obtuvo las licenciaturas y maestrías en ingeniería de información y comunicaciones en Zhejiang University, según el perfil de The Washington Post. La cobertura pública ha enmarcado su motivación alrededor de la investigación técnica original y de reducir la brecha de IA de China con los laboratorios de EE. UU.

Qué pueden invocar los desarrolladores

DeepSeek introdujo la familia V4 en vista previa el 24 de abril con modelos Pro y Flash diseñados alrededor de una ventana de contexto de 1 millón de tokens. El registro de cambios de abril dijo que los desarrolladores podían invocar V4 Pro a través de OpenAI ChatCompletions e interfaces compatibles con Anthropic ajustando el parámetro model a deepseek-v4-pro sin cambiar la URL base.

OpenRouter ahora usa el slug versionado deepseek/deepseek-v4-pro-0813. Su página del modelo proporciona endpoints de chat completions compatibles con OpenAI y Responses, así como un endpoint Anthropic Messages. La ficha expone controles de razonamiento, streaming, llamadas a herramientas y parámetros de salida estructurada.

DeepSeek documenta una longitud máxima de salida de 384,000 tokens. Ese techo permite generaciones inusualmente largas, aunque las aplicaciones siguen teniendo que gestionar el prompt combinado, el historial de conversación, los resultados de herramientas y la salida dentro de la asignación de contexto del modelo.

OpenRouter identifica a DeepSeek como el único proveedor del endpoint y dice que reenvía cada solicitud directamente a DeepSeek. No se lista ningún host alternativo, por lo que OpenRouter no puede cambiar una solicitud 0813 a otro proveedor si el endpoint de DeepSeek no está disponible o está degradado. Eso hace que el monitoreo directo y los planes de respaldo sean importantes para despliegues en producción.

La pista de lanzamiento se detiene antes de 0813

El registro de cambios del 31 de julio de DeepSeek documenta cómo DeepSeek manejó el modelo V4 Flash más pequeño. Dice que DeepSeek-V4-Flash-0731 conservó la arquitectura y el tamaño del modelo de vista previa mientras recibía post-entrenamiento adicional. El mismo aviso limita explícitamente esa actualización a Flash y dice que la API, la app y los modelos web de V4 Pro permanecieron sin cambios.

El registro de cambios revisado no contiene una entrada equivalente para V4 Pro 0813. OpenRouter llama a 0813 el lanzamiento de disponibilidad general (GA), mientras que el aviso más reciente de DeepSeek en el registro suministrado dijo que V4 Pro no había cambiado y que su lanzamiento oficial seguiría. Esas declaraciones pueden coexistir si OpenRouter versionó un despliegue existente, si DeepSeek cambió la infraestructura de servicio sin documentarlo, o si DeepSeek aún no había publicado una nota de lanzamiento. La evidencia disponible no distingue entre esas posibilidades.

OpenRouter tampoco mostró mediciones de latencia ni de rendimiento cuando la ficha apareció. DeepSeek no suministró resultados específicos de codificación, razonamiento, tareas de agentes o fiabilidad para 0813 en los materiales revisados. La etiqueta GA, por lo tanto, describe disponibilidad en OpenRouter más que rendimiento verificado respecto al endpoint V4 Pro previo.

Los precios favorecen pruebas controladas de contexto largo

La página de precios de DeepSeek lista tarifas actuales de V4 Pro de $0.435 por millón de tokens de entrada no almacenados en caché, $0.003625 por millón de tokens leídos desde caché y $0.87 por millón de tokens de salida. La página también advierte de un aumento de precios futuro, por lo que la economía de cargas de trabajo actual es temporal.

La tarifa por lectura de caché importa para aplicaciones que envían repetidamente el mismo repositorio, colección de documentos, prompt del sistema o prefijo de conversación. Los operadores aún necesitan modelar las tasas de acierto de caché y el consumo de salida porque una asignación de contexto larga no significa que cada solicitud costará lo mismo. Los bucles de agentes también pueden multiplicar el uso de tokens en planificación, llamadas a herramientas y reintentos.

La ficha de OpenRouter mostró un precio efectivo de entrada ponderado por uso por debajo de la tarifa publicada el día del lanzamiento debido al caché. Esa cifra refleja la mezcla de tráfico observada por OpenRouter y no es un precio garantizado para la carga de trabajo de otro cliente.

El tráfico temprano abarca clientes de chat y de codificación

La página del modelo de OpenRouter mostró 394,000 tokens de SillyTavern, 255,000 de Velocity CLI, 57,000 del agente de codificación pi, 33,000 de Janitor AI y 4,000 de Open WebUI el 12 de agosto. OpenRouter dijo que aún no había suficiente actividad para mostrar un historial de tráfico.

Esos conteos muestran que las interfaces de chat y las herramientas de codificación comenzaron a probar el endpoint. No establecen adopción sostenida, retención de clientes ni fiabilidad en producción. OpenRouter separadamente dice que su mercado más amplio atiende a más de 10 millones de usuarios, procesa más de 200 billones de tokens al mes y ofrece más de 400 modelos de más de 70 proveedores. Esas son cifras de OpenRouter en general y no cifras de uso para DeepSeek V4 Pro 0813.

El endpoint entra en un mercado donde otros desarrolladores también están ofreciendo modelos de largo contexto para codificación y trabajo de agentes. MiniMax M3 admite una ventana de contexto de 1 millón de tokens y agrega capacidades nativas de imagen, video y uso de computadora. OpenAI's GPT-5.3-Codex apunta a agentes de codificación y uso de computadora de larga duración. Compararlos con 0813 requiere mediciones de finalización de tareas, latencia, fiabilidad y costo total del flujo de trabajo que la ficha del día de lanzamiento de OpenRouter no proporciona.

Para los desarrolladores, el evento concreto es el acceso a través de un slug versionado de OpenRouter respaldado únicamente por DeepSeek. La ventana de contexto documentada, las interfaces de API, el techo de salida y los precios actuales son suficientes para pruebas controladas. Los equipos que consideren una migración a producción todavía necesitan ejecutar sus propias evaluaciones de carga de trabajo porque ni DeepSeek ni OpenRouter han vinculado el identificador 0813 a un modelo medido o a un cambio en el servicio.

Reader comments

Conversation for this story loads after sign-in.