DeepSeek V4 Pro frente a Flash: programación, agentes y mucho más

Deepseek Pro frente a Flash

DeepSeek ofrece ahora dos modelos V4 con la misma ventana de contexto de un millón de tokens, pero con perfiles de cálculo muy diferentes. ¿Deberías pagar más por el V4 Pro, o el V4 Flash, más pequeño, es suficiente para el trabajo que realmente realizas?

Esta comparación analiza las especificaciones oficiales, el precio de la API, los parámetros de referencia de codificación y de los agentes, la velocidad, la concurrencia y las pruebas controladas con la misma solicitud. Distingue entre los resultados publicados por DeepSeek, las mediciones independientes y nuestras propias pruebas con la API.

Respuesta rápida: V4 Flash es la opción más práctica cuando la latencia, el rendimiento y el coste son factores importantes. V4 Pro ofrece una mayor capacidad activa y mejores resultados oficiales en tareas que requieren conocimientos complejos, contextos largos, codificación y agentes de varios pasos.

Ambos modelos figuran en GlobalGPT, lo que facilita su comparación sin necesidad de mantener integraciones independientes.

¿Qué es DeepSeek V4?

DeepSeek V4 es una familia de modelos de «mezcla de expertos» de peso abierto. El ficha oficial del modelo indica que el V4 Pro cuesta 1,6 T en total / 49 000 millones de parámetros activos y V4 Flash en 284 000 en total / 13 000 parámetros activos. Ambos admiten una ventana de contexto de 1 millón de tokens y utilizan la licencia MIT.

DeepSeek V4 Pro frente a Flash: Especificaciones

EspecificaciónV4 FlashV4 Pro
VersiónFlash-0731Pro-0813
Parámetros284B / 13B activo1,6 T / 49 B activos
Contexto / resultado1 M / 384 K1 M / 384 K
Concurrencia2,500500

En página oficial de modelos y precios enumera las llamadas a herramientas, la salida en formato JSON, la API de respuestas y la compatibilidad con la API Anthropic para ambas.

Modelos oficiales DeepSeek V4 Flash y V4 Pro y tabla de precios
La documentación oficial de la API de DeepSeek confirma las versiones actuales de V4 Flash y V4 Pro, así como sus límites, características y precios.

Precio y rendimiento

Flash cuesta $0,14 por cada millón de tokens de entrada con fallo de caché y $0,28 por cada millón de tokens de salida. Pro cuesta $0,435 y $0,87, respectivamente. Flash cuesta aproximadamente 68% más barato para el tráfico normal no almacenado en caché.

Aviso sobre el precio: DeepSeek afirma que tiene previsto aumentar los precios generales de la API. Vuelve a consultar la página oficial antes de elaborar tu presupuesto.

Lo que realmente muestran las pruebas de rendimiento

A pleno rendimiento, DeepSeek sitúa a Pro por delante de Flash en LiveCodeBench (93,5 frente a 91,6), en la clasificación de Codeforces (3206 frente a 3052), en Terminal Bench 2.0 (67,9 frente a 56,9), en SWE Verified (80,6 frente a 79,0), en BrowseComp (83,4 frente a 73,2) y en MRCR 1M (83,5 frente a 78,7).

Artificial Analysis indica de forma independiente que el V4 Pro 0813 tiene un precio de 53 en el Índice de Inteligencia v4.1.1 y sobre 83,2 tokens de salida por segundo. Durante nuestra comprobación no había disponible ninguna página de detalles específica para el Flash-0731, por lo que este no es un resultado comparativo independiente.

Oficial DeepSeek · Máximo esfuerzo

Resultados seleccionados de pruebas de rendimiento

LiveCodeBench93.5 frente a 91,6Pro frente a Flash
Terminal Bench 2.067.9 frente a 56,9Pro frente a Flash
BrowseComp83.4 frente a 73,2Pro frente a Flash
MRCR 1M83.5 frente a 78,7Pro frente a Flash

Resultados comunicados por los proveedores; el contexto y el alcance de la muestra se ajustan a la tabla publicada por DeepSeek. No se trata de nuestras puntuaciones obtenidas en la práctica.

Análisis artificial53Índice de inteligencia v4.1.1 · Solo para la versión Pro
Velocidad de salida medida83,2 t/sAnálisis artificial · Solo para usuarios Pro
Límite de las pruebasPágina de detalles sin FlashNo se trata de un enfrentamiento directo independiente.
Resumen del análisis artificial para DeepSeek V4 Pro 0813
Artificial Analysis ofrece métricas de rendimiento y velocidad exclusivas de la versión Pro; no se trata de una comparación independiente de Flash.

DeepSeek V4 Pro frente a Flash: pruebas prácticas

Ambos modelos reciben el mismo prompt, la misma temperatura, la misma entrada y la misma ruta de la API. El tiempo transcurrido local incluye la sobrecarga de la red y de la plataforma.

Prueba práctica 01 · Programación

Depuración de precios para varios archivos

Ganador: V4 Pro
V4 Flash18,5 s · 519 tokens

Se detectó un redondeo prematuro, pero no se tuvo en cuenta el porcentaje de conversión y se dejó sin modificar la función de redondeo defectuosa.

V4 Pro84,9 s · 6.857 tokens

He detectado los tres errores y he devuelto los archivos corregidos, junto con las pruebas de regresión solicitadas.

Configuración de la tarea: Detectar un error de cálculo de precios en TypeScript que afecta a varios archivos, mantener la API pública, corregir el comportamiento del redondeo de descuentos y divisas, y proponer pruebas de regresión.

Lo que esto pone de manifiesto: Flash identificó un síntoma importante, mientras que Pro rastreó los defectos interrelacionados en los tres archivos.

Veredicto editorial: V4 Pro cumplió todos los criterios de aceptación. Flash requirió una corrección del material antes de que el parche pudiera utilizarse con seguridad.

Prueba práctica 02 · Agentes

Clasificación de incidentes y planificación estructurada

Decisión dividida
V4 Flash51,6 s · 1.656 tokens

Se ha elaborado un plan de seguridad válido, pero se ha envuelto el JSON solicitado en una etiqueta de código Markdown.

V4 Pro111,6 s · 9.172 tokens

Solo se devolvió un JSON válido, con un filtro de pruebas más claro y unas restricciones más estrictas a continuación.

Configuración de la tarea: Evaluar un incidente a partir de pruebas de solo lectura, distinguir los hechos de las suposiciones, identificar las acciones que requieren aprobación, elaborar un plan de verificación y generar un resultado estrictamente estructurado.

Lo que esto pone de manifiesto: Ambos modelos respetaban el límite de seguridad de «solo lectura». La diferencia práctica radicaba en la disciplina de formato frente a la velocidad y la economía de producción.

Veredicto editorial: Elige V4 Pro cuando sea importante obtener un resultado estrictamente legible por máquina; elige V4 Flash cuando el plan pueda ser revisado por una persona y la prioridad sea la eficiencia.

Prueba práctica 03 · El día a día en el trabajo

Acta de la reunión en formato JSON estricto

Decisión dividida
V4 Flash · 18,6 s · 418 tokens

El JSON es válido y más rápido, pero ha clasificado erróneamente un estado presupuestario «confirmado» como «incierto».

V4 Pro · 220,9 s · 17 244 tokens

JSON válido con un etiquetado más preciso que distingue entre datos contrastados e incertidumbres.

Configuración de la tarea: Convertir un memorándum de proyecto con fecha en un esquema JSON fijo sin añadir datos.

Lo que esto pone de manifiesto: Flash era mucho más eficiente; Pro identificaba los estados de riesgo con mayor precisión.

Veredicto editorial: «Pro» para decisiones de riesgo automatizadas; «Flash» para la extracción revisada por personas.

Prueba práctica 04 · Investigación

Memorándum de decisión basado en pruebas

Ambos aprobaron
V4 Flash · 9,9 s · 333 fichas

Me mantuve dentro del paquete de origen y generé un enrutamiento basado en tareas.

V4 Pro · 60,4 s · 4.189 tokens

La misma recomendación, pero con límites y garantías más claros en cuanto a las pruebas.

Configuración de la tarea: Redacta un memorándum de entre 180 y 230 palabras utilizando únicamente el paquete de fuentes controlado y exactamente tres puntos sobre las lagunas en las pruebas.

Lo que esto pone de manifiesto: Ambos rechazaron las afirmaciones sin fundamento y llegaron a la misma recomendación.

Veredicto editorial: Ambos superaron la prueba; Pro fue ligeramente más preciso, mientras que Flash resultó mucho más eficiente.

Prueba práctica 05 · Razonamiento

Programación con restricciones y autocomprobaciones

Ganador: V4 Pro
V4 Flash · 6,3 s · 173 fichas

Introduje «E» en «PM» a pesar de la norma de que solo se permite «AM», y luego marqué el horario como válido.

V4 Pro · 31,5 s · 2.118 tokens

Se ha devuelto un calendario válido y se han comprobado con precisión todas las restricciones.

Configuración de la tarea: Asigna cinco tareas dependientes a cinco ranuras, respeta seis restricciones, devuelve únicamente JSON y comprueba automáticamente el cumplimiento de todas las reglas.

Lo que esto pone de manifiesto: La propia validación de Flash contradecía su calendario.

Veredicto editorial: El V4 Pro gana porque tanto su programa como sus comprobaciones eran correctos.

¿Qué modelo DeepSeek V4 deberías utilizar?

Codificación

Empieza con Flash para funciones aisladas, pruebas, SQL y correcciones bien delimitadas.

  • Pásate a la versión Pro para resolver la ambigüedad entre varios archivos.
  • Si necesitas realizar una recuperación que requiera un uso intensivo de la terminal, opta por la versión Pro.

Agentes

Empieza con Flash para cadenas de herramientas cortas y protegidas.

  • Utiliza la versión Pro para los pasos que requieran más tiempo.
  • Mantén los permisos fuera del modelo.

Tareas cotidianas

Empieza con Flash para resúmenes, extractos y borradores de correos electrónicos.

  • Utiliza la versión Pro para los documentos conflictivos.
  • Verifica externamente las afirmaciones de gran importancia.

DeepSeek V4 Pro frente a Flash: cómo elegir

Cuadro de mando de decisiones · 5 pruebas coincidentes

Ruta según el coste de corrección, no según el nombre del modelo

Ventaja de Flash5 / 5 más rápido
Victorias de nivel profesional2 victorias claras
Diferencia de precios oficial~3,11×
Carga de trabajoInicioPruebasEscalar cuando
Extracción por lotesFlashMás rápido en 5/5; 2.500 conexiones simultáneasLas etiquetas de riesgo impulsan la automatización
Depuración del repositorioProSe han detectado todos los defectos detectados previamenteFlash solo para triaje
Agentes de baja estatura y bien defendidosFlashSe puede utilizar a un coste menorEs obligatorio utilizar JSON estricto
Automatización de restriccionesProHorario válido y comprobacionesLa corrección humana es barata
Síntesis de la evidenciaO bienAmbos aprobaronElegir según el presupuesto de latencia

Conclusión: Utilizar Flash de forma predeterminada para volúmenes acotados. Contratar la versión Pro cuando el coste de la corrección supere el coste del token.

Preguntas frecuentes

¿Es la memoria Flash DeepSeek V4 adecuada para programar?

Sí. Según los resultados oficiales, Flash se sitúa cerca de Pro en algunas pruebas de programación. Pro tiene una ventaja más clara cuando la programación se extiende al uso de la terminal, la navegación o el razonamiento sobre repositorios.

¿El V4 Pro y el Flash comparten la misma ventana de contexto?

Sí. En DeepSeek se especifica una ventana de contexto de 1 millón de tokens y una salida máxima de 384 000 tokens para ambos.

¿El V4 Pro es siempre más preciso?

Ningún modelo es siempre más preciso. El modelo Pro tiene mayor capacidad activa y lidera las comparativas oficiales más exigentes, pero en tareas rutinarias con especificaciones muy concretas la diferencia práctica puede ser mínima.

¿Cuánto más barato es el V4 Flash?

Según los precios consultados el 13 de agosto de 2026, Flash cuesta unos 68% menos en el caso de los tokens de entrada y salida con fallo de caché.

¿Pueden ambos modelos utilizar herramientas?

Sí. La tabla oficial de la API incluye las llamadas a las herramientas, la salida en formato JSON, la API de respuestas y la compatibilidad con la API Anthropic para ambas.

¿Qué modelo resultó más rápido en las pruebas prácticas?

V4 Flash fue más rápido en las cinco ejecuciones de la API local. Estos tiempos incluyen la sobrecarga de la red y de la plataforma, por lo que no corresponden a la latencia del proveedor.

¿Por qué V4 Pro utiliza tantos tokens de finalización más?

La ruta «Pro» sometida a prueba mostró un número considerable de tokens de razonamiento interno dentro de su presupuesto de finalización. Esto puede resultar útil en tareas difíciles, pero aumenta el tiempo transcurrido y el uso de tokens.

¿Debería utilizar V4 Pro para todos los flujos de trabajo de los agentes?

No. Empieza con Flash para cadenas de herramientas breves, delimitadas y revisables. Pasa a Pro cuando los errores o las restricciones que interactúan entre sí supongan un alto coste de corrección.

¿Son estos los resultados oficiales de las pruebas de rendimiento del DeepSeek?

No. Las cinco tarjetas recogen los resultados de las pruebas API controladas para este artículo. Las pruebas de rendimiento oficiales DeepSeek y los datos de Artificial Analysis, de terceros, se indican por separado.

Compara la misma instrucción en GlobalGPT antes de decidirse por una ruta.

Comparte el post:

Entradas relacionadas