DeepSeek V4-Flash presenta el costo operativo más bajo entre modelos de IA principales…100 veces más barato que Claude

  • Costo promedio de 3 centavos por prueba…índice de rendimiento de 50 puntos, por debajo de modelos de alto rendimiento

Fotografía de DeepSeek AFP Yonhapnews
DeepSeek [Foto=AFP·Yonhapnews]
El nuevo modelo de la startup china de inteligencia artificial DeepSeek registró el costo operativo más bajo entre los principales modelos de IA a nivel mundial. El costo por ciclo de prueba de rendimiento fue más de 100 veces más económico que el "Claude Fable 5" de Anthropic.

Según la agencia Reuters del 2 de agosto (hora local), la empresa evaluadora de modelos de IA Artificial Analysis informó que el "V4-Flash" de DeepSeek presentó el costo de ejecución de pruebas más bajo entre los principales modelos globales.

El costo promedio por prueba del V4-Flash, según cálculos de Artificial Analysis, fue de 3 centavos de dólar (aproximadamente 43 pesos). El "Kimi K3" de Moonshot AI de China fue de 86 centavos (aproximadamente 1,230 pesos), el "GPT-5.6 Sol" de OpenAI fue de 1.86 dólares (aproximadamente 2,600 pesos), y el "Claude Fable 5" de Anthropic se registró en 3.15 dólares (aproximadamente 4,500 pesos).

La tarifa de uso del V4-Flash es de 0.14 dólares por millón de tokens de entrada (aproximadamente 200 pesos) y 0.28 dólares por millón de tokens de salida (aproximadamente 400 pesos). Un token es la unidad de datos que la IA utiliza al procesar o generar texto.

DeepSeek lanzó oficialmente el V4-Flash el 31 de julio pasado. Se interpreta que DeepSeek, que se encuentra en preparativos para una oferta pública inicial (OPI), busca recuperar el liderazgo del mercado aprovechando su fortaleza como modelo de IA de costo extremadamente bajo.

Sin embargo, el costo real de operación no puede determinarse únicamente por el precio de los tokens. Reuters señaló que, aunque el precio sea más bajo, si se requieren más procesos de razonamiento y más tokens de entrada y salida para generar una respuesta, el costo final puede ser significativamente mayor.

Además, el rendimiento quedó por debajo del de algunos modelos de alto desempeño. El V4-Flash recibió una puntuación de 50 puntos sobre 100 en el "Índice de Inteligencia" de Artificial Analysis, que combina los resultados de 9 pruebas de rendimiento en codificación, razonamiento y tareas empresariales.

Obtuvo la misma puntuación que el "Gemini 3.6 Flash" de Google, pero 1 punto menos que el "Muse Spark 1.1" de Meta y "GLM-5.2" de Z.AI de China. El Kimi K3 de Moonshot AI registró 57 puntos, mientras que el "Claude Opus 5" y "Claude Fable 5" de Anthropic, así como el GPT-5.6 de OpenAI, obtuvieron al menos 9 puntos más que el V4-Flash.

Este índice se calcula combinando los resultados de evaluación de 9 pruebas de rendimiento que incluyen codificación, razonamiento y tareas empresariales.

DeepSeek también está preparando el "V4-Pro", un modelo con rendimiento superior al V4-Flash, pero no ha revelado la fecha oficial de lanzamiento.



* Este artículo ha sido traducido por IA.