DeepSeek V4 Pro iguala el rendimiento de Claude Fable 5 pero con un precio 50 veces menor

Foto de DeepSeek Reuters/Yonhapnews
DeepSeek [Foto=Reuters·Yonhapnews]
La empresa de inteligencia artificial china DeepSeek ha lanzado la versión oficial de V4 Pro, que incorpora funcionalidades mejoradas de agentes de IA.

DeepSeek actualizó V4 Pro en su interfaz de programación de aplicaciones (API) el 13 de agosto, según informó el medio especializado chino China First Financial, también el 13 de agosto. En las pruebas comparativas del sector de agentes de IA—que realizan automáticamente tareas complejas de codificación y trabajo informático—el V4 Pro de DeepSeek ha demostrado un rendimiento comparable al del modelo de IA más reciente de Anthropic, Claude Fable 5, e incluso lo supera en algunas evaluaciones.

El aspecto más destacable del rendimiento radica en las tareas de agentes. V4 Pro obtuvo 87.9 puntos en la prueba "Terminal Bench", que evalúa la capacidad de ejecutar comandos reales en entornos de terminal y modificar archivos para resolver problemas. Esta puntuación difiere apenas en 0.1 puntos de los 88.0 puntos obtenidos por Claude Fable 5, lo que representa esencialmente un rendimiento equivalente.

V4 Pro de DeepSeek también demostró fortalezas en CyberGym, una evaluación de agentes de ciberseguridad, y en AutomationBench, una prueba de automatización de tareas complejas. En algunas evaluaciones, incluso superó el desempeño de Fable 5.

DeepSeek diseñó V4 Pro como un modelo de expertos mixtos (MoE) con 1.6 billones de parámetros totales y 49 mil millones de parámetros activos utilizados en cálculos reales. Además, soporta un contexto ultraamplio de 1 millón de tokens, permitiendo procesar documentos largos o bases de código extensas de una sola vez y mantener trabajos prolongados sin interrupciones.

Las capacidades de codificación también son considerables. Según la documentación técnica de DeepSeek, V4 Pro alcanzó 93.5 puntos en LiveCodeBench y 3206 puntos en Codeforces. En Codeforces, específicamente, superó algunos de los modelos más recientes de OpenAI y Google.

Notablemente, V4 Pro posee una ventaja competitiva abrumadora en precio. El precio de la API de V4 Pro es de 3 yuanes (aproximadamente 630 pesos) por cada millón de tokens de entrada y 6 yuanes (1260 pesos) por cada millón de tokens de salida. En contraste, Claude Fable 5 cuesta 10 dólares estadounidenses (aproximadamente 14000 pesos) por millón de tokens de entrada y 50 dólares (70000 pesos) por millón de tokens de salida. El precio de V4 Pro de DeepSeek representa aproximadamente 1/50 del costo de Fable 5.

DeepSeek V4 Pro demuestra que la IA china está evolucionando más allá de simplemente producir modelos económicos, según la evaluación de China First Financial. Especialmente en un contexto donde la competencia se está desplazando desde el ámbito de los "chatbots" que responden preguntas hacia la competencia en "agentes"—sistemas de IA que realizan tareas reales como codificación, seguridad informática y automatización laboral—DeepSeek ha probado el potencial de los agentes de IA chinos.



* Este artículo ha sido traducido por IA.