OpenAI lanza GPT-6 Sol y Luna: modelos eficientes adaptados a cada tarea

  • GPT-6 Sol y Luna mejoran velocidad y rentabilidad basándose en el rendimiento de GPT-6 Astra

  • Tareas complejas requieren mayor nivel de razonamiento; operaciones repetitivas y masivas utilizan modelos de menor costo

GPT-6 Sol y GPT-6 Luna demostraron alto rendimiento operativo y eficiencia de costos respectivamente en la evaluación de AutomationBench. [Foto=OpenAI]
GPT-6 Sol y GPT-6 Luna demostraron alto rendimiento operativo y eficiencia de costos respectivamente en la evaluación de AutomationBench. [Foto=OpenAI]

OpenAI presentó GPT-6 Sol y GPT-6 Luna, ampliando su línea de productos tras el lanzamiento de GPT-6 Astra. Estos nuevos modelos permiten a los usuarios elegir la solución más adecuada según la complejidad de las tareas, escala operativa, velocidad de procesamiento requerida y presupuesto disponible.

La compañía anunció el 23 de septiembre el lanzamiento de GPT-6 Sol y Luna. Ambos modelos fueron entrenados con metodologías similares a GPT-6 Astra y muestran mejoras significativas respecto a sus predecesores, GPT-5.6 Sol y GPT-5.6 Luna, en áreas clave como tareas especializadas, precisión factual, codificación y utilización de herramientas informáticas.

Mientras que GPT-6 Astra está diseñado para operaciones críticas que exigen un alto nivel de rendimiento, Sol y Luna se enfocan en proporcionar capacidades mejoradas de manera más rápida y rentable. Según OpenAI, esto permite la adopción de GPT-6 en operaciones cotidianas y diversos servicios.

OpenAI reveló que GPT-6 Sol superó el rendimiento de GPT-6 Astra en AutomationBench, una evaluación que mide la capacidad de los sistemas de inteligencia artificial para ejecutar tareas en entornos operativos reales.

Automat ionBench evalúa la capacidad de completar tareas de principio a fin utilizando 47 herramientas en contextos de ventas, marketing, operaciones, atención al cliente, finanzas y recursos humanos. GPT-6 Sol alcanzó un 33,2% en el nivel de razonamiento más alto, denominado «xhigh», superando el 30,3% de GPT-6 Astra en el nivel «low».

GPT-6 Luna registró una puntuación 5,4 puntos porcentuales superior a GPT-5.6 Luna en el nivel de razonamiento «high», mientras que redujo el costo por tarea en un 58%. El nivel de razonamiento indica el grado de recursos computacionales que invierte el modelo para resolver problemas, permitiendo optimizar el rendimiento en tareas complejas o incrementar velocidad y eficiencia en operaciones más simples.

La precisión factual también mejoró considerablemente. OpenAI evaluó este aspecto utilizando conversaciones reales desidentificadas de usuarios de ChatGPT donde se señalaron errores factuales en versiones anteriores. GPT-6 Sol registró aproximadamente la mitad del nivel de errores de GPT-5.6 Sol, logrando una precisión factual cercana a la de GPT-6 Astra con costos significativamente menores.

El rendimiento en codificación y la eficiencia en desarrollo también fueron optimizados. En conversaciones técnicas y relacionadas con programación, se redujo la jerga técnica, expresiones torpes y explicaciones innecesarias para transmitir los conceptos esenciales de forma más clara y concisa.

GPT-6 Sol y Luna están disponibles para usuarios de Plus, Pro, Business, Enterprise y Edu a través de ChatGPT Work y Codex. Los usuarios de planes gratuitos y de pago estándar pueden acceder a GPT-6 Luna en la aplicación de escritorio.
 



* Este artículo ha sido traducido por IA.