Astra vs Mitos: la batalla de dos gigantes antes de su salida a bolsa

  • OpenAI y Anthropic revelan sus modelos de última generación en septiembre; resultados divergentes en benchmarks internos e independientes

  • OpenAI opta por acceso público completo, mientras que Anthropic limita la divulgación a organismos verificados; estrategias de mercado opuestas

  • Anthropic apunta al Nasdaq en octubre con una valoración que podría alcanzar los 2 billones de dólares

Imagen creada con IA [Foto=Gemini]
Imagen creada con IA [Foto=Gemini]


OpenAI y Anthropic han presentado simultáneamente sus modelos más avanzados antes de sus respectivas salidas a bolsa. Anthropic lanzó el 1 de septiembre "Claude Mitos 5.1", mientras que OpenAI reveló el 3 de septiembre "GPT-6 Astra". La competencia entre ambas compañías por el liderazgo mundial en inteligencia artificial ha reavivado las expectativas sobre un nuevo ciclo de inversión en el sector.

El sector tecnológico evaluó el 7 de septiembre la contienda entre ambas compañías como el comienzo de una carrera hacia la inteligencia general artificial (AGI, por sus siglas en inglés). La AGI se define como una inteligencia artificial capaz de realizar tareas que los humanos realizan de manera similar.

Astra de OpenAI está disponible inmediatamente en todos los canales: planes pagos de ChatGPT, API, Azure y Bedrock. En contraste, Mitos 5.1 se mantiene con acceso restringido únicamente a un número limitado de instituciones verificadas a través del "Proyecto Glasswing", vinculado al gobierno estadounidense.

La ventaja en rendimiento según benchmarks varía según los criterios de evaluación. En los propios benchmarks de OpenAI, Astra superó a Claude Fable 5.1, el modelo gemelo de Mitos 5.1. Sin embargo, según el índice de inteligencia de la agencia de evaluación independiente Artificial Analysis, Mitos 5.1 se adelantó por estrecho margen con 57 puntos contra 55. Greg Brockman, presidente de OpenAI, afirmó al presentar Astra que el modelo representa "el comienzo de la era AGI" y que se acerca más que ningún otro a la inteligencia general de nivel humano.

Analizando indicadores específicos, Astra registró un 99,9% en ARC-AGI-3, que evalúa la capacidad de manipulación de computadoras, y un 57,9% en TerminalBench 4.0, que mide la capacidad de resolver problemas de software, superando a los modelos de la familia Mitos y Fable (55,8%). En el SRE Bench, que mide capacidades de ataque cibernético mediante ingeniería inversa binaria, alcanzó una precisión del 88,0%. Incluso identificó dos vulnerabilidades nuevas en el motor del navegador V8 utilizado por Google Chrome.

Sin embargo, OpenAI enfrenta críticas sobre la controlabilidad de sus modelos de IA. En julio pasado, durante una evaluación de ciberseguridad, un modelo de OpenAI escapó de su entorno aislado y atacó infraestructura de Hugging Face. OpenAI divulgó el incidente y publicó un informe técnico el mes siguiente. No obstante, reaparecieron problemas posteriores cuando se descubrió que un incidente de robo de datos en Wikipedia alemana ocurrido en mayo había sido ocultado durante meses antes de ser revelado por grupos de investigación externos.

Anthropicoptó por una estrategia opuesta: demostrar el rendimiento de Mitos 5.1 mediante capacidades de defensa verificadas en lugar de benchmarks públicos. Aunque OpenAI sostiene que Astra supera a Mitos 5.1 en rendimiento de benchmarks, en la evaluación independiente del Instituto Británico de Seguridad de IA (AISI), solamente el modelo predecesor, Mitos Preview, ha completado íntegramente "The Last Ones", una simulación de ataque a redes empresariales de 32 etapas. Por esta razón, Mitos está clasificado como un modelo de alto riesgo a nivel estatal y no está disponible para el público general, aunque algunos analistas opinan que su rendimiento real supera al del Astra, que sí está disponible públicamente.

La competencia entre ambos modelos está vinculada a los calendarios de salida a bolsa. Anthropic presentó de manera confidencial su registro de oferta pública (S-1) ante la Comisión de Bolsa y Valores de Estados Unidos el 1 de junio, con Goldman Sachs, JP Morgan y Morgan Stanley como colocadores principales, apuntando a una valoración cercana a 1 billón de dólares y una cotización en el Nasdaq para octubre. OpenAI presentó su S-1 una semana después, el 8 de junio, pero se perfila un retraso en el calendario del IPO debido a volatilidad de mercado. Anthropic también registró ingresos de 11.500 millones de dólares en el segundo trimestre del año, superando por primera vez a OpenAI (6.700 millones de dólares).

Si ambas compañías logran cotizar exitosamente, se formaría el mayor agrupamiento de ofertas públicas iniciales en la historia, superando a SpaceX, que se cotizó en junio con una valoración de 1,77 billones de dólares. Se estima que Anthropic podría alcanzar una valoración de hasta 2 billones de dólares tras su salida a bolsa. La confrontación entre Astra y Mitos podría convertirse en el punto de inflexión que determine no solo el liderazgo en la industria de IA, sino también cuál será la empresa de inteligencia artificial con mayor valoración en el mercado.




* Este artículo ha sido traducido por IA.