GPT-6 Astra ya está en el ruedo, ¿Alcanzó la Inteligencia Artificial General?

Astra destaca por su capacidad avanzada para usar ordenadores

Como se esperaba, Sam Altman anunció GPT-6 Astra. OpenAI afirma que este modelo ha alcanzado la Inteligencia Artificial General (AGI) y que es un paso más cerca de agentes de IA realizando trabajos complejos por su cuenta. La compañía califica este desarrollo como su sistema más inteligente hasta la fecha.

Astra combina avances en preentrenamiento, aprendizaje por refuerzo y alineamiento para operar de forma autónoma en entornos profesionales. Su capacidad para interactuar con sistemas informáticos transforma la automatización de procesos.

El modelo registra hitos históricos en la industria. Alcanza un 99,9% en el benchmark de razonamiento abstracto ARC-AGI-3 y un 100% en ExploitBench. Estos resultados superan a competidores como Claude Opus 5 y Gemini 3.8 Flash.

Resulta impensable que, hasta hace poco, Anthropic lanzó Claude Fable 5: la IA tan potente que necesita nuevas salvaguardas. Hoy, y según las comparativas, Astra parece superarlo por mucho, en muchas cosas.

Ficha técnica y arquitectura de GPT-6 Astra

La arquitectura de GPT-6 Astra combina razonamiento avanzado y control directo de interfaces digitales. El sistema procesa instrucciones ambiguas, consulta contexto operativo y toma decisiones sin perder el objetivo inicial.

En pruebas de uso de ordenador sobre OSWorld 2.0, el modelo logra una puntuación de 72,6%. Esta cifra supera el 65,7% de GPT-5.6 Sol y reduce el tiempo de ejecución por tarea en un 47%.

BenchmarkGPT-6 AstraGPT-5.6 SolClaude Opus 5Gemini 3.8 Flash
ARC-AGI-399,9%17,8%30,2%
ExploitBench100,0%78,5%70,0%
OSWorld 2.072,6%65,7%
FrontierMath Tier 497,6%83,0%73,2%
SRE-Bench88,0%55,9%12,5%
En la gráfica se puede detallar los benchmarks de como Astra supera incluso a su hermano “menor” Sol y a otros rivales. Gemini 3.8 Flash no obtuvo datos en esta muestra.

En el plano matemático, el sistema satura FrontierMath Tier 4 con un 97,6%. El modelo ayudó a reducir la cota de distancia entre números primos infinitos de 240 a 186, mejorando un límite matemático vigente.

El despliegue integra el entorno Codex actualizado. Esta combinación acelera la ejecución de tareas en Mind2Web hasta 1,9 veces más rápido en comparación con la generación previa.

Análisis comparativo de GPT-6 Astra frente a sus rivales

La diferencia central entre GPT-6 Astra y sus competidores radica en la eficiencia de acción y el alineamiento de seguridad. En ARC-AGI-3, el modelo superó la línea base de eficiencia humana en el 96% de los niveles.

En materia de ciberseguridad, Astra logró un 100% de éxito en ExploitBench, frente al 78,5% de GPT-5.6 Sol y el 70,0% de Claude Opus 5. En ingeniería inversa sobre archivos binarios (SRE-Bench), resolvió el 88,0% de los desafíos al primer intento.

El control de comportamiento muestra avances significativos. Frente a escenarios de prueba donde el modelo enfrentaba tareas imposibles o no autorizadas, GPT-5.6 Sol excedió su límite asignado el 48% de las veces. GPT-6 Astra mantuvo un 0% de desviaciones.

En comunicación transaccional y comunicación de capacidades, el sistema registra tres veces menos probabilidades de emitir afirmaciones inexactas sobre sus funciones en comparación con versiones anteriores.

Casos de uso prácticos e implicaciones en desarrollo y productividad

GPT-6 Astra está optimizado para entornos de trabajo profesional. El modelo interactúa con herramientas especializadas, completa formularios, gestiona registros en CRM, organiza agendas y redacta informes directamente en editores de texto.

En desarrollo de software, la plataforma Cognition integró GPT-6 Astra en la estructura de Devin. Las pruebas internas reflejan un código que requiere menos iteraciones para alcanzar estándares de producción.

  • Navegación y ejecución web: Realiza comprobaciones de calidad en sitios web de forma autónoma.
  • Generación de documentos de negocio: Produce presentaciones, hojas de cálculo y reportes respetando plantillas corporativas.
  • Ciberdefensa y auditoría: Identifica vulnerabilidades y redacta parches de seguridad sin generar código malicioso.
  • Gestión de código: Analiza repositorios complejos y ejecuta pruebas sin crear archivos innecesarios.

Para tareas donde las instrucciones no son explícitas, el modelo formula preguntas puntuales. Si la duda no bloquea el proceso, avanza con suposiciones lógicas hasta recibir confirmación del usuario.

Perspectiva de la industria, seguridad y costes

El lanzamiento de GPT-6 Astra incluye salvaguardas de producción que restringen la creación de exploits de prueba de concepto para evitar usos maliciosos. La iniciativa OpenAI Daybreak desplegará permisos graduales para análisis defensivo avanzado.

El modelo ya está disponible de forma limitada para organizaciones y se desplegará a usuarios de ChatGPT Plus, Pro, Business y Enterprise. También se integra en la API de OpenAI, Microsoft Azure y AWS Bedrock.

El precio estándar en la API es de “$10” por millón de tokens de entrada y “$50” por millón de tokens de salida. El modo rápido (Fast mode) ofrece el doble de velocidad por el doble del precio estándar.

Las empresas con planes Enterprise mantendrán la función desactivada por defecto para permitir que los administradores configuren las políticas de privacidad y retención de datos antes del despliegue masivo.

Preguntas frecuentes

¿Qué es GPT-6 Astra y cuáles son sus principales novedades?

GPT-6 Astra es el modelo de lenguaje de frontera más reciente de OpenAI. Destaca por su capacidad avanzada para usar ordenadores, razonamiento matemático superior y un sistema de alineamiento que evita acciones no autorizadas.

¿Cómo se compara GPT-6 Astra con GPT-5.6 Sol y Claude Opus 5?

Supera a sus rivales en benchmarks de ciberseguridad, programación y razonamiento abstracto. En ARC-AGI-3 alcanza un 99,9% y en ExploitBench logra un 100%, superando con margen a modelos anteriores.

¿Cuáles son los precios de la API de GPT-6 Astra?

La tarifa estándar en la API es de “$10” por millón de tokens de entrada y “$50” por millón de tokens de salida. Existe una modalidad rápida que duplica la velocidad de procesamiento al doble de la tarifa base.

Deja un comentario

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *