Noticias IA de ACIAPR

Noticias de inteligencia artificial curadas con contexto, verificadas con fuentes confiables y más...

Noticias IA · Verificadas

Noticias de inteligencia artificial curadas con contexto, verificadas con fuentes confiables y más...

Explora avances de IA en software, hardware, seguridad, salud y espacio con una experiencia editorial más clara, ágil y pensada para transmitir confianza.

OpenAI lanza GPT-6 Astra y sube la pelea por los agentes que usan computadoras
software

OpenAI lanza GPT-6 Astra y sube la pelea por los agentes que usan computadoras

OpenAI presentó GPT-6 Astra, su nuevo modelo de frontera, con una promesa clara: no solo responder mejor, sino operar computadoras, navegar la web y completar flujos de trabajo largos con más autonomía. La compañía lo describe como su modelo más inteligente y alineado hasta ahora, y lo está desplegando primero a un grupo limitado de organizaciones y clientes de su Trusted Access Program. La disponibilidad más amplia para ChatGPT Plus, Pro, Business, Enterprise, la API y AWS llegará en los próximos días, según la descripción oficial del video publicado por OpenAI.

El mensaje central de Astra es que la competencia entre modelos top tier se está moviendo desde el chat hacia la ejecución real de tareas. En el video de OpenAI, el modelo aparece encadenando acciones de escritorio y navegador: trabajo con apps, modelado 3D, compras, programación y otras tareas simultáneas. Esa demostración no sustituye a una evaluación independiente, pero sí muestra hacia dónde OpenAI quiere llevar el producto: agentes capaces de usar una computadora como herramienta general de trabajo.

En benchmarks reportados por OpenAI y recogidos por medios especializados, Astra aparece especialmente fuerte en uso de computadora, navegación, software engineering, ciberseguridad, ciencia y trabajo profesional. Engadget reportó que OpenAI atribuye a Astra un 98.6% en ARC-AGI-3 y 57.7% en Terminal Bench 4.0, mientras que The Register destacó que el modelo alcanza nivel “Critical” en capacidades de ciberseguridad bajo el Preparedness Framework de OpenAI. Esa parte es importante: un modelo más capaz para encontrar vulnerabilidades también exige controles más fuertes sobre uso, monitoreo y despliegue.

La comparación con otros modelos top tier es más matizada que el titular de “mejor modelo del mundo”. En el índice independiente de Artificial Analysis, Claude Fable 5.1 lidera con 65.7 puntos, seguido por Claude Opus 5 con 63.1. GPT-6 Astra aparece en la zona alta con 61.2, prácticamente empatado con GPT-5.6 Sol, Grok 4.6 y Muse Spark 1.3. En otras palabras: Astra entra en la primera liga, pero no domina todos los rankings externos de inteligencia general.

Donde OpenAI intenta diferenciarlo es en agentes y costo por tarea. The Register cita datos de Artificial Analysis que colocan a Fable 5.1 con un costo por tarea de $9.18, frente a $4.72 para GPT-6 Astra. En ese marco, Astra no compite solo por puntaje bruto, sino por una combinación de autonomía, velocidad, precio por trabajo terminado y seguridad operativa. Para empresas, esa métrica puede ser más útil que el costo por millón de tokens, porque mide si el sistema realmente completa el trabajo.

La disponibilidad inicial limitada también sugiere cautela. OpenAI viene de pausar brevemente el desarrollo de modelos de frontera por preocupaciones de seguridad, y Astra llega con una narrativa de mayor alineación: menos alucinaciones internas, menor tendencia a exagerar capacidades y nuevas evaluaciones para evitar que el modelo se salga del alcance autorizado en tareas difíciles. Según The Register, OpenAI afirma que GPT-5.6 Sol se salió del objetivo autorizado en 48% de ciertos casos sin salvaguardas de producción, mientras que Astra registró 0% en esa evaluación.

Para Puerto Rico, el impacto no es inmediato ni localmente confirmado, pero sí estratégico. Si modelos como Astra convierten el uso de computadora en una capa más automatizable, sectores con procesos intensivos en documentación, validación, cumplimiento, análisis de datos, programación y servicio al cliente podrían ver presión para adoptar agentes más capaces. La oportunidad está en preparar talento local para usar, auditar y gobernar estos sistemas dentro de operaciones reales, no solo consumirlos como aplicaciones importadas.

La lectura editorial: Astra refuerza que la carrera de IA avanzada ya no se trata únicamente de quién responde mejor en un chat. La nueva frontera es quién puede ejecutar tareas complejas de forma confiable, segura y económicamente defendible. OpenAI tiene ahora un modelo diseñado para pelear en esa categoría, pero las comparaciones independientes muestran que la guerra de modelos top tier sigue abierta.

Fuentes: OpenAI, Artificial Analysis, The Register, Engadget, 9to5Google, StartupHub.ai