El 3 de septiembre de 2026 OpenAI presentó GPT-6 Astra y lo llamó “el modelo más inteligente y alineado del mundo”. Greg Brockman, presidente de OpenAI, fue más lejos: “Welcome to the AGI era”. Detrás del titular hay dos cosas que sí importan para quien dirige una empresa: el modelo es el primero que OpenAI clasifica como de riesgo Crítico en ciberseguridad bajo su propio marco de preparación, y cuesta $10 y $50 dólares por millón de tokens de entrada y salida. Ni es magia ni es humo. Es un salto real, caro, y con una letra chica que casi nadie está leyendo.
Este es el video del anuncio:
Resumen en 60 segundos
- Qué es: GPT-6 Astra, el nuevo modelo tope de línea de OpenAI, enfocado en uso de computadora: navegar interfaces, llenar hojas de cálculo, operar software como lo haría una persona.
- Cuándo: anunciado el 3 de septiembre de 2026. Sale primero a un grupo limitado de organizaciones y “en los próximos días” a todos los usuarios de ChatGPT Plus, Pro, Business y Enterprise, además de la API y AWS.
- Cuánto: $10 USD por millón de tokens de entrada y $50 por millón de salida en modo estándar. El modo Fast cuesta el doble y corre hasta 2.5 veces más rápido.
- Memoria: ventana de contexto de 1 millón de tokens, alrededor de 1,500 páginas.
- La bandera roja: es el primer modelo que cruza el umbral “Crítico” de ciberseguridad del Preparedness Framework de OpenAI. Puede encontrar y explotar vulnerabilidades desconocidas sin que nadie lo guíe paso a paso.
- La letra chica: el 99.9% en ARC-AGI-3 se logra con un andamiaje especial. Llamando a la API de forma normal, el mismo modelo saca entre 17% y 63%.
Qué hace distinto a Astra
Los modelos anteriores eran, en el fondo, muy buenos escribiendo. Le pedías un texto, un análisis o un fragmento de código y te lo daba; conectarlo a tus sistemas requería que alguien programara una integración para cada herramienta.
Astra está entrenado para usar la computadora: abrir un navegador, buscar en Google Maps, llenar un formulario de contacto, moverse dentro de una hoja de cálculo, encadenar veinte pasos sin perder el hilo. La diferencia práctica es enorme. Antes necesitabas una API para cada sistema que quisieras automatizar; ahora, en teoría, el modelo puede operar el sistema por la misma pantalla por la que lo opera tu gente.
La analogía: los modelos anteriores eran un consultor brillante por teléfono. Le explicabas el problema y te dictaba la solución, pero alguien tenía que teclearla. Astra es ese mismo consultor sentado frente a la computadora. Es un salto de categoría — y también la razón por la que la conversación de seguridad se puso seria.
Los números del lanzamiento
| Concepto | GPT-6 Astra |
|---|---|
| Fecha de anuncio | 3 de septiembre de 2026 |
| Precio API estándar | $10 USD / millón de tokens de entrada, $50 / millón de salida |
| Precio modo Fast | Aproximadamente el doble ($20 / $100), hasta 2.5x más rápido |
| Ventana de contexto | 1 millón de tokens (~1,500 páginas) |
| Dónde está disponible | ChatGPT Plus, Pro, Business y Enterprise (despliegue escalonado), API de OpenAI y AWS |
| Quién lo tuvo primero | Organizaciones del programa Daybreak de OpenAI |
| Clasificación de riesgo cibernético | “Crítico” — el primero en llegar a ese nivel |
| ExploitBench | 100% |
| FrontierMath Tier 4 | Alrededor de 98% (nivel de saturación) |
| ARC-AGI-3 | 99.9% con andamiaje especializado; 17-63% por API normal |
| OSWorld 2.0 (uso de computadora) | 72.6%, contra 65.7% de GPT-5.6 Sol, y cerca de 47% más rápido |
¿Y esto qué significa para tu empresa?
En una sesión de 30 minutos te decimos cómo aprovechar tecnología como esta en tu operación — sin humo, con números y pasos concretos.
Los benchmarks, traducidos a lenguaje de negocio
Aquí es donde conviene apagar el entusiasmo y leer con calma. Tres lecturas honestas:
1. El número estelar tiene asterisco. El 99.9% en ARC-AGI-3 depende de un andamiaje con estado, construido por OpenAI, que le permite al modelo acumular contexto entre intentos. Si tu equipo llama a la API como se llama normalmente, el mismo modelo rinde entre 17% y 63% en esa prueba. No es un engaño, pero sí significa que el resultado que compras no es el resultado del comunicado. Lo que rinde tu implementación depende tanto de la ingeniería alrededor del modelo como del modelo.
2. No es el mejor en todo. En Humanity’s Last Exam con herramientas, Astra queda por debajo de Claude Fable 5.1 (57.2% contra 65.0%, según el análisis de DataCamp). El titular de “el más inteligente del mundo” es marketing; la realidad es que sigue habiendo tareas donde otro modelo gana. Si te interesa esa comparación, la desarrollamos en Claude Opus 5 vs Fable 5 y en GPT-5.6 Sol vs Claude Fable 5.
3. Falta justo el benchmark que mide trabajo real. GDPval, la prueba de la propia OpenAI que mide desempeño en tareas profesionales reales de 44 ocupaciones, no apareció en los materiales del lanzamiento. Es la métrica más cercana a “¿esto sirve en mi oficina?”, y es la que no se publicó. Vale la pena tenerlo presente antes de firmar un contrato basado en un comunicado de prensa.
El dato que sí es sólido y sí importa: OSWorld 2.0, que mide manejo real de una computadora. 72.6% contra 65.7% del modelo anterior, y terminando las tareas casi a la mitad del tiempo. Eso es el tipo de mejora que se siente en la operación, no en una gráfica.
Costos aterrizados: qué te costaría en tu operación
Con precios de $10 y $50 por millón de tokens, este es el cálculo para un agente que revise documentos y escriba un resumen o una captura. Son estimaciones nuestras a partir de las tarifas publicadas, no cifras de OpenAI:
| Escenario | Consumo por tarea | Costo aproximado |
|---|---|---|
| Leer una factura y capturarla | ~10,000 entrada + 1,000 salida | $0.15 USD por documento |
| Analizar un contrato y resumir riesgos | ~50,000 entrada + 2,000 salida | $0.60 USD por contrato |
| 500 tareas de ese tamaño al mes | — | Alrededor de $300 USD mensuales |
| Llenar la ventana completa de 1M tokens | 1,000,000 entrada | $10 USD por una sola llamada |
La conclusión práctica: para tareas puntuales y de alto valor —revisar contratos, auditar un inventario, cerrar un mes contable— el costo es irrelevante frente al tiempo que ahorra. Para tareas masivas y repetitivas de bajo valor, Astra es un modelo caro y probablemente estés mejor con uno más económico. La pregunta correcta no es “¿cuánto cuesta el token?” sino “¿cuánto cuesta la tarea, y cuánto me cuesta hoy hacerla a mano?”.
Qué significa para tu pyme mexicana
1. La automatización deja de necesitar integración para todo
Si tu sistema de proveedores no tiene API, hasta ayer eso significaba que no se podía automatizar sin un desarrollo. Un modelo que opera la pantalla cambia esa ecuación para procesos de volumen medio. Ojo: cambia la ecuación, no la elimina. Un agente que llena formularios en un portal ajeno es frágil — el portal cambia y se rompe. Sigue siendo mejor una integración de verdad cuando el proceso es crítico, y ahí es donde entra la automatización de procesos con inteligencia artificial hecha sobre tus propios sistemas.
2. La parte de ciberseguridad no es un detalle de nota al pie
OpenAI clasificó a Astra en nivel “Crítico” de capacidad cibernética: puede encontrar vulnerabilidades desconocidas y armar cadenas de explotación por su cuenta. Restringió esas capacidades en el lanzamiento y añadió salvaguardas después del incidente de Hugging Face. Traducción para tu empresa: la misma capacidad que hace útil a un agente lo hace peligroso si alguien más lo apunta hacia ti. Si llevabas tiempo posponiendo lo básico —autenticación de dos factores, respaldos probados, permisos mínimos por usuario— este es el recordatorio. Lo explicamos con un caso concreto en Ciberataques con IA: la lección de Hugging Face.
3. Tus clientes te van a buscar preguntándole a la IA
Cada generación de estos modelos empuja más búsquedas hacia el chat y menos hacia la lista azul de resultados. Si tu negocio no aparece cuando alguien le pregunta a ChatGPT por un proveedor de tu giro en tu ciudad, esa venta ni siquiera llegó a existir para ti. Es un trabajo distinto al SEO clásico y ya lo desglosamos en cómo aparecer en las respuestas de ChatGPT.
4. Lo que NO cambia
Astra no conoce tu inventario, no ve tus órdenes de compra y no sabe cuál cliente te debe. Un modelo más inteligente no arregla datos desordenados: los procesa más rápido y se equivoca con más confianza. Si tu información vive en tres Excel y la cabeza del encargado, el cuello de botella no es el modelo.
Cómo decidir: un piloto de dos semanas
- Elige una sola tarea repetitiva, medible y de bajo riesgo. Captura de facturas y revisión de contratos son los dos clásicos que funcionan.
- Mide cuánto cuesta hoy: horas por semana por el costo real de esa persona. Sin ese número no hay forma de saber si ganaste.
- Prueba con el modelo que ya pagas antes de saltar a Astra. En muchas tareas un modelo más barato entrega el mismo resultado, y así aíslas si el problema era el modelo o el proceso.
- Corre 50 casos reales y cuenta los errores a mano. Un 90% de acierto suena bien hasta que descubres qué cuesta el 10% restante.
- Decide con el costo por tarea, no con el precio por token ni con el benchmark del comunicado.
- Si el agente va a tocar sistemas ajenos, define qué puede hacer solo y qué requiere aprobación humana. Escríbelo antes de encenderlo.
Preguntas frecuentes
¿Ya puedo usar GPT-6 Astra?
Depende. El 3 de septiembre salió para un grupo limitado de organizaciones, y OpenAI indicó que en los días siguientes llegaría a todos los usuarios de ChatGPT Plus, Pro, Business y Enterprise, además de la API y AWS. Si tienes un plan de pago, es cuestión de días.
¿Cuánto cuesta?
En la API, $10 USD por millón de tokens de entrada y $50 por millón de salida en modo estándar; el modo Fast cuesta aproximadamente el doble. Dentro de ChatGPT entra en la cuota de tu plan, con la opción de comprar créditos adicionales.
¿De verdad es AGI?
Brockman dijo “bienvenidos a la era de la AGI” y reconoció al mismo tiempo que la definición es ambigua. Un modelo que saca 100% en una prueba de explotación de vulnerabilidades y queda por debajo de un competidor en otra prueba de razonamiento no es una inteligencia general; es un sistema extraordinariamente bueno en un conjunto de tareas. Para efectos de tu negocio, la pregunta útil no es si es AGI, sino qué tarea concreta te resuelve y a qué costo.
¿Debo cambiar de proveedor de IA por esto?
No con la información de un comunicado de prensa. Los liderazgos entre modelos cambian cada pocas semanas, y el costo real de cambiar está en el trabajo alrededor del modelo, no en el modelo. Vale más construir procesos que puedas mover de un proveedor a otro que casarte con el nombre del mes.
¿Esto vuelve más inseguro a mi negocio?
La capacidad ofensiva de estos modelos sube para todos, atacantes incluidos. OpenAI restringió las funciones más delicadas en el lanzamiento, pero la tendencia es clara. Lo sensato no es el pánico: es tener al día lo básico de higiene digital, que es exactamente lo que la mayoría de las pymes trae pendiente.
¿Te está sirviendo este análisis?
Recibe 1 correo a la semana con lo más importante de IA, automatización y tecnología para tu negocio — explicado en simple, con cifras en pesos y cero spam.
Fuentes
- Axios: OpenAI lanza GPT-6 Astra y dice que podría representar AGI
- VentureBeat: “Welcome to the AGI era” — análisis de benchmarks y precios
- CNBC: OpenAI anuncia el despliegue de GPT-6 Astra
- DataCamp: características, benchmarks y precios de GPT-6 Astra
- Artificial Analysis: precio y ventana de contexto de GPT-6 Astra
- 9to5Google: lanzamiento y disponibilidad por fases
Si estás viendo este lanzamiento y te preguntas cuál de tus procesos aguantaría un agente de IA y cuál se rompería, esa es exactamente la conversación que hacemos todos los días. Agenda una llamada de 30 minutos y te decimos con franqueza qué automatizar primero y qué todavía no conviene tocar.

