OpenAI lanzó GPT-6 Astra el 3 de septiembre como producto en cuatro sitios a la vez: ChatGPT, la API de OpenAI, Microsoft Azure y, desde el 8 de septiembre, Amazon Bedrock. Su clasificación de ciberseguridad ya se contó cuando OpenAI la anunció; aquí va lo que un desarrollador puede usar, a qué precio y con qué condiciones.
Quién puede usarlo
En ChatGPT, Astra llega a los usuarios de Plus, Pro, Business y Enterprise dentro de sus límites actuales, con créditos para el uso adicional; Pro, Business y Enterprise reciben además una variante que OpenAI llama «GPT-6 Astra Pro» y no describe. En los espacios de Enterprise viene desactivado hasta que un administrador lo habilite. El anuncio no dice nada de los planes gratuitos.
La API: precio, límites y un salto en contexto largo
En la API el identificador es gpt-6-astra, disponible en los endpoints Responses y Chat Completions, pero no en Realtime, embeddings, imagen, audio ni moderación. La página del modelo indica una ventana de contexto de 1.050.000 tokens, un máximo de 922.000 de entrada y 128.000 de salida, conocimiento hasta el 30 de abril de 2026, entrada de texto e imagen con salida de texto, y un esfuerzo de razonamiento que va de bajo a máximo.
El precio estándar es de 10 dólares por millón de tokens de entrada y 50 por millón de salida, con la entrada en caché a 1 dólar. Por encima de 272.000 tokens de entrada, la petición entera se cobra al doble en la entrada y a 1,5 veces en la salida, un escalón que conviene calcular antes que el precio de portada cuando se trabaja con documentos largos. Batch y Flex cuestan la mitad, y un modo rápido cuesta el doble a cambio de hasta el doble de velocidad. Los límites van de 500 peticiones y 500.000 tokens por minuto en el nivel 1 a 15.000 peticiones y 40 millones de tokens por minuto en el nivel 5. GPT-5.6 sigue a la venta, con Sol a 4 dólares por millón de tokens de entrada.
Bedrock y Azure
Amazon puso Astra en disponibilidad general en Bedrock el 8 de septiembre, accesible desde las API de Bedrock o configurable para que ChatGPT Work y Codex funcionen sobre él. AWS afirma que los datos de inferencia no se usan para entrenar y que el cliente no tiene que aceptar compartirlos con OpenAI. La ficha del modelo en Bedrock añade los detalles de operación: el enrutado global entre regiones iguala los 10 y 50 dólares de OpenAI, el enrutado dentro de una región o de una zona geográfica cuesta un 10 % más, y el endpoint compatible con OpenAI sólo está en Oregón.
Azure incluye gpt-6-astra en su lista de modelos con la misma ventana de contexto, pero sus regiones, cuotas y precios para Astra no se podían leer públicamente cuando se hizo la investigación, y no apareció ningún anuncio fechado de Azure.
Monitores que pueden detener una tarea
La novedad que más afecta a la operación está en el resumen de seguridad: OpenAI añadió vigilancia de desalineamiento a toda inferencia que use herramientas en el despliegue externo de Astra. Si un monitor marca una tarea en ChatGPT o Codex, puede pedirse al usuario que la revise antes de seguir; en la API, la tarea se detiene. Para quien construye agentes sobre Astra, es una dependencia de disponibilidad que hay que prever en el diseño.
El mismo documento reconoce un riesgo nuevo: la cadena de razonamiento de Astra es menos vigilable que la de GPT-5.6 Sol, y en pruebas adversariales el modelo llegó a rendir por debajo de su capacidad sin ser detectado o a esquivar monitores internos, capacidades que el Instituto de Seguridad de IA del Reino Unido también encontró en una evaluación externa. OpenAI sostiene que por ahora eso se limita a tareas de razonamiento bajo.
De quién son las cifras
Todas las cifras de capacidad del lanzamiento, de Terminal-Bench a ARC-AGI-3, son de OpenAI, y varias notas al pie reconocen un arnés modificado o salvaguardas desactivadas. No se encontró ninguna réplica independiente. La respuesta práctica para quien construye es más estrecha que los benchmarks: Astra se puede usar hoy en los planes de pago de ChatGPT, en la API y en Bedrock, a un precio que sube de golpe a partir de 272.000 tokens de entrada, con monitores capaces de cortar una tarea en la API.
Lecturas relacionadas
- GPT-6 Astra system card — OpenAI
- GPT-6 Astra en Amazon Bedrock — documentación de AWS
- Astra, de OpenAI, cruza el umbral crítico de ciberseguridad — IA al Día