Skip to content
Tech AI Wire

GPT-6 Astra ya está disponible de forma general en Bedrock y Copilot

GPT-6 Astra está disponible de forma general en Amazon Bedrock a 10 dólares por millón de tokens de entrada, y en GitHub Copilot para los planes Pro+, Max, Business y Enterprise.

Por Tech AI Wire Team

3 min de lectura

XLinkedIn
The GitHub Copilot model picker in Visual Studio Code, open and showing GPT-6 Astra among the selectable models.

En cifras

standard price per million input / output tokens, short context
$10 / $50
per million cached input tokens, short context
$1
input tokens of context on Amazon Bedrock
1M

El GPT-6 Astra de OpenAI ya está disponible de forma general fuera de los propios productos de OpenAI. GitHub lo puso en disponibilidad general en Copilot el 4 de septiembre de 2026, y AWS lo puso en disponibilidad general en Amazon Bedrock el 8 de septiembre de 2026. En Bedrock acepta una ventana de contexto de hasta 1 millón de tokens de entrada.

Para los desarrolladores, la cifra que importa es la factura, y los precios de OpenAI son más complicados que una tarifa única.

Cuánto cuesta

La documentación de precios de OpenAI divide GPT-6 Astra de dos maneras a la vez. Los precios cambian con la longitud de su contexto, y otra vez según elija el modo Standard o el modo Fast. Todas las cifras son por millón de tokens.

Modo y contextoEntradaEntrada en cachéSalida
Standard, contexto corto$10.00$1.00$50.00
Standard, contexto largo$20.00$2.00$75.00
Modo Fast, contexto corto$20.00-$100.00
Modo Fast, contexto largo$40.00-$150.00

Dos detalles son fáciles de pasar por alto y caros de descubrir tarde.

El modo Fast duplica el precio de entrada y duplica el precio de salida frente a Standard. Tampoco está disponible en todas partes: la documentación de OpenAI indica que «el modo Fast no está disponible para GPT-6 Astra con residencia de datos en la UE. Use el procesamiento Standard para esas solicitudes».

Por separado, los modelos publicados después del 5 de marzo de 2026 llevan un incremento de coste del 10 % cuando se llaman a través de endpoints regionales. GPT-6 Astra entra en esa ventana, así que un despliegue regional cuesta más de lo que indica la tabla anterior.

La entrada en caché es donde está el ahorro real. A 1,00 dólar frente a 10,00 dólares, un acierto de caché en contexto corto cuesta una décima parte de una lectura nueva. Ese patrón ya es estándar entre los proveedores de frontera, y Anthropic movió la misma palanca cuando Claude Fable 5.1 recortó un 75 % las lecturas de caché mientras mantenía sin cambios los precios de los tokens.

Dónde conseguirlo

PlataformaDetalles
Amazon BedrockDisponibilidad general el 8 de septiembre de 2026. Hasta 1M de tokens de entrada. ChatGPT Work y Codex pueden configurarse para usarlo aquí
GitHub CopilotDisponibilidad general el 4 de septiembre de 2026, a través del selector de modelos
Planes de CopilotPro+, Max, Business y Enterprise
Superficies de CopilotVS Code, Visual Studio, Copilot CLI, el agente de codificación, la app de Copilot, github.com, GitHub Mobile, los IDE de JetBrains, Xcode y Eclipse

GitHub describe el despliegue en Copilot como gradual, así que el modelo puede no aparecer en su selector el primer día. Los administradores de Business y Enterprise controlan el acceso mediante políticas de modelos, lo que significa que un desarrollador individual en un plan de empresa puede estar esperando a un administrador y no a GitHub.

GitHub también indica que el uso en Copilot se factura como «facturación por uso al precio de lista del proveedor OpenAI». Las tarifas de la tabla anterior son las que paga allí, no una tarifa aparte de Copilot.

AWS remite a la documentación de Bedrock para la disponibilidad por región en lugar de enumerar regiones en el anuncio, y ninguno de los dos anuncios indica límites de tasa.

Qué significa esto para los desarrolladores

Calcule el precio de su propia carga de trabajo antes de cambiar nada. La división en cuatro entre longitud de contexto y modo significa que una única tarifa de titular le dice muy poco. En salida, una llamada en modo Fast con contexto largo cuesta tres veces la tarifa Standard de contexto corto.

Compruebe si realmente está en contexto corto. La documentación de OpenAI pone precios distintos al contexto corto y al largo, pero los anuncios no dicen dónde está el límite. Si sus prompts rondan un umbral que no puede ver, su coste por llamada puede cambiar sin que cambie su código. Merece la pena medirlo con tráfico real antes de comprometer un presupuesto.

Si está en la UE, planifique prescindiendo del modo Fast en lugar de contar con él. La residencia de datos en la UE lo descarta por completo, y un endpoint regional añade un 10 % encima. Una arquitectura que dé por supuesto el modo Fast no sobrevivirá a una revisión de cumplimiento que exija residencia de datos.

El consejo sobre la caché es el menos vistoso y el más valioso. Estructure los prompts de modo que la parte estable vaya primero y se mantenga idéntica byte a byte entre llamadas, porque eso es lo que hace posible un acierto de caché. A una décima parte del precio de entrada, hacer esto bien vale más que la mayoría de las elecciones de modelo.

Una advertencia sobre la capacidad. Los resultados de benchmark publicados de Astra han variado mucho según cómo se lo pruebe, incluida una brecha de 37 puntos en ARC-AGI-3 que se debía al arnés de pruebas. La disponibilidad general cambia lo que puede comprar, no lo que el modelo puede hacer. Ejecute su propia evaluación sobre sus propias tareas antes de mover tráfico de producción.

Fuentes

  1. OpenAI GPT-6 Astra is now generally available on Amazon Bedrock - AWS
  2. GPT-6 Astra is generally available in GitHub Copilot - GitHub Changelog
  3. OpenAI API pricing - OpenAI

Artículos relacionados