← L'édition
IASuite1 min de lecture

OpenAI détaille la fiche technique de GPT-6 Astra

OpenAI vient d'ouvrir la documentation officielle de GPT-6 Astra, son modèle le plus puissant dédié au code et au raisonnement. On y découvre une gestion fine de l'effort de réflexion et une fenêtre de contexte dépassant le million de tokens.

Fil « Guide pratique pour l'utilisation et le réglage de la famille de modèles GPT-6 » · ← Relire l'épisode du 3 octobre

Illustration de l'article — developers.openai.com
Image : developers.openai.com

Après avoir publié ses recommandations d'intégration pour la gamme GPT-6, OpenAI dévoile aujourd'hui la fiche technique officielle de son modèle le plus avancé, GPT-6 Astra. Spécialisé dans le développement logiciel, le raisonnement complexe et le computer use (la capacité d'un agent à manipuler directement une interface informatique), le modèle embarque une fenêtre de contexte (le volume de texte analysé en une fois) de 1 050 000 tokens (fragments de mots) et permet de générer jusqu'à 128 000 tokens en sortie.

L'API (interface de programmation) formalise l'usage du paramètre reasoning_effort (niveau d'effort de réflexion), un curseur permettant de moduler le temps d'analyse pour équilibrer latence (délai de réponse), précision et consommation d'énergie selon le contexte de vos agents de code :

  • Échelle d'effort disponible : low, medium, high, xhigh et max.
  • Exemple de requête paramétrée :
{
  "model": "gpt-6-astra",
  "reasoning_effort": "xhigh",
  "messages": [{"role": "user", "content": "Analyse cette base de code"}]
}

Sur le plan tarifaire, GPT-6 Astra est proposé à 10,00 $ par million de tokens d'entrée (1,00 $ pour les tokens en cache, c'est-à-dire réutilisés d'une requête à l'autre) et 50,00 $ par million de tokens de sortie. Les requêtes très volumineuses dépassant 272 000 tokens d'entrée appliquent une tarification spécifique : le prix des tokens d'entrée y est doublé et celui des tokens de sortie est majoré de 50 %.