Aktory Référentiel IA
Lignée Codex

GPT-5.1-Codex Max

Retiré
OpenAI · Gamme Codex · sorti le 4 décembre 2025

A version of GPT-5.1-codex optimized for long running tasks.

Les faits

Ce qu'il coûte, ce qu'il tient

Fenêtre de contexte 400K jetons

Ce qu’il peut avoir sous les yeux en une seule fois, question et réponse comprises.

Prix d’entrée 1,25 $ / M jetons

Ce que coûte le texte qu’on lui envoie.

Prix de sortie 10 $ / M jetons

Ce que coûte le texte qu’il produit, toujours plus cher que l’entrée.

Sortie maximale 128K jetons

La plus longue réponse qu’il peut produire d’un seul tenant.

Connaissances arrêtées à septembre 2024

Il ne sait rien de ce qui s’est passé après cette date, sauf si on le lui fournit.

Cycle de vie

D'aujourd'hui à sa fin de service

Sortie 4 décembre 2025
Dépréciation Non annoncée
Retrait 23 juillet 2026

Motif du retrait : Remplacé par gpt-5.6-sol.

Capacités

Ce qu'il sait faire

Raisonnement

Le modèle peut réfléchir avant de répondre, en produisant des jetons de raisonnement facturés comme la sortie. La profondeur se règle par un niveau d'effort.

Réponse au fil de l'eau

La réponse arrive mot à mot pendant qu'elle s'écrit, au lieu d'attendre qu'elle soit finie.

Sortie structurée

Le modèle rend une réponse au format demandé, exploitable par un programme sans relecture.

Appel de fonctions

Le modèle peut demander l'exécution d'une fonction du programme qui l'appelle et se servir du résultat.

Lecture d'images

Le modèle voit les images qu'on lui soumet et peut répondre à leur sujet.

Recherche sur le web

Le modèle peut consulter le web pendant qu'il répond, ce qui lui donne accès à des faits postérieurs à son entraînement.

Mise en cache des requêtes

Une partie de requête déjà envoyée est facturée moins cher si elle est réutilisée peu après.

La lignée Codex

Les autres versions

Toute la lignée
Benchmarks expliqués

Ce qu'il vaut, avec les conditions

3 tests relevés pour ce modèle, regroupés par ce qu'ils mesurent. Chaque chiffre est annoncé par le laboratoire, avec sa source et ses conditions ; une jauge n'est dessinée que quand l'échelle du test a un maximum connu.

Code et ingénierie logicielle

Le modèle reçoit un dépôt et un problème, et doit produire un correctif qui passe les tests, sans intervention humaine.

3 tests

SWE-Lancer

79,9 %

Réaliser de vraies missions de développement freelance, payées, telles qu'elles ont été publiées sur une place de marché.

xhigh, relevé sous « SWE-Lancer IC SWE »

Source

SWE-bench Verified

77,9 %

Corriger de vrais tickets ouverts sur GitHub, dans le dépôt d'origine, sans aide.

n=500, xhigh

Source

Terminal-Bench 2.0

58,1 %

Du travail réel en ligne de commande, dans un conteneur, du début à la fin.

xhigh

Source
Pour les développeurs

Intégrer ce modèle

L'appeler

Identifiant d’APIgpt-5.1-codex-max

Le nom exact à écrire dans le code pour appeler ce modèle.

Alias gpt-5.1-codex-max

Les autres noms du même modèle, selon la plateforme qui le revend.

Ce qu'il accepte

Entrées acceptées texteimage
Sorties produites texte

Facturation détaillée par million de jetons

Lecture depuis le cache0,13 $

Mettre en mémoire un début de requête réutilisé d’un appel à l’autre : 1,25 fois le prix d’entrée.