Most powerful open-weight model, fits into an H100 GPU
Ce qu’il peut avoir sous les yeux en une seule fois, question et réponse comprises.
La plus longue réponse qu’il peut produire d’un seul tenant.
Il ne sait rien de ce qui s’est passé après cette date, sauf si on le lui fournit.
Le modèle peut réfléchir avant de répondre, en produisant des jetons de raisonnement facturés comme la sortie. La profondeur se règle par un niveau d'effort.
La réponse arrive mot à mot pendant qu'elle s'écrit, au lieu d'attendre qu'elle soit finie.
Le modèle rend une réponse au format demandé, exploitable par un programme sans relecture.
Le modèle peut demander l'exécution d'une fonction du programme qui l'appelle et se servir du résultat.
Le modèle peut écrire puis exécuter du code pour calculer ou vérifier lui-même.
Le modèle peut se brancher sur des services extérieurs par le protocole ouvert Model Context Protocol.
Le modèle peut consulter le web pendant qu'il répond, ce qui lui donne accès à des faits postérieurs à son entraînement.
gpt-oss-120b
Le nom exact à écrire dans le code pour appeler ce modèle.
gpt-oss-120b Les autres noms du même modèle, selon la plateforme qui le revend.