A small model alternative to o1
Ce qu’il peut avoir sous les yeux en une seule fois, question et réponse comprises.
Ce que coûte le texte qu’on lui envoie.
Ce que coûte le texte qu’il produit, toujours plus cher que l’entrée.
La plus longue réponse qu’il peut produire d’un seul tenant.
Il ne sait rien de ce qui s’est passé après cette date, sauf si on le lui fournit.
Motif du retrait : Remplacé par o4-mini.
Le modèle peut réfléchir avant de répondre, en produisant des jetons de raisonnement facturés comme la sortie. La profondeur se règle par un niveau d'effort.
La réponse arrive mot à mot pendant qu'elle s'écrit, au lieu d'attendre qu'elle soit finie.
Le modèle peut chercher une réponse dans des documents fournis plutôt que dans ce qu'il a appris.
Des fichiers peuvent lui être soumis directement.
Le modèle peut écrire puis exécuter du code pour calculer ou vérifier lui-même.
Le modèle peut se brancher sur des services extérieurs par le protocole ouvert Model Context Protocol.
o1-mini
Le nom exact à écrire dans le code pour appeler ce modèle.
o1-mini-2024-09-12 Les autres noms du même modèle, selon la plateforme qui le revend.
Mettre en mémoire un début de requête réutilisé d’un appel à l’autre : 1,25 fois le prix d’entrée.