Aktory Référentiel IA
Lignée Opus

Claude Opus 4.7

Actif
Anthropic · Gamme Opus · sorti le 16 avril 2026
Les faits

Ce qu'il coûte, ce qu'il tient

Fenêtre de contexte 1M jetons

Ce qu’il peut avoir sous les yeux en une seule fois, question et réponse comprises.

Prix d’entrée 5 $ / M jetons

Ce que coûte le texte qu’on lui envoie.

Prix de sortie 25 $ / M jetons

Ce que coûte le texte qu’il produit, toujours plus cher que l’entrée.

Sortie maximale 128K jetons

La plus longue réponse qu’il peut produire d’un seul tenant.

Connaissances arrêtées à janvier 2026

Il ne sait rien de ce qui s’est passé après cette date, sauf si on le lui fournit.

Cycle de vie

D'aujourd'hui à sa fin de service

Sortie 16 avril 2026
Dépréciation Non annoncée
Retrait Maintenu au moins jusqu'au 16 avril 2027
Capacités

Ce qu'il sait faire

Raisonnement adaptatif
Réflexion étendue
Vision
La lignée Opus

Les autres versions

Toute la lignée
Benchmarks expliqués

Ce qu'il vaut, avec les conditions

11 tests relevés pour ce modèle, regroupés par ce qu'ils mesurent. Chaque chiffre est annoncé par le laboratoire, avec sa source et ses conditions ; une jauge n'est dessinée que quand l'échelle du test a un maximum connu.

Code et ingénierie logicielle

Le modèle reçoit un dépôt et un problème, et doit produire un correctif qui passe les tests, sans intervention humaine.

1 test

Terminal-Bench 2.0

69,4 %

Du travail réel en ligne de commande, dans un conteneur, du début à la fin.

Moyenne sur 5 essais.

Source

Raisonnement sur des situations inconnues

Aucune connaissance préalable ne sert : il faut inférer une règle jamais vue à partir de quelques exemples.

1 test

ARC-AGI

75,83 %

Inférer une règle jamais vue à partir de quelques grilles d'exemples.

Chiffre annoncé dans la system card, conditions détaillées à la source.

Source

Connaissances et raisonnement scientifique

Des questions à réponse unique, du niveau lycée au niveau doctorat, où seule la justesse compte.

2 tests

GMMLU

89,9 %

Une version mondiale de MMLU, revue pour ne pas privilégier la culture anglo-saxonne.

Exactitude moyenne.

Source

GraphWalks (contexte long)

58,6 %

Parcourir un graphe dont la description remplit toute la fenêtre de contexte.

Chiffre annoncé dans la system card, conditions détaillées à la source.

Source

Mathématiques

Des démonstrations de niveau olympiade et des problèmes tirés de la recherche en cours.

1 test

USAMO 2026

69,3 %

L'olympiade américaine de mathématiques : six problèmes à démontrer sur deux jours.

Moyenne sur 10 essais, moyenne sur 10 tentatives par problème.

Source

Pilotage d'un ordinateur

Le modèle agit à la souris et au clavier sur une machine réelle, comme le ferait une personne.

3 tests

ScreenSpot-Pro

79,5 %

Pointer précisément le bon élément d'interface sur une capture d'écran de logiciel professionnel.

Sans outils, effort maximal, réflexion adaptative.

Source

OSWorld

78 %

Accomplir des tâches courantes sur une machine Ubuntu réelle, à la souris et au clavier.

Réussite au premier essai, moyenne sur 5 essais.

Source

LAB-Bench FigQA

8,6 %

Interpréter les figures d'articles de biologie.

Raisonnement adaptatif, effort max, sans outils.

Source

Travail professionnel réel

Des livrables de métier : dossiers juridiques, flux d'entreprise, enchaînements d'outils, documents de travail.

3 tests

BrowseComp

79,3 %

Trouver sur le web une information difficile à dénicher, en naviguant soi-même.

Effort maximal, limite de 10M jetons.

Source

DRACO

77,7 %

Des questions de recherche complexes, jugées sur l'exactitude, la complétude et l'objectivité.

Effort maximal, réflexion adaptative, limite de 1M jetons.

Source

Finance Agent

64,4 %

Des recherches financières sur les documents déposés par les sociétés cotées.

Raisonnement adaptatif, effort high.

Source
Pour les développeurs

Intégrer ce modèle

L'appeler

Identifiant d’APIclaude-opus-4-7

Le nom exact à écrire dans le code pour appeler ce modèle.

Alias anthropic.claude-opus-4-7 (Amazon Bedrock)claude-opus-4-7 (Google Cloud)

Les autres noms du même modèle, selon la plateforme qui le revend.

Disponible sur API ClaudeAmazon BedrockGoogle Cloud Vertex AIMicrosoft Foundry

Ce qu'il accepte

Entrées acceptées texteimage
Sorties produites texte
Langues

Multilingue, d’après la documentation officielle.

Latence

Moyenne · Sa vitesse comparée aux autres modèles du même laboratoire, pas une mesure absolue.

Facturation détaillée par million de jetons

Écriture en cache6,25 $ Écriture en cache, 1 heure10 $ Lecture depuis le cache0,5 $ Traitement par lots, entrée2,5 $ Traitement par lots, sortie12,5 $

Mettre en mémoire un début de requête réutilisé d’un appel à l’autre : 1,25 fois le prix d’entrée.