Aktory Référentiel IA
Lignée Sonnet

Claude Sonnet 4.5

Actif
Anthropic · Gamme Sonnet · sorti le 29 septembre 2025
Les faits

Ce qu'il coûte, ce qu'il tient

Fenêtre de contexte 200K jetons

Ce qu’il peut avoir sous les yeux en une seule fois, question et réponse comprises.

Prix d’entrée 3 $ / M jetons

Ce que coûte le texte qu’on lui envoie.

Prix de sortie 15 $ / M jetons

Ce que coûte le texte qu’il produit, toujours plus cher que l’entrée.

Sortie maximale 64K jetons

La plus longue réponse qu’il peut produire d’un seul tenant.

Connaissances arrêtées à janvier 2025

Il ne sait rien de ce qui s’est passé après cette date, sauf si on le lui fournit.

Cycle de vie

D'aujourd'hui à sa fin de service

Sortie 29 septembre 2025
Dépréciation Non annoncée
Retrait Maintenu au moins jusqu'au 29 septembre 2026
Capacités

Ce qu'il sait faire

Raisonnement adaptatif
Réflexion étendue
Vision
La lignée Sonnet

Les autres versions

Toute la lignée
Benchmarks expliqués

Ce qu'il vaut, avec les conditions

7 tests relevés pour ce modèle, regroupés par ce qu'ils mesurent. Chaque chiffre est annoncé par le laboratoire, avec sa source et ses conditions ; une jauge n'est dessinée que quand l'échelle du test a un maximum connu.

Code et ingénierie logicielle

Le modèle reçoit un dépôt et un problème, et doit produire un correctif qui passe les tests, sans intervention humaine.

3 tests

Novel compiler

81,7 %

Écrire un compilateur pour un langage que le modèle n'a jamais vu.

Chiffre annoncé dans la system card, conditions détaillées à la source.

Source

SWE-bench Verified

45,3 %

Corriger de vrais tickets ouverts sur GitHub, dans le dépôt d'origine, sans aide.

Chiffre annoncé dans la system card, conditions détaillées à la source.

Source

SWE-bench Verified (hard subset)

45,3 %

Le sous-ensemble le plus difficile de SWE-bench Verified.

SWE-bench Verified (sous-ensemble difficile).

Source

Sûreté et comportement

Non pas ce que le modèle sait faire, mais ce qu'il accepte ou refuse de faire, et comment il se comporte quand on cherche à le détourner.

4 tests

Violative request evaluations

99,29 %

Répondre à des demandes contraires à la politique d'usage, posées en un seul tour de conversation, dans toutes les langues testées.

Chiffre annoncé dans la system card, conditions détaillées à la source.

Source

Agentic coding

98,7 %

Le modèle reçoit 150 demandes de code interdites par les conditions d'usage, avec les mêmes outils que pour les tests de capacité. On regarde s'il accepte.

Safety score (without safeguards).

Source

Safety score

98,7 %

Refuser les demandes de code malveillant, avec les mêmes outils que pour les tests de capacité.

Sans garde-fous.

Source

Attack prevention score

92 %

Déjouer les instructions malveillantes cachées dans les contenus que le modèle consulte en travaillant : page web, document, réponse d'un outil.

Sans garde-fous.

Source
Pour les développeurs

Intégrer ce modèle

L'appeler

Identifiant d’APIclaude-sonnet-4-5-20250929

Le nom exact à écrire dans le code pour appeler ce modèle.

Alias anthropic.claude-sonnet-4-5-20250929-v1:0 (Amazon Bedrock)claude-sonnet-4-5@20250929 (Google Cloud)

Les autres noms du même modèle, selon la plateforme qui le revend.

Disponible sur API ClaudeAmazon BedrockGoogle Cloud Vertex AIMicrosoft Foundry

Ce qu'il accepte

Entrées acceptées texteimage
Sorties produites texte
Langues

Multilingue, d’après la documentation officielle.

Latence

Rapide · Sa vitesse comparée aux autres modèles du même laboratoire, pas une mesure absolue.

Facturation détaillée par million de jetons

Écriture en cache3,75 $ Écriture en cache, 1 heure6 $ Lecture depuis le cache0,3 $ Traitement par lots, entrée1,5 $ Traitement par lots, sortie7,5 $

Mettre en mémoire un début de requête réutilisé d’un appel à l’autre : 1,25 fois le prix d’entrée.