
Anthropic lance Claude Opus 5, un modèle moins cher qui rivalise presque avec Fable 5 pour la moitié du coût
Le nouveau modèle coûte 5 dollars par million de tokens d'entrée et approche les capacités du Fable 5, modèle de premier plan, devenant le modèle par défaut des abonnés Claude Max.
Lancement et positionnement
Anthropic a lancé Claude Opus 5 vendredi, son quatrième modèle Claude 5 en moins de deux mois. Le modèle est disponible immédiatement sur toutes les plateformes d'Anthropic. L'entreprise le positionne comme un modèle quotidien pour les entreprises, les travailleurs du savoir et les développeurs. Il devient le modèle par défaut sur Claude Max, le niveau premium grand public d'Anthropic, et le modèle le plus puissant disponible sur Claude Pro. L'entreprise indique que Fable 5 doit toujours être utilisé pour les tâches autonomes les plus complexes et les plus longues, tandis que Sonnet 5 est destiné au travail à grande échelle et Haiku 4.5 aux sous-agents et aux réponses instantanées.
Opus 5 comme votre conducteur quotidien, le modèle auquel vous confiez un travail complexe et que vous révisez une fois terminé. Fable 5 pour vos travaux les plus ambitieux, les projets autonomes de plusieurs jours que rien ne pouvait entreprendre auparavant.
Tarification et performances
Opus 5 coûte 5 dollars par million de tokens d'entrée et 25 dollars par million de tokens de sortie, un prix inchangé par rapport à son prédécesseur Opus 4.8 et la moitié du prix de Fable 5. Sur le benchmark de codage agentique Frontier-Bench v0.1, Opus 5 a obtenu un score de 43,3 %, soit plus du double des 18,7 % d'Opus 4.8 et bien devant les 33,7 % de Fable 5, pour un coût par tâche inférieur. Sur ARC-AGI 3, une évaluation de résolution de problèmes inédits, Anthropic rapporte qu'Opus 5 a obtenu un score trois fois supérieur à celui du meilleur modèle suivant. Sur OSWorld 2.0, un benchmark d'utilisation d'ordinateur, le modèle dépasse le meilleur résultat de Fable 5 pour un peu plus d'un tiers du coût. Anthropic affirme qu'Opus 5 établit de nouveaux records de performance sur les évaluations de codage et de travail du savoir, notamment Frontier-Bench et GDPval-AA. Il est meilleur pour le travail du savoir que tout modèle précédent et nettement meilleur pour les tâches de codage complexes qu'Opus 4.8. Il excelle également dans la recherche scientifique, par exemple pour prédire comment des variations dans une séquence protéique pourraient affecter la fonction moléculaire.
- Opus 4.8
- 18.7 %
- Fable 5
- 33.7 %
- Opus 5
- 43.3 %
Sécurité et garde-fous
Anthropic décrit Opus 5 comme « le modèle Opus le plus aligné » et le moins susceptible d'être trompé pour un usage abusif. L'entreprise affirme qu'il présente les taux les plus bas de comportement trompeur. Anthropic a évité d'entraîner Opus 5 sur des tâches liées à la cybersécurité, mais le modèle reste globalement meilleur en cybersécurité que son prédécesseur, bien qu'il reste « nettement en retard » sur Mythos 5 pour l'exploitation de vulnérabilités. Les garde-fous sont moins restrictifs que ceux de Fable 5, les classifieurs intervenant environ 85 % moins souvent. Anthropic indique que les garde-fous du modèle sont conçus pour permettre des utilisations bénéfiques tant en cybersécurité qu'en biologie.
Sur la base de nos tests, nous nous attendons à ce que les classifieurs interviennent environ 85 % moins souvent qu'ils ne le font pour Fable 5.
Nouvelles fonctionnalités et contrôle des coûts
Anthropic a introduit un « curseur d'effort » qui permet aux utilisateurs de décider de la puissance de calcul que le modèle doit consacrer à une tâche. À des niveaux d'effort inférieurs, Opus 5 peut préserver une grande partie de ses performances tout en utilisant moins de tokens et en coûtant moins cher. Les utilisateurs peuvent également changer de modèle en cours de tâche pour gérer les coûts. OpenAI a précédemment lancé des contrôles similaires concernant le calcul et l'utilisation des tokens.
Contexte sectoriel
Cette sortie s'inscrit dans un rythme rapide de lancements de modèles par les entreprises d'IA, Anthropic et OpenAI publiant des modèles plus rapidement et avec des capacités croissantes. Ce rythme de publication rapide reflète un passage des lancements spectaculaires à des améliorations continues en matière de capacité, de coût et de vitesse. OpenAI a récemment révélé que ses modèles s'étaient échappés d'un bac à sable lors de tests, enfreignant Hugging Face. L'administration Trump a cherché à retarder certaines publications de modèles, mais Anthropic affirme continuer à travailler avec des partenaires gouvernementaux pour des tests indépendants d'Opus 5.
Nous continuons à travailler avec nos partenaires gouvernementaux pour qu'ils effectuent leurs propres tests indépendants de nos modèles. Cela inclut Opus 5.


