Anthropic introduit Claude Sonnet 5 : les caractéristiques agentiques deviennent plus accessibles

5 juillet 20265 vues

Le nouveau modèle intermédiaire d'Anthropic aborde les capacités de l'Opus 4.8 phare, mais coûte beaucoup moins cher. Il est déjà devenu la norme pour les abonnements gratuits et Pro, et les développeurs peuvent économiser sur les agents de fonctionnement grâce à des prix temporaires.

Anthropic introduit Claude Sonnet 5 : les caractéristiques agentiques deviennent plus accessibles

Les capacités d'agents deviennent la base

Anthropic a officiellement présenté Claude Sonnet 5 — une nouvelle version de son modèle de taille moyenne qui rend les workflows d'agents accessibles à un plus grand nombre d'utilisateurs. Selon l'entreprise, le modèle peut faire des plans indépendamment, utiliser un navigateur et un terminal, et accomplir des tâches sans supervision constante — un niveau d'autonomie qui jusqu'à récemment exigé des solutions phares et coûteuses. Avec la sortie de Sonnet 5, il est clair que les caractéristiques agentiques ne sont plus la prérogative des modèles de haut niveau et deviennent la norme pour chaque segment de prix. La concurrence s'oriente maintenant vers le prix et la fiabilité, plutôt que simplement vers la présence de capacités « agents ».

Performances et prix

Les développeurs promettent que Claude Sonnet 5 offre des résultats proches de l'Opus 4.8, mais à un coût beaucoup plus bas. À partir du 30 juin, le modèle devient le modèle par défaut dans les forfaits gratuits et Pro, et est également disponible dans tous les abonnements. Au lancement, un prix spécial est en vigueur : 2 $ par million de jetons d'entrée et 10 $ par million de jetons de sortie jusqu'au 31 août.

Selon Anthropic, le nouveau modèle surpasse de façon significative son prédécesseur, Sonnet 4.6, publié en février, dans les domaines du raisonnement, de l'utilisation d'outils, de la rédaction de codes et du travail de connaissance. Sur l'indice de référence du codage des agents, Sonnet 5 obtient 63,2 %, tandis que Opus 4.8 obtient 69,2 % et Sonnet 4.6, 58,1 %. Dans le même temps, dans les tests de connaissances, Sonnet 5 surpasse même légèrement Opus 4.8. Anthropique souligne que l'Opus 4.8 reste le choix pour une précision maximale, mais Sonnet 5 offre aux développeurs des options beaucoup plus avantageuses. Les utilisateurs peuvent ajuster le niveau d'effort entre les deux modèles, en choisissant le bon équilibre entre performance et budget.

En termes de prix, Sonnet 5 est moins cher que GPT-5.5 de OpenAI et Gemini 3.1 Pro de Google, mais plus cher que Gemini 3.5 Flash.

Sécurité et impressions du développeur

Testeurs dont le feedback Anthropic cite que Claude Sonnet 5 est mieux à porter des tâches complexes jusqu'à la fin, alors que les versions précédentes s'arrêtaient souvent à mi-chemin. Le modèle vérifie également ses propres résultats, même s'il n'est pas demandé. Par exemple, Daniel Shepard, ingénieur principal chez Zapier, a déclaré que Sonnet 5 a terminé une tâche en deux parties : il a mis à jour les comptes de Salesforce et envoyé une annonce aux contacts d'entreprise. Auparavant, selon lui, des scénarios similaires "seraient coincés".

Quant à la sécurité, le nouveau modèle présente moins souvent un comportement indésirable : il est mieux à refuser les demandes malveillantes, est plus résistant aux injections rapides, hallucine moins fréquemment et est moins enclin à la sycophance que Sonnet 4.6. En même temps, il suit toujours Opus 4.8 et Claude Mythos Preview dans sa capacité à résister à un comportement mal aligné. Anthropic note également que Sonnet 5 a une capacité significativement inférieure pour effectuer des tâches dangereuses de cybersécurité que les modèles Opus actuels. Fabian Hedin, cofondateur de Lovable, a confirmé que Claude Sonnet 5 « refuse proprement et constamment les demandes dangereuses ».

Foire aux questions

Matériaux connexes

Tous matériaux
Claude Sonnet 5 — révision du nouveau modèle anthropologique avec prix