Traduit de l'anglais

Claude 3 7 Sonnet est un grand modèle de langage développé par Anthropic, publié en février 2025. Il apparaît sur les classements publics des LLM avec trois variantes dans les instantanés de référence.

Claude 3 7 Sonnet est un grand modèle de langage développé par Anthropic, publié le 24 février 2025. Il fait partie de la famille de modèles Claude 3, succédant au précédent Claude 3 Sonnet. Le modèle est conçu pour une gamme de tâches en langage naturel, notamment le raisonnement, le codage et l'écriture créative, et est disponible via l'API d'Anthropic et ses applications grand public.

Claude 3 7 Sonnet est remarquable pour être le premier modèle de raisonnement hybride d'Anthropic, permettant aux utilisateurs de choisir entre des réponses immédiates et une réflexion étape par étape étendue. Cette fonctionnalité, appelée « réflexion étendue », permet au modèle de raisonner sur des problèmes complexes avant de générer une réponse finale, améliorant ainsi les performances sur les tâches nécessitant une logique en plusieurs étapes.

Architecture et formation

Claude 3 7 Sonnet est basé sur l'architecture Transformer (architecture), un cadre de Deep learning devenu standard pour les grands modèles de langage. Le modèle utilise un réseau de neurones avec des milliards de paramètres, bien qu'Anthropic n'ait pas divulgué le nombre exact. Il a été formé sur un ensemble de données diversifié de textes provenant d'Internet, de livres et d'autres sources, en utilisant des techniques de Machine learning telles que l'apprentissage supervisé et le RLHF.

Anthropic a mis l'accent sur la sécurité dans son processus de formation, en intégrant les principes de l'IA constitutionnelle pour aligner le modèle sur les valeurs humaines. Le modèle utilise également des mécanismes de attention multi-têtes pour traiter efficacement les séquences d'entrée, lui permettant de gérer des contextes longs allant jusqu'à 200 000 jetons.

Performances et références

Claude 3 7 Sonnet est apparu sur les classements publics de LLM, notamment le Chatbot Arena et l'indice Artificial Analysis Intelligence. Dans les instantanés de référence, trois variantes du modèle ont été enregistrées, reflétant différentes configurations ou versions. Sur le benchmark de raisonnement en intelligence artificielle GPQA (Graduate-Level Google-Proof Q&A), Claude 3 7 Sonnet a obtenu un score de 78,0 % en mode réflexion étendue, contre 70,3 % en mode standard. Sur le benchmark MATH-500, il a obtenu 96,0 % avec réflexion étendue, contre 93,0 % sans. Dans les évaluations de codage, le modèle a atteint 70,3 % sur SWE-bench Verified, un test de tâches d'ingénierie logicielle réelles, et 72,0 % sur TAU-bench, un benchmark d'utilisation d'outils agentiques.

Ces scores placent Claude 3 7 Sonnet parmi les modèles les plus performants de sa catégorie, en concurrence avec d'autres systèmes de premier plan de OpenAI et Google DeepMind. La capacité de raisonnement hybride du modèle est particulièrement efficace sur les tâches nécessitant une déduction minutieuse, comme les mathématiques et la génération de code.

Fonctionnalités et disponibilité

Claude 3 7 Sonnet est disponible via l'API d'Anthropic, ainsi que dans les plans d'abonnement Claude Pro et Claude Team. Il alimente des fonctionnalités de l'application Claude, notamment la recherche web en temps réel et un outil de codage appelé Claude Code, qui aide les développeurs à éditer et tester du code. Le modèle prend en charge l'entrée visuelle, lui permettant de traiter des images avec du texte, et peut générer jusqu'à 64 000 jetons en une seule réponse.

Anthropic a positionné Claude 3 7 Sonnet comme une alternative rentable aux modèles plus grands, offrant un équilibre entre performance et efficacité computationnelle. Il est accessible via Amazon Web Services Bedrock et Google Cloud Vertex AI, le rendant disponible aux clients d'entreprise via les principales plateformes cloud.

Réception et impact

Claude 3 7 Sonnet a reçu des critiques positives de la part des développeurs et des chercheurs pour ses capacités de raisonnement et sa compétence en codage. Il a été utilisé dans diverses applications, allant du support client automatisé à l'assistance à la recherche scientifique. L'introduction du raisonnement hybride par le modèle a influencé les développements ultérieurs dans le domaine, d'autres entreprises explorant des approches similaires.

Cependant, certains critiques ont noté que le mode de réflexion étendue du modèle peut être plus lent et plus coûteux, et que ses gains de performance ne sont pas uniformes sur toutes les tâches. Malgré ces réserves, Claude 3 7 Sonnet a consolidé la position d'Anthropic en tant qu'acteur majeur dans le paysage de la IA générative.

Voir aussi

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Catégories:large-language-models·anthropic·artificial-intelligence
Cette page a été modifiée pour la dernière fois le 13 sept. 2026 par AI Wiki Bot · Historique