Grok 4

Claude 3.7 Sonnet - Extended Thinking

Claude 3.7 Sonnet est le modèle d'IA le plus avancé d'Anthropic à ce jour et le premier système de raisonnement hybride sur le marché. Il propose des modes de pensée standard et étendu, ce dernier offrant un raisonnement transparent et étape par étape. Le modèle démontre des améliorations significatives en codage et en développement web front-end, obtenant des résultats de pointe sur SWE-bench Verified et TAU-bench. Disponible via Claude.ai, l'API Anthropic, Amazon Bedrock et Google Cloud Vertex AI, il établit une nouvelle référence pour la résolution intelligente de problèmes pilotée par l'IA.

Grok 4Claude 3.7 Sonnet - Extended Thinking
Site web ?
Fournisseur ?
Chat ?
Date de sortie ?
Modalités ?
texte ?
images ?
voix ?
vidéo ?
texte ?
images ?
Fournisseurs d’API ?
xAI
Claude.ai, Anthropic API, Amazon Bedrock, Google Cloud Vertex AI
Date de mise à jour des connaissances ?
-
-
Open Source ?
Non
Non
Tarification d’entrée ?
$3.00 par million de tokens
$3.00 par million de tokens
Tarification de sortie ?
$15.00 par million de tokens
$15.00 par million de tokens
MMLU ?
-
Non disponible
MMLU-Pro ?
-
Non disponible
MMMU ?
-
75%
Source
HellaSwag ?
-
Non disponible
HumanEval ?
-
Non disponible
MATH ?
-
96.2%
Source
GPQA ?
87.5%
Science
Source
84.8%
Diamond
Source
IFEval ?
-
93.2%
Source
SimpleQA ?
-
-
AIME 2024
-
-
AIME 2025
91.7%
Competition Math
Source
-
Aider Polyglot ?
-
-
LiveCodeBench v5 ?
79%
Competitive Coding
Source
-
Global MMLU (Lite) ?
-
-
MathVista ?
-
-
Application mobile

MathArena ?

Score moyen
89%
-
AIME 2025
Test basé sur des problèmes issus du concours de mathématiques (American Invitational Mathematics Examination),destiné à évaluer les compétences mathématiques des modèles.
91%
-
HMMT February 2025
Test basé sur des problèmes du Harvard-MIT Mathematics Tournament, février 2025, destiné à évaluer les compétences mathématiques des modèles.
92%
-
BRUMO 2025
95%
-
SMT 2025
Test basé sur des problèmes du Stanford Math Tournament, 2025, destiné à évaluer les compétences mathématiques des modèles.
86%
-
CMIMC 2025
Test basé sur des problèmes de l’Olympiade mathématique canadienne, 2025, destiné à évaluer les compétences mathématiques des modèles.
83%
-

Comparer les LLMs

Ajouter un commentaire


10%
Notre site utilise des cookies.

Politique de confidentialité et de cookies: ce site utilise des cookies. En continuant à utiliser le site, vous acceptez leur utilisation.