Gemini 2.0 Flash Thinking

Commentaires: 0
Gemini 2.0 Flash Thinking #0
Gemini 2.0 Flash Thinking #1
Gemini 2.0 Flash Thinking #2
Gemini 2.0 Flash Thinking #3

Gemini 2.0 Flash Thinking est un modèle avancé de raisonnement conçu pour améliorer les performances et la transparence en rendant son processus de pensée visible. Il excelle dans la résolution de problèmes complexes, les défis de programmation et le raisonnement mathématique, en proposant des solutions étape par étape. Optimisé pour les tâches nécessitant des explications détaillées et une analyse logique, le modèle intègre également nativement des outils tels que l’exécution de code et les fonctionnalités de recherche Google.

4466
870

Position dans le classement général au
Juillet 2026
28
Évaluation des utilisateurs
https://compare-ai.foundtt.com
3.9

Présentation du modèle

Site web
Page web du modèle d’IA
Fournisseur
L’entité qui fournit ce modèle.
Chat
Entrez un message pour commencer à discuter
-
Date de sortie
Première date de publication du modèle.
1 an ago
Déc 19, 2024
Modalités
Types de données que ce modèle peut traiter
texte ?
images ?
Fournisseurs d’API
Les fournisseurs qui proposent ce modèle. (Cette liste n’est pas exhaustive.)
Google AI Studio, Vertex AI, Gemini API
Date de mise à jour des connaissances
Dernière mise à jour des connaissances du modèle.
04.2024
Open Source
Disponibilité du code du modèle pour une utilisation publique.
Non
Tarification d’entrée
Coût du traitement des tokens dans vos invites
Non disponible
Tarification de sortie
Coût des tokens générés par le modèle
Non disponible
MMLU
Massive Multitask Language Understanding - Évalue les connaissances dans 57 domaines, y compris les mathématiques, l’histoire, le droit et plus encore
Non disponible
MMLU-Pro
Un benchmark MMLU plus robuste avec des questions plus complexes axées sur le raisonnement, un plus grand ensemble de choix et une sensibilité réduite aux invites
Non disponible
MMMU
Massive Multitask Multimodal Understanding - Évalue la compréhension à travers le texte, les images, l’audio et la vidéo
75.4%
Source
HellaSwag
Un benchmark exigeant de complétion de phrases
Non disponible
HumanEval
Évalue la génération de code et les capacités de résolution de problèmes
Non disponible
MATH
Évalue les capacités de résolution de problèmes mathématiques à différents niveaux de difficulté
Non disponible
GPQA
Évalue les connaissances de niveau doctorat en chimie, biologie et physique via des questions à choix multiples nécessitant une expertise approfondie
74.2%
Diamond Science
Source
IFEval
Évalue la capacité du modèle à suivre avec précision des instructions de formatage explicites, à générer des sorties appropriées et à maintenir une cohérence dans l’exécution des tâches
Non disponible
SimpleQA
Évaluation de la précision des questions simples
-
AIME 2024
-
AIME 2025
-
Aider Polyglot
Benchmark de programmation multilingue.
-
LiveCodeBench v5
Benchmark pour la programmation en temps réel
-
Global MMLU (Lite)
Une version simplifiée du benchmark pour évaluer l’universalité des modèles au niveau mondial.
-
MathVista
Évalue les capacités de raisonnement mathématique des modèles d’IA dans des contextes visuels
-
Application mobile

Ajouter un commentaire

Comparer les LLMs


10%
Notre site utilise des cookies.

Politique de confidentialité et de cookies: ce site utilise des cookies. En continuant à utiliser le site, vous acceptez leur utilisation.