Gemini 2.0 Flash Thinking

Komentáre: 0
Gemini 2.0 Flash Thinking #0
Gemini 2.0 Flash Thinking #1
Gemini 2.0 Flash Thinking #2
Gemini 2.0 Flash Thinking #3

Gemini 2.0 Flash Thinking je pokročilý model logického myslenia navrhnutý na zvýšenie výkonu a zrozumiteľnosti tým, že sprístupňuje svoj myšlienkový proces. Vyniká pri riešení zložitých problémov, programátorských výziev a matematického uvažovania, pričom poskytuje riešenia krok za krokom. Model je optimalizovaný na úlohy vyžadujúce podrobné vysvetlenia a logickú analýzu a obsahuje natívnu integráciu nástrojov, vrátane vykonávania kódu a funkcií Google Search.

4466
870

Pozícia v celkovom rebríčku k dátumuJúl 2026
28
Hodnotenie používateľovhttps://compare-ai.foundtt.com
3.9

Prehľad modelu

Webová stránka
Webová stránka AI modelu
Poskytovateľ
Subjekt, ktorý poskytuje tento model.
Chat
Zadajte správu a začnite chatovať
-
Dátum vydania
Kedy bol model prvýkrát vydaný.
1 rok ago
Dec 19, 2024
Modality
Typy dát, ktoré tento model dokáže spracovať
text ?
obrázky ?
Poskytovatelia API
Poskytovatelia, ktorí ponúkajú tento model. (Toto nie je vyčerpávajúci zoznam.)
Google AI Studio, Vertex AI, Gemini API
Dátum zastarania vedomostí
Kedy boli vedomosti modelu naposledy aktualizované.
04.2024
Open Source
Či je kód modelu dostupný na verejné použitie.
Nie
Cena za vstup
Cena za spracovanie tokenov vo vašich promptoch
Nie je k dispozícii
Cena za výstup
Cena za tokeny generované modelom
Nie je k dispozícii
MMLU
Massive Multitask Language Understanding – Testuje vedomosti v 57 predmetoch vrátane matematiky, histórie, práva a ďalších
Nie je k dispozícii
MMLU-Pro
Robustnejší benchmark MMLU s náročnejšími otázkami zameranými na uvažovanie, väčším výberom a zníženou citlivosťou na prompty
Nie je k dispozícii
MMMU
Massive Multitask Multimodal Understanding – Testuje porozumenie textu, obrázkom, audiu a videu
75.4%
Zdroj
HellaSwag
Náročný benchmark na dokončovanie viet
Nie je k dispozícii
HumanEval
Hodnotí schopnosti generovania kódu a riešenia problémov
Nie je k dispozícii
MATH
Testuje schopnosti riešenia matematických problémov na rôznych úrovniach náročnosti
Nie je k dispozícii
GPQA
Testuje vedomosti na úrovni PhD v chémii, biológii a fyzike prostredníctvom otázok s výberom odpovedí, ktoré vyžadujú hlboké odborné znalosti
74.2%
Diamond Science
Zdroj
IFEval
Testuje schopnosť modelu presne dodržiavať explicitné pokyny na formátovanie, generovať vhodné výstupy a udržiavať konzistentné dodržiavanie pokynov pri rôznych úlohách
Nie je k dispozícii
SimpleQA
Hodnotenie presnosti jednoduchých otázok
-
AIME 2024
-
AIME 2025
-
Aider Polyglot
Viacjazyčný programovací benchmark.
-
LiveCodeBench v5
Benchmark pre programovanie v reálnom čase
-
Global MMLU (Lite)
Zjednodušená verzia benchmarku na hodnotenie univerzálnosti modelov na globálnej úrovni.
-
MathVista
Hodnotí schopnosti matematického uvažovania modelov AI vo vizuálnych kontextoch
-
Mobilná aplikácia

Pridať komentár

Porovnaj LLM


10%
Naša stránka používa súbory cookies.

Zásady ochrany osobných údajov a súborov cookies: Táto stránka používa súbory cookies. Pokračovaním v používaní stránky súhlasíte s ich použitím.