Gemini 2.0 Flash Thinking

„Gemini 2.0 Flash Thinking“ yra pažangus samprotavimo modelis, sukurtas siekiant pagerinti našumą ir aiškumą, padarant savo mąstymo procesą matomą. Jis puikiai sprendžia sudėtingas problemas, programavimo iššūkius ir matematinius uždavinius, pateikdamas žingsnis po žingsnio sprendimus. Optimizuotas užduotims, reikalaujančioms išsamių paaiškinimų ir loginės analizės, modelis taip pat turi integruotas priemones, įskaitant kodo vykdymą ir „Google“ paieškos galimybes.

Llama 3.3 70B Instruct

„Llama 3.3 70B Instruct“, sukurtas „Meta“, yra daugiakalbis didelės apimties kalbos modelis, specialiai pritaikytas instrukcijomis grindžiamoms užduotims ir optimizuotas pokalbių programoms. Jis gali apdoroti ir generuoti tekstą keliomis kalbomis, turėdamas kontekstinį langą, palaikantį iki 128 000 žetonų. Pristatytas 2024 m. gruodžio 6 d., modelis lenkia daugelį atvirojo kodo ir nuosavų pokalbių modelių įvairiuose pramonės etaloniniuose testuose. Jis naudoja Grouped-Query Attention (GQA),kad pagerintų mastelį, ir buvo apmokytas įvairiais duomenimis, apimančiais daugiau nei 15 trilijonų žetonų iš viešai prieinamų šaltinių. Modelio žinios yra atnaujintos iki 2023 m. gruodžio mėn.

Gemini 2.0 Flash ThinkingLlama 3.3 70B Instruct
Internetinė svetainė ?
Tiekėjas ?
Pokalbiai ?
Išleidimo data ?
Modalumai ?
tekstas ?
vaizdai ?
tekstas ?
API tiekėjai ?
Google AI Studio, Vertex AI, Gemini API
Fireworks, Together, DeepInfra, Hyperbolic
Žinių nutraukimo data ?
04.2024
12.2024
Atvirojo kodo ?
Ne
Taip
Įvesties kaina ?
Nėra prieinama
$0.23 už milijoną žodžių
Išvesties kaina ?
Nėra prieinama
$0.40 už milijoną žodžių
MMLU ?
Nėra prieinama
86%
0-shot, CoT
Šaltinis
MMLU-Pro ?
Nėra prieinama
68.9%
5-shot, CoT
Šaltinis
MMMU ?
75.4%
Šaltinis
Nėra prieinama
HellaSwag ?
Nėra prieinama
Nėra prieinama
HumanEval ?
Nėra prieinama
88.4%
pass@1
Šaltinis
MATH ?
Nėra prieinama
77%
0-shot, CoT
Šaltinis
GPQA ?
74.2%
Diamond Science
Šaltinis
50.5%
0-shot, CoT
Šaltinis
IFEval ?
Nėra prieinama
92.1%
Šaltinis
SimpleQA ?
-
-
AIME 2024
-
-
AIME 2025
-
-
Aider Polyglot ?
-
-
LiveCodeBench v5 ?
-
-
Global MMLU (Lite) ?
-
-
MathVista ?
-
-
Mobilioji programa
-

Palyginti LLM

Pridėti komentarą


10%
Mūsų svetainė naudoja slapukus.

Privatumo ir slapukų politika: Ši svetainė naudoja slapukus. Tęsdami naudojimąsi svetaine, jūs sutinkate su jų naudojimu.