Claude 3.7 Sonnet

Claude 3.7 Sonnet yra „Anthropic“ kol kas pažangiausias modelis ir pirmoji hibridinė samprotavimo AI rinkoje. Jis siūlo standartinį ir išplėstinį mąstymo režimus, pastarasis teikia skaidrų, žingsnis po žingsnio samprotavimą. Modelis išsiskiria kodinimu ir front-end web programuote, pasiekdamas modernius rezultatus SWE-bench Verified ir TAU-bench testuose. Prieinamas per „Claude.ai“, „Anthropic API“, „Amazon Bedrock“ ir „Google Cloud Vertex AI“, jis nustato naują standartą intelektualiai AI valdomai problemų sprendimui.

Mistral Large 2

Mistral Large 2, sukurtas „Mistral“, siūlo 128 000 ženklų konteksto langą ir kainuoja 3,00 USD už milijoną įvesties ženklų ir 9,00 USD už milijoną išvesties ženklų. 2024 m. liepos 24 d. išleistas modelis MMLU teste 5-shot vertinime surinko 84,0 balą, parodydamas stiprų našumą įvairiose užduotyse.

Claude 3.7 SonnetMistral Large 2
Internetinė svetainė ?
Tiekėjas ?
Pokalbiai ?
Išleidimo data ?
Modalumai ?
tekstas ?
vaizdai ?
tekstas ?
API tiekėjai ?
Claude.ai, Anthropic API, Amazon Bedrock, Google Cloud Vertex AI
Azure AI, AWS Bedrock, Google AI Studio, Vertex AI, Snowflake Cortex
Žinių nutraukimo data ?
-
Nežinoma
Atvirojo kodo ?
Ne
Taip
Įvesties kaina ?
$3.00 už milijoną žodžių
$3.00 už milijoną žodžių
Išvesties kaina ?
$15.00 už milijoną žodžių
$9.00 už milijoną žodžių
MMLU ?
Nėra prieinama
84%
5-shot
Šaltinis
MMLU-Pro ?
Nėra prieinama
50.69%
Šaltinis
MMMU ?
71.8%
Šaltinis
Nėra prieinama
HellaSwag ?
Nėra prieinama
Nėra prieinama
HumanEval ?
Nėra prieinama
Nėra prieinama
MATH ?
82.2%
Šaltinis
1.13%
Šaltinis
GPQA ?
68%
Diamond
Šaltinis
24.94%
IFEval ?
90.8%
Šaltinis
84.01%
SimpleQA ?
-
-
AIME 2024
-
-
AIME 2025
-
-
Aider Polyglot ?
-
-
LiveCodeBench v5 ?
-
-
Global MMLU (Lite) ?
-
-
MathVista ?
-
-
Mobilioji programa
-

VideoGameBench ?

Bendras balas
0%
-
Doom II
0%
-
Dream DX
0%
-
Awakening DX
0%
-
Civilization I
0%
-
Pokemon Crystal
0%
-
The Need for Speed
0%
-
The Incredible Machine
0%
-
Secret Game 1
0%
-
Secret Game 2
0%
-
Secret Game 3
0%
-

Palyginti LLM

Pridėti komentarą


10%
Mūsų svetainė naudoja slapukus.

Privatumo ir slapukų politika: Ši svetainė naudoja slapukus. Tęsdami naudojimąsi svetaine, jūs sutinkate su jų naudojimu.