Qwen2.5-VL-32B vs Llama 3.3 70B Instruct

Qwen2.5-VL-32B

Per pastaruosius penkis mėnesius nuo Qwen2-VL išleidimo kūrėjai sukūrė naujus modelius, paremtus juo, suteikdami vertingų atsiliepimų. Dabar Qwen2.5-VL pristato patobulintas galimybes, įskaitant tikslų vaizdų, teksto ir diagramų analizę bei objektų lokalizavimą su struktūruotomis JSON išvestimis. Jis supranta ilgus vaizdo įrašus, nustato pagrindinius įvykius ir veikia kaip agentas, bendraujantis su įrankiais kompiuteriuose ir telefonuose. Modelio architektūra apima dinaminį vaizdo įrašų apdorojimą ir optimizuotą ViT kodavimo įrenginį, skirtą greičiui ir tikslumui padidinti.

Llama 3.3 70B Instruct

„Llama 3.3 70B Instruct“, sukurtas „Meta“, yra daugiakalbis didelės apimties kalbos modelis, specialiai pritaikytas instrukcijomis grindžiamoms užduotims ir optimizuotas pokalbių programoms. Jis gali apdoroti ir generuoti tekstą keliomis kalbomis, turėdamas kontekstinį langą, palaikantį iki 128 000 žetonų. Pristatytas 2024 m. gruodžio 6 d., modelis lenkia daugelį atvirojo kodo ir nuosavų pokalbių modelių įvairiuose pramonės etaloniniuose testuose. Jis naudoja Grouped-Query Attention (GQA),kad pagerintų mastelį, ir buvo apmokytas įvairiais duomenimis, apimančiais daugiau nei 15 trilijonų žetonų iš viešai prieinamų šaltinių. Modelio žinios yra atnaujintos iki 2023 m. gruodžio mėn.

	Qwen2.5-VL-32B	Llama 3.3 70B Instruct
Internetinė svetainė ?	Open	Open
Tiekėjas ?	Alibaba	Meta
Pokalbiai ?
Išleidimo data ?
Modalumai ?	tekstas ? vaizdai ? vaizdo ?	tekstas ?
API tiekėjai ?	-	Fireworks, Together, DeepInfra, Hyperbolic
Žinių nutraukimo data ?	Nežinoma	12.2024
Atvirojo kodo ?	Taip (Šaltinis)	Taip
Įvesties kaina ?	$0	$0.23 už milijoną žodžių
Išvesties kaina ?	$0	$0.40 už milijoną žodžių
MMLU ?	78.4% Šaltinis	86% 0-shot, CoT Šaltinis
MMLU-Pro ?	49.5%	68.9% 5-shot, CoT Šaltinis
MMMU ?	70%	Nėra prieinama
HellaSwag ?	Nėra prieinama	Nėra prieinama
HumanEval ?	Nėra prieinama	88.4% pass@1 Šaltinis
MATH ?	82.2%	77% 0-shot, CoT Šaltinis
GPQA ?	46.0% Diamond	50.5% 0-shot, CoT Šaltinis
IFEval ?	Nėra prieinama	92.1% Šaltinis
SimpleQA ?	-	-
AIME 2024	-	-
AIME 2025	-	-
Aider Polyglot ?	-	-
LiveCodeBench v5 ?	-	-
Global MMLU (Lite) ?	-	-
MathVista ?	-	-
Mobilioji programa	-	-

Qwen2.5-VL-32B

Llama 3.3 70B Instruct

Internetinė svetainė ?

Open

Tiekėjas ?

Alibaba

Palyginti LLM
Qwen2.5-VL-32B vs Llama 3.3 70B Instruct

Qwen2.5-VL-32B

Llama 3.3 70B Instruct

Palyginti LLM

Pridėti komentarą

Palyginti LLMQwen2.5-VL-32B vs Llama 3.3 70B Instruct

Qwen2.5-VL-32B

Llama 3.3 70B Instruct

Palyginti LLM

Pridėti komentarą

Palyginti LLM
Qwen2.5-VL-32B vs Llama 3.3 70B Instruct