Grok 3 Beta vs Qwen2.5-VL-32B - LLM Karşılaştırması

Grok 3 Beta

Grok 3, xAI'nin en gelişmiş modeli olup, önceki son teknoloji modellerin hesaplama gücünün 10 katına sahip Colossus süper kümesinde eğitilmiştir. 1M token bağlam penceresi ve gelişmiş akıl yürütme yetenekleri sunar; büyük ölçekli pekiştirmeli öğrenme sayesinde saniyelerden dakikalara uzanan derin düşünme süreçlerini destekleyerek karmaşık problemleri çözme kabiliyetini artırır. Model, akademik ölçütler ve gerçek dünya kullanıcı değerlendirmelerinde en üst seviyede performans göstererek Chatbot Arena'da 1402 Elo puanı kazanmıştır. Grok 3 Mini ile birlikte piyasaya sürülmüştür; bu varyant, optimize edilmiş akıl yürütme süreçleri için maliyet açısından verimli bir seçenektir.

Qwen2.5-VL-32B

Son beş ay içinde, Qwen2-VL'nin piyasaya sürülmesinden bu yana geliştiriciler, yeni modeller oluşturup değerli geri bildirimlerde bulundu. Şimdi, Qwen2.5-VL gelişmiş yetenekler sunuyor; görüntüleri, metinleri ve grafikleri hassas bir şekilde analiz edebilir ve yapılandırılmış JSON çıktılarıyla nesne konumlandırma sağlayabilir. Uzun videoları anlayabilir, kilit olayları belirleyebilir ve bilgisayarlar ile telefonlardaki araçlarla etkileşime giren bir ajan olarak işlev görebilir. Modelin mimarisi, dinamik video işleme ve optimize edilmiş ViT kodlayıcı ile daha yüksek hız ve doğruluk sunar.

	Grok 3 Beta	Qwen2.5-VL-32B
Web Sitesi ?	Open	Open
Sağlayıcı ?	xAI	Alibaba
Sohbet ?
Yayın Tarihi ?
Modallikler ?	metin ? görseller ? video ?	metin ? görseller ? video ?
API Sağlayıcıları ?	xAI	-
Bilgi Kesim Tarihi ?	2025-01	Bilinmiyor
Açık Kaynak ?	Hayır	Evet (Kaynak)
Fiyatlandırma Girdisi ?	Mevcut değil	$0
Fiyatlandırma Çıktısı ?	Mevcut değil	$0
MMLU ?	Mevcut değil	78.4% Kaynak
MMLU-Pro ?	79.9% Base model Kaynak	49.5%
MMMU ?	78% With Think mode Kaynak	70%
HellaSwag ?	Mevcut değil	Mevcut değil
HumanEval ?	Mevcut değil	Mevcut değil
MATH ?	Mevcut değil	82.2%
GPQA ?	84.6% With Think mode, Diamond Kaynak	46.0% Diamond
IFEval ?	Mevcut değil	Mevcut değil
SimpleQA ?	-	-
AIME 2024	-	-
AIME 2025	-	-
Aider Polyglot ?	-	-
LiveCodeBench v5 ?	-	-
Global MMLU (Lite) ?	-	-
MathVista ?	-	-
Mobil Uygulama	Google Play Apple Apps	-

Grok 3 Beta

Qwen2.5-VL-32B

Web Sitesi ?

Open

Sağlayıcı ?

xAI

Alibaba

Sohbet ?

Yayın Tarihi ?

Modallikler ?

metin ?
görseller ?
video ?

API Sağlayıcıları ?

xAI

Bilgi Kesim Tarihi ?

2025-01

Bilinmiyor

Açık Kaynak ?

Hayır

Evet (Kaynak)

Fiyatlandırma Girdisi ?

Mevcut değil

Fiyatlandırma Çıktısı ?

Mevcut değil

MMLU ?

Mevcut değil

78.4%
Kaynak

MMLU-Pro ?

79.9%
Base model
Kaynak

49.5%

MMMU ?

78%
With Think mode
Kaynak

70%

HellaSwag ?

Mevcut değil

HumanEval ?

Mevcut değil

MATH ?

Mevcut değil

82.2%

GPQA ?

84.6%
With Think mode, Diamond
Kaynak

46.0%
Diamond

IFEval ?

Mevcut değil

SimpleQA ?

AIME 2024

AIME 2025

Aider Polyglot ?

LiveCodeBench v5 ?

Global MMLU (Lite) ?

MathVista ?

Mobil Uygulama

Google Play
Apple Apps

LLM Karşılaştırması
Grok 3 Beta vs Qwen2.5-VL-32B

Grok 3 Beta

Qwen2.5-VL-32B

LLM Karşılaştırması

Yorum Ekle

LLM KarşılaştırmasıGrok 3 Beta vs Qwen2.5-VL-32B

Grok 3 Beta

Qwen2.5-VL-32B

LLM Karşılaştırması

Yorum Ekle

LLM Karşılaştırması
Grok 3 Beta vs Qwen2.5-VL-32B