Grok 3 Beta vs DeepSeek-R1 - LLM Karşılaştırması

Grok 3 Beta

Grok 3, xAI'nin en gelişmiş modeli olup, önceki son teknoloji modellerin hesaplama gücünün 10 katına sahip Colossus süper kümesinde eğitilmiştir. 1M token bağlam penceresi ve gelişmiş akıl yürütme yetenekleri sunar; büyük ölçekli pekiştirmeli öğrenme sayesinde saniyelerden dakikalara uzanan derin düşünme süreçlerini destekleyerek karmaşık problemleri çözme kabiliyetini artırır. Model, akademik ölçütler ve gerçek dünya kullanıcı değerlendirmelerinde en üst seviyede performans göstererek Chatbot Arena'da 1402 Elo puanı kazanmıştır. Grok 3 Mini ile birlikte piyasaya sürülmüştür; bu varyant, optimize edilmiş akıl yürütme süreçleri için maliyet açısından verimli bir seçenektir.

DeepSeek-R1

DeepSeek-R1, token başına 37B etkin parametreye sahip 671B parametreli bir Uzman Karışımı (MoE) modelidir ve büyük ölçekli pekiştirmeli öğrenme ile özellikle akıl yürütme yeteneklerine odaklanılarak eğitilmiştir. Model, geliştirilmiş akıl yürütme kalıplarını keşfetmek ve insan tercihleriyle uyum sağlamak için iki RL aşaması ile birlikte akıl yürütme ve diğer yetenekleri başlatmak üzere iki SFT aşaması içerir. Matematik, kodlama ve akıl yürütme görevlerinde OpenAI-o1 ile karşılaştırılabilir performans sergiler.

	Grok 3 Beta	DeepSeek-R1
Web Sitesi ?	Open	Open
Sağlayıcı ?	xAI	DeepSeek
Sohbet ?
Yayın Tarihi ?
Modallikler ?	metin ? görseller ? video ?	metin ?
API Sağlayıcıları ?	xAI	DeepSeek, HuggingFace
Bilgi Kesim Tarihi ?	2025-01	Bilinmiyor
Açık Kaynak ?	Hayır	Evet
Fiyatlandırma Girdisi ?	Mevcut değil	$0.55 milyon belirteç başına
Fiyatlandırma Çıktısı ?	Mevcut değil	$2.19 milyon belirteç başına
MMLU ?	Mevcut değil	90.8% Pass@1 Kaynak
MMLU-Pro ?	79.9% Base model Kaynak	84% EM Kaynak
MMMU ?	78% With Think mode Kaynak	-
HellaSwag ?	Mevcut değil	-
HumanEval ?	Mevcut değil	-
MATH ?	Mevcut değil	-
GPQA ?	84.6% With Think mode, Diamond Kaynak	71.5% Pass@1 Kaynak
IFEval ?	Mevcut değil	83.3% Prompt Strict Kaynak
SimpleQA ?	-	-
AIME 2024	-	-
AIME 2025	-	-
Aider Polyglot ?	-	-
LiveCodeBench v5 ?	-	-
Global MMLU (Lite) ?	-	-
MathVista ?	-	-
Mobil Uygulama	Google Play Apple Apps	Google Play Apple Apps

Grok 3 Beta

DeepSeek-R1

Web Sitesi ?

Open

Sağlayıcı ?

xAI

DeepSeek

Sohbet ?

Yayın Tarihi ?

Modallikler ?

metin ?
görseller ?
video ?

metin ?

API Sağlayıcıları ?

xAI

DeepSeek, HuggingFace

Bilgi Kesim Tarihi ?

2025-01

Bilinmiyor

Açık Kaynak ?

Hayır

Evet

Fiyatlandırma Girdisi ?

Mevcut değil

$0.55 milyon belirteç başına

Fiyatlandırma Çıktısı ?

Mevcut değil

$2.19 milyon belirteç başına

MMLU ?

Mevcut değil

90.8%
Pass@1
Kaynak

MMLU-Pro ?

79.9%
Base model
Kaynak

84%
EM
Kaynak

MMMU ?

78%
With Think mode
Kaynak

HellaSwag ?

Mevcut değil

HumanEval ?

Mevcut değil

MATH ?

Mevcut değil

GPQA ?

84.6%
With Think mode, Diamond
Kaynak

71.5%
Pass@1
Kaynak

IFEval ?

Mevcut değil

83.3%
Prompt Strict
Kaynak

SimpleQA ?

AIME 2024

AIME 2025

Aider Polyglot ?

LiveCodeBench v5 ?

Global MMLU (Lite) ?

MathVista ?

Mobil Uygulama

Google Play
Apple Apps

LLM Karşılaştırması
Grok 3 Beta vs DeepSeek-R1

Grok 3 Beta

DeepSeek-R1

LLM Karşılaştırması

Yorum Ekle

LLM KarşılaştırmasıGrok 3 Beta vs DeepSeek-R1

Grok 3 Beta

DeepSeek-R1

LLM Karşılaştırması

Yorum Ekle

LLM Karşılaştırması
Grok 3 Beta vs DeepSeek-R1