Grok 3 Beta vs Claude 3.7 Sonnet - Extended Thinking

Grok 3 Beta

Grok 3, xAI'nin en gelişmiş modeli olup, önceki son teknoloji modellerin hesaplama gücünün 10 katına sahip Colossus süper kümesinde eğitilmiştir. 1M token bağlam penceresi ve gelişmiş akıl yürütme yetenekleri sunar; büyük ölçekli pekiştirmeli öğrenme sayesinde saniyelerden dakikalara uzanan derin düşünme süreçlerini destekleyerek karmaşık problemleri çözme kabiliyetini artırır. Model, akademik ölçütler ve gerçek dünya kullanıcı değerlendirmelerinde en üst seviyede performans göstererek Chatbot Arena'da 1402 Elo puanı kazanmıştır. Grok 3 Mini ile birlikte piyasaya sürülmüştür; bu varyant, optimize edilmiş akıl yürütme süreçleri için maliyet açısından verimli bir seçenektir.

Claude 3.7 Sonnet - Extended Thinking

Claude 3.7 Sonnet, Anthropic'in şimdiye kadarki en gelişmiş yapay zeka modeli olup, piyasadaki ilk hibrit akıl yürütme sistemidir. Hem standart hem de genişletilmiş düşünme modları sunar; genişletilmiş mod, şeffaf ve adım adım akıl yürütme sağlar. Model, kodlama ve ön yüz web geliştirmede önemli iyileştirmeler göstererek SWE-bench Verified ve TAU-bench'te son teknoloji sonuçlar elde etmiştir. Claude.ai, Anthropic API, Amazon Bedrock ve Google Cloud'un Vertex AI hizmetleri aracılığıyla kullanılabilir ve yapay zeka destekli problem çözme konusunda yeni bir standart belirler.

	Grok 3 Beta	Claude 3.7 Sonnet - Extended Thinking
Web Sitesi ?	Open	Open
Sağlayıcı ?	xAI	Anthropic
Sohbet ?
Yayın Tarihi ?
Modallikler ?	metin ? görseller ? video ?	metin ? görseller ?
API Sağlayıcıları ?	xAI	Claude.ai, Anthropic API, Amazon Bedrock, Google Cloud Vertex AI
Bilgi Kesim Tarihi ?	2025-01	-
Açık Kaynak ?	Hayır	Hayır
Fiyatlandırma Girdisi ?	Mevcut değil	$3.00 milyon belirteç başına
Fiyatlandırma Çıktısı ?	Mevcut değil	$15.00 milyon belirteç başına
MMLU ?	Mevcut değil	Mevcut değil
MMLU-Pro ?	79.9% Base model Kaynak	Mevcut değil
MMMU ?	78% With Think mode Kaynak	75% Kaynak
HellaSwag ?	Mevcut değil	Mevcut değil
HumanEval ?	Mevcut değil	Mevcut değil
MATH ?	Mevcut değil	96.2% Kaynak
GPQA ?	84.6% With Think mode, Diamond Kaynak	84.8% Diamond Kaynak
IFEval ?	Mevcut değil	93.2% Kaynak
SimpleQA ?	-	-
AIME 2024	-	-
AIME 2025	-	-
Aider Polyglot ?	-	-
LiveCodeBench v5 ?	-	-
Global MMLU (Lite) ?	-	-
MathVista ?	-	-
Mobil Uygulama	Google Play Apple Apps	Google Play Apple Apps

Grok 3 Beta

Claude 3.7 Sonnet - Extended Thinking

Web Sitesi ?

Open

Sağlayıcı ?

xAI

Anthropic

Sohbet ?

Yayın Tarihi ?

Modallikler ?

metin ?
görseller ?
video ?

metin ?
görseller ?

API Sağlayıcıları ?

xAI

Claude.ai, Anthropic API, Amazon Bedrock, Google Cloud Vertex AI

Bilgi Kesim Tarihi ?

2025-01

Açık Kaynak ?

Hayır

Fiyatlandırma Girdisi ?

Mevcut değil

$3.00 milyon belirteç başına

Fiyatlandırma Çıktısı ?

Mevcut değil

$15.00 milyon belirteç başına

MMLU ?

Mevcut değil

MMLU-Pro ?

79.9%
Base model
Kaynak

Mevcut değil

MMMU ?

78%
With Think mode
Kaynak

75%
Kaynak

HellaSwag ?

Mevcut değil

HumanEval ?

Mevcut değil

MATH ?

Mevcut değil

96.2%
Kaynak

GPQA ?

84.6%
With Think mode, Diamond
Kaynak

84.8%
Diamond
Kaynak

IFEval ?

Mevcut değil

93.2%
Kaynak

SimpleQA ?

AIME 2024

AIME 2025

Aider Polyglot ?

LiveCodeBench v5 ?

Global MMLU (Lite) ?

MathVista ?

Mobil Uygulama

Google Play
Apple Apps

LLM Karşılaştırması
Grok 3 Beta vs Claude 3.7 Sonnet - Extended Thinking

Grok 3 Beta

Claude 3.7 Sonnet - Extended Thinking

LLM Karşılaştırması

Yorum Ekle

LLM KarşılaştırmasıGrok 3 Beta vs Claude 3.7 Sonnet - Extended Thinking

Grok 3 Beta

Claude 3.7 Sonnet - Extended Thinking

LLM Karşılaştırması

Yorum Ekle

LLM Karşılaştırması
Grok 3 Beta vs Claude 3.7 Sonnet - Extended Thinking