o3-mini vs Claude 3.7 Sonnet - Extended Thinking

o3-mini

OpenAI o3-mini, STEM uygulamaları için tasarlanmış yüksek hızlı ve maliyet etkin bir akıl yürütme modelidir; bilim, matematik ve kodlama alanlarında güçlü performans sergiler. Ocak 2025’te piyasaya sürülen model, fonksiyon çağrısı, yapılandırılmış çıktılar ve geliştirici mesajları gibi temel geliştirici özelliklerini içerir. Kullanıcılar, düşük, orta ve yüksek düzeyde akıl yürütme yoğunluğu arasında seçim yaparak yanıt süresi ile derin analiz arasında denge kurabilir. Görsel yeteneklere sahip olmayan bu model, başlangıçta yalnızca seviye 3-5 API geliştiricilerine sunulmuştur ve Chat Completions API, Assistants API ve Batch API aracılığıyla erişilebilir.

Claude 3.7 Sonnet - Extended Thinking

Claude 3.7 Sonnet, Anthropic'in şimdiye kadarki en gelişmiş yapay zeka modeli olup, piyasadaki ilk hibrit akıl yürütme sistemidir. Hem standart hem de genişletilmiş düşünme modları sunar; genişletilmiş mod, şeffaf ve adım adım akıl yürütme sağlar. Model, kodlama ve ön yüz web geliştirmede önemli iyileştirmeler göstererek SWE-bench Verified ve TAU-bench'te son teknoloji sonuçlar elde etmiştir. Claude.ai, Anthropic API, Amazon Bedrock ve Google Cloud'un Vertex AI hizmetleri aracılığıyla kullanılabilir ve yapay zeka destekli problem çözme konusunda yeni bir standart belirler.

	o3-mini	Claude 3.7 Sonnet - Extended Thinking
Web Sitesi ?	Open	Open
Sağlayıcı ?	OpenAI	Anthropic
Sohbet ?
Yayın Tarihi ?
Modallikler ?	metin ?	metin ? görseller ?
API Sağlayıcıları ?	OpenAI API	Claude.ai, Anthropic API, Amazon Bedrock, Google Cloud Vertex AI
Bilgi Kesim Tarihi ?	Bilinmiyor	-
Açık Kaynak ?	Hayır	Hayır
Fiyatlandırma Girdisi ?	$1.10 milyon belirteç başına	$3.00 milyon belirteç başına
Fiyatlandırma Çıktısı ?	$4.40 milyon belirteç başına	$15.00 milyon belirteç başına
MMLU ?	86.9% pass@1, high effort Kaynak	Mevcut değil
MMLU-Pro ?	Mevcut değil	Mevcut değil
MMMU ?	Mevcut değil	75% Kaynak
HellaSwag ?	Mevcut değil	Mevcut değil
HumanEval ?	Mevcut değil	Mevcut değil
MATH ?	97.9% pass@1, high effort Kaynak	96.2% Kaynak
GPQA ?	79.7% 0-shot, high effort Kaynak	84.8% Diamond Kaynak
IFEval ?	Mevcut değil	93.2% Kaynak
SimpleQA ?	-	-
AIME 2024	-	-
AIME 2025	-	-
Aider Polyglot ?	-	-
LiveCodeBench v5 ?	-	-
Global MMLU (Lite) ?	-	-
MathVista ?	-	-
Mobil Uygulama	Google Play Apple Apps	Google Play Apple Apps

o3-mini

Claude 3.7 Sonnet - Extended Thinking

Web Sitesi ?

Open

Sağlayıcı ?

OpenAI

Anthropic

Sohbet ?

Yayın Tarihi ?

Modallikler ?

metin ?

metin ?
görseller ?

API Sağlayıcıları ?

OpenAI API

Claude.ai, Anthropic API, Amazon Bedrock, Google Cloud Vertex AI

Bilgi Kesim Tarihi ?

Bilinmiyor

Açık Kaynak ?

Hayır

Fiyatlandırma Girdisi ?

$1.10 milyon belirteç başına

$3.00 milyon belirteç başına

Fiyatlandırma Çıktısı ?

$4.40 milyon belirteç başına

$15.00 milyon belirteç başına

MMLU ?

86.9%
pass@1, high effort
Kaynak

Mevcut değil

MMLU-Pro ?

Mevcut değil

MMMU ?

Mevcut değil

75%
Kaynak

HellaSwag ?

Mevcut değil

HumanEval ?

Mevcut değil

MATH ?

97.9%
pass@1, high effort
Kaynak

96.2%
Kaynak

GPQA ?

79.7%
0-shot, high effort
Kaynak

84.8%
Diamond
Kaynak

IFEval ?

Mevcut değil

93.2%
Kaynak

SimpleQA ?

AIME 2024

AIME 2025

Aider Polyglot ?

LiveCodeBench v5 ?

Global MMLU (Lite) ?

MathVista ?

Mobil Uygulama

Google Play
Apple Apps

LLM Karşılaştırması
o3-mini vs Claude 3.7 Sonnet - Extended Thinking

o3-mini

Claude 3.7 Sonnet - Extended Thinking

LLM Karşılaştırması

Yorum Ekle

LLM Karşılaştırmasıo3-mini vs Claude 3.7 Sonnet - Extended Thinking

o3-mini

Claude 3.7 Sonnet - Extended Thinking

LLM Karşılaştırması

Yorum Ekle

LLM Karşılaştırması
o3-mini vs Claude 3.7 Sonnet - Extended Thinking