o3-mini vs Claude 3.7 Sonnet - LLM Karşılaştırması

o3-mini

OpenAI o3-mini, STEM uygulamaları için tasarlanmış yüksek hızlı ve maliyet etkin bir akıl yürütme modelidir; bilim, matematik ve kodlama alanlarında güçlü performans sergiler. Ocak 2025’te piyasaya sürülen model, fonksiyon çağrısı, yapılandırılmış çıktılar ve geliştirici mesajları gibi temel geliştirici özelliklerini içerir. Kullanıcılar, düşük, orta ve yüksek düzeyde akıl yürütme yoğunluğu arasında seçim yaparak yanıt süresi ile derin analiz arasında denge kurabilir. Görsel yeteneklere sahip olmayan bu model, başlangıçta yalnızca seviye 3-5 API geliştiricilerine sunulmuştur ve Chat Completions API, Assistants API ve Batch API aracılığıyla erişilebilir.

Claude 3.7 Sonnet

Claude 3.7 Sonnet, Anthropic'in şimdiye kadarki en gelişmiş modeli olup, piyasadaki ilk hibrit akıl yürütme yapay zekasıdır. Hem standart hem de genişletilmiş düşünme modları sunar; genişletilmiş mod, şeffaf ve adım adım akıl yürütme sağlar. Model, kodlama ve ön yüz web geliştirmede üstün performans göstererek SWE-bench Verified ve TAU-bench'te son teknoloji sonuçlar elde etmiştir. Claude.ai, Anthropic API, Amazon Bedrock ve Google Cloud'un Vertex AI hizmetleri aracılığıyla kullanılabilir ve yapay zeka destekli problem çözme konusunda yeni bir ölçüt belirler.

	o3-mini	Claude 3.7 Sonnet
Web Sitesi ?	Open	Open
Sağlayıcı ?	OpenAI	Anthropic
Sohbet ?
Yayın Tarihi ?
Modallikler ?	metin ?	metin ? görseller ?
API Sağlayıcıları ?	OpenAI API	Claude.ai, Anthropic API, Amazon Bedrock, Google Cloud Vertex AI
Bilgi Kesim Tarihi ?	Bilinmiyor	-
Açık Kaynak ?	Hayır	Hayır
Fiyatlandırma Girdisi ?	$1.10 milyon belirteç başına	$3.00 milyon belirteç başına
Fiyatlandırma Çıktısı ?	$4.40 milyon belirteç başına	$15.00 milyon belirteç başına
MMLU ?	86.9% pass@1, high effort Kaynak	Mevcut değil
MMLU-Pro ?	Mevcut değil	Mevcut değil
MMMU ?	Mevcut değil	71.8% Kaynak
HellaSwag ?	Mevcut değil	Mevcut değil
HumanEval ?	Mevcut değil	Mevcut değil
MATH ?	97.9% pass@1, high effort Kaynak	82.2% Kaynak
GPQA ?	79.7% 0-shot, high effort Kaynak	68% Diamond Kaynak
IFEval ?	Mevcut değil	90.8% Kaynak
SimpleQA ?	-	-
AIME 2024	-	-
AIME 2025	-	-
Aider Polyglot ?	-	-
LiveCodeBench v5 ?	-	-
Global MMLU (Lite) ?	-	-
MathVista ?	-	-
Mobil Uygulama	Google Play Apple Apps	Google Play Apple Apps
VideoGameBench ?
Toplam puan	-	0%
Doom II	-	0%
Dream DX	-	0%
Awakening DX	-	0%
Civilization I	-	0%
Pokemon Crystal	-	0%
The Need for Speed	-	0%
The Incredible Machine	-	0%
Secret Game 1	-	0%
Secret Game 2	-	0%
Secret Game 3	-	0%

o3-mini

Claude 3.7 Sonnet

Web Sitesi ?

Open

Sağlayıcı ?

OpenAI

Anthropic

Sohbet ?

Yayın Tarihi ?

Modallikler ?

metin ?

metin ?
görseller ?

API Sağlayıcıları ?

OpenAI API

Claude.ai, Anthropic API, Amazon Bedrock, Google Cloud Vertex AI

Bilgi Kesim Tarihi ?

Bilinmiyor

Açık Kaynak ?

Hayır

Fiyatlandırma Girdisi ?

$1.10 milyon belirteç başına

$3.00 milyon belirteç başına

Fiyatlandırma Çıktısı ?

$4.40 milyon belirteç başına

$15.00 milyon belirteç başına

MMLU ?

86.9%
pass@1, high effort
Kaynak

Mevcut değil

MMLU-Pro ?

Mevcut değil

MMMU ?

Mevcut değil

71.8%
Kaynak

HellaSwag ?

Mevcut değil

HumanEval ?

Mevcut değil

MATH ?

97.9%
pass@1, high effort
Kaynak

82.2%
Kaynak

GPQA ?

79.7%
0-shot, high effort
Kaynak

68%
Diamond
Kaynak

IFEval ?

Mevcut değil

90.8%
Kaynak

SimpleQA ?

AIME 2024

AIME 2025

Aider Polyglot ?

LiveCodeBench v5 ?

Global MMLU (Lite) ?

MathVista ?

Mobil Uygulama

Google Play
Apple Apps

VideoGameBench ?

Toplam puan

Doom II

Dream DX

Awakening DX

Civilization I

Pokemon Crystal

The Need for Speed

The Incredible Machine

Secret Game 1

Secret Game 2

Secret Game 3

LLM Karşılaştırması
o3-mini vs Claude 3.7 Sonnet

o3-mini

Claude 3.7 Sonnet

VideoGameBench ?

LLM Karşılaştırması

Yorum Ekle

LLM Karşılaştırmasıo3-mini vs Claude 3.7 Sonnet

o3-mini

Claude 3.7 Sonnet

VideoGameBench ?

LLM Karşılaştırması

Yorum Ekle

LLM Karşılaştırması
o3-mini vs Claude 3.7 Sonnet