o3-mini

OpenAI o3-mini는 STEM 분야에 최적화된 고속·저비용 추론 모델로, 과학, 수학, 코딩 작업에서 강력한 성능을 발휘합니다. 2025년 1월 출시되었으며, 함수 호출, 구조화 출력, 개발자 메시지 등 주요 기능을 포함합니다. 낮음, 중간, 높음의 세 가지 추론 강도 설정으로 분석 깊이와 응답 속도 간 최적화를 지원합니다. o3 모델과 달리 비전 기능은 없으며, API 사용 3~5등급 개발자에게 먼저 제공되었고 Chat Completions API, Assistants API, Batch API로 접근 가능합니다.

Claude 3.7 Sonnet - Extended Thinking

Claude 3.7 Sonnet은 Anthropic이 개발한 가장 진보된 AI 모델로, 시장 최초의 하이브리드 추론 시스템입니다. 일반 모드와 단계별 사고를 제공하는 확장 사고 모드를 지원합니다. 이 모델은 SWE-bench Verified 및 TAU-bench에서 최고 성능을 발휘하며, 코딩과 프론트엔드 웹 개발 분야에서 상당한 향상을 보여줍니다. Claude.ai, Anthropic API, Amazon Bedrock, Google Cloud의 Vertex AI를 통해 사용할 수 있으며, 지능형 AI 기반 문제 해결의 새로운 표준을 세웁니다.

o3-miniClaude 3.7 Sonnet - Extended Thinking
웹사이트 ?
제공자 ?
채팅 ?
출시일 ?
모달리티 ?
텍스트 ?
텍스트 ?
이미지 ?
API 제공자 ?
OpenAI API
Claude.ai, Anthropic API, Amazon Bedrock, Google Cloud Vertex AI
지식 업데이트 종료일 ?
알 수 없음
-
오픈 소스 ?
아니오
아니오
입력 가격 ?
$1.10 100만 토큰당
$3.00 100만 토큰당
출력 가격 ?
$4.40 100만 토큰당
$15.00 100만 토큰당
MMLU ?
86.9%
pass@1, high effort
출처
정보 없음
MMLU-Pro ?
정보 없음
정보 없음
MMMU ?
정보 없음
75%
출처
HellaSwag ?
정보 없음
정보 없음
HumanEval ?
정보 없음
정보 없음
MATH ?
97.9%
pass@1, high effort
출처
96.2%
출처
GPQA ?
79.7%
0-shot, high effort
출처
84.8%
Diamond
출처
IFEval ?
정보 없음
93.2%
출처
SimpleQA ?
-
-
AIME 2024
-
-
AIME 2025
-
-
Aider Polyglot ?
-
-
LiveCodeBench v5 ?
-
-
Global MMLU (Lite) ?
-
-
MathVista ?
-
-
모바일 앱

LLM 비교

댓글 추가


10%
당사 웹사이트는 쿠키를 사용합니다.

개인정보 및 쿠키 정책: 본 사이트는 쿠키를 사용합니다. 사이트를 계속 이용하면 쿠키 사용에 동의하는 것으로 간주됩니다.