Nova Pro

아마존 노바 프로는 텍스트, 이미지, 비디오 입력을 고급 처리할 수 있는 최첨단 멀티모달 모델입니다. 30만 토큰의 컨텍스트 윈도우를 지원하며, 문서 분석, 시각적 질문 응답, 복잡한 에이전트 기반 워크플로우에 뛰어난 성능을 보입니다. Amazon Nova 기초 모델 시리즈의 일부로, 맞춤형 활용을 위한 파인튜닝 및 증류도 지원합니다.

Qwen2.5-VL-32B

Qwen2-VL이 출시된 이후 지난 5개월 동안 개발자들은 이를 기반으로 다양한 모델을 구축하고 피드백을 제공해왔습니다. 이제 Qwen2.5-VL은 이미지, 텍스트, 차트에 대한 정밀 분석과 구조화된 JSON 출력의 객체 위치 지정 기능 등 향상된 기능을 제공합니다. 긴 동영상 이해, 핵심 이벤트 식별, 컴퓨터와 휴대폰 도구와 상호작용하는 에이전트 역할 수행이 가능합니다. 모델 아키텍처는 동적 비디오 처리와 최적화된 ViT 인코더를 통해 속도와 정확도가 개선되었습니다.

Nova ProQwen2.5-VL-32B
웹사이트 ?
제공자 ?
채팅 ?
출시일 ?
모달리티 ?
텍스트 ?
이미지 ?
비디오 ?
텍스트 ?
이미지 ?
비디오 ?
API 제공자 ?
Amazon Bedrock
-
지식 업데이트 종료일 ?
의도적으로 공개되지 않음
알 수 없음
오픈 소스 ?
아니오
(출처)
입력 가격 ?
$0.80 100만 토큰당
$0
출력 가격 ?
$3.20 100만 토큰당
$0
MMLU ?
85.9%
CoT
출처
78.4%
출처
MMLU-Pro ?
정보 없음
49.5%
MMMU ?
정보 없음
70%
HellaSwag ?
정보 없음
정보 없음
HumanEval ?
89%
pass@1
출처
정보 없음
MATH ?
76.6%
CoT
출처
82.2%
GPQA ?
46.9%
Main
출처
46.0%
Diamond
IFEval ?
92.1%
출처
정보 없음
SimpleQA ?
-
-
AIME 2024
-
-
AIME 2025
-
-
Aider Polyglot ?
-
-
LiveCodeBench v5 ?
-
-
Global MMLU (Lite) ?
-
-
MathVista ?
-
-
모바일 앱
-
-

LLM 비교

댓글 추가


10%
당사 웹사이트는 쿠키를 사용합니다.

개인정보 및 쿠키 정책: 본 사이트는 쿠키를 사용합니다. 사이트를 계속 이용하면 쿠키 사용에 동의하는 것으로 간주됩니다.