DeepSeek-R1 — це модель з 671B параметрів, побудована на архітектурі Mixture-of-Experts (MoE),з 37B активованих параметрів на токен. Вона навчалась за допомогою масштабного навчання з підкріпленням із акцентом на розвиток навичок міркування. Модель включає два етапи RL для виявлення покращених шаблонів міркування та відповідності людським уподобанням, а також два етапи SFT для закладання основ міркувальних та неміркувальних здібностей. Модель демонструє продуктивність, порівнянну з OpenAI-o1, у завданнях з математики, програмування та міркування.
Gemini 2.5 Pro — це найдосконаліша модель ШІ від Google, розроблена для глибоких міркувань і продуманого створення відповідей. Вона перевершує ключові тести, демонструючи виняткову логіку та навички програмування. Оптимізована для створення динамічних веб-додатків, автономних систем коду та адаптації коду, забезпечуючи високу продуктивність. З вбудованими мультимодальними можливостями та розширеним контекстним вікном вона ефективно обробляє великі набори даних і інтегрує різні джерела інформації для вирішення складних завдань.
DeepSeek-R1 | Gemini 2.5 Pro | |
---|---|---|
Постачальник | ||
Веб-сайт | ||
Дата випуску | Jan 21, 2025 4 months ago | Mar 25, 2025 2 months ago |
Модальності | текст | текст зображення голос відео |
Постачальники API | DeepSeek, HuggingFace | Google AI Studio, Vertex AI, Gemini app |
Дата оновлення знань | Невідомо | - |
Відкритий код | Так | Ні |
Вартість введення | $0.55 за мільйон токенів | Недоступно |
Вартість виведення | $2.19 за мільйон токенів | Недоступно |
MMLU | 90.8% Pass@1 Джерело | Недоступно |
MMLU Pro | 84% EM Джерело | Недоступно |
MMMU | - | 81.7% Джерело |
HellaSwag | - | Недоступно |
HumanEval | - | Недоступно |
MATH | - | Недоступно |
GPQA | 71.5% Pass@1 Джерело | 84.0% Diamond Science Джерело |
IFEval | 83.3% Prompt Strict Джерело | Недоступно |
Array | - | 52.9% |
AIME 2024 | - | 92.0% |
AIME 2025 | - | 86.7% |
Array | - | 74.0% / 68.6% |
Array | - | 70.4% |
Array | - | 89.8% |
Array | - | - |
Мобільний додаток |
Compare AI. Test. Benchmarks. Чат-боти для мобільних застосунків, Sketch
Copyright © 2025 All Right Reserved.