Grok 3 — это самый продвинутый модельный продукт xAI, обученный на суперкомпьютерном кластере Colossus с вычислительной мощностью, превышающей предыдущие передовые модели в 10 раз. Обладает контекстным окном в 1 миллион токенов и расширенными возможностями рассуждения, улучшенными благодаря крупномасштабному обучению с подкреплением, что позволяет осуществлять глубокие мыслительные процессы от секунд до минут для решения сложных задач. Модель демонстрирует выдающиеся результаты в академических тестах и реальных пользовательских оценках, набрав рейтинг Elo 1402 в Chatbot Arena. Выпущена вместе с Grok 3 Mini — экономичной версией, оптимизированной для упрощенного рассуждения.
OpenAI o4-mini — это новейшая облегченная модель в серии o, разработанная для эффективного и мощного анализа текстовых и визуальных задач. Оптимизированная для скорости и производительности, она превосходно справляется с генерацией кода и анализом изображений, сохраняя баланс между задержкой и глубиной анализа. Модель поддерживает контекстное окно в 200 000 токенов с выводом до 100 000 токенов, что делает её подходящей для длительных и объемных взаимодействий. Она обрабатывает как текстовые, так и графические входные данные, выдавая текстовые результаты с расширенными аналитическими возможностями. Благодаря компактной архитектуре и универсальной производительности o4-mini идеально подходит для широкого спектра реальных приложений, требующих быстрого и экономически эффективного интеллекта.
Grok 3 Beta | o4-mini | |
---|---|---|
Веб-сайт
| ||
Провайдер
| ||
Чат
| ||
Дата выпуска
| ||
Модальности
| текст изображения видео | текст изображения |
Поставщики API
| xAI | OpenAI API |
Дата актуальности знаний
| 2025-01 | - |
Открытый исходный код
| Нет | Нет |
Стоимость ввода
| Недоступно | $1.10 за миллион токенов |
Стоимость вывода
| Недоступно | $4.40 за миллион токенов |
MMLU
| Недоступно | fort |
MMLU-Pro
| 79.9% Base model Источник | - |
MMMU
| 78% With Think mode Источник | 81.6% Источник |
HellaSwag
| Недоступно | - |
HumanEval
| Недоступно | 14.28% Источник |
MATH
| Недоступно | - |
GPQA
| 84.6% With Think mode, Diamond Источник | 81.4% Источник |
IFEval
| Недоступно | - |
SimpleQA
| - | - |
AIME 2024 | - | 93.4% Источник |
AIME 2025 | - | 92.7% Источник |
Aider Polyglot
| - | - |
LiveCodeBench v5
| - | - |
Global MMLU (Lite)
| - | - |
MathVista
| - | - |
Мобильное приложение |
Compare AI. Test. Benchmarks. Чат-боты для мобильных приложений, Sketch
Copyright © 2025 All Right Reserved.