Grok 3 Beta

Grok 3 — это самый продвинутый модельный продукт xAI, обученный на суперкомпьютерном кластере Colossus с вычислительной мощностью, превышающей предыдущие передовые модели в 10 раз. Обладает контекстным окном в 1 миллион токенов и расширенными возможностями рассуждения, улучшенными благодаря крупномасштабному обучению с подкреплением, что позволяет осуществлять глубокие мыслительные процессы от секунд до минут для решения сложных задач. Модель демонстрирует выдающиеся результаты в академических тестах и реальных пользовательских оценках, набрав рейтинг Elo 1402 в Chatbot Arena. Выпущена вместе с Grok 3 Mini — экономичной версией, оптимизированной для упрощенного рассуждения.

o3-mini

OpenAI o3-mini — это высокоскоростная и экономичная модель логического мышления, разработанная для STEM-приложений, обладающая высокой производительностью в науке, математике и программировании. Выпущенная в январе 2025 года, она включает ключевые функции для разработчиков, такие как вызовы функций, структурированные выходные данные и сообщения разработчиков. Модель предлагает три уровня глубины анализа—низкий, средний и высокий—что позволяет пользователям находить баланс между детальным разбором и скоростью отклика. В отличие от модели o3, она не поддерживает обработку изображений. Изначально доступна избранным разработчикам на уровнях использования API 3-5 и может быть использована через Chat Completions API, Assistants API и Batch API.

Grok 3 Betao3-mini
Провайдер
Веб-сайт
Дата выпуска
Jan 19, 2025
3 месяца назад
Jan 31, 2025
2 месяца назад
Модальности
текст ?
изображения ?
видео ?
текст ?
Поставщики API
xAI
OpenAI API
Дата актуальности знаний
2025-01
Неизвестно
Открытый исходный код
Нет
Нет
Стоимость ввода
Недоступно
$1.10 за миллион токенов
Стоимость вывода
Недоступно
$4.40 за миллион токенов
MMLU
Недоступно
86.9%
pass@1, high effort
Источник
MMLU Pro
79.9%
Base model
Источник
Недоступно
MMMU
78%
With Think mode
Источник
Недоступно
HellaSwag
Недоступно
Недоступно
HumanEval
Недоступно
Недоступно
MATH
Недоступно
97.9%
pass@1, high effort
Источник
GPQA
84.6%
With Think mode, Diamond
Источник
79.7%
0-shot, high effort
Источник
IFEval
Недоступно
Недоступно
Мобильное приложение

Сравнение LLM

Добавить комментарий


10%
Наш сайт использует cookies

Этот сайт использует файлы cookie. Продолжая пользоваться сайтом, вы соглашаетесь с их использованием.