GPT-OSS

Komentáře: 0
GPT-OSS #0
GPT-OSS #1
0
0

Pozice v celkovém hodnocení k datu
Červenec 2026
19
Hodnocení uživatelů
https://compare-ai.foundtt.com
4.1

Přehled modelu

Webová stránka
Webová stránka AI modelu
Poskytovatel
Subjekt, který poskytuje tento model.
Chat
Zadejte zprávu a začněte chatovat
Datum vydání
Kdy byl model poprvé vydán.
11 měsíců ago
Srp 05, 2025
Modality
Typy dat, která tento model dokáže zpracovat
text ?
Poskytovatelé API
Poskytovatelé, kteří tento model nabízejí. (Toto není vyčerpávající seznam.)
Self-hosted, Hugging Face, AWS, Azure, Databricks
Datum uzávěrky znalostí
Kdy byly poslední aktualizace znalostí modelu.
-
Open Source
Zda je kód modelu k dispozici pro veřejné použití.
Ano
Cena za vstup
Cena za zpracování tokenů ve vašich výzvách
$0.15 na milion tokenů
Cena za výstup
Cena za tokeny generované modelem
$0.60 na milion tokenů
MMLU
Massive Multitask Language Understanding - Testuje znalosti v 57 oblastech, včetně matematiky, historie, práva a dalších
82.7%
Zdroj
MMLU-Pro
Robustnější MMLU benchmark s těžšími, na uvažování zaměřenými otázkami, větším výběrem a nižší citlivostí na výzvy
-
MMMU
Massive Multitask Multimodal Understanding - Testuje porozumění napříč textem, obrázky, zvukem a videem
-
HellaSwag
Náročný benchmark pro dokončení vět
-
HumanEval
Hodnotí schopnosti generování kódu a řešení problémů
-
MATH
Testuje schopnosti řešení matematických problémů napříč různými úrovněmi obtížnosti
-
GPQA
Testuje znalosti na úrovni PhD z chemie, biologie a fyziky prostřednictvím otázek s výběrem, které vyžadují hlubokou odbornou znalost
80.1%
Diamond
Zdroj
IFEval
Testuje schopnost modelu přesně dodržovat explicitní formátovací pokyny, generovat vhodné výstupy a udržovat konzistenci dodržování pokynů napříč různými úkoly
-
SimpleQA
Hodnocení přesnosti jednoduchých otázek
66.2%
Zdroj
AIME 2024
69%
Zdroj
AIME 2025
98.7%
Aider Polyglot
Vícejazyčný programovací benchmark.
-
LiveCodeBench v5
Benchmark pro programování v reálném čase
42.7%
v5
Zdroj
Global MMLU (Lite)
Zjednodušená verze benchmarku pro hodnocení univerzálnosti modelů na globální úrovni.
-
MathVista
Hodnotí schopnosti matematického uvažování modelů umělé inteligence ve vizuálních kontextech
-
Mobilní aplikace
-

Přidat komentář

Porovnat LLM


10%
Naše stránky používají soubory cookie.

Zásady ochrany osobních údajů a souborů cookie: Tento web používá soubory cookie. Dalším používáním webu souhlasíte s jejich používáním.