GPT-OSS

Komentarai: 0
GPT-OSS #0
GPT-OSS #1
0
0

Pozicija bendroje reitingų lentelėje nuo
Liepa 2026
19
Vartotojo įvertinimas
https://compare-ai.foundtt.com
4.1

Modelio apžvalga

Internetinė svetainė
DI modelio puslapis
Tiekėjas
Subjekto, kuris teikia šį modelį, pavadinimas.
Pokalbiai
Įveskite žinutę, kad pradėtumėte pokalbį
Išleidimo data
Kada modelis buvo pirmą kartą išleistas.
11 mėnesių ago
Rgp 05, 2025
Modalumai
Duomenų tipai, kuriuos šis modelis gali apdoroti
tekstas ?
API tiekėjai
Tiekėjai, kurie siūlo šį modelį. (Tai nėra išsamus sąrašas.)
Self-hosted, Hugging Face, AWS, Azure, Databricks
Žinių nutraukimo data
Kada paskutinį kartą buvo atnaujintos modelio žinios.
-
Atvirojo kodo
Ar modelio kodas yra prieinamas viešam naudojimui.
Taip
Įvesties kaina
Kaina už žodžių apdorojimą jūsų užklausose
$0.15 už milijoną žodžių
Išvesties kaina
Kaina už modelio sugeneruotus žodžius
$0.60 už milijoną žodžių
MMLU
Masinis daugiužduotis kalbos supratimas – testuoja žinias apie 57 temas, įskaitant matematiką, istoriją, teisę ir daugiau
82.7%
Šaltinis
MMLU-Pro
Išsamus MMLU testas su sudėtingesniais, mąstymą orientuotais klausimais, didesniu pasirinkimu ir sumažintu jautrumu užklausoms
-
MMMU
Masinis daugiužduotis multimodalus supratimas – testuoja supratimą apie tekstą, vaizdus, garsą ir vaizdo įrašus
-
HellaSwag
Iššūkis sakinio užbaigimo testas
-
HumanEval
Vertina kodo generavimo ir problemų sprendimo gebėjimus
-
MATH
Testuoja matematinių užduočių sprendimo gebėjimus įvairiais sudėtingumo lygiais
-
GPQA
Testuoja PhD lygio žinias chemijoje, biologijoje ir fizikoje per pasirinkimo klausimus, kurie reikalauja gilių žinių šiose srityse
80.1%
Diamond
Šaltinis
IFEval
Testuoja modelio gebėjimą tiksliai sekti aiškias formatavimo instrukcijas, generuoti tinkamus rezultatus ir išlaikyti nuoseklumą įvairiose užduotyse
-
SimpleQA
Paprastų klausimų tikslumo vertinimas
66.2%
Šaltinis
AIME 2024
69%
Šaltinis
AIME 2025
98.7%
Aider Polyglot
Daugiakalbis programavimo etalonas.
-
LiveCodeBench v5
Realaus laiko programavimo etalonas
42.7%
v5
Šaltinis
Global MMLU (Lite)
Supaprastinta etalono versija, skirta modelių universalumui įvertinti pasaulyje.
-
MathVista
Įvertina DI modelių matematinius samprotavimo gebėjimus vaizdiniuose kontekstuose
-
Mobilioji programa
-

Pridėti komentarą

Palyginti LLM


10%
Mūsų svetainė naudoja slapukus.

Privatumo ir slapukų politika: Ši svetainė naudoja slapukus. Tęsdami naudojimąsi svetaine, jūs sutinkate su jų naudojimu.