GPT-5

Hozzászólások: 0
GPT-5 #0
GPT-5 #1
3026
193

Helyezés az összesített rangsorban dátummal Július 2026
27
Felhasználói értékelés https://compare-ai.foundtt.com
4

Modell Áttekintés

Weboldal
AI Modell Weboldal
Szolgáltató
A modellt biztosító entitás.
Csevegés
Írjon be egy üzenetet a csevegés megkezdéséhez
Kiadási Dátum
Mikor jelent meg a modell először.
11 hónapok ago
Aug 07, 2025
Modalitások
A modell által feldolgozható adattípusok
szöveg ?
képek ?
hang ?
videó ?
API Szolgáltatók
A modellt kínáló szolgáltatók. (Ez nem egy teljes lista.)
OpenAI API
Tudás Befejezési Dátuma
Utoljára mikor frissült a modell tudása.
-
Nyílt Forráskódú
A modell kódja nyilvánosan használható-e.
Nem
Bemeneti Árazás
A promptokban feldolgozott tokenek költsége
-
Kimeneti Árazás
A modell által generált tokenek költsége
-
MMLU
Massive Multitask Language Understanding – 57 tantárgyban teszteli a tudást, beleértve a matematikát, történelmet, jogot és egyebeket
-
MMLU-Pro
Egy robusztusabb MMLU benchmark nehezebb, gondolkodásra összpontosító kérdésekkel, nagyobb választási lehetőségekkel és csökkentett prompt érzékenységgel
-
MMMU
Massive Multitask Multimodal Understanding – Teszteli a megértést szöveg, kép, hang és videó terén
84.2%
Forrás
HellaSwag
Egy kihívást jelentő mondatkiegészítési benchmark
-
HumanEval
Értékeli a kódgenerálás és problémamegoldó képességeket
24.8%
Full Set
Forrás
MATH
Különböző nehézségi szinteken teszteli a matematikai problémamegoldó képességeket
-
GPQA
Doktori szintű tudást tesztel kémiában, biológiában és fizikában, több választós kérdéseken keresztül, amelyek mély szakmai tudást igényelnek
85.7%
Diamond
Forrás
IFEval
Teszteli a modell képességét, hogy pontosan kövesse az explicit formázási utasításokat, megfelelő kimeneteket generáljon, és következetesen betartsa az utasításokat különböző feladatok során
-
SimpleQA
Egyszerű kérdések pontosságának értékelése
-
AIME 2024
-
AIME 2025
94.6%
Forrás
Aider Polyglot
Többnyelvű programozási benchmark.
88.0%
Multi-language code editing
Forrás
LiveCodeBench v5
Valós idejű programozási benchmark
-
Global MMLU (Lite)
A benchmark egyszerűsített verziója a modellek globális szintű univerzalitásának értékelésére.
-
MathVista
Értékeli az AI modellek matematikai következtetési képességeit vizuális környezetben
-
Mobilalkalmazás
-

Hozzászólás Hozzáadása

LLM-ek Összehasonlítása


10%
Webhelyünk sütiket használ

Ez az oldal sütiket használ. A webhely további használatával Ön elfogadja azok használatát.