GPT-5

Komentarze: 0
GPT-5 #0
GPT-5 #1
3026
193

Pozycja w ogólnym rankingu na dzień
Lipiec 2026
27
Ocena użytkowników
https://compare-ai.foundtt.com
4

Przegląd modelu

Strona internetowa
Strona internetowa modelu AI
Dostawca
Podmiot dostarczający ten model.
Czat
Wpisz wiadomość, aby rozpocząć czat
Data wydania
Kiedy model został po raz pierwszy wydany.
11 miesięcy ago
Sie 07, 2025
Modalności
Rodzaje danych, które ten model może przetwarzać
tekst ?
obrazy ?
głos ?
wideo ?
Dostawcy API
Dostawcy oferujący ten model. (To nie jest wyczerpująca lista.)
OpenAI API
Data ostatniej aktualizacji wiedzy
Kiedy wiedza modelu była ostatnio aktualizowana.
-
Open Source
Czy kod modelu jest dostępny do publicznego użytku.
Nie
Cena za wejście
Koszt przetwarzania tokenów w Twoich promptach
-
Cena za wyjście
Koszt za tokeny wygenerowane przez model
-
MMLU
Massive Multitask Language Understanding - Testuje wiedzę z 57 dziedzin, w tym matematyki, historii, prawa i innych
-
MMLU-Pro
Bardziej zaawansowane benchmarki MMLU z trudniejszymi pytaniami skupionymi na rozumowaniu, większym zestawem wyborów i zmniejszoną wrażliwością na prompty
-
MMMU
Massive Multitask Multimodal Understanding - Testuje rozumienie tekstu, obrazów, dźwięku i wideo
84.2%
Źródło
HellaSwag
Wymagające benchmarki uzupełniania zdań
-
HumanEval
Ocenia możliwości generowania kodu i rozwiązywania problemów
24.8%
Full Set
Źródło
MATH
Testuje umiejętności rozwiązywania problemów matematycznych na różnych poziomach trudności
-
GPQA
Testuje wiedzę na poziomie doktorskim z chemii, biologii i fizyki poprzez pytania wielokrotnego wyboru wymagające głębokiej wiedzy specjalistycznej
85.7%
Diamond
Źródło
IFEval
Testuje zdolność modelu do dokładnego przestrzegania wyraźnych instrukcji formatowania, generowania odpowiednich wyników i utrzymania spójnego przestrzegania instrukcji w różnych zadaniach
-
SimpleQA
Ocena dokładności prostych pytań
-
AIME 2024
-
AIME 2025
94.6%
Źródło
Aider Polyglot
Wielojęzyczny benchmark programistyczny.
88.0%
Multi-language code editing
Źródło
LiveCodeBench v5
Benchmark programowania w czasie rzeczywistym
-
Global MMLU (Lite)
Uproszczona wersja benchmarku do oceny uniwersalności modeli na poziomie globalnym.
-
MathVista
Ocenia zdolności rozumowania matematycznego modeli AI w kontekstach wizualnych
-
Aplikacja mobilna
-

Dodaj komentarz

Porównaj LLM


10%
Polityka prywatności i ciasteczka

Używamy plików cookies, by ułatwić korzystanie z naszych serwisów. Jeśli nie chcesz, by pliki cookies były zapisywane na Twoim dysku, zmień ustawienia swojej przeglądarki.