Grok 4

تعليقات: 0
Grok 4 #0
Grok 4 #1
Grok 4 #2
4314
377

المركز في التصنيف العام اعتبارًا من
يوليو 2026
1
تقييم المستخدمين
https://compare-ai.foundtt.com
4.4

نظرة عامة على النموذج

موقع الويب
صفحة نموذج الذكاء الاصطناعي على الويب
المزود
الكيان الذي يوفر هذا النموذج.
الدردشة
أدخل رسالة لبدء الدردشة
تاريخ الإصدار
تاريخ الإصدار الأول للنموذج.
1 سنة ago
يول 09, 2025
الوسائط
أنواع البيانات التي يمكن لهذا النموذج معالجتها
نص ?
صور ?
صوت ?
فيديو ?
مزودو API
المزودون الذين يقدمون هذا النموذج. (هذه ليست قائمة شاملة.)
xAI
تاريخ قطع المعرفة
تاريخ آخر تحديث لمعرفة النموذج.
-
مفتوح المصدر
ما إذا كان كود النموذج متاحًا للاستخدام العام.
لا
تسعير الإدخال
تكلفة معالجة الرموز في مطالباتك
$3.00 لكل مليون رمز
تسعير الإخراج
تكلفة الرموز التي يولدها النموذج
$15.00 لكل مليون رمز
MMLU
فهم اللغة متعدد المهام الضخم - يختبر المعرفة عبر 57 موضوعًا بما في ذلك الرياضيات والتاريخ والقانون والمزيد
-
MMLU-Pro
معيار MMLU أكثر قوة مع أسئلة أكثر صعوبة تركز على التفكير، ومجموعة اختيار أكبر، وتقليل حساسية المطالبة
-
MMMU
فهم متعدد المهام والوسائط الضخم - يختبر الفهم عبر النصوص والصور والصوت والفيديو
-
HellaSwag
معيار إكمال الجمل الصعب
-
HumanEval
يقيم قدرات توليد الكود وحل المشكلات
-
MATH
يختبر قدرات حل المشكلات الرياضية عبر مستويات صعوبة مختلفة
-
GPQA
يختبر المعرفة على مستوى الدكتوراه في الكيمياء والأحياء والفيزياء من خلال أسئلة متعددة الخيارات تتطلب خبرة عميقة في المجال
87.5%
Science
المصدر
IFEval
يختبر قدرة النموذج على اتباع تعليمات التنسيق الصريحة بدقة، وتوليد مخرجات مناسبة، والحفاظ على الالتزام بالتعليمات عبر مهام مختلفة
-
SimpleQA
تقييم دقة الأسئلة البسيطة
-
AIME 2024
-
AIME 2025
91.7%
Competition Math
المصدر
Aider Polyglot
معيار البرمجة متعدد اللغات.
-
LiveCodeBench v5
معيار للبرمجة في الوقت الحقيقي
79%
Competitive Coding
المصدر
Global MMLU (Lite)
نسخة مبسطة من المعيار لتقييم عالمية النماذج على المستوى العالمي.
-
MathVista
تقييم قدرات التفكير الرياضي لنماذج الذكاء الاصطناعي في سياقات بصرية
-
تطبيق الجوال

MathArena ?

المعدل المتوسط89%
AIME 2025
اختبار قائم على مسائل من مسابقة الرياضيات (American Invitational Mathematics Examination) يهدف إلى تقييم المهارات الرياضية للنماذج.
91%
HMMT February 2025
اختبار قائم على مسائل من بطولة هارفارد-MIT للرياضيات، فبراير 2025، يهدف إلى تقييم المهارات الرياضية للنماذج.
92%
BRUMO 202595%
SMT 2025
اختبار قائم على مسائل من بطولة ستانفورد للرياضيات، 2025، يهدف إلى تقييم المهارات الرياضية للنماذج.
86%
CMIMC 2025
اختبار قائم على مسائل من أولمبياد الرياضيات الكندي، 2025، يهدف إلى تقييم المهارات الرياضية للنماذج.
83%

إضافة تعليق

مقارنة نماذج LLM


10%
يستخدم موقعنا ملفات تعريف الارتباط.

سياسة الخصوصية وملفات تعريف الارتباط: يستخدم هذا الموقع ملفات تعريف الارتباط. باستخدامك المستمر للموقع، فإنك توافق على استخدامها.