



موقع الويب صفحة نموذج الذكاء الاصطناعي على الويب | |
المزود الكيان الذي يوفر هذا النموذج. | |
الدردشة أدخل رسالة لبدء الدردشة | |
تاريخ الإصدار تاريخ الإصدار الأول للنموذج. | 1 سنة ago يول 09, 2025 |
الوسائط أنواع البيانات التي يمكن لهذا النموذج معالجتها | نص صور صوت فيديو |
مزودو API المزودون الذين يقدمون هذا النموذج. (هذه ليست قائمة شاملة.) | xAI |
تاريخ قطع المعرفة تاريخ آخر تحديث لمعرفة النموذج. | - |
مفتوح المصدر ما إذا كان كود النموذج متاحًا للاستخدام العام. | لا |
تسعير الإدخال تكلفة معالجة الرموز في مطالباتك | $3.00 لكل مليون رمز |
تسعير الإخراج تكلفة الرموز التي يولدها النموذج | $15.00 لكل مليون رمز |
MMLU فهم اللغة متعدد المهام الضخم - يختبر المعرفة عبر 57 موضوعًا بما في ذلك الرياضيات والتاريخ والقانون والمزيد | - |
MMLU-Pro معيار MMLU أكثر قوة مع أسئلة أكثر صعوبة تركز على التفكير، ومجموعة اختيار أكبر، وتقليل حساسية المطالبة | - |
MMMU فهم متعدد المهام والوسائط الضخم - يختبر الفهم عبر النصوص والصور والصوت والفيديو | - |
HellaSwag معيار إكمال الجمل الصعب | - |
HumanEval يقيم قدرات توليد الكود وحل المشكلات | - |
MATH يختبر قدرات حل المشكلات الرياضية عبر مستويات صعوبة مختلفة | - |
GPQA يختبر المعرفة على مستوى الدكتوراه في الكيمياء والأحياء والفيزياء من خلال أسئلة متعددة الخيارات تتطلب خبرة عميقة في المجال | 87.5% Science المصدر |
IFEval يختبر قدرة النموذج على اتباع تعليمات التنسيق الصريحة بدقة، وتوليد مخرجات مناسبة، والحفاظ على الالتزام بالتعليمات عبر مهام مختلفة | - |
SimpleQA تقييم دقة الأسئلة البسيطة | - |
AIME 2024 | - |
AIME 2025 | 91.7% Competition Math المصدر |
Aider Polyglot معيار البرمجة متعدد اللغات. | - |
LiveCodeBench v5 معيار للبرمجة في الوقت الحقيقي | 79% Competitive Coding المصدر |
Global MMLU (Lite) نسخة مبسطة من المعيار لتقييم عالمية النماذج على المستوى العالمي. | - |
MathVista تقييم قدرات التفكير الرياضي لنماذج الذكاء الاصطناعي في سياقات بصرية | - |
تطبيق الجوال | |
MathArena | |
| المعدل المتوسط | 89% |
| AIME 2025 اختبار قائم على مسائل من مسابقة الرياضيات (American Invitational Mathematics Examination) يهدف إلى تقييم المهارات الرياضية للنماذج. | 91% |
| HMMT February 2025 اختبار قائم على مسائل من بطولة هارفارد-MIT للرياضيات، فبراير 2025، يهدف إلى تقييم المهارات الرياضية للنماذج. | 92% |
| BRUMO 2025 | 95% |
| SMT 2025 اختبار قائم على مسائل من بطولة ستانفورد للرياضيات، 2025، يهدف إلى تقييم المهارات الرياضية للنماذج. | 86% |
| CMIMC 2025 اختبار قائم على مسائل من أولمبياد الرياضيات الكندي، 2025، يهدف إلى تقييم المهارات الرياضية للنماذج. | 83% |
Compare AI. Test. Benchmarks. تطبيبات دردشة الجوال, Sketch
Copyright © 2026 All Right Reserved.