أفضل نماذج الذكاء الاصطناعي في العلوم

الترتيب حسب GPQA Diamond: أسئلة اختيار من متعدد صعبة جدًا في الأحياء والفيزياء والكيمياء كتبها خبراء حاصلون على الدكتوراه، والإجابة العشوائية تحقق 25%. اختبرتها Epoch AI بشكل مستقل.

حُدّث في 30 سبتمبر 2026

اختياراتنا

#النموذجGPQA Diamondiالمؤشر العامiالمدخلاتiالمخرجاتiالسياقi
1
95.8%
166.6‏10 US$‏50 US$1.1M
2
95.6%
—‏2 US$‏10 US$1M
3
Gemini 3.8 FlashGoogle DeepMind
95.4%
157.1‏0.75 US$‏3.75 US$1M
4
Gemini 3.7 FlashGoogle DeepMind
94.8%
157.7‏0.75 US$‏3.75 US$1M
5
94.6%
159.1‏30 US$‏180 US$1.1M
6
Gemini 3.1 Pro PreviewGoogle DeepMind
94.4%
154.9‏2 US$‏12 US$1M
7
Gemini 3.6 FlashGoogle DeepMind
94.1%
154.4‏0.75 US$‏3.75 US$1M
8
94.0%
156.5‏2 US$‏6 US$500K
9
Claude Opus 5Anthropic
93.9%
162.7‏5 US$‏25 US$1M
10
93.5%
162.0‏2 US$‏10 US$1.1M

لكل مليون رمز · USD

إجابات سريعة

ما أفضل نموذج ذكاء اصطناعي للأسئلة العلمية؟
يتصدر GPT-6 Astra من OpenAI هذا الترتيب (GPQA Diamond: 95.8%). ويكلّف ‏10 US$ لكل مليون رمز مدخلات و‏50 US$ لكل مليون رمز مخرجات.
هل يوجد بديل أرخص؟
يكلّف Gemini 3.8 Flash من Google DeepMind (GPQA Diamond: 95.4%) مبلغ ‏0.75 US$ / ‏3.75 US$ لكل مليون رمز، أي أقل بنحو 13 مرة من GPT-6 Astra.

كيف نرتّب

تأتي الدرجات من اختبارات تجريها Epoch AI بشكل مستقل (CC BY 4.0)، لا من إعلانات الشركات نفسها. وتأتي الأسعار من الواجهة البرمجية العامة لـ OpenRouter. ويُحدَّث الاثنان تلقائيًا عدة مرات يوميًا، لذا يواكب هذا الترتيب الإصدارات الجديدة وتغيّرات الأسعار.

تصنيفات أخرى

البرمجةالرياضياتالأرخصمجانيةمفتوحة المصدرسياق طويلالصور وPDFالتصنيفات →