أفضل نماذج الذكاء الاصطناعي في العلوم
الترتيب حسب GPQA Diamond: أسئلة اختيار من متعدد صعبة جدًا في الأحياء والفيزياء والكيمياء كتبها خبراء حاصلون على الدكتوراه، والإجابة العشوائية تحقق 25%. اختبرتها Epoch AI بشكل مستقل.
اختياراتنا
الترتيب
قارن بين أول نموذجين| # | النموذج | GPQA Diamondi | المؤشر العامi | المدخلاتi | المخرجاتi | السياقi |
|---|---|---|---|---|---|---|
| 1 | GPT-6 AstraOpenAI | 95.8% | 166.6 | 10 US$ | 50 US$ | 1.1M |
| 2 | Claude Sonnet 5.5Anthropic | 95.6% | — | 2 US$ | 10 US$ | 1M |
| 3 | Gemini 3.8 FlashGoogle DeepMind | 95.4% | 157.1 | 0.75 US$ | 3.75 US$ | 1M |
| 4 | Gemini 3.7 FlashGoogle DeepMind | 94.8% | 157.7 | 0.75 US$ | 3.75 US$ | 1M |
| 5 | GPT-5.4 ProOpenAI | 94.6% | 159.1 | 30 US$ | 180 US$ | 1.1M |
| 6 | Gemini 3.1 Pro PreviewGoogle DeepMind | 94.4% | 154.9 | 2 US$ | 12 US$ | 1M |
| 7 | Gemini 3.6 FlashGoogle DeepMind | 94.1% | 154.4 | 0.75 US$ | 3.75 US$ | 1M |
| 8 | Grok 4.6xAI | 94.0% | 156.5 | 2 US$ | 6 US$ | 500K |
| 9 | Claude Opus 5Anthropic | 93.9% | 162.7 | 5 US$ | 25 US$ | 1M |
| 10 | GPT-5.6 SolOpenAI | 93.5% | 162.0 | 2 US$ | 10 US$ | 1.1M |
لكل مليون رمز · USD
إجابات سريعة
- ما أفضل نموذج ذكاء اصطناعي للأسئلة العلمية؟
- يتصدر GPT-6 Astra من OpenAI هذا الترتيب (GPQA Diamond: 95.8%). ويكلّف 10 US$ لكل مليون رمز مدخلات و50 US$ لكل مليون رمز مخرجات.
- هل يوجد بديل أرخص؟
- يكلّف Gemini 3.8 Flash من Google DeepMind (GPQA Diamond: 95.4%) مبلغ 0.75 US$ / 3.75 US$ لكل مليون رمز، أي أقل بنحو 13 مرة من GPT-6 Astra.
كيف نرتّب
تأتي الدرجات من اختبارات تجريها Epoch AI بشكل مستقل (CC BY 4.0)، لا من إعلانات الشركات نفسها. وتأتي الأسعار من الواجهة البرمجية العامة لـ OpenRouter. ويُحدَّث الاثنان تلقائيًا عدة مرات يوميًا، لذا يواكب هذا الترتيب الإصدارات الجديدة وتغيّرات الأسعار.
تصنيفات أخرى
البرمجةالرياضياتالأرخصمجانيةمفتوحة المصدرسياق طويلالصور وPDFالتصنيفات →