أفضل نماذج الذكاء الاصطناعي للبرمجة
الترتيب حسب SWE-bench Verified: نسبة الأخطاء الحقيقية من مشاريع مفتوحة المصدر حقيقية التي يصلحها كل نموذج بمفرده. اختبرتها Epoch AI بشكل مستقل، مع أسعار الواجهات البرمجية الحالية.
اختياراتنا
الترتيب
قارن بين أول نموذجين| # | النموذج | SWE-bench Verifiedi | المؤشر العامi | المدخلاتi | المخرجاتi | السياقi |
|---|---|---|---|---|---|---|
| 1 | Claude Opus 4.7Anthropic | 83.5% | 156.4 | 5 US$ | 25 US$ | 1M |
| 2 | Gemini 3.5 FlashGoogle DeepMind | 79.3% | 154.6 | 1.50 US$ | 9 US$ | 1M |
| 3 | GLM 5.2Z.ai (Zhipu) | 78.7% | 151.8 | 0.14 US$ | 3.99 US$ | 1M |
| 4 | Claude Opus 4.6Anthropic | 78.7% | 155.4 | 5 US$ | 25 US$ | 1M |
| 5 | DeepSeek V4 Pro 0813DeepSeek | 77.6% | 155.4 | 0.66 US$ | 1.98 US$ | 1M |
| 6 | Qwen3.7 MaxAlibaba Qwen | 77.3% | 153.7 | 1.48 US$ | 4.43 US$ | 1M |
| 7 | GPT-5.4OpenAI | 76.9% | 156.9 | 2.50 US$ | 15 US$ | 1.1M |
| 8 | Qwen3.6 Max PreviewAlibaba Qwen | 76.7% | 149.3 | 1.03 US$ | 6.16 US$ | 256K |
| 9 | Kimi K2.6Moonshot AI | 76.7% | 151.0 | 0.65 US$ | 3.41 US$ | 256K |
| 10 | Claude Opus 4.5Anthropic | 76.7% | 150.1 | 5 US$ | 25 US$ | 200K |
لكل مليون رمز · USD
إجابات سريعة
- ما أفضل نموذج ذكاء اصطناعي للبرمجة؟
- يتصدر Claude Opus 4.7 من Anthropic هذا الترتيب (SWE-bench Verified: 83.5%). ويكلّف 5 US$ لكل مليون رمز مدخلات و25 US$ لكل مليون رمز مخرجات.
- هل يوجد بديل أرخص؟
- يكلّف DeepSeek V4 Pro 0813 من DeepSeek (SWE-bench Verified: 77.6%) مبلغ 0.66 US$ / 1.98 US$ لكل مليون رمز، أي أقل بنحو 10 مرة من Claude Opus 4.7.
كيف نرتّب
تأتي الدرجات من اختبارات تجريها Epoch AI بشكل مستقل (CC BY 4.0)، لا من إعلانات الشركات نفسها. وتأتي الأسعار من الواجهة البرمجية العامة لـ OpenRouter. ويُحدَّث الاثنان تلقائيًا عدة مرات يوميًا، لذا يواكب هذا الترتيب الإصدارات الجديدة وتغيّرات الأسعار.
تصنيفات أخرى
الرياضياتالعلومالأرخصمجانيةمفتوحة المصدرسياق طويلالصور وPDFالتصنيفات →