أفضل نماذج الذكاء الاصطناعي للبرمجة

الترتيب حسب SWE-bench Verified: نسبة الأخطاء الحقيقية من مشاريع مفتوحة المصدر حقيقية التي يصلحها كل نموذج بمفرده. اختبرتها Epoch AI بشكل مستقل، مع أسعار الواجهات البرمجية الحالية.

حُدّث في 30 سبتمبر 2026

اختياراتنا

#النموذجSWE-bench Verifiediالمؤشر العامiالمدخلاتiالمخرجاتiالسياقi
1
83.5%
156.4‏5 US$‏25 US$1M
2
Gemini 3.5 FlashGoogle DeepMind
79.3%
154.6‏1.50 US$‏9 US$1M
3
GLM 5.2Z.ai (Zhipu)
78.7%
151.8‏0.14 US$‏3.99 US$1M
4
78.7%
155.4‏5 US$‏25 US$1M
5
77.6%
155.4‏0.66 US$‏1.98 US$1M
6
Qwen3.7 MaxAlibaba Qwen
77.3%
153.7‏1.48 US$‏4.43 US$1M
7
GPT-5.4OpenAI
76.9%
156.9‏2.50 US$‏15 US$1.1M
8
76.7%
149.3‏1.03 US$‏6.16 US$256K
9
Kimi K2.6Moonshot AI
76.7%
151.0‏0.65 US$‏3.41 US$256K
10
76.7%
150.1‏5 US$‏25 US$200K

لكل مليون رمز · USD

إجابات سريعة

ما أفضل نموذج ذكاء اصطناعي للبرمجة؟
يتصدر Claude Opus 4.7 من Anthropic هذا الترتيب (SWE-bench Verified: 83.5%). ويكلّف ‏5 US$ لكل مليون رمز مدخلات و‏25 US$ لكل مليون رمز مخرجات.
هل يوجد بديل أرخص؟
يكلّف DeepSeek V4 Pro 0813 من DeepSeek (SWE-bench Verified: 77.6%) مبلغ ‏0.66 US$ / ‏1.98 US$ لكل مليون رمز، أي أقل بنحو 10 مرة من Claude Opus 4.7.

كيف نرتّب

تأتي الدرجات من اختبارات تجريها Epoch AI بشكل مستقل (CC BY 4.0)، لا من إعلانات الشركات نفسها. وتأتي الأسعار من الواجهة البرمجية العامة لـ OpenRouter. ويُحدَّث الاثنان تلقائيًا عدة مرات يوميًا، لذا يواكب هذا الترتيب الإصدارات الجديدة وتغيّرات الأسعار.

تصنيفات أخرى

الرياضياتالعلومالأرخصمجانيةمفتوحة المصدرسياق طويلالصور وPDFالتصنيفات →