أفضل نماذج الذكاء الاصطناعي للغة العربية
يستهلك النص العربي رموزًا أكثر من النص الإنجليزي، ويختلف الفارق من نموذج لآخر. قسنا ذلك بأنفسنا، ثم جمعناه مع درجات جودة مستقلة والأسعار الحالية لنبيّن أي النماذج تمنحك أفضل نتيجة مقابل ما تدفعه بالعربية.
تكلفة اللغة العربية حسب عائلة النماذج
| أداة التقطيعi | الرموز (الإنجليزية) | الرموز (العربية) | الزيادة مقارنة بالإنجليزية |
|---|---|---|---|
| Mistral (Nemo) | 220 | 277 | +26% |
| OpenAI (GPT-4o) | 219 | 295 | +35% |
| Google (Gemma 3) | 218 | 320 | +47% |
| Meta (Llama 4) | 219 | 347 | +58% |
| Alibaba (Qwen 3) | 219 | 360 | +64% |
| DeepSeek (V3.1) | 219 | 368 | +68% |
| Z.ai (GLM-4.5) | 219 | 409 | +87% |
لا تنشر Anthropic (Claude) وxAI (Grok) أدوات التقطيع الخاصة بهما، لذا لا يمكن قياسهما، ونستخدم لنماذجهما متوسط العائلات المقاسة (مع علامة ≈). ويُقدَّر Gemini باستخدام Gemma، أداة التقطيع المفتوحة من Google.
أقوى النماذج وتكلفتها الفعلية باللغة العربية
التصنيفات →| النموذج | المؤشر العامi | معامل العربية | المدخلاتi | 1,000 صفحة |
|---|---|---|---|---|
GPT-6 AstraOpenAI | 166.6 | ×1.35 | 10 US$ | 4.56 US$ |
Claude Fable 5.1Anthropic | 165.0 | ≈ ×1.55 | 10 US$ | 5.25 US$ |
Claude Fable 5Anthropic | 163.6 | ≈ ×1.55 | 10 US$ | 5.25 US$ |
Claude Opus 5Anthropic | 162.7 | ≈ ×1.55 | 5 US$ | 2.62 US$ |
GPT-5.5 ProOpenAI | 162.5 | ×1.35 | 30 US$ | 13.69 US$ |
GPT-5.6 SolOpenAI | 162.0 | ×1.35 | 2 US$ | 0.912 US$ |
GPT-5.6 TerraOpenAI | 159.3 | ×1.35 | 2 US$ | 0.912 US$ |
GPT-5.5OpenAI | 159.3 | ×1.35 | 5 US$ | 2.28 US$ |
GPT-5.4 ProOpenAI | 159.1 | ×1.35 | 30 US$ | 13.69 US$ |
Claude Opus 4.8Anthropic | 158.3 | ≈ ×1.55 | 5 US$ | 2.62 US$ |
Gemini 3.7 FlashGoogle DeepMind | 157.7 | ×1.47 | 0.75 US$ | 0.371 US$ |
Kimi K3Moonshot AI | 157.7 | ≈ ×1.55 | 3 US$ | 1.57 US$ |
Gemini 3.8 FlashGoogle DeepMind | 157.1 | ×1.47 | 0.75 US$ | 0.371 US$ |
Muse Spark 1.3Meta | 156.9 | ×1.58 | 1.25 US$ | 0.671 US$ |
GPT-5.4OpenAI | 156.9 | ×1.35 | 2.50 US$ | 1.14 US$ |
تكلفة قراءة 1,000 صفحة من النص (نحو 300,000 كلمة بالإنجليزية) مكتوبة باللغة العربية كمدخلات. يحصل كل نموذج على المعامل المقاس على أحدث أداة تقطيع عامة لشركته، لذا فهو تقدير، إذ قد تستخدم النماذج الأحدث أداة مختلفة. تشير ≈ إلى الشركات التي لا تنشر أداة تقطيع (متوسط العائلات المقاسة).
أفضل قيمة مقابل السعر باللغة العربية
نماذج قوية (مؤشر عام 140 أو أكثر) مرتبة من الأرخص إلى الأغلى في معالجة النص باللغة العربية.
- 0.01 US$ / 1,000 صفحة
- 0.017 US$ / 1,000 صفحة
- 0.036 US$ / 1,000 صفحة
- 0.038 US$ / 1,000 صفحة
- 0.045 US$ / 1,000 صفحة
- 0.084 US$ / 1,000 صفحة
- 0.09 US$ / 1,000 صفحة
- 0.091 US$ / 1,000 صفحة
نماذج صُممت للغة العربية
لا تتوفر النماذج المتخصصة دائمًا عبر الواجهات البرمجية الكبرى أعلاه، لكنها تستحق التجربة، خاصةً للهجات المحلية والمعرفة الثقافية.
- Jais ↗نماذج عربية إنجليزية من الإمارات، منشورة بأوزان مفتوحة.
- ALLaM ↗نماذج تركّز على العربية طوّرتها الهيئة السعودية للبيانات والذكاء الاصطناعي.
- Fanar ↗نماذج ومساعد يركّزان على العربية من قطر.
- Falcon Arabic ↗نسخ عربية من نماذج Falcon المفتوحة من معهد الابتكار التكنولوجي في أبوظبي.
- SILMA ↗نماذج عربية مفتوحة صغيرة مصممة للعمل بتكلفة منخفضة.
تصنيفات مستقلة للغة العربية
تختبر هذه المشاريع النماذج مباشرةً باللغة العربية. استخدمها إلى جانب الدرجات العامة أعلاه.
- Open Arabic LLM Leaderboard (OALL) ↗يقيّم النماذج المفتوحة في اختبارات المعرفة والاستدلال بالعربية.
- HELM Arabic ↗تقييم شفاف وقابل لإعادة الإنتاج للنماذج المفتوحة والتجارية بالعربية.
- Arabic Broad Leaderboard ↗اختبار عربي واسع يغطي أنواعًا كثيرة من المهام، مع قياسات للسرعة.
نصائح لاستخدام الذكاء الاصطناعي باللغة العربية
- اختبر النموذج بلهجتك. معظم النماذج أقوى في العربية الفصحى الحديثة، أما النتائج باللهجات المصرية أو الخليجية أو الشامية أو المغاربية فتتفاوت كثيرًا من نموذج لآخر.
- اطلب العربية صراحةً. أضف عبارة «أجب بالعربية» إلى تعليماتك، خاصةً إذا تضمن سؤالك مصطلحات إنجليزية، وإلا فقد يغيّر بعض النماذج اللغة.
- تحقق من العرض من اليمين إلى اليسار. قد يظهر النص الذي يخلط العربية بالحروف اللاتينية (أسماء المنتجات، الشيفرة، الأرقام) بترتيب خاطئ إذا لم يتعامل تطبيقك مع الاتجاه بشكل صحيح.
- خصص ميزانية لرموز إضافية. بحسب النموذج، يكلّف المحتوى نفسه بالعربية أكثر من الإنجليزية بنسبة تتراوح بين 26% و87%، فاستخدم الجدول أعلاه أو عدّاد الرموز للتقدير.
- راجع الأسماء والأرقام والتشكيل. قد يكون النص العربي المولَّد سلسًا لكنه يخطئ في أسماء الأعلام أو التواريخ أو علامات التشكيل، فراجع أي محتوى قبل نشره.
كيف قسنا
كتبنا النصوص الأربعة نفسها (خبر، ورسالة لعميل، وشرح تقني، ونصائح سفر) بـ 15 لغة، ثم عددنا الرموز التي تنتجها كل أداة تقطيع متاحة للعموم. تأتي درجات الجودة من Epoch AI وتُقاس غالبًا بالإنجليزية، لذا اختبر دائمًا النماذج المرشحة على محتواك الخاص باللغة العربية.