لا تحتسب نماذج الذكاء الاصطناعي السعر بالكلمة، بل بـالرمز (token)، وهو قطعة من النص كثيرًا ما تساوي كلمة كاملة في الإنجليزية، لكنها لا تساوي سوى جزء من كلمة في لغات كثيرة أخرى. والنتيجة زيادة خفية في التكلفة: اطرح السؤال نفسه باللغة الهندية أو العربية أو التركية، وستدفع مقابل رموز أكثر مما في الإنجليزية، للمعنى نفسه تمامًا.
ما حجم هذه الزيادة؟ وهل يمكن تجنّبها؟ قمنا بقياسها.
طريقة القياس
كتبنا النصوص الأربعة نفسها (خبرًا، ورسالة إلى عميل، وشرحًا تقنيًا، ونصائح سفر) بـ15 لغة، مترجمة لتقول الشيء نفسه تمامًا. ثم عددنا الرموز التي تحتاجها كل نسخة باستخدام أدوات التقطيع المتاحة للعموم لـ7 عائلات من النماذج: GPT وGemma وLlama وDeepSeek وMistral وQwen وGLM. لا تنشر Anthropic (Claude) ولا xAI (Grok) أدوات التقطيع الخاصة بها، لذا تعذّر قياسها. نعيد القياس كل شهر، والأرقام أدناه بتاريخ 25 سبتمبر 2026.
النتائج
بمتوسط أدوات التقطيع الـ7، تأتي الهندية في صدارة اللغات الأعلى تكلفة في قياسنا: يحتاج النص نفسه فيها إلى رموز أكثر بنسبة 177% مقارنة بالإنجليزية. وتحتاج العربية إلى رموز أكثر بنسبة 55%، بينما تتقارب اللغات الأوروبية الكبرى (الفرنسية والإسبانية والبرتغالية والألمانية والإيطالية) عند زيادة بنحو 34%.
تشكّل الصينية استثناءً: فهي تحتاج في المتوسط إلى عدد رموز يقارب الإنجليزية، وأقل منها مع DeepSeek (−16%). فالرمز الواحد قد يمثّل كلمة كاملة، وأدوات التقطيع المدرَّبة على كثير من النصوص بها تحتفظ بالرموز الشائعة كاملة.
| اللغة | المتوسط | العائلة الأكفأ | الأقل كفاءة |
|---|---|---|---|
| الهندية | +177% | Gemma +30% | GLM +413% |
| العربية | +55% | Mistral +26% | GLM +87% |
| التركية | +54% | Gemma +30% | DeepSeek +103% |
| الفيتنامية | +54% | Llama +34% | DeepSeek +124% |
| الكورية | +48% | Llama +20% | GLM +89% |
| الإيطالية | +48% | Llama +28% | Qwen +69% |
| اليابانية | +47% | Gemma +17% | Mistral +70% |
| الإندونيسية | +42% | Gemma +18% | Qwen +66% |
| الفرنسية | +35% | GPT +25% | DeepSeek +49% |
| الروسية | +31% | Llama +6% | Qwen +60% |
| الألمانية | +30% | GPT +17% | DeepSeek +50% |
| البرتغالية | +30% | GPT +15% | DeepSeek +47% |
| الإسبانية | +27% | GPT +17% | DeepSeek +45% |
| الصينية | +0% | DeepSeek −16% | Mistral +40% |
عائلة النموذج لا تقلّ أهمية عن اللغة
تُخفي المتوسطات فارقًا أكبر بكثير. ففي الهندية، تحتاج أداة التقطيع الأكفأ (Gemma) إلى رموز أكثر بنسبة 30% مقارنة بالإنجليزية، مقابل 413% للأقل كفاءة (GLM)، أي 3.9× للنص نفسه. وفي العربية يتراوح الفارق بين +26% مع Mistral و+87% مع GLM.
لا توجد عائلة تتفوق في كل اللغات: GPT هي الأكفأ في 4 من 14 لغة وGemma في 4 وLlama في 4 وDeepSeek في 1 وMistral في 1. عمليًا، قد يؤدي نموذجان بالسعر نفسه لكل رمز إلى فاتورتين مختلفتين جدًا حين يكتب مستخدموك بلغتهم.
لماذا يحدث ذلك؟
تبني أداة التقطيع مفرداتها من عينة كبيرة من النصوص. وحين تكون العينة إنجليزية في معظمها، تحصل الكلمات الإنجليزية الشائعة على رمز خاص بها، بينما تُقطَّع كلمات اللغات الأخرى إلى عدة أجزاء. وتزيد الكتابات غير اللاتينية الأمر سوءًا: فالكلمة المكتوبة بالخط الديفاناغاري (الهندية) أو بالحروف العربية قد تُقسَّم إلى أجزاء صغيرة كثيرة. وللقواعد دور أيضًا: فالعربية والتركية تُلصقان السوابق واللواحق بالكلمات، ما يولّد صيغًا كثيرة نادرًا ما تراها أداة التقطيع كاملة. أما الحروف الصينية فتعمل بطريقة مختلفة: فالحرف الواحد قد يمثّل كلمة كاملة، وأدوات التقطيع المدرَّبة على كثير من النصوص الصينية تحتفظ بالشائع منها كاملًا.
ماذا يعني ذلك لفاتورتك؟
لنأخذ خدمة تدفع 1,000 US$ شهريًا بالإنجليزية. للحجم نفسه باللغة الهندية، ستدفع نحو 2,774 US$ بأداة تقطيع متوسطة، وما بين 1,303 US$ و5,128 US$ حسب عائلة النموذج. وتنطبق الزيادة على ما يقرؤه النموذج وما يكتبه على حد سواء.
كيف تدفع أقل؟
- افتح أداة أفضل ذكاء اصطناعي للغتك: تعرض التكلفة المقاسة لكل عائلة بلغتك، وأفضل النماذج لها.
- قِس نصوصك الخاصة باستخدام عدّاد الرموز: فالفارق يتوقف على مفرداتك وموضوعك.
- فكّر في كتابة التعليمات (موجّه النظام) بالإنجليزية حتى لو كتب مستخدموك بلغة أخرى، لأنها تُرسل مع كل طلب. وتأكد من أن الإجابات تبقى جيدة بلغتك.
- خزّن مؤقتًا التعليمات الطويلة المتكررة: فالمدخلات المخزنة مؤقتًا تكلّف جزءًا صغيرًا من السعر العادي.
- قارن التكاليف الإجمالية لا أسعار الرمز: تحسب حاسبة التكلفة أحجامك الحقيقية لكل نموذج.
أربعة نصوص عيّنة صغيرة، وتختلف النتائج باختلاف نوع النص. الطريقة الكاملة مشروحة في صفحة طريقة عملنا.
تُعاد حسابات أرقام هذا المقال من بياناتنا مع كل تحديث (آخر تحديث: 25 سبتمبر 2026). كيف نعمل