تخطَّ إلى المحتوى

من 1.8 سنت إلى دولارين: فجوة أسعار نماذج الذكاء الاصطناعي 2026

مقارنة لأسعار واجهات 18 نموذجًا لغويًا تُظهر أن المهمة نفسها قد تكلّف أكثر من 100 ضعف حسب النموذج الذي تختاره.

فريق الراصد، نقلًا عن r/ArtificialInteligence 7 دقيقة قراءة 2 مشاهدة
الخلاصة

مقارنة نشرها مطوّر لأسعار واجهات 18 نموذجًا لغويًا من OpenAI وAnthropic وGoogle وxAI وDeepSeek وMistral تُظهر أن مهمة واحدة بحجم 100 ألف توكن إدخال و20 ألف إخراج تكلّف 0.018 دولار على أرخص نموذج مقابل دولارين على أغلاه، أي أكثر من 100 ضعف. الأرخص ليس الأفضل دائمًا، والحل غالبًا توزيع المهام بين نماذج متعددة.

أبرز النقاط

  • المهمة نفسها تكلّف 0.018 دولار على Gemini 2.5 Flash-Lite ودولارين على Claude Fable 5.
  • الفارق بين الطرفين يتجاوز 100 ضعف داخل السوق نفسه وفي التوقيت نفسه.
  • سعر المخرجات هو ما يفجّر الفواتير عادة، لا سعر المدخلات.
  • توجيه المهام بين نماذج رخيصة ومتوسطة ومتقدمة أوفر من الاعتماد على مزوّد واحد.
  • المقارنة من إعداد مطوّر مستقل قارنها بصفحات التسعير الرسمية، وليست بيانًا من الشركات.

المهمة الواحدة التي كشفت الفارق

صاحب المقارنة اختار مهمة واحدة وشغّلها حسابيًا على كل النماذج: 100 ألف توكن إدخال و20 ألف توكن إخراج. التوكن هو وحدة النص التي تحاسبك عليها الشركة، وتساوي تقريبًا كلمة قصيرة أو جزءًا من كلمة.

اعتمد أسعار القائمة الرسمية للسياق القصير فقط. أي بلا خصومات المعالجة المجمّعة، ولا التخزين المؤقت، ولا حسومات استخدام الأدوات أو الأولوية في المعالجة.

المعادلة بسيطة ويمكنك تطبيقها على أي مشروع: (توكنات الإدخال ÷ مليون × سعر الإدخال) + (توكنات الإخراج ÷ مليون × سعر الإخراج).

الترتيب كاملًا: من 1.8 سنت إلى دولارين

هذه تكلفة المهمة الواحدة بالدولار على كل نموذج، حسب المقارنة:

الفارق بين طرفي القائمة يتجاوز 111 ضعفًا. ولاحظ أن القفزات ليست تدريجية: هناك عالم كامل بين المستوى الاقتصادي والمستوى المتقدم.

لماذا يهمّك

لأن اختيار النموذج قرار مالي قبل أن يكون قرارًا تقنيًا. لو نفّذ تطبيقك 10 آلاف مهمة بهذا الحجم شهريًا، فالفاتورة 180 دولارًا على الأرخص وحوالي 20 ألف دولار على الأغلى.

الفرق هنا ليس بندًا في جدول مصاريف، بل هو الفرق بين مشروع يعيش من اشتراكات مستخدميه ومشروع يحرق تمويله على واجهات برمجية.

والأخطر أن كثيرًا من الفرق تختار النموذج الأشهر افتراضيًا، ثم تكتشف حجم الفاتورة بعد أشهر من الإطلاق.

الفخ الحقيقي: توكنات الإخراج

معظم المزوّدين يسعّرون الإدخال والإخراج بأسعار مختلفة، والإخراج أغلى غالبًا. في مثال المقارنة، الإدخال خمسة أضعاف الإخراج حجمًا، ومع ذلك يظل سعر الإخراج هو ما يقلب الحسبة في التطبيقات الثرثارة.

إن كان منتجك يولّد ردودًا طويلة، مثل كتابة المقالات أو التقارير أو توليد الشيفرة، فراقب سعر الإخراج أولًا. نموذج بمدخلات رخيصة قد يصبح باهظًا لأنه يكتب كثيرًا.

والعكس صحيح: تطبيقات التوليد المعزّز بالاسترجاع تضخّ نصوصًا ضخمة في المدخلات وتخرج بإجابة قصيرة، فالمعادلة عندها تنقلب.

الأرخص ليس الأفضل، والأغلى ليس الأذكى بالضرورة

صاحب المقارنة نفسه يحذّر من قراءة الجدول كترتيب جودة. النماذج تختلف في قدرة الاستدلال، وأداء البرمجة، والتعامل مع السياق الطويل، والسرعة، والثبات، واستخدام الأدوات.

وقد رأينا في تجارب سابقة أن النموذج الأعلى سعرًا لا يفوز تلقائيًا في كل مهمة. المعيار العملي هو: ما أرخص نموذج ينجز مهمتك بجودة مقبولة؟

الطريقة الوحيدة للإجابة هي الاختبار على بياناتك أنت، لا على لوحات النتائج العامة.

توزيع المهام بدل الزواج من مزوّد واحد

الاقتراح الأكثر عملية في المقارنة هو توجيه المهام: تشغيل أكثر من نموذج داخل التطبيق نفسه، وإرسال كل مهمة إلى النموذج المناسب لها.

  • نماذج رخيصة للتصنيف، واستخراج البيانات، والترجمة، والتلخيص القصير.
  • نماذج متوسطة للوكلاء اليومية والتوليد المنظّم.
  • نماذج متقدمة للاستدلال المعقّد، والبرمجة، والمهام التي لا تحتمل الخطأ.

هذا التصميم يخفض الفاتورة كثيرًا، لكنه يضيف عبء صيانة: طبقة توجيه، ومعالجة أعطال، واختبارات جودة لكل مسار.

من أين جاءت هذه الأرقام؟

المقارنة ليست بيانًا رسميًا من الشركات. نشرها مطوّر يدير مدونة تقنية، وأفصح عن ذلك صراحة، وقال إنه راجع الأسعار على صفحات التسعير الرسمية للمزوّدين الستة.

ملخصه المنشور ضمّ 15 رقمًا، بينما أحال إلى الجدول الكامل للنماذج الثمانية عشر على موقعه. تعامل مع الأرقام كمؤشر ترتيبي، وتحقق من السعر الرسمي قبل أي قرار.

الأسعار متحركة أيضًا. رأينا خفوضات كبيرة خلال الفترة الماضية، وأي جدول اليوم قد يتغيّر خلال أسابيع.

بالنسبة للمنطقة العربية

هذه الفجوة السعرية تعني للفرق العربية أكثر مما تعني لشركة أمريكية ممولة. ميزانية استوديو صغير في عمّان أو تونس أو الرياض لا تحتمل فاتورة بآلاف الدولارات شهريًا على مهام يمكن أن يؤديها نموذج بسنتات.

هناك عامل إضافي يخصّنا: الترميز العربي. معظم أدوات تقطيع النص تحوّل الكلمة العربية إلى توكنات أكثر من نظيرتها الإنجليزية. النتيجة أن النص العربي نفسه يكلّف أكثر، وهو ما لا يظهر في أي جدول أسعار.

ماذا يعني هذا عمليًا؟

  • احسب تكلفتك على نص عربي حقيقي من منتجك، لا على تقديرات إنجليزية.
  • ابدأ بأرخص نموذج يعطي جودة مقبولة بالعربية، وارفع المستوى عند الحاجة فقط.
  • اختبر جودة اللهجات المحلية، لا الفصحى وحدها، قبل أن تحسم اختيارك.
  • راقب فاتورة الأسبوع الأول بعد الإطلاق، لا فاتورة نهاية الشهر.

نقطة أخيرة: الدفع بالبطاقات الدولية والاشتراكات بالدولار يظل عائقًا في عدة دول عربية. تحقق من إمكانية الدفع والفوترة قبل أن تبني بنيتك التقنية على مزوّد قد لا تستطيع دفع فاتورته أصلًا.

الخلاصة

الفارق بين أرخص نموذج وأغلاه في المقارنة يتجاوز 100 ضعف للمهمة نفسها. هذا رقم يكفي وحده لجعل اختيار النموذج بندًا في خطة عملك لا تفصيلًا هندسيًا.

الطريق العملي واضح: احسب تكلفة مهامك الفعلية بالمعادلة، راقب سعر الإخراج تحديدًا، ووزّع المهام على أكثر من نموذج بدل الاعتماد على واحد. الجودة تُشترى عند الحاجة، لا في كل طلب.

أسئلة شائعة

ما أرخص نموذج لغوي في هذه المقارنة؟

Gemini 2.5 Flash-Lite من غوغل، بتكلفة 0.018 دولار للمهمة المرجعية التي شملت 100 ألف توكن إدخال و20 ألف توكن إخراج. يليه مباشرة DeepSeek V4 Flash بـ 0.0196 دولار، ثم Mistral Small 4 بـ 0.027 دولار. هذه أسعار قائمة رسمية للسياق القصير بلا خصومات، وقد تتغير في أي وقت.

كيف أحسب تكلفة مشروعي بنفسي؟

استخدم المعادلة التالية: اقسم عدد توكنات الإدخال على مليون واضربها في سعر الإدخال، ثم اقسم توكنات الإخراج على مليون واضربها في سعر الإخراج، ثم اجمع الناتجين. اضرب الحصيلة في عدد الطلبات المتوقعة شهريًا. احسبها على نص عربي حقيقي من تطبيقك، لأن العربية تستهلك توكنات أكثر من الإنجليزية عادة.

هل النموذج الأغلى أفضل دائمًا؟

لا. السعر يعكس كلفة التشغيل وموقع النموذج في تسعير الشركة، لا الجودة في مهمتك تحديدًا. النماذج تتفاوت في الاستدلال والبرمجة والسياق الطويل والسرعة والثبات، وقد يتفوق نموذج متوسط على نموذج متقدم في مهمة بسيطة مثل التصنيف أو التلخيص. الحكم الوحيد الموثوق هو اختبارك على بياناتك.

ما المقصود بتوجيه المهام بين النماذج؟

أن يشغّل تطبيقك أكثر من نموذج ويرسل كل مهمة إلى الأنسب لها. النماذج الرخيصة للتصنيف والاستخراج والترجمة والتلخيص القصير، والمتوسطة للوكلاء اليومية والتوليد المنظّم، والمتقدمة للاستدلال المعقّد والبرمجة والمهام الحساسة. هذا يخفض الفاتورة كثيرًا، لكنه يتطلب طبقة توجيه ومعالجة أعطال واختبارات جودة لكل مسار.

لماذا يركّز الخبر على سعر المخرجات؟

لأن سعر توكن الإخراج أعلى من الإدخال لدى معظم المزوّدين. التطبيقات التي تولّد نصوصًا طويلة، مثل كتابة المحتوى أو التقارير أو الشيفرة، تدفع أكثر بكثير مما تتوقعه من قراءة سعر المدخلات وحده. نموذج بمدخلات رخيصة جدًا قد يصبح باهظًا إن كان يميل إلى الإسهاب في ردوده.

هل هذه الأرقام رسمية من الشركات؟

لا. نشرها مطوّر مستقل يدير مدونة تقنية، وأفصح عن ذلك، وقال إنه راجع الأسعار على صفحات التسعير الرسمية لستة مزوّدين هم OpenAI وAnthropic وGoogle وxAI وDeepSeek وMistral. تعامل معها كمؤشر على ترتيب الأسعار لا كمرجع نهائي، وتحقق من السعر الرسمي المحدّث قبل أي قرار تعاقدي.

ما الذي يجب أن يفعله فريق ناشئ عربي اليوم؟

أن يبدأ من المهمة لا من اسم النموذج. حدّد مهامك، جرّب أرخص نموذج يعطي جودة مقبولة بالعربية، وارفع المستوى فقط حيث تفشل الجودة. اختبر اللهجات المحلية لا الفصحى وحدها، وراقب الفاتورة في الأسبوع الأول بعد الإطلاق. تحقق أيضًا من إمكانية الدفع والفوترة في بلدك قبل بناء منتجك على مزوّد بعينه.

المصادر

مراجع إضافية

أعدّ فريق الراصد هذا التقرير بالعربية اعتمادًا على ما نشرته r/ArtificialInteligence، مع تحقّق مستقل وإضافة السياق العربي. الرابط الأصلي مذكور أعلاه.

النقاش (0)

اكتب تعليقك الآن، سنطلب منك إنشاء حساب عند النشر فقط.

لا توجد تعليقات بعد. كن أول من يشارك برأيه.

النشرة اليومية

كل ما يهمّك في الذكاء الاصطناعي، في 60 ثانية يوميًا

نرصد المئات من المصادر ونرسل لك الخلاصة فقط. بلا حشو، وبلا رسائل مزعجة.

اقرأ أيضًا