تكلفة التوكن
Token Cost
يُسمّى أيضًا: سعر التوكن، تكلفة الرموز، تسعير التوكنات
المبلغ الذي تدفعه مقابل كل جزء صغير من النص يقرؤه نموذج الذكاء الاصطناعي أو يكتبه لك.
تكلفة التوكن هي طريقة التسعير الأساسية في خدمات الذكاء الاصطناعي التوليدي. الشركات مثل "OpenAI" و"Anthropic" لا تحاسبك بالساعة ولا بعدد الأسئلة، بل بعدد التوكنات (وهي القطع الصغيرة التي يقسّم النموذج النص إليها، وقد تكون كلمة كاملة أو جزءًا من كلمة). كل توكن يدخل إلى النموذج أو يخرج منه له سعر محدد، يُحسب عادة لكل مليون توكن.
التسعير يفرّق بين نوعين من التوكنات:
- توكنات الإدخال: كل ما ترسله أنت للنموذج، من سؤالك إلى المستندات المرفقة والتعليمات. سعرها أرخص عادة.
- توكنات الإخراج: كل ما يكتبه النموذج ردًا عليك. سعرها أعلى، أحيانًا 3 إلى 5 أضعاف سعر الإدخال، لأن توليد النص يستهلك حوسبة أكبر.
في اللغة العربية تحديدًا، توجد مشكلة عملية: معظم النماذج تقسّم النص العربي إلى توكنات أكثر مقارنة بالنص الإنجليزي الذي يحمل المعنى نفسه. فالجملة العربية قد تستهلك ضعف عدد التوكنات، ما يعني تكلفة أعلى على المحتوى العربي في بعض النماذج. النماذج الأحدث حسّنت هذه النقطة، لكنها تبقى عاملًا يستحق الانتباه.
تظهر هذه التكلفة في حياتك بطريقتين: إذا كنت مستخدمًا عاديًا لتطبيق مثل ChatGPT، فأنت تدفع اشتراكًا شهريًا ثابتًا والشركة تتحمل التكلفة عنك. أما إذا كنت مطورًا أو صاحب مشروع يستخدم واجهة برمجة التطبيقات (طريقة ربط برنامجك بالنموذج مباشرة)، فستدفع فعليًا عن كل توكن، وهنا يصبح فهم هذا المصطلح مسألة مال حقيقي.
✓ استخدام صحيح
صاحب متجر إلكتروني سعودي بنى روبوت محادثة للرد على العملاء عبر واجهة Claude البرمجية. لاحظ أن الفاتورة ارتفعت، فاختصر التعليمات الثابتة التي تُرسل مع كل رسالة من 2000 توكن إلى 500، فانخفضت التكلفة الشهرية بشكل ملموس.
لماذا: هذا فهم صحيح: التعليمات الثابتة تُرسل مع كل محادثة وتُحسب كتوكنات إدخال في كل مرة، لذا اختصارها يوفّر مالًا حقيقيًا دون التأثير على الجودة.
طالبة جامعية تلخّص أبحاثًا طويلة. بدل إرسال البحث كاملًا (50 صفحة) في كل سؤال، أرسلته مرة واحدة وطرحت أسئلتها المتتابعة في نفس المحادثة، ثم بدأت محادثة جديدة عند الانتقال لبحث آخر.
لماذا: استخدام ذكي: إبقاء المحادثة الطويلة مفتوحة بلا داعٍ يعني إعادة معالجة كل التوكنات السابقة مع كل رسالة جديدة، وبدء محادثة جديدة عند تغيّر الموضوع يقلل الاستهلاك.
✕ خطأ شائع
مطوّر تطبيقات ظن أن التوكن يساوي كلمة واحدة دائمًا، فقدّر ميزانية مشروعه بحساب عدد الكلمات المتوقعة فقط، ففوجئ بفاتورة أعلى بكثير من توقعاته.
الصواب: التوكن لا يساوي كلمة. الكلمة العربية الواحدة قد تنقسم إلى 2 أو 3 توكنات في بعض النماذج. الصواب: استخدام أدوات حساب التوكنات التي توفرها الشركات لتقدير التكلفة الفعلية قبل إطلاق المشروع.
صاحب عيادة اعتقد أن اشتراكه الشهري في ChatGPT بقيمة 20 دولارًا يعني أن استخدام واجهة OpenAI البرمجية في نظام حجوزات العيادة مجاني أيضًا.
الصواب: الاشتراك في التطبيق منفصل تمامًا عن الاستخدام البرمجي. واجهة برمجة التطبيقات تُحاسب بتكلفة التوكن على كل طلب، ولها فاتورة مستقلة. الصواب: فتح حساب مطوّر منفصل ومراقبة الاستهلاك من لوحة التحكم.
كيف تميّزه بسرعة
الخلط الأكثر شيوعًا هو الظن بأن التوكن يساوي كلمة، وأن تكلفة الإدخال والإخراج واحدة. الحقيقة أن الكلمة العربية قد تتحول إلى عدة توكنات، وأن توكنات الإخراج (ما يكتبه النموذج) أغلى من توكنات الإدخال (ما ترسله أنت) بأضعاف. تجنّب هذا الخطأ باستخدام حاسبات التوكنات الرسمية قبل تقدير أي ميزانية، وبمراجعة صفحة التسعير التي تفصل بين سعر الإدخال والإخراج.
لماذا يهمّك؟
أي شخص يفكر في بناء خدمة تعتمد على الذكاء الاصطناعي، من روبوت خدمة عملاء إلى أداة تلخيص، سيدفع فعليًا حسب تكلفة التوكن، وفهمها يحدد جدوى مشروعه من عدمها. المحتوى العربي يستهلك توكنات أكثر من الإنجليزي في كثير من النماذج، ما يجعل هذا المصطلح أكثر أهمية للقارئ العربي تحديدًا. حتى المستخدم العادي يستفيد من فهمه، لأنه يفسّر حدود الاستخدام في الخطط المجانية والمدفوعة.
أدوات تستخدم هذا المفهوم
مصطلحات ذات صلة
كل ما يهمّك في الذكاء الاصطناعي، في 60 ثانية يوميًا
نرصد المئات من المصادر ونرسل لك الخلاصة فقط. بلا حشو، وبلا رسائل مزعجة.