تخطَّ إلى المحتوى

اختبرنا ChatGPT وGemini وClaude بالعربية: من يفهم لغتنا فعلًا؟

وضعنا النماذج الثلاثة أمام مهام عربية يومية واحدة: إيميل رسمي، وتلخيص، وتصحيح لغوي. النتائج لم تكن متساوية أبدًا.

فريق الراصد 7 دقيقة قراءة 2 مشاهدة
الخلاصة

اختبرنا ChatGPT وGemini وClaude على ثلاث مهام عربية يومية بنفس البرومبت. Claude قدّم أكثر لغة طبيعية وأقرب إلى الكاتب العربي، وChatGPT جاء قويًا لكنه يميل إلى الإطناب والحشو، بينما تعثّر Gemini في نبرة الترجمة الحرفية رغم سرعته في التلخيص. التصحيح اللغوي كان الاختبار الأصعب على الثلاثة، وكشف أخطاء في الهمزات وعلامات الترقيم لدى الجميع.

أبرز النقاط

  • اختبار موحّد: نفس البرومبت الحرفي للنماذج الثلاثة في 3 مهام يومية
  • Claude كتب أكثر إيميل يشبه ما يكتبه موظف عربي حقيقي
  • ChatGPT قوي لغويًا لكنه أطنب وأضاف عبارات مجاملة لم نطلبها
  • Gemini الأسرع في التلخيص لكن صياغته تفضح أصلها الإنجليزي
  • التصحيح اللغوي أسقط الثلاثة في أخطاء الهمزات بدرجات متفاوتة

لماذا يهمّك

ملايين المستخدمين العرب يكتبون يوميًا عبر روبوت المحادثة: رسائل عمل، وتقارير، ومنشورات. لكن معظم المقارنات المنشورة بين النماذج تجري بالإنجليزية، ثم تُعمَّم نتائجها علينا كأن اللغة تفصيل ثانوي.

الفرق بين نموذج يكتب عربية طبيعية وآخر يكتب ترجمة مقنّعة قد يعني الفرق بين إيميل يحترمه عميلك وإيميل يفضح أنك لم تكتبه بنفسك. هذا الاختبار يوفّر عليك التجربة والخطأ.

3 مهام وبرومبت واحد وقواعد صارمة

صمّمنا الاختبار ليكون عادلًا قدر الإمكان. أعطينا النماذج الثلاثة نفس البرومبت (التعليمة النصية التي توجّه النموذج) حرفيًا، بلا أي تعديل، وفي محادثات جديدة تمامًا.

المهام الثلاث كانت:

  • إيميل رسمي: رسالة اعتذار لعميل عن تأخر تسليم مشروع أسبوعًا، مع اقتراح موعد جديد.
  • تلخيص: اختصار مقال عربي من نحو 900 كلمة إلى 5 نقاط رئيسية.
  • تصحيح لغوي: نص فيه 12 خطأ متعمّدًا في الهمزات والتاء المربوطة وعلامات الترقيم وتراكيب شائعة.

لم نستخدم أي تعليمات إضافية عن الأسلوب، لنرى السلوك الافتراضي لكل نموذج كما يراه المستخدم العادي.

الإيميل الرسمي: من يكتب مثل موظف عربي حقيقي؟

Claude قدّم أفضل نتيجة في تجربتنا. الرسالة جاءت مباشرة، بتحية مناسبة، واعتذار واضح بلا مبالغة، وموعد بديل محدد. النبرة تشبه ما يكتبه موظف عربي متمرّس فعلًا.

ChatGPT كتب رسالة صحيحة لغويًا لكنها أطول من اللازم. أضاف عبارات مجاملة متكررة مثل "نثمّن ثقتكم الغالية" و"حرصًا منا على أعلى معايير الجودة" رغم أننا لم نطلبها. القارئ العربي يشمّ رائحة الذكاء الاصطناعي في هذا الحشو فورًا.

Gemini جاءت رسالته الأقرب إلى الترجمة. بدأ بعبارة "نأمل أن تصلكم هذه الرسالة وأنتم بخير"، وهي نقل حرفي للافتتاحية الإنجليزية المعروفة. التركيب سليم نحويًا، لكن الأسلوب لا يشبه ما نكتبه نحن.

التلخيص: السرعة وحدها لا تكفي

هنا انقلبت الموازين جزئيًا. Gemini كان الأسرع، والتقط النقاط الخمس الرئيسية بدقة جيدة، لكنه صاغ بعضها بجمل مبنية للمجهول ثقيلة مثل "تم التأكيد على أهمية".

ChatGPT قدّم تلخيصًا دقيقًا ومرتبًا، لكنه أعاد صياغة نقطة واحدة بطريقة أضافت معنى لم يرد في النص الأصلي. هذه بذرة الهلوسة (اختلاق النموذج لمعلومات غير موجودة)، وهي أخطر ما في مهام التلخيص.

Claude التزم بالنص الأصلي بأمانة أعلى، ولم يضف شيئًا من عنده، لكنه أطال في نقطتين حتى صارتا فقرتين صغيرتين بدل نقطة خاطفة. اختصرناه ببرومبت ثانٍ فاستجاب جيدًا.

التصحيح اللغوي: الاختبار الذي أسقط الجميع

زرعنا في النص 12 خطأ: همزات وصل وقطع، وتاء مربوطة مكان الهاء، و"إنشاء الله" بدل "إن شاء الله"، وأخطاء ترقيم، وتركيب "قمنا بإرسال" الذي نطلب استبداله بالفعل المباشر.

النتائج في تجربتنا:

  • Claude: صحّح 10 أخطاء من 12، وفاته خطأ في همزة قطع وخطأ ترقيم. الأهم أنه شرح كل تصحيح بوضوح.
  • ChatGPT: صحّح 9 أخطاء، لكنه "صحّح" أيضًا جملتين سليمتين وغيّر أسلوبهما دون داعٍ، وهذا مزعج لمن يريد تصحيحًا لا إعادة كتابة.
  • Gemini: صحّح 8 أخطاء، وترك "إنشاء الله" كما هي، وهو خطأ شائع كان اكتشافه هو مربط الاختبار.

الخلاصة هنا واضحة: لا تعتمد على أي نموذج وحده في تدقيق نص سيُنشر باسمك.

نقاط ضعف لن تجدها في صفحات الإعلانات

بعد عشرات المحاولات الإضافية خارج الاختبار الأساسي، تكرّرت أنماط ضعف محددة لدى كل نموذج.

  • ChatGPT: الإطناب والمجاملات الزائدة، وميل إلى قالب واحد يتكرر في كل إيميل مهما غيّرت الطلب.
  • Gemini: أسلوب الترجمة الحرفية، وأحيانًا يُدخل كلمة إنجليزية وسط النص العربي بلا سبب.
  • Claude: الحذر الزائد، فيطيل الشرح والتحفظات حين تكفي إجابة قصيرة، ويحتاج برومبت واضحًا ليختصر.

القاسم المشترك: الثلاثة يتحسّنون كثيرًا مع هندسة البرومبت الجيدة. جملة واحدة مثل "اكتب بعربية طبيعية مباشرة بلا مجاملات زائدة" غيّرت جودة المخرجات بوضوح عند الجميع.

أيّها تختار؟ الجواب يعتمد على مهمتك

لا يوجد فائز مطلق، لكن توجد توصيات عملية بناءً على ما رأيناه:

  • للمراسلات الرسمية والكتابة الطبيعية: Claude، بفارق ملموس في نبرة اللغة.
  • للتلخيص السريع والمهام المتنوعة: Gemini أو ChatGPT، مع مراجعة الصياغة قبل الاستخدام.
  • للتصحيح اللغوي: Claude أولًا، لكن مع مراجعة بشرية إلزامية دائمًا.

وتذكّر أن هذه النماذج تتحدّث بإصدارات جديدة كل بضعة أشهر، وأداؤها العربي يتغير مع كل إصدار. ما رصدناه اليوم قد يختلف بعد نصف عام، لذلك أعد اختبار أداتك المفضلة دوريًا على مهامك أنت، لا على مهام غيرك.

الخلاصة

العربية لم تعد لغة منسية لدى النماذج اللغوية الكبيرة، لكنها ليست لغة أولى بعد. Claude تصدّر اختبارنا في طبيعية اللغة والتصحيح، وChatGPT قدّم قوة لغوية يفسدها الحشو، وGemini أسرع من أسلوبه.

النصيحة العملية: اختر النموذج حسب المهمة، واكتب برومبت واضحًا يحدد الأسلوب، ولا تنشر نصًا عربيًا ولّده الذكاء الاصطناعي قبل قراءته بعين بشرية. النماذج تكتب لك، لكن اسمك أنت على النص.

أسئلة شائعة

أي نموذج ذكاء اصطناعي هو الأفضل للكتابة بالعربية؟

في اختبارنا العملي على ثلاث مهام يومية، قدّم Claude أكثر لغة عربية طبيعية، خاصة في المراسلات الرسمية والتصحيح اللغوي. ChatGPT جاء قويًا لغويًا لكنه يميل إلى الإطناب وعبارات المجاملة الزائدة، وGemini كان سريعًا في التلخيص لكن أسلوبه أقرب إلى الترجمة الحرفية. لا يوجد فائز مطلق، والاختيار يعتمد على نوع مهمتك.

هل يمكن الاعتماد على ChatGPT أو Claude في تدقيق نص عربي قبل نشره؟

لا، ليس اعتمادًا كاملًا. في اختبارنا لنص فيه 12 خطأ متعمّدًا، لم يكتشف أي نموذج كل الأخطاء. Claude صحّح 10 أخطاء، وChatGPT صحّح 9 لكنه عدّل جملًا سليمة بلا داعٍ، وGemini صحّح 8 فقط. استخدم النموذج كمدقق أولي يلتقط معظم الأخطاء، ثم راجع النص بنفسك أو اعرضه على مدقق بشري قبل النشر.

لماذا تبدو نصوص الذكاء الاصطناعي العربية كأنها مترجمة عن الإنجليزية؟

لأن الجزء الأكبر من بيانات التدريب التي تعلّمت منها هذه النماذج مكتوب بالإنجليزية، فتنتقل أنماط الصياغة الإنجليزية إلى مخرجاتها العربية. تظهر المشكلة في عبارات مثل "نأمل أن تصلكم هذه الرسالة وأنتم بخير" وفي كثرة المبني للمجهول. يمكنك تقليل هذا الأثر ببرومبت يطلب صراحة عربية طبيعية مباشرة بلا أسلوب ترجمي.

كيف أكتب برومبت يحسّن جودة العربية في هذه النماذج؟

حدّد الأسلوب صراحة بدل الاكتفاء بوصف المهمة. أضف تعليمات مثل: اكتب بعربية فصحى مبسطة، بجمل قصيرة، بلا مجاملات زائدة، وتجنّب المبني للمجهول. في تجربتنا، جملة واحدة من هذا النوع حسّنت مخرجات النماذج الثلاثة بوضوح. ويفيد أيضًا إعطاء النموذج مثالًا لنص بالأسلوب الذي تريده ليحاكيه، وهو ما يُعرف بالتعلم بأمثلة قليلة.

ما معنى الهلوسة في تلخيص النصوص وكيف أكتشفها؟

الهلوسة هي اختلاق النموذج لمعلومات غير موجودة في النص الأصلي وتقديمها بثقة. في اختبارنا، أضاف أحد النماذج معنى لم يرد في المقال الذي طلبنا تلخيصه. لاكتشافها، قارن كل نقطة في الملخص بالنص الأصلي، خاصة الأرقام والأسماء والاستنتاجات. وإن كان الملخص سيُستخدم في عمل رسمي، فالمقارنة اليدوية ليست خيارًا بل ضرورة.

هل تتحسّن هذه النماذج في العربية مع الوقت؟

نعم، والتحسّن ملحوظ من إصدار إلى آخر، لكن بوتيرة أبطأ من الإنجليزية. الشركات تصدر نماذج جديدة كل بضعة أشهر، وكل إصدار قد يغيّر ترتيب الأداء العربي الذي رصدناه. لذلك ننصح بإعادة اختبار أداتك المفضلة دوريًا على مهامك الفعلية أنت، فنتائج اليوم ليست ضمانة لنتائج الغد.

النقاش (0)

اكتب تعليقك الآن، سنطلب منك إنشاء حساب عند النشر فقط.

لا توجد تعليقات بعد. كن أول من يشارك برأيه.

النشرة اليومية

كل ما يهمّك في الذكاء الاصطناعي، في 60 ثانية يوميًا

نرصد المئات من المصادر ونرسل لك الخلاصة فقط. بلا حشو، وبلا رسائل مزعجة.

اقرأ أيضًا