تخطَّ إلى المحتوى

Reddit يجلس على منجم بيانات ولم يبدأ تحصيل ثمنه بعد

حيلة صغيرة اخترعها المستخدمون، إضافة كلمة reddit إلى بحث غوغل، تحوّلت إلى عقود ترخيص بمئات الملايين ودعاوى قضائية ضد شركات ذكاء اصطناعي كبرى.

فريق الراصد 12 دقيقة قراءة 8 مشاهدة
الخلاصة

يبيع Reddit محتوى مستخدميه لغوغل مقابل 60 مليون دولار سنويًا ولـ OpenAI مقابل نحو 70 مليونًا وفق تقديرات صحفية. الرقم يبدو كبيرًا، لكنه جزء صغير من إيرادات الشركة، وأصغر من قيمة محتوى بشري صار الأكثر استشهادًا في نماذج المحادثة. الآن تفاوض على تسعير ديناميكي، وتقاضي من يكشط بياناتها بلا إذن.

أبرز النقاط

  • بحث غوغل المتضمّن كلمة reddit نما أكثر من 60% بين 2022 و2024 وفق بيانات عرضتها غوغل في مؤتمر I/O
  • صفقة غوغل معلنة بـ 60 مليون دولار سنويًا، وصفقة OpenAI تُقدَّر بنحو 70 مليونًا، وقد شكّلتا معًا نحو 10% من إيرادات 2024
  • نشرة الاكتتاب كشفت عقود ترخيص بقيمة تعاقدية إجمالية 203 ملايين دولار على مدد بين سنتين وثلاث
  • Reddit يقاضي Anthropic وPerplexity وشركات كشط بيانات، وPerplexity وصفت الدعوى بأنها ابتزاز
  • في يوليو 2026 هبط سهم الشركة بعد تقرير عن احتمال عدم تجديد عقد غوغل

الحيلة التي علّمها المستخدمون لغوغل

لم تبدأ القصة في غرفة اجتماعات، بل في عادة صغيرة عند ملايين المستخدمين. بدل كتابة "أفضل لابتوب 2024" في غوغل، صار الناس يكتبون "أفضل لابتوب 2024 reddit".

السبب بسيط: نتائج البحث العادية امتلأت بمقالات مكتوبة لإرضاء محرك البحث لا لإفادة القارئ. مراجعات مبالغة في المديح يكتبها مسوّقون بالعمولة، ومدونات شركات تهتم بالتصدّر أكثر من اهتمامها بذكر العيوب.

نقاشات Reddit كانت النقيض: غير منقّحة، شخصية، ومحددة. شخص جرّب المنتج فعلًا وكتب عنه بلغة إنسان لا بلغة إعلان.

الأرقام تؤكد اتساع الظاهرة. وفق بيانات عرضتها غوغل نفسها في مؤتمر I/O لعام 2024، نمت عمليات البحث المتضمّنة كلمة "reddit" بأكثر من 60% بين 2022 و2024. وبحسب Semrush، قفزت الزيارات الشهرية للمنصة من 132 مليونًا في أغسطس 2023 إلى ما قُدّر بـ 346 مليونًا في أبريل 2024.

وفي 6 مايو 2026 اعترفت غوغل بالسلوك رسميًا: نتائج بحثها المدعومة بالذكاء الاصطناعي صارت تعرض اقتباسات مباشرة من المنتديات ومنصات التواصل، ضمن تحديث لـ AI Overviews وAI Mode. بعبارة أخرى، بدل أن يضيف المستخدم كلمة reddit يدويًا، صار المحرك يجلبها له.

لماذا يهمّك

حين تسأل ChatGPT أو Google Gemini عن كاميرا أو دواء أو مشكلة في سيارتك، فجزء معتبر من جودة الإجابة يعود إلى نقاشات كتبها بشر مجانًا على Reddit.

هذا يعني أمرين. الأول أن جودة المساعد الذكي الذي تستخدمه ليست سحرًا خوارزميًا فقط، بل تعتمد على مصادر بشرية محددة قد تُغلق أو يُمنع الوصول إليها في أي لحظة.

الثاني أن قيمة "المحتوى البشري الأصلي" ترتفع بينما تغرق الشبكة في نصوص يولّدها الذكاء الاصطناعي التوليدي. من يملك أرشيفًا من كلام الناس الحقيقي صار يملك أصلًا قابلًا للبيع.

ما الذي يجعل نقاشًا عن غسالة أثمن من موسوعة؟

وفق شركة التحليلات Profound AI، صار Reddit المصدر الأكثر استشهادًا في نماذج الذكاء الاصطناعي، بثلاثة أضعاف ويكيبيديا. الموسوعة تعطيك تعريفًا، والمنتدى يعطيك تجربة.

المدير المالي للشركة لخّص السبب: ما يجعل بيانات Reddit ثمينة بشكل خاص هو حجمها وحداثتها ونيّتها التجارية، مع كون المنصة موطنًا لواحدة من أكبر مجموعات المحادثة البشرية على الإنترنت.

ثلاث كلمات مفتاحية هنا:

  • الحجم: عقدان من النقاشات في آلاف المجالات.
  • الحداثة: محتوى يتجدد كل دقيقة، وهذا ما تحتاجه النماذج لتبقى مواكبة.
  • نيّة الشراء: كثير من النقاشات يدور حول ماذا أشتري ولماذا، وهذه أثمن أنواع بيانات التدريب تجاريًا.

60 مليونًا من غوغل، و70 من OpenAI

في فبراير 2024، وفي اليوم نفسه الذي قدّمت فيه Reddit طلب الاكتتاب العام، أعلنت صفقة ترخيص محتوى مع غوغل بقيمة 60 مليون دولار سنويًا، تمنح غوغل وصولًا آنيًا إلى محتوى المنتديات.

بعدها بأشهر جاءت شراكة مماثلة مع OpenAI، قُدّرت قيمتها بنحو 70 مليون دولار سنويًا وفق تقارير صحفية. لم تؤكد الشركتان هذا الرقم رسميًا.

كشفت النتائج المالية أن الصفقتين شكّلتا معًا نحو 10% من إيرادات بلغت 1.3 مليار دولار، أي قرابة 130 مليون دولار. ووصفت المديرة التشغيلية جين وونغ الأمر بأنه جزء صغير من الإيرادات لكنه مهم لشركة بهذا الحجم.

وفي نشرة الاكتتاب، أفصحت الشركة عن ترتيبات ترخيص بيانات بقيمة تعاقدية إجمالية 203 ملايين دولار، بمدد تتراوح بين سنتين وثلاث سنوات.

لماذا 140 مليونًا رقم صغير لا كبير

في 2025 بلغ بند الإيرادات الأخرى، الذي يضم عقود الترخيص، نحو 140 مليون دولار مقابل إيرادات كلية تناهز 2.2 مليار. أي أن أثمن ما تملكه الشركة يأتي بأقل من عُشر دخلها.

للمقارنة، صفقة OpenAI مع News Corp لخمس سنوات تتجاوز قيمتها 250 مليون دولار وفق وول ستريت جورنال، وتبقى أكبر اتفاقية ترخيص محتوى معلنة حتى الآن.

الرئيس التنفيذي ستيف هوفمان يرى أن الظرف تغيّر كليًا. قال إن كل متغير تبدّل منذ توقيع تلك الصفقات الأولى: المجموعة النصية صارت أكبر وأكثر تميزًا وأكثر ضرورة، وهذا يضع الشركة في موقع استراتيجي قوي.

الأرقام كلها هنا معلنة أو تقديرات صحفية، ولا شيء في هذا المقال نصيحة استثمارية.

من سعر ثابت إلى عدّاد يدور

المشكلة في العقد الثابت أنه لا يعرف كم استُهلك فعلًا. تدفع الشركة مبلغًا سنويًا سواء استخدمت البيانات مرة أو مليار مرة.

لهذا تتفاوض Reddit مع غوغل وOpenAI على هيكل مختلف يقوم على التسعير الديناميكي: تكسب المنصة أكثر كلما ازدادت قيمة بياناتها في الأجوبة المولّدة. المنطق نفسه الذي بدأ ناشرون يطبقونه، إذ يُدفع لهم حين تجلب أنظمة الذكاء الاصطناعي محتواهم آنيًا.

الشركة تسعى أيضًا إلى تكامل أعمق مع منتجات غوغل الذكية، وتقترح شراكة تشجّع المستخدمين على أن يصبحوا مساهمين نشطين، بحيث تغذّي حركة البحث نمو المنصة، وتنتج بدورها محتوى للتدريب المستقبلي.

هنا تكمن العقدة: ملخصات غوغل الذكية تقلّص الزيارات القادمة من صفحة النتائج. الصفقة قد تأكل مصدر قيمتها إن أجاب المحرك بدل أن يحيل.

ثلاث دعاوى ورد فعل اسمه "ابتزاز"

الوجه الآخر للترخيص هو المقاضاة. من لا يدفع، تلاحقه المنصة أمام المحاكم.

ضد Anthropic: في يونيو 2025 رفعت Reddit دعوى تزعم أن الشركة كشطت الموقع أكثر من مئة ألف مرة حتى بعد إعلانها التوقف. الشكوى تتمحور حول خرق اتفاقية المستخدمين والإثراء غير المشروع والمنافسة غير العادلة، وكانت جلسة فيها مقررة في يناير 2026.

ضد Perplexity وشركاء الكشط: في 22 أكتوبر 2025 رفعت Reddit دعوى فيدرالية في المحكمة الجنوبية لنيويورك ضد Perplexity وثلاث شركات كشط بيانات هي SerpApi وOxylabs UAB وAWM Proxy. تزعم الدعوى أنها دبّرت مخططًا لسحب بيانات Reddit بشكل غير مباشر من نتائج غوغل، ثم إعادة بيعها أو استخدامها في التدريب، مع إخفاء الهويات لتجاوز القيود التقنية، وعلى نطاق وصفته بالصناعي. وتطالب بتعويضات وأمر قضائي دائم وحظر استخدام البيانات المكشوطة سابقًا، متهمة Perplexity ببناء شركة قيمتها 20 مليار دولار على بيانات مسروقة.

الرد: نفت Perplexity الاتهامات ووصفت الدعوى بأنها ابتزاز وهجوم على الوصول المفتوح للمعلومات. وكتبت على Reddit نفسه أن تخمينها هو أن الدعوى استعراض قوة في مفاوضات Reddit مع غوغل وOpenAI، مؤكدة أنها لا تدرّب نماذج أساسية. في المقابل ذكرت Reddit أنها أرسلت إنذارًا بالكف والامتناع العام الماضي، وأن الاستشهادات بها ارتفعت بعده أربعين ضعفًا.

يوليو 2026: السهم يهبط والعقد معلّق

في 22 يوليو 2026 هبط سهم Reddit بنسبة تراوحت بين 6% و9% وفق التقارير، بعد أنباء عن احتمال عدم تجديد عقد المحتوى مع غوغل.

القراءة الأولى أن الشركة تخسر مصدر دخل. القراءة الثانية، وهي الأرجح، أنها تفاوض من موقع أقوى. من يملك المصدر الأكثر استشهادًا في نماذج المحادثة لا يقبل بسعر 2024.

لكن المخاطرة حقيقية: قطع العلاقة مع غوغل يعني احتمال خسارة حركة بحث ضخمة، وهي شريان المنصة نفسه. لا نعرف حتى الآن كيف سينتهي التفاوض.

بالنسبة للمنطقة العربية

الدرس الأول عملي وفوري: الحيلة نفسها تعمل بالعربية. إضافة كلمة reddit إلى بحثك تعطيك تجارب بشر، لكن التغطية العربية على المنصة محدودة مقارنة بالإنجليزية، والنقاشات الجادة عن المنتجات والخدمات في المنطقة تعيش في أماكن أخرى.

وهنا المشكلة الأكبر. المحتوى المجتمعي العربي مشتّت بين مجموعات فيسبوك ومحادثات واتساب وX ومنتديات قديمة كثير منها أُغلق أو تدهور. هذه أماكن يصعب على النماذج الوصول إليها بشكل منظم، وبعضها مغلق تمامًا. النتيجة أن كمًا هائلًا من التجربة العربية الحقيقية لا يدخل في بيانات التدريب أصلًا.

ما يعنيه ذلك للمستخدم العربي مباشرة: حين تسأل نموذجًا عن مشكلة محلية، مثل تعامل مع جهة حكومية أو مراجعة منتج يُباع في السوق الخليجي أو المصري، تكون الإجابة أضعف وأكثر عرضة للهلوسة، لأن المصدر البشري الذي يعتمد عليه النموذج غير موجود بالكثافة نفسها.

والفرق الثاني أن Reddit يملك شركة ومحامين وقسمًا تجاريًا يحصّل ثمن المحتوى. المحتوى العربي المجتمعي لا يملك جهة تفاوض نيابة عنه. لا نعلم بأي صفقة ترخيص بيانات معلنة بين شركة ذكاء اصطناعي كبرى ومنصة محتوى عربية حتى تاريخه.

ماذا تفعل عمليًا:

  • إن كنت تدير منتدى أو مجتمعًا عربيًا: اعرف أن أرشيفك أصل له قيمة، وراجع شروط الاستخدام وملف robots قبل أن يُكشط مجانًا.
  • إن كنت صاحب متجر أو خدمة: النقاشات الصادقة عن منتجك في المجتمعات صارت تدخل في أجوبة المساعدات الذكية. السمعة في المجتمعات لم تعد شأنًا هامشيًا.
  • إن كنت تكتب محتوى: ما يميّزك عن آلة التوليد هو التجربة الشخصية المحددة، لا المقال العام المصقول.

الخلاصة

Reddit ليس شركة ذكاء اصطناعي، لكنه صار أحد أهم موارد تدريبه. حوّل عادة بحثية مجانية إلى عقود بمئات الملايين، ثم اكتشف أن السعر الذي قبله عام 2024 لم يعد يعكس قيمة ما يملك.

المرحلة القادمة عنوانها ثلاثة أشياء: تجديد العقود بشروط أفضل، والانتقال من السعر الثابت إلى التسعير الديناميكي، وملاحقة من يكشط بلا إذن أمام القضاء.

الاتجاه العام واضح: كلما امتلأت الشبكة بمحتوى مولَّد، ارتفع ثمن الكلام البشري الأصلي. السؤال العربي الذي لا جواب له بعد هو من يحصّل ثمن كلامنا نحن.

أسئلة شائعة

لماذا يضيف الناس كلمة reddit إلى بحثهم في غوغل؟

لأن نتائج البحث العادية امتلأت بمقالات مكتوبة لإرضاء محرك البحث، مثل مراجعات مسوّقي العمولة ومدونات الشركات التي تخفي العيوب. إضافة كلمة reddit تقود إلى نقاشات كتبها أشخاص جرّبوا المنتج فعلًا. وفق بيانات عرضتها غوغل في مؤتمر I/O لعام 2024، نمت عمليات البحث المتضمّنة هذه الكلمة بأكثر من 60% بين 2022 و2024.

كم تدفع غوغل وOpenAI لـ Reddit مقابل بياناته؟

صفقة غوغل معلنة بقيمة 60 مليون دولار سنويًا، أُعلن عنها في فبراير 2024 في يوم تقديم طلب الاكتتاب. صفقة OpenAI تُقدَّر بنحو 70 مليون دولار سنويًا وفق تقارير صحفية غير مؤكدة رسميًا. وقد شكّلت الصفقتان معًا نحو 10% من إيرادات بلغت 1.3 مليار دولار. ونشرة الاكتتاب كشفت عقود ترخيص بقيمة تعاقدية إجمالية 203 ملايين دولار.

لماذا يقاضي Reddit شركتي Anthropic وPerplexity؟

الاتهام هو كشط البيانات بلا إذن ولا دفع. في يونيو 2025 قاضى Reddit شركة Anthropic زاعمًا أنها دخلت الموقع أكثر من مئة ألف مرة بعد إعلانها التوقف. وفي أكتوبر 2025 قاضى Perplexity وثلاث شركات كشط، متهمًا إياها بسحب بياناته بشكل غير مباشر من نتائج غوغل. Perplexity نفت الاتهامات ووصفت الدعوى بأنها ابتزاز.

ما التسعير الديناميكي في صفقات بيانات الذكاء الاصطناعي؟

هو نموذج يربط ما يُدفع للناشر بحجم استخدام محتواه فعليًا، بدل مبلغ سنوي ثابت لا يتغير. Reddit يتفاوض مع غوغل وOpenAI على هيكل من هذا النوع، بحيث يزداد دخله كلما ازدادت قيمة بياناته في الأجوبة المولّدة. الفكرة نفسها بدأ ناشرون تطبيقها: يُدفع لهم حين تجلب أنظمة الذكاء الاصطناعي محتواهم آنيًا.

لماذا هبط سهم Reddit في يوليو 2026؟

هبط السهم بنسبة تراوحت بين 6% و9% وفق التقارير، بعد أنباء عن احتمال عدم تجديد عقد المحتوى مع غوغل. الخطر مزدوج: خسارة دخل الترخيص من جهة، واحتمال خسارة حركة بحث ضخمة من جهة أخرى. محللون رأوا في عدم التجديد خطوة إلى الوراء، بينما يراه آخرون تفاوضًا من موقع أقوى. لا نصيحة استثمارية هنا.

هل هذا الأمر يؤثر على جودة الإجابات العربية في روبوتات المحادثة؟

نعم بشكل غير مباشر. النماذج تعتمد بكثافة على نقاشات بشرية مثل التي في Reddit، والتغطية العربية هناك محدودة مقارنة بالإنجليزية. أما النقاشات العربية الحقيقية فتعيش في مجموعات فيسبوك وواتساب ومنتديات كثير منها أُغلق. النتيجة أن الأسئلة المحلية العربية تحصل على إجابات أضعف وأكثر عرضة للهلوسة، لأن المصدر البشري المنظّم غير متاح بالقدر نفسه.

هل يمكن لمنصة محتوى عربية أن تبيع بياناتها للنماذج؟

نظريًا نعم، لكن لا نعلم بأي صفقة ترخيص بيانات معلنة بين شركة ذكاء اصطناعي كبرى ومنصة محتوى عربية حتى الآن. الفارق أن Reddit يملك كيانًا تجاريًا وفريقًا قانونيًا يحصّل الثمن ويقاضي المخالفين، بينما المحتوى المجتمعي العربي مشتّت بلا جهة تفاوض نيابة عنه. أول خطوة عملية لأي مالك أرشيف عربي هي ضبط شروط الاستخدام وقواعد الوصول الآلي.

المصدر

  • فريق الراصد تحرير

مراجع إضافية

النقاش (0)

اكتب تعليقك الآن، سنطلب منك إنشاء حساب عند النشر فقط.

لا توجد تعليقات بعد. كن أول من يشارك برأيه.

النشرة اليومية

كل ما يهمّك في الذكاء الاصطناعي، في 60 ثانية يوميًا

نرصد المئات من المصادر ونرسل لك الخلاصة فقط. بلا حشو، وبلا رسائل مزعجة.

اقرأ أيضًا