AI · 3 October 2026
مسؤول تنفيذي في مايكروسوفت وصف استخراج بيانات الذكاء الاصطناعي بأنه "أكبر سرقة عمل في تاريخ الإنسانية"، وثائق قضائية جديدة غير محجوبة تكشف ذلك
تكشف وثائق قضائية مرفوعة عنها السرية حديثاً أن مايكروسوفت وصفت سراً ممارسات OpenAI في جمع البيانات بأنها "سرقة"، في حين قامت كلتا الشركتين باستخراج محتوى صحيفة التايمز المحجوب خلف جدار الدفع، وبناء قواعد بيانات منه، وحذّرتا داخلياً من أن ذلك سيقوّض دور الناشرين.
ما حدث
كشفت مستندات قضائية جديدة غير محجوبة عن أن مسؤولاً تنفيذياً في Microsoft وصف داخلياً عمليات استخراج البيانات (Scraping) التي قامت بها OpenAI لتدريب نماذج الذكاء الاصطناعي بأنها "أكبر سرقة للعمل في تاريخ البشرية". وتُظهر الوثائق، التي خرجت إلى العلن في إطار قضية قانونية جارية، أن Microsoft و OpenAI قامتا باستخراج محتوى صحيفة The New York Times المحمي بجدار دفع (Paywall) واستخدامه في بناء مجموعات بيانات لتدريب أنظمة الذكاء الاصطناعي.
وتشير الرسائل والمراسلات الداخلية المسربة إلى أن مسؤولين في الشركتين كانوا على علم بأن هذه الممارسات قد تتسبب في أضرار جسيمة لناشري المحتوى، وأن هناك تحذيرات داخلية من أن استمرار هذا النهج قد "يُفرغ" الصحافة المدفوعة من قيمتها الاقتصادية.
تأتي هذه الكشوفات في سياق دعوى قضائية أوسع تخص حقوق النشر والاستخدام غير المصرح به لمحتوى إعلامي في تدريب نماذج الذكاء الاصطناعي التوليدي.
لماذا يهم الأمر
تسلط هذه الوثائق الضوء على فجوة متنامية بين الخطاب العلني لشركات الذكاء الاصطناعي الكبرى حول الاستخدام "المسؤول" للبيانات، وبين ما كان يُناقَش داخلياً حول المخاطر القانونية والأخلاقية لهذه الممارسات. بالنسبة لقادة التحول الرقمي والذكاء الاصطناعي في المؤسسات، تمثل القضية تذكيراً بأن مصادر البيانات المستخدمة في تدريب النماذج يمكن أن تصبح نقطة ضعف قانونية وسمعة لا يمكن تجاهلها عند تبني أو شراء حلول ذكاء اصطناعي من طرف ثالث.
كما تطرح القضية أسئلة أوسع حول حوكمة البيانات، وشفافية مصادر التدريب، ومسؤولية الشركات التي تبني منتجاتها على محتوى مملوك لجهات أخرى دون تعويض واضح — وهي قضايا ستتردد أصداؤها في الأطر التنظيمية المستقبلية للذكاء الاصطناعي في مختلف الأسواق.
الرأي التحليلي لـRenascence
ما يغيب عن كثير من التغطية هو أن هذه القضية ليست فقط عن حقوق النشر، بل عن الثقة كعنصر تصميمي في كل منتج يعتمد على الذكاء الاصطناعي.
حين تُبنى منتجات الذكاء الاصطناعي على بيانات مصدرها غير شفاف أو محل نزاع، فإن المستخدم النهائي هو من يتحمل تكلفة هذا الغموض لاحقاً — عبر فقدان الثقة أو التشكيك في مصداقية النتائج. المؤسسات التي تتعامل مع أدوات الذكاء الاصطناعي ينبغي أن تتعامل مع "أصل البيانات" كمعيار جودة أساسي، لا كتفصيل قانوني هامشي. السؤال الحقيقي ليس "هل النموذج دقيق؟" بل "هل يمكنني أن أثق في الطريقة التي تعلّم بها؟" — وهذا سؤال تصميم خدمة بقدر ما هو سؤال قانوني.
Sources
This briefing was written by our Newsdesk, synthesising reporting from the outlets below. Follow the links for the original coverage.
More in AI
Stay ahead of CX
Get the signal, not the noise.
The stories shaping customer experience — plus the Journal and Experience Loom — in your inbox.
