AI · 10 October 2026
وثائق قضائية غير محجوبة تكشف: مسؤول في مايكروسوفت وصف استخراج بيانات الذكاء الاصطناعي بـ'أكبر سرقة للعمل في تاريخ البشرية'
تكشف وثائق قضائية كُشف عنها حديثاً أن مايكروسوفت وصفت سراً ممارسات شركة OpenAI في جمع البيانات بأنها 'سرقة'، في حين كانت الشركتان تستخرجان محتوى صحيفة التايمز المحمي بجدار دفع، وتبنيان مجموعات بيانات منه، وتحذران داخلياً من أن ذلك سيقضي على الناشرين.
ما الذي حدث
كشفت وثائق قضائية غير محجوبة تم الإفراج عنها حديثاً عن مراسلات داخلية في Microsoft وصف فيها أحد المسؤولين التنفيذيين ممارسات جمع البيانات التي تعتمد عليها نماذج الذكاء الاصطناعي بأنها "أكبر عملية سرقة للعمل البشري في التاريخ". وتُظهر الوثائق، المرتبطة بدعوى قضائية مرفوعة من صحيفة The New York Times ضد Microsoft وOpenAI، أن كلتا الشركتين قامتا بجمع محتوى محمي بجدار دفع من الصحيفة واستخدامه لبناء مجموعات بيانات لتدريب نماذجها اللغوية.
بحسب ما نقلته TechCrunch وArs Technica، تضمنت المراسلات الداخلية تحذيرات من موظفين داخل Microsoft من أن هذه الممارسات قد تُلحق ضرراً جسيماً بالناشرين وبنموذج عملهم التجاري، حتى وهي تواصل جمع المحتوى ذاته واستخدامه داخلياً.
لماذا يهم الأمر
تسلّط هذه الوثائق الضوء على فجوة متنامية بين الخطاب العلني للشركات التقنية الكبرى حول الذكاء الاصطناعي المسؤول، وبين الممارسات الداخلية الفعلية المتعلقة بجمع البيانات وتدريب النماذج. بالنسبة لقادة التحول الرقمي والذكاء الاصطناعي، تُعيد القضية فتح النقاش حول مصدر البيانات التي تُبنى عليها النماذج التوليدية، ومدى شفافية الشركات تجاه الجهات التي تملك هذا المحتوى أصلاً.
كما تضع القضية الشركات التي تطوّر أو تتبنى أدوات الذكاء الاصطناعي التوليدي أمام مساءلة أكبر بشأن حوكمة البيانات، إذ لم يعد كافياً الاكتفاء بسياسات استخدام عامة، بل بات مطلوباً توثيق واضح لمصادر التدريب وآليات الموافقة عليها، خصوصاً مع تصاعد الدعاوى القضائية المشابهة عالمياً.
بالأرقام
- قضية واحدة رئيسية مرفوعة من صحيفة The New York Times ضد Microsoft وOpenAI تتعلق باستخدام محتواها دون إذن.
- وثائق غير محجوبة تم الإفراج عنها حديثاً تكشف مراسلات داخلية لم تكن معلنة سابقاً.
رأي Renascence
ما يغفله كثيرون في متابعة هذه القضية هو أن جوهرها ليس تقنياً بل سلوكياً: هو الفجوة بين ما تقوله المؤسسات عن قيمها وما تفعله فعلياً حين لا تُراقَب. وهذه الفجوة، إن انكشفت لاحقاً، تكلف الثقة أضعاف ما توفره السرعة في جمع البيانات.
حين تكتشف الجهات المالكة للمحتوى أو المستخدمون أن الممارسات الداخلية تناقض الخطاب العلني، لا تنهار الثقة تدريجياً بل دفعة واحدة. المؤسسات التي تبني أنظمة ذكاء اصطناعي يجب أن تُعامل الشفافية حول مصادر البيانات كمكوّن أساسي في تصميم الخدمة نفسها، لا كبند قانوني يُدار لاحقاً عند الحاجة. القرار الصحيح هنا ليس الدفاع القانوني فحسب، بل مراجعة صادقة لحوكمة البيانات قبل أن تفرضها المحاكم.
Sources
This briefing was written by our Newsdesk, synthesising reporting from the outlets below. Follow the links for the original coverage.
More in AI
Stay ahead of CX
Get the signal, not the noise.
The stories shaping customer experience — plus the Journal and Experience Loom — in your inbox.
