الاثنين، 3 أغسطس 2026

الذكاء الاصطناعي

OpenAI تطلب من المتعاقدين تحميل عينات عمل حقيقية، بحسب ما ورد

تطلب شركتا OpenAI وHandshake AI من المتعاقدين تحميل عينات من أعمال حقيقية لتدريب نماذج الذكاء الاصطناعي، بحسب ما ورد، مما يثير مخاوف كبيرة تتعلق بالملكية الفكرية والسرية.

OpenAI reportedly asks contractors to upload real work samples

أدى السعي للحصول على بيانات تدريب عالية الجودة بشركات الذكاء الاصطناعي إلى البحث عن مدخلات واقعية أكثر تحديداً. وتطلب شركة OpenAI وشركة بيانات التدريب Handshake AI من المتعاقدين الخارجيين تحميل أعمال حقيقية قاموا بها في وظائفهم السابقة والحالية، بحسب ما ورد. ووفقاً لتقرير نشرته Wired، يبدو أن هذه الممارسة جزء من استراتيجية أوسع تتبعها شركات الذكاء الاصطناعي التي توظف متعاقدين لإنشاء بيانات تدريب عالية الجودة، على أمل أن يسمح ذلك لنماذجها في نهاية المطاف بأتمتة المزيد من الأعمال المكتبية.

وفي حالة OpenAI، يطلب عرض تقديمي داخلي للشركة من المتعاقدين وصف المهام التي قاموا بها في وظائف أخرى وتحميل أمثلة على أعمال حقيقية أنجزوها بالفعل في العمل، بحسب ما ورد. ويحدد العرض التقديمي أن هذه الأمثلة يجب أن تتضمن مخرجات ملموسة بدلاً من ملخصات للملفات، حيث يطلب الملفات الفعلية مثل مستندات Word، وملفات PDF، وعروض PowerPoint التقديمية، وجداول بيانات Excel، والصور، أو مستودعات الأكواد البرمجية. ولمعالجة مخاوف الخصوصية، توجّه OpenAI المتعاقدين بحذف المعلومات السرية والمعلومات التي تحدد الهوية الشخصية قبل التحميل، بحسب ما ورد. وتوجه الشركة المتعاقدين لاستخدام أداة في ChatGPT تسمى “Superstar Scrubbing”، والمصممة لإزالة المعلومات التي تحدد الهوية الشخصية (PII) من البيانات قبل تقديمها.

ومع ذلك، فإن طريقة جمع البيانات هذه تفتح الباب أمام ثغرات قانونية خطيرة. فقد صرّح محامي الملكية الفكرية Evan Brown لموقع Wired بأن أي مختبر ذكاء اصطناعي يتبع هذا النهج “يعرّض نفسه لخطر كبير”. وأشار Brown إلى أن هذه الاستراتيجية تتطلب قدراً كبيراً من الثقة في المتعاقدين ليقرروا ما هو سري وما هو غير ذلك. ومن خلال الاعتماد على المتعاقدين الأفراد لتصفية البيانات المملوكة للشركات، قد تقوم شركات الذكاء الاصطناعي عن غير قصد بدمج ملكية فكرية محمية للشركات، مما يعرّضها لدعاوى قضائية محتملة. وقد رفض متحدث باسم OpenAI التعليق على التقرير.

لماذا يهم

تسلط هذه الممارسة الضوء على المساعي الحثيثة التي تبذلها شركات الذكاء الاصطناعي لتأمين بيانات تدريب عالية الجودة، بينما تعرّضها في الوقت ذاته لمسؤوليات قانونية ومخاطر تتعلق بالسرية والملكية الفكرية.