گزارش اخیر وبسایت 404 Media زنگ خطری جدی را برای کاربران هوش مصنوعی مایکروسافت به صدا درآورده است. طبق اسناد منتشر شده، تصاویر بارگذاری شده توسط کاربران در ابزار ویرایش تصویر Copilot، بدون هیچگونه پوشش یا سانسور (Uncensored) برای بازرسان انسانی ارسال میشود تا کیفیت خروجی مدل ارزیابی گردد؛ موضوعی که چالشهای اخلاقی و حریم خصوصی عمیقی را در پاییز ۱۴۰۳ ایجاد کرده است.
چالشهای نظارت انسانی در فرآیند بهبود مدل
فرآیند بهبود مدلهای هوش مصنوعی معمولاً شامل حلقهای از بازخورد انسانی (RLHF) است تا خروجیها به خواستههای کاربر نزدیکتر شوند. با این حال، در مورد کوپایلت، مایکروسافت از پیمانکاران انسانی برای ارزیابی تطابق خروجی با دستورات کاربر استفاده میکند. در این فرآیند، بازرس به سه المان اصلی دسترسی دارد: دستور متنی (Prompt)، تصویر اصلی آپلود شده توسط کاربر، و دو نسخه خروجی تولید شده توسط هوش مصنوعی. وظیفه پیمانکار این است که انتخاب کند کدام نسخه کیفیت بهتری دارد، بدون آنکه وظیفه اصلی او «محتوای غیرمجاز» باشد.
دسترسی به محتوای حساس و غیراخلاقی
بر اساس گزارش 404 Media، بسیاری از پرامپتهای دریافتی شامل محتوای جنسی، تصاویر نامناسب یا درخواستهایی برای دستکاری غیراخلاقی تصاویر افراد است. نکته نگرانکننده اینجاست که در تمامی این موارد، چهرهها و جزئیات تصاویر به صورت «کدر نشده» (Uncensored) به پیمانکاران نمایش داده میشود. کارکنان گزارش دادهاند که با مواردی از قبیل تغییر در پوشش افراد یا درخواستهای پیشنهادی (Suggestive) مواجه شدهاند که با استانداردهای عمومی اخلاقی فاصله زیادی دارد و عملاً بازرسان را در موقعیت مشاهده محتوای نامناسب قرار میدهد.
مشخصات عملیاتی فرآیند ارزیابی
- نوع ارزیابی: رتبهبندی کیفی خروجی (Quality Rating).
- دادههای در دسترس پیمانکار: تصویر خام کاربر، دستور متنی و خروجیهای مدل.
- وضعیت حریم خصوصی: تصاویر چهره بدون سانسور و فاقد ابزار پنهانسازی خودکار.
- مبنای قانونی: استناد مایکروسافت به «شرایط استفاده» جهت بهبود محصول.
- شرکتهای پیمانکار: گزارش به نقش شرکتهایی نظیر Prolific اشاره دارد.
ابهام در سیاستهای مایکروسافت و مسئولیتپذیری
مایکروسافت در پاسخ به این افشاگری، با استناد به توافقنامههای استفاده از سرویس اعلام کرده است که از دادههای کاربران برای بهبود محصول و اجرای کدهای اخلاقی استفاده میکند. اما این پرسش اساسی مطرح است: آیا کاربر هنگام آپلود یک عکس شخصی برای ویرایش، تصور میکند که این تصویر توسط یک ناظر انسانی دیده خواهد شد؟ در دنیای هوش مصنوعی، خط باریکی میان «آموزش مدل» و «نقض حریم خصوصی» وجود دارد. استفاده از بازرسان انسانی برای رتبهبندی کیفیت، اگرچه به ارتقای دقت مدل (Diffusion) کمک میکند، اما در صورت عدم رعایت پروتکلهای ناشناسسازی (Anonymization)، اعتماد کاربران به اکوسیستم کوپایلت را به شدت کاهش میدهد.
نتیجهگیری برای کاربران حرفهای
با توجه به شرایط فعلی، پیشنهاد میشود کاربران از آپلود تصاویر بسیار خصوصی، حاوی اطلاعات حساس یا تصاویری که هویت افراد را در شرایط نامناسب فاش میکند، در ابزارهای هوش مصنوعی که فرآیند بازبینی انسانی دارند، جداً خودداری کنند. شفافیت در نحوه استفاده از دادههای کاربران توسط مایکروسافت و سایر غولهای فناوری، یکی از ملزومات حیاتی در سالهای پیش رو برای حفظ حریم خصوصی دیجیتال است.