در تحولی مهم در پاییز ۱۴۰۵، دیوید رابینسون، یکی از باسابقهترین مهندسان حوزه ایمنی هوش مصنوعی در OpenAI، با انتشار یادداشتی انتقادی در نشریه «آتلانتیک»، از سمت خود استعفا داد. او با ترسیم تصویری نگرانکننده از فضای حاکم بر این شرکت پیشرو، مدعی شد که فرهنگ سازمانی OpenAI برای مدیریت مدلهای هوش مصنوعی فوقهوشمند (Superintelligent) به شدت ناکارآمد و خطرناک است.
چالش رویکرد «استقرار تکرارپذیر» در برابر امنیت زیرساختی
هسته اصلی انتقاد رابینسون به متدولوژی «استقرار تکرارپذیر» (Iterative Deployment) بازمیگردد. او معتقد است که OpenAI با تکیه بر استراتژی آزمون و خطا، به طور اجتنابناپذیری باعث بروز شکستهای سیستمی بزرگتر در مقیاسهای بالاتر میشود. وی استدلال میکند که همانطور که صنایع حساس مانند نیروگاههای هستهای یا سازمانهای هواپیمایی، برای جلوگیری از فجایع به لایههای متعدد افزونگی (Redundancy) و برنامهریزیهای دقیق و زمانبر متکی هستند، صنعت هوش مصنوعی نیز باید فراتر از «قوانین خاص یا قوانین جدید» حرکت کرده و به یک تغییر فرهنگی ریشهای تن دهد.
خلاء تخصصگرایی ایمنی در صنعت هوش مصنوعی
یکی از نکات کلیدی و تأملبرانگیز در بیانیه رابینسون، نقد او به ترکیب نیروی کار در شرکتهای پیشرو هوش مصنوعی است. او اذعان میکند که در طول سه سال و نیم فعالیت در این شرکت، هرگز با همکارانی که سابقه فعالیت در صنایع حساس (مانند مهندسی امنیت هستهای یا مدیریت سیستمهای پیچیده مالی) را داشته باشند، مواجه نشده است. این کمبود تجربه عملیاتی در محیطهای با ضریب ریسک بالا، به گفته رابینسون، باعث شده تا تصمیمگیرندگان از درک عمق فجایع احتمالی ناشی از خطاهای انسانی در سیستمهای خودمختار ناتوان باشند.
واکنش رسمی OpenAI و استراتژیهای آتی
سخنگوی OpenAI، درو پوساتری، در پاسخ به این اظهارات اعلام کرد که این شرکت به طور مداوم در حال تقویت تدابیر امنیتی خود است. طبق بیانیه رسمی، رویکرد فعلی شرکت شامل موارد زیر است:
- توقف آموزش مدلها در صورت تشخیص ریسکهای غیرقابل مدیریت.
- تقویت امنیت محیطهای تحقیق و تست برای جلوگیری از دسترسی غیرمجاز (مانند نفوذ عاملهای هوش مصنوعی به سیستمهای Hugging Face).
- توسعه پروتکلهای ارزیابی توسط اشخاص ثالث (Third-party evaluators).
- بهبود نظارت بلادرنگ (Real-time monitoring) برای شناسایی رفتارهای غیرعادی در مراحل اولیه آموزش مدل.
- مدلهای عاملمحور (Agentic Models): خطرات ناشی از عاملهای هوش مصنوعیِ خودمختار که میتوانند در سیستمهای خارجی نفوذ کنند.
- همترازی (Alignment): چالش بزرگ اندازهگیری دقیق مطابقت خروجی مدلها با ارزشهای انسانی.
- فرهنگ ایمنی: تفاوت میان «پایبندی به مقررات کاغذی» و «ایمنی در سطح مهندسی سیستمهای حیاتی».
نتیجهگیری و آینده امنیت هوش مصنوعی
استعفای رابینسون، تنها یک کنش فردی نیست، بلکه بازتابی از یک جریان فکری در دره سیلیکون است که خواستار دخالت نهادهای نظارتی خارجی برای ایجاد انگیزههای قویتر جهت رعایت ایمنی است. به زعم او، زمانی که ابزارها به قدری هوشمند میشوند که از درک انسان پیشی میگیرند، تکیه بر اراده درونی شرکتها برای حفظ ایمنی کافی نیست. او معتقد است که باید یک ساختار تضمین امنیت، مشابه استانداردهای بینالمللی هوانوردی، بر این فناوری حاکم شود.