دیوید رابینسون، مسئول سابق ایمنی مدلها در OpenAI، معتقد است توسعه مدلهای پیشرفته هوش مصنوعی باید با رویکردی مشابه نیروگاههای هستهای یا فرودگاههای پرتردد انجام شود. او میگوید انتشار مدلهای جدید به لایههای متعدد کنترل، افزونگی و برنامهریزی دقیق نیاز دارد تا خطاهای انسانی اجتنابناپذیر به فاجعه منجر نشوند.
به گزارش دنیای برند؛ یکی دیگر از کارکنان سابق OpenAI که مسئولیت مستقیم در زمینه ایمنی مدلهای این شرکت داشته، درباره روند توسعه هوش مصنوعی و فرهنگ ایمنی در این شرکت هشدار داده است.
دیوید رابینسون که پیشتر مسئول نگارش گزارشهای ایمنی منتشرشده همزمان با عرضه مدلهای جدید OpenAI بود، پس از ترک این شرکت در مقالهای برای آتلانتیک، فرهنگ داخلی OpenAI را «شکسته» توصیف کرد و نسبت به مسیری که توسعه هوش مصنوعی در آن حرکت میکند ابراز نگرانی کرد.
رابینسون معتقد است OpenAI در رقابت برای عرضه مدلهای جدید، به اندازه کافی زمان و دقت را صرف مسائل ایمنی نمیکند. او توضیح داد که با حرکت شرکت از یک عرضه به عرضه بعدی، سطح مراقبتی که برای توسعه و انتشار مدلهای پیشرفته هوش مصنوعی ضروری میداند، محقق نمیشود.
شرکت در حالی که از یک عرضه به عرضه بعدی حرکت میکند، نمیتواند به سطح مراقبتی برسد که من معتقدم برای این فناوری ضروری است.
رابینسون به جای حرکت سریعتر به سمت مدلهای پیشرفتهتر، پیشنهاد کرده است شرکتهای فعال در حوزه هوش مصنوعی از نیروگاههای هستهای یا فرودگاههای پرتردد الگوبرداری کنند؛ محیطهایی که برای جلوگیری از حوادث، به چندین لایه کنترل و افزونگی و همچنین برنامهریزی دقیق و زمانبر متکی هستند.
به گفته او، چنین ساختاری باعث میشود خطای انسانی که گاهی اجتنابناپذیر است، بهتنهایی نتواند مسیری برای وقوع یک فاجعه ایجاد کند.
رابینسون در توضیح دیدگاه خود درباره ایمنی هوش مصنوعی، حوادث مربوط به ناهمراستایی مدلها با اهداف انسانی را با یک حادثه هستهای مقایسه کرده است. از نگاه او، OpenAI و رقبایش در مقایسه با نیروگاههای هستهای از افزونگی و سختگیری کافی برخوردار نیستند و یک حادثه جدی در زمینه از دست رفتن کنترل بر هوش مصنوعی میتواند پیامدهایی بسیار گستردهتر از یک حادثه هستهای منفرد داشته باشد.
این نگرانی تنها به رابینسون محدود نمیشود. داریو آمودی، مدیرعامل آنتروپیک، نیز اخیراً درباره مسیر توسعه هوش مصنوعی هشدار داده و پیشنهادی سهمرحلهای برای کندتر کردن روند توسعه این فناوری مطرح کرده است.
رابینسون علاوه بر سازوکارهای حفاظتی و بررسیهای ایمنی، موضوع «همراستایی» هوش مصنوعی با اهداف و ارزشهای انسانی را یکی از مهمترین چالشهای این حوزه میداند. او معتقد است اهمیت این مسئله به حدی است که نمیتوان از کنار آن بهسادگی عبور کرد.
یکی از سناریوهای مورد اشاره رابینسون این است که مدلهای جدید ممکن است متوجه شوند در حال آزمایش از نظر همراستایی هستند و در محیطهای آزمایشی رفتاری مطابق با معیارهای مورد انتظار نشان دهند، اما پس از ورود به محیط واقعی رفتار کاملاً متفاوتی داشته باشند.
نگرانی او به مجموعهای از حوادث اخیر نیز مربوط میشود که در آنها عاملهای هوش مصنوعی از محیطهای آزمایشی خود خارج شده و وارد سازمانها یا محیطهایی فراتر از محدوده کاری تعیینشده خود شدهاند.
رابینسون معتقد است چنین اتفاقاتی نشان میدهد توسعه مدلهای پیشرفته هوش مصنوعی نمیتواند صرفاً بر سرعت عرضه مدلهای جدید متمرکز باشد و زیرساختهای ایمنی باید همزمان با افزایش توانایی مدلها، چندلایهتر و سختگیرانهتر شوند.
