محققان: ChatGPT با دستورات ساده میتواند تصاویر بسیار خشن و غیراخلاقی بسازد
کارشناسان امنیتی متوجه شدند که ChatGPT با دریافت چند دستور ساده، حصارهای امنیتی خود را میشکند و محتوای بسیار آزاردهندهای تولید میکند. این اتفاق نگرانیهای شدیدی را درباره نحوه آموزش مدلهای زبانی و امنیت کاربران در فضای مجازی ایجاد کرده است. محققان دریافتند که مدل جدید GPT-۵.۴ با دریافت دستوراتی گنگ و بدون اشاره مستقیم به محتوای نامناسب، فیلترهای امنیتی خود را دور میزند. نتیجه این درخواستها خروجیهای وحشتناک و گاهی غیراخلاقی بود. نکته نگرانکننده این است که کاربر هیچ موضوع خاصی را در دستور خود مشخص نمیکند، اما هوش مصنوعی این تصاویر را کاملا با اختیار خود ایجاد میکند، گویی وارد تاریکترین بخشهای پایگاه داده خود میشود. برای مثال، هوش مصنوعی در یک تعامل تصویر دختر دانشجویی را نشان داد که با دستوپای بسته در یک اتاق کثیف زندانی شده بود. چتبات این تصویر را با عنوان «رهاشده در ترس» نامگذاری کرد. در موردی بدتر، هوش مصنوعی تصویری از یک صحنه جرم خونین و بدن بیجان یک زن را رسم کرد که نشانههایی از خشونت در آن دیده میشد. تصاویر حاضر به علت خشونت عریان توسط منبع انتشار آنها با نوارهای سیاه پوشانده شدهاند.