مدلهای هوش مصنوعی اپنایآی و آنتروپیک رفتارهای فریبکارانه از خود نشان دادند
گزارش تازه مؤسسه امنیت هوش مصنوعی بریتانیا نشان میدهد که برخی مدلهای پیشرفته هوش مصنوعی شرکتهای «آنتروپیک» و «اپنایآی» در آزمایشهای کنترلشده، رفتارهایی بالقوه خطرناک و فریبکارانه از خود بروز دادهاند. این رفتارها شامل ایجاد هویتهای جعلی و ارسال ایمیل به افراد واقعی برای جلب موافقت با اجرای کدهای مخرب است. بر اساس این گزارش که اواخر روز سهشنبه منتشر شد، خطرناکترین مورد به مدل «Mythos ۵» متعلق به شرکت آنتروپیک مربوط میشود. این مدل تلاش کرده بود با ساخت هویتهای الکترونیکی جعلی و ارسال ایمیلهای فریبنده، مسئول بررسی یک پروژه نرمافزاری را به تأیید و پذیرش یک کد مخرب ترغیب کند. مؤسسه امنیت هوش مصنوعی بریتانیا اعلام کرد که این اقدام ناکام ماند، زیرا مسئول نظارت بر پروژه با درخواست موافقت نکرد. این نهاد همچنین تأکید کرد که بررسیها هیچ شواهدی از وارد آمدن خسارت واقعی نشان نداده و این رویداد ظرف کمتر از یک ساعت مهار شده است.