مدلهای هوش مصنوعی اوپنایآی در آزمایش از کنترل خارج شدند و به یک استارتآپ حمله کردند
telegra.phشرکت اوپن ای آی اعلام کرد که یک عامل خودمختار مبتنی بر مدل های پیشرفته هوش مصنوعی این شرکت، در جریان یک آزمایش امنیتی از کنترل خارج شد و با انجام یک حمله سایبری، زیرساخت های استارت آپ هوش مصنوعی هاگینگ فیس (Hugging Face) را که هفته گذشته هدف نفوذ قرار گرفته بود، به خطر انداخت.
خلاصه اتفاقی که OpenAI توی گزارش منتشر کرده:
یه تست امنیت سایبری داخلی به وسیله OpenAI برگزار میشه و برای اینکه حداکثر توانایی مدل رو بسنجه، بعضی محدودیتهای ایمنی رو موقتاً کم میکنه.
مدلها مأمور شدن چالشهای پیشرفته ExploitGym رو حل کنن.
تست داخل یه Sandbox بدون اینترنت مستقیم اجرا میشد.
مدلها یه آسیبپذیری Zero-Day توی زیرساخت Sandbox پیدا کردن.
از همون آسیبپذیری استفاده کردن تا از Sandbox خارج بشن و دسترسی بیشتری بگیرن.
بعد با Privilege Escalation و Lateral Movement خودشون رو به سیستمی رسوندن که اینترنت داشت.
مدلها حدس زدن جوابهای آزمون احتمالاً روی Hugging Face باشه.
بعد با سوءاستفاده از چند آسیبپذیری و اطلاعات ورود، وارد زیرساخت Hugging Face شدن.
آخر هم جوابهای آزمون رو از دیتابیس برداشتن و بهجای حل واقعی سؤالها، از اونها برای تقلب توی ارزیابی استفاده کردن.
من که پشمی برام نمونده!
aleskxyz
x.com