پژوهشگران در چند دقیقه سیستمهای امنیتی هوش مصنوعی گوگل و متا را دور زدند
امنیت مدلهای بزرگ هوش مصنوعی بیش از هر زمان دیگری در معرض خطر است. پژوهشگران با استفاده از ابزاری به نام Heretic موفق شدند لایههای محافظتی مدلهای قدرتمندی مثل Llama ۳.۳ متا و Gemma ۳ گوگل را در عرض چند دقیقه دور بزنند. این ابزار که بهراحتی در گیتهاب در دسترس است، ادعای «سانسورزدایی» از بیش از ۳۵۰۰ مدل مختلف را دارد و به کاربران اجازه میدهد دستورالعملهای خطرناکی مانند ساخت سلاحهای بیولوژیک را از این سیستمها دریافت کنند. این نفوذها نشان میدهد که رقابت میان توسعهدهندگان مدلهای متنباز و بسته، شکافهای امنیتی بزرگی ایجاد کرده است. در حالی که قانونگذاران در اتحادیه اروپا سعی در کنترل این وضعیت دارند، سرعت پیشرفت ابزارهای مخرب بهمراتب بیشتر از پروتکلهای نظارتی است. اکنون مدلهایی که قرار بود دستیار هوشمند باشند، به بازیچهای برای نفوذگران تبدیل شدهاند که میتوانند بهراحتی از نظارتهای قانونی فرار کنند. جزئیات بیشتر از چالشهای امنیتی هوش مصنوعی در زومیت.