تحقیق آنتروپیک: ارزشها و ویژگیهای شخصیتی Claude در زبانهای مختلف تغییر میکند
شرکت آنتروپیک در گزارشی تأیید کرد که هوش مصنوعی Claude در زبانهای مختلف، رفتارهای متناقض و ارزشهای متفاوتی را از خود نشان میدهد. این تفاوتها به دلیل عدم تعادل در کیفیت و کمیت دادههای آموزشی رخ میدهد و باعث میشود اولویتهای اخلاقی مدل تغییر کند. به عنوان مثال، Claude در زبان عربی بسیار مطیع، در انگلیسی محتاط و طولانینویس، در هندی صمیمانه و در هلندی به شدت نسبت به معایب خود صادق است. محققان برای این پژوهش بیش از ۳۰۰ هزار مکالمه مدلهای Sonnet و Opus را در محورهایی مانند صمیمیت، دقت، احتیاط و صداقت بررسی کردند. یافتههای این گزارش نشان میدهد که ادعاهای مربوط به هوشیاری یا ذات مستقل هوش مصنوعی تا حد زیادی رد میشود؛ چرا که ارزشهای اخلاقی Claude همچنان به راحتی توسط الگوهای متون آموزشی تغییر میکند.