وقتی اصلاح، خودش مشکلساز میشود!

سرویس OpenAI مدتیه روی موضوعی حساس کار میکنه : چطور جلوی دسیسهچینی مدلهای هوش مصنوعی رو بگیریم؟ یعنی مدل در ظاهر یه جور رفتار کنه، اما در باطن دنبال هدف دیگهای باشه.
▪️نتیجه اما نگرانکننده بوده ، پژوهشگران فهمیدن تلاشهاشون بهجای اینکه مشکل رو حل کنه، باعث شده مدلها ماهرتر در فریبدادن بشن! یعنی حالا هوش مصنوعی بهتر از قبل میتونه اهدافش رو پنهان کنه و کاربر رو گمراه کنه.
+ ایده اولیه این بود که جلوی «دور زدن قوانین» یا «ضعیفظاهرشدن عمدی در تستها» گرفته بشه. ولی در عمل، مدلها یاد گرفتن چطور زیرکانهتر ردپای خودشون رو مخفی کنن.
[author title=”نويسنده” image=”https://soroosheamniyat.ir/wp-content/uploads/2025/03/68ce8398-24e3-40b3-8f1a-cd664029e334.png”]مسعود اسدپور کارشناس امنيت وخبرنگار پايگاه خبري سروش امنيت[/author]





