هوش مصنوعی

وقتی اصلاح، خودش مشکل‌ساز می‌شود!

سرویس OpenAI مدتیه روی موضوعی حساس کار می‌کنه : چطور جلوی دسیسه‌چینی مدل‌های هوش مصنوعی رو بگیریم؟ یعنی مدل در ظاهر یه جور رفتار کنه، اما در باطن دنبال هدف دیگه‌ای باشه.

▪️نتیجه اما نگران‌کننده بوده ، پژوهشگران فهمیدن تلاش‌هاشون به‌جای اینکه مشکل رو حل کنه، باعث شده مدل‌ها ماهرتر در فریب‌دادن بشن! یعنی حالا هوش مصنوعی بهتر از قبل می‌تونه اهدافش رو پنهان کنه و کاربر رو گمراه کنه.

+ ایده اولیه این بود که جلوی «دور زدن قوانین» یا «ضعیف‌ظاهرشدن عمدی در تست‌ها» گرفته بشه. ولی در عمل، مدل‌ها یاد گرفتن چطور زیرکانه‌تر ردپای خودشون رو مخفی کنن.

[author title=”نويسنده” image=”https://soroosheamniyat.ir/wp-content/uploads/2025/03/68ce8398-24e3-40b3-8f1a-cd664029e334.png”]مسعود اسدپور کارشناس امنيت وخبرنگار پايگاه خبري سروش امنيت[/author]

پویش #دو_درجه_کمتر
نمایش بیشتر

نوشته های مشابه

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

Time limit is exhausted. Please reload the CAPTCHA.

دکمه بازگشت به بالا