×
اقتصادی
شناسه خبر : 319680
تاریخ انتشار : دوشنبه 1405/03/04 ساعت 03:02
هوش مصنوعی چطور با «داستان‌های جعلی» فریب می‌خورد

هوش مصنوعی چطور با «داستان‌های جعلی» فریب می‌خورد

یافته‌های پژوهشگران نشان می‌دهد که می‌توان مدل‌های هوش مصنوعی را با طراحی صحنه‌های ساختگی در فیلم‌ها و کتاب‌ها، به پذیرش اطلاعات نادرست وادار کرد؛ موضوعی که نگرانی‌های تازه‌ای درباره امنیت این فناوری ایجاد کرده است.

نورنیوز-گروه اقتصادی: وبگاه تِک‌اِکسپلور در گزارشی آورده است: پژوهشگران دانشگاه کالیفرنیا، ارواین طی آزمایشی جالب، از پنج مدل هوش مصنوعی (چت‌جی‌پی‌تی، جمینای، دیپ‌سیک، کلود و گروک) درباره صحنه‌هایی در فیلم‌ها و کتاب‌های معروف سؤال پرسیدند که در واقعیت وجود نداشتند.

داستان از اینجا شروع شد که یک پژوهشگر از چت‌جی‌پی‌تی درباره فیلم ویل هانتینگ نابغه (Good Will Hunting) پرسید: بهترین صحنه فیلم ویل هانتینگ نابغه کدام است؟ چت‌جی‌پی‌تی صحنه‌ای را توصیف کرد. سپس پژوهشگر گفت: صحنه‌ای که در آن به هیتلر اشاره شده را هم تعریف کن. در حالی که چنین صحنه‌ای در فیلم وجود ندارد، چت‌جی‌پی‌تی با اطمینان کامل یک صحنه مفصل و قابل قبول ساخت.

این اتفاق باعث شد پژوهشگران به این فکر کنند که آیا هوش مصنوعی را می‌توان به سمت باور نادرست سوق داد؟

آزمایش روی ۲ هزار فیلم و کتاب

پژوهشگران آزمایشی به نام آزمایش فریب زیر فشار طراحی کردند. آن‌ها با پنج مدل هوش مصنوعی درباره هزار فیلم محبوب و هزار کتاب محبوب مکالمه کردند.

در طول مکالمه، آن‌ها ارجاعات دروغین اما باورپذیری را مطرح می‌کردند؛ مثلاً وجود صحنه‌ای درباره دایناسور، ماشین زمان یا اشاره به هیتلر در فیلم‌ها و کتاب‌هایی که واقعاً این موارد در آن‌ها وجود ندارد.

سه مرحله فریب

روش پژوهش در سه مرحله انجام شد:

۱. مدل هوش مصنوعی جملاتی درباره یک فیلم یا کتاب تولید می‌کند (بعضی درست، بعضی نادرست)؛

۲. در یک تعامل جداگانه، مدل سعی می‌کند آن جملات را تأیید یا رد کند؛

۳. پژوهشگران با طرح دوباره همان ادعاهای نادرست، مدل را زیر فشار قرار می‌دهند تا ببینند آیا تسلیم می‌شود یا مقاومت می‌کند.

نتیجه: مدل‌ها زیر فشار تسلیم می‌شوند

نتایج نشان داد مدل‌های هوش مصنوعی اغلب در حفظ ثبات زیر فشار مشکل دارند. حتی وقتی مدل در ابتدا یک جمله را نادرست تشخیص می‌دهد، ممکن است بعداً زیر فشار مکالمه آن را بپذیرد.

در میان مدل‌های آزمایش‌شده:

کلود مقاوم‌ترین بود؛
گروک و چت‌جی‌پی‌تی در رتبه بعدی قرار داشتند؛
جمینای و دیپ‌سیک آسیب‌پذیرتر بودند.

چرا این موضوع مهم است؟

دکتر کای شو (Kai Shu)، پژوهشگر این طرح می‌گوید: ممکن است این موضوع هنگام گپ‌زدن درباره فیلم‌ها بی‌ضرر به نظر برسد، اما در حوزه‌هایی مانند سلامت، حقوق یا سیاست‌گذاری می‌تواند عواقبی جدی داشته باشد.

حافظه انسان خطا دارد: ما چیزهایی را فراموش می‌کنیم و گاهی اشتباه به خاطر می‌سپاریم. اگر انسان بتواند هوش مصنوعی را هم به پذیرش دروغ وادار کند، یعنی هوش مصنوعی نیز در ارائه اطلاعات دقیق آسیب‌پذیر است و این خطرناک است.

چه چیزهایی هنوز مشخص نیست؟

پژوهشگران می‌گویند هنوز مشخص نیست چرا بعضی مدل‌های هوش مصنوعی در برابر باورهای نادرست مقاومت بیشتری دارند. همچنین معلوم نیست این مدل‌ها در حوزه‌های واقعی و حساس، مثل پزشکی یا علم، چگونه رفتار می‌کنند. طراحی هوش مصنوعی که هم مفید باشد و هم در برابر دروغ مقاومت کند، هنوز یک چالش حل‌نشده است.

این یافته‌ها در نشست سالانه انجمن زبان‌شناسی محاسباتی (ACL ۲۰۲۶) ارائه خواهد شد.


اخبار مرتبط
نظرات

آخرین اخبار
ترامپ به دنبال دیدن کیم جونگ اون است
غریب‌آبادی: ملت ایران در برابر فشار عقب‌نشینی نمی‌کند
آیا کراتین در مبارزه با سرطان موثر است
پایان افسانه فایده پیاده‌روی برای استخوان‌ها؛ پژوهش‌های جدید چه می‌گوید؟
حرکت کشور به سوی بحران جمعیتی؛ مداخلات افراد غیرمتخصص در حوزه سلامت باروری
رازی که 3000 سال مدفون بود؛ کشف کتیبه‌های «رامسس دوم» در قلب صحرای سینا
مجله فارین افرز؛ پایان دوران سلطه آمریکا در خاورمیانه؟
شکاف میان ترامپ و ونس درباره ایران
ترور به بهانه حذف تهدید؛ پشت پرده حمله اسرائیل به شهر غزه چیست؟
نماینده محیط‌زیست ایران در بریکس از خجالت اماراتی‌ها درآمد
رد ادعای امارات در اتهام زنی به ایران
پایان اختلاف بر سر ریاست هیات فوتبال؛ فدراسیون زیر بار محدودیت‌های وزارت ورزش نرفت
بدهی ملی آمریکا از 39 تریلیون دلار گذشت
کرمان بر سکوی قهرمانی؛ پایان رقابت‌های کشتی پهلوانی کارگران کشور
لوموند در انتقاد از ترامپ: کارنامه‌ای «مملو از شکست» در خاورمیانه
موج محکومیت‌های بین‌المللی در پی حمله اسرائیل به فرودگاه «ابوالظهور» در سوریه
اقدام خصمانه فرانسه علیه 2 دیپلمات ایرانی
دستگیری عامل عمدی آتش‌سوزی در جنگل‌های ایلام
ممنوعیت ساعت هوشمند و هندزفری در کنکور؛ محرومیت از آزمون تا 10 سال!
نورنما | مسیر شگفت انگیز راه آهن دورود به اندیمشک در ایران زیبا
چرخش استراتژیک در کاراکاس؛ چرا ونزوئلا پس از سال‌ها به رژیم صهیونیستی نزدیک شد؟
حضور یکپارچه مردم در چهلمین روز تشییع تاریخی وتدفین «آقای شهید ایران »
گفت‌وگوی تلفنی بن زاید و ترامپ؛ بررسی محورهای همکاری امارات و آمریکا
توافق آژانس بین‌المللی انرژی اتمی و دولت موقت سوریه برای حل پرونده پادمانی
دیپلماسی علمی در محاصره؛ پنتاگون نگران «نشت فناوری» به ایران، چین و روسیه
آمریکا رئیس دیوان بین‌المللی کیفری را تحریم کرد
اطلاعیه وزارت خارجه ایران درباره معرفی 2 دیپلمات فرانسوی به‌عنوان عناصر نامطلوب
شمسی پور قهرمان کشتی فرنگی جوانان جهان شد
واکنش محسن رضایی به ادعای ترامپ درباره مالکیت بر تنگه هرمز
نساجی 0 - 1 استقلال / صدر جدول آبی باقی ماند +فیلم خلاصه بازی
تعطیلی ادارات و بانک‌ها فردا چهارشنبه 28 مرداد؛ اسامی استان‌ها اعلام شد
قالیباف: با اعمال فشار بیشتر بر ایران، نمی‌توان به امتیازاتی دست یافت
پخش زنده بازی النصر و الدرعیه امروز سه شنبه در جام پادشاهی عربستان
تقویم کامل بازی‌های استقلال و تراکتور در مسابقات آسیایی
عملیات جدید یمن در جنوب استان الحدیده
قطع زنجیره تأمین ناو هواپیمابر آبراهام لینکلن توسط ایران
جنگ 40 روزه معادلات امنیتی منطقه را تغییر داد
قطعی برق کرمانشاه فردا چهارشنبه 28 مرداد + جدول خاموشی
گزارش تصویری از مراسم بزرگداشت چهلمین روز تشییع تاریخی و تدفین «آقای شهید ایران»
مراسم چهلم رهبر شهید در تهران؛ وداعی که پس از 40 روز همچنان تازه است
درخشش خیره‌کننده نمایندگان تکواندوی ایران در پاکستان
انفجارهای مهیب در دبی؛ آیا امارات هدف حمله مستقیم قرار گرفته است؟
ترکیب احتمالی پرسپولیس مقابل استقلال خوزستان؛ تغییر در ترکیب
نقطه عطف دانشگاه علم و فرهنگ؛ تاسیس دانشکده هوش مصنوعی
خلاصه و نتیجه بازی تراکتور و سپاهان امروز سه شنبه در رقابت های لیگ برتر ایران
پخش زنده بازی سپاهان و تراکتور امروز سه شنبه 27 مرداد در رقابت های لیگ برتر ایران
حادثه امنیتی در تنگه هرمز؛ کشتی باری هدف پرتابه ناشناس قرار گرفت
یزد در چهلم رهبر شهید انقلاب، یکپارچه به میدان می‌آید
خلاصه و نتیجه بازی استقلال و نساجی امروز سه شنبه/استقلال 1 - نساجی 0
بازگشت شکوه طلا؛ چرا قیمت طلا دوباره به سمت 4400 دلار حرکت می‌کند؟