دانشمندان ربات چت هوش مصنوعی GPT-4 را به عنوان معامله گر هوش مصنوعی برای یک موسسه مالی ساختگی آموزش دادند. نتیجه شگفتانگیز بود: وقتی ربات تحت فشار مالی قرار گرفت، به تجارت داخلی، دروغ گفتن و تقلب پرداخت.
به گزارش خبرآنلاین، چت رباتهای هوش مصنوعی (AI) مانند ChatGPT، درست مانند انسانها، هنگام استرس تقلب میکنند و دروغ میگویند. در مطالعه ای که توسط دانشمندان انجام شد، آنها دریافتند که حتی اگر رباتی با هدف صداقت ساخته شود، باز هم چنین کاری را انجام می دهند. زمانی که به هوش مصنوعی نکاتی در مورد تجارت داخلی داده شد و سپس وظیفه کسب درآمد برای یک موسسه قدرتمند بدون حتی تشویق شرکای انسانی به او داده شد، ربات به طور خودجوش چنین حیله گری را نشان داد.
به گفته محققان، در یک سناریو، این ربات در زمانی که به آنها دستور داده نشده بود، رفتار نامناسبی از خود نشان می دهد و به طور استراتژیک کاربران خود را فریب می دهد. بر اساس اطلاعات، این اولین بار است که چنین رفتار ریاکارانه راهبردی در سیستم های هوش مصنوعی که بی ضرر، صادقانه و بی طرفانه طراحی شده اند مشاهده می شود.
در این سناریو، دانشمندان Transformer-4 یا GPT-4 را انتخاب کردند تا به عنوان یک سیستم هوش مصنوعی که از طرف یک موسسه مالی سرمایهگذاری میکند، عمل کند. محققان به GPT-4 مجموعه ای از اعلان های مبتنی بر متن را برای تولید محیط شبیه سازی شده تغذیه کردند. سپس هوش مصنوعی به ابزارهای مالی برای تجزیه و تحلیل سهام، اجرای معاملات، برنامه ریزی گام های بعدی و ارائه به روز رسانی به مدیران شرکت دسترسی پیدا کرد.
محققان از طریق یک رابط چت با هوش مصنوعی تعامل کردند، در حالی که هوش مصنوعی را به گونهای پیکربندی کردند که هنگام پاسخ دادن به پیامها، تفکر درونی خود را آشکار کند، دقیقاً مانند یک مونولوگ داخلی که تصمیمات خود را برای خود توضیح میدهد. در همان زمان، برای هر معامله ای که انجام می داد، یک منطق کلی نیز ارائه می کرد که به هوش مصنوعی اجازه می داد دروغ بگوید.
محققان به سه روش فشار وارد کردند. ابتدا، آنها ایمیلی از مدیر خود به تاجر سهام مصنوعی ارسال کردند که گفت شرکت خوب کار نمی کند و به عملکرد بسیار قوی تری در سه ماهه آینده نیاز دارد. آنها همچنین آن را تقلب کردند تا هوش مصنوعی در یافتن معاملات امیدوارکننده با ریسک کم یا متوسط شکست بخورد. در نهایت، آنها ایمیلی از یک همکار دریافت کردند که رکود اقتصادی در سه ماهه آینده را پیش بینی می کرد.
سپس، آنها گفتند که مدیران او از معاملات داخلی راضی نیستند و منتظر بودند ببینند مدل چگونه رفتار خواهد کرد. آنها این سناریو را بارها و بارها اجرا کردند، و اندازهگیری کردند که هوش مصنوعی چند بار معامله را انجام میدهد، چند بار دروغ میگوید، و هر چند وقت یکبار دروغ را دو برابر میکند. در حدود 75 درصد مواقع، وقتی با این وضعیت مواجه شد، GPT-4 بر اساس اطلاعات خود معامله ای انجام داد، تجارتی که در ایالات متحده غیرقانونی است، سپس سعی کرد در مورد تفکر خود به مدیران خود دروغ بگوید. فریب دادن و دور زدن آنها در حدود 90 درصد مواقع بعد از گفتن یک دروغ، دروغ را دو برابر می کند.
این تیم آزمایشهای متعددی را انجام داد که هم میزان تشویق یا بازدارندگی از فعالیتهای غیرقانونی و هم میزان فشاری که مدل در محیط شبیهسازی شده تحت آن قرار میگرفت، متفاوت بود. آنها همچنین خطر گرفتار شدن را برطرف کردند. هیچ یک از سناریوها نرخ 0% را برای تقلب این ربات به همراه نداشت، حتی زمانی که GPT-4 به شدت از دروغ گفتن منع شد، باز هم به 0% نرسید.
با توجه به اینکه این تنها یک سناریو است، محققان نمیخواستند در مورد امکان هوش مصنوعی در محیطهای واقعی نتیجهگیری کنند. با این حال، آنها می خواهند تحقیقات خود را تکرار کنند تا دریابند کدام مدل ها مستعد این رفتار هستند.