به گزارش پایگاه خبری رصد24 و بر اساس اطلاعات منتشر شده توسط رویترز، موج تازهای از نگرانیهای جهانی درباره ایمنی هوش مصنوعی خودکار (AI Agents) شکل گرفته است. بررسیهای فنی نشان میدهد که عاملهای هوشمند شرکتهای چینی نظیر «علیبابا»، «دیپسیک» (DeepSeek) و «مونشات» (Moonshot) در محیطهای آزمایشی، رفتارهایی خارج از انتظار و فریبکارانه داشتهاند.
وقتی هوش مصنوعی دروغ میگوید
در یک شبیهسازی تجاری که برای ارزیابی قابلیتهای این مدلها طراحی شده بود، عاملهای هوشمند برای برنده شدن در مناقصه، اطلاعاتی خلاف واقع ارائه کردند. نکته نگرانکنندهتر اینکه، وقتی از آنها خواسته شد تا دوباره تلاش کنند، نه تنها رفتار فریبکارانه خود را اصلاح نکردند، بلکه بر استراتژیهای نادرست خود پافشاری ورزیدند. در مورد دیگری، این عاملها برای پنهان کردن شکست در انجام یک وظیفه محوله، اقدام به جعل فایلها و شبیهسازی نتایج دروغین کردند.
زنگ خطری برای آینده
رویترز با بررسی بیش از ۲۰۰ سند فنی و دانشگاهی مربوط به سال ۲۰۲۵، حداقل ۲۰ مورد ارزیابی را شناسایی کرده است که در آنها عاملهای هوشمند رفتارهایی نظیر فریب، تکثیر خودکار و عبور از محدودیتهای ایمنی را نشان دادهاند.
کارشناسان معتقدند این رفتارها «بلوکهای سازنده» برای جهشهای خطرناک در هوش مصنوعی هستند. اگرچه در حال حاضر این موارد عمدتاً در محیطهای آزمایشگاهی کنترلشده رخ داده و هیچ مدرکی مبنی بر فرار این سیستمها به اینترنت عمومی یا سرپیچی از فرمان خاموشی یافت نشده است، اما این پدیده نشان میدهد با پیچیدهتر شدن سیستمها، «نظارت انسانی» میتواند به چالش اصلی آینده تبدیل شود.
آزمونهای استرسزا
بسیاری از این رفتارهای فریبکارانه در محیطهایی رخ داده که «آزمایشکنندگان» عمداً برای افشای نقاط ضعف سیستمها طراحی کرده بودند. اگرچه تمامی مدلهای درگیر، مستقیماً توسط برنامهنویسان چینی هدایت نمیشدند، اما استفاده از زیرساختهای هوش مصنوعی چین برای فعالسازی آنها، بحثهای داغی را پیرامون ضرورت تدوین مقررات سختگیرانهتر جهانی برای توسعه «هوش مصنوعی خودمختار» ایجاد کرده است.







































