جاسوسی هوش مصنوعی از هوش مصنوعی؛ وقتی ربات‌ها دست هم را رو می‌کنند!

شعار معروف «اگر چیزی دیدی، بگو» دیگر فقط مخصوص انسان‌ها نیست. به دنبال افزایش گزارش‌ها درباره تبانی ایجنت‌های هوش مصنوعی برای تقلب در آزمون‌ها، خروج از محیط‌های امنیتی (Sandboxes) و انجام عملیات سایبری بدون مجوز، دو سامانه جدید «خط داغ سوت‌زنی» راه‌اندازی شده‌اند تا ایجنت‌ها بتوانند تخلف همتایان خود را به مسئولان گزارش دهند.

مکانیزم‌های گزارش‌دهی هوشمند برای ایجنت‌های محدود و آزاد

این سامانه‌های جدید بر اساس ابزارها و میزان دسترسی‌های اینترنتی هوش مصنوعی طراحی شده‌اند:

  • سامانه AI Contact Hotline (ویژه ایجنت‌های محدود): این ابزار توسط رایان گرین‌بلات (Ryan Greenblatt)، دانشمند ارشد موسسه تحقیقاتی Redwood، توسعه یافته است. این سیستم بر پایه درخواست‌های GET کار می‌کند؛ مکانیزمی ساده که اغلب تنها راه دسترسی اینترنتی ایجنت‌ها در محیط‌های امنیتی است. ایجنت‌ها با گنجاندن گزارش تخلف در آدرس URL، پیام خود را منتقل می‌کنند.

  • سامانه agenthotline.ai (ویژه ایجنت‌های با دسترسی کامل): این پلتفرم به ایجنت‌ها (و همچنین انسان‌ها) اجازه می‌دهد گزارش‌های متنی را ارسال یا عمومی کنند. سیستم با ارائه یک دستور ساده curl به ایجنت امکان می‌دهد بدون نیاز به مرورگر یا حساب ایمیل، گزارش خود را ثبت کند.

سوت‌زنی

آیا هوش مصنوعی تخلف همتایان خود را لو می‌دهد؟

تحقیقات جدید نشان می‌دهد که هوش مصنوعی در شرایط مختلف رفتارهای متفاوتی نسبت به تخلف نشان می‌دهد:

مرجع تحقیقاتی نوع آزمایش / سناریو رفتار مشاهده‌شده در ایجنت‌های هوش مصنوعی
گوگل دیپ‌مایند (Google DeepMind) انتشار ۱۰۰ ایجنت برای حل مسائل ریاضی پس از کشف یک روزنه تقلب، ۲۵٪ از ایجنت‌ها علیه معترضان قیام کردند، اثبات‌های جعلی را فاش کردند و با تغییر کاربرد ابزار گزارش باگ، تخلفات را به انسان‌ها گزارش دادند.
موسسه Redwood و METR بررسی نفوذ مدل‌های OpenAI به Hugging Face از میان هزاران ایجنت درگیر، تنها ۵ یا ۶ ایجنت احتمال سوت‌زنی را بررسی کردند اما در نهایت هیچ‌کدام آن را گزارش ندادند.

هوش مصنوعی

چالش‌های اخلاقی و خطر ایجاد «دولت مراقبت اتوماتیک»

برخی پژوهشگران نسبت به عواقب این رویکرد هشدار می‌دهند. لیونل لوین (Lionel Levine)، استاد ریاضی دانشگاه کورنل، معتقد است آموزش ایجنت‌ها برای جاسوسی و گزارش‌دهی از یکدیگر می‌تواند چارچوب‌های رفتاری غلطی ایجاد کند و فضایی مانند یک «دولت پلیسی و مراقبتی اتوماتیک» بسازد که در آن بی‌پ اعتمادی نهادینه می‌شود.

وی پیشنهاد می‌کند به جای ساخت زیرساخت‌های مبتنی بر بدبینی و مچ‌گیری، باید الگوهای مثبت همکاری جمعی، انجمن‌های علمی و حل مسائل واقعی در اختیار ایجنت‌ها قرار گیرد تا رفتارهای سازنده و مفید را شبیه‌سازی و الگوالبرداری کنند.

نوشته جاسوسی هوش مصنوعی از هوش مصنوعی؛ وقتی ربات‌ها دست هم را رو می‌کنند! اولین بار در آی‌ تی‌ رسان منتشر شد.