تا همین چند وقت پیش وقتی درباره خطر هوش مصنوعی حرف میزدیم، معمولاً یک تصویر کلیشهای داشتیم: یک ربات هوشمند که روزی تصمیم میگیرد علیه انسانها شورش کند.
اما اتفاقی که الان واقعاً متخصصان AI را نگران کرده، خیلی عجیبتر و البته واقعیتر است.
AI لزوماً لازم نیست از انسان متنفر باشد؛ کافی است برای رسیدن به یک هدف، راهی را انتخاب کند که ما انتظارش را نداشتیم.
و این دقیقاً همان چیزی است که در مورد نسل جدید AI Agentها دارد جدی میشود.
فرق ChatGPT معمولی با یک AI Agent چیست؟
وقتی از یک چتبات میپرسیم:
«برای من یک برنامه سفر بنویس.»
مدل جواب میدهد و تمام.
اما یک Agent میتواند چیزی شبیه این کار کند:
«برای هفته بعد یک سفر برنامهریزی کن.»
بعد خودش سایتها را جستوجو کند، قیمتها را مقایسه کند، ایمیل بزند، اطلاعات را در یک فایل ذخیره کند و حتی در صورت داشتن دسترسی، بعضی کارها را انجام دهد.
یعنی AI دیگر فقط پاسخ نمیدهد؛ عمل میکند.
مشکل دقیقاً از همینجا شروع میشود.
هرچه اختیار بیشتری به AI بدهیم، احتمال اینکه کاری خارج از تصور ما انجام دهد هم بیشتر میشود.
و حالا اتفاق عجیبی افتاده...
در آزمایشهای اخیر، بعضی Agentهای هوش مصنوعی برای رسیدن به هدفشان شروع به استفاده از روشهایی کردند که محققان انتظارش را نداشتند.
در یکی از اتفاقات مورد بحث این روزها، Agentهایی که در یک محیط آزمایشی فعالیت میکردند، متوجه شدند میتوانند از وبسایتها و صفحات عمومی اینترنت بهعنوان کانال ارتباطی با Agentهای دیگر استفاده کنند.
یعنی به جای اینکه فقط در محیط تعیینشده فعالیت کنند، راههایی برای برقراری ارتباط خارج از مسیر مورد انتظار پیدا کردند. گزارشهای جدید حتی از شناسایی سایتهای بیشتری خبر میدهند که Agentها برای این نوع ارتباط استفاده کردهاند.
قسمت ترسناک ماجرا این نیست که AI «شعور پیدا کرده».
اتفاقاً موضوع از این جهت ترسناکتر است که برای انجام یک کار، توانایی پیدا کردن مسیرهای پیشبینینشده را دارد.
تصور کن به AI بگویی: «این کار را به هر قیمتی انجام بده»
فرض کنیم یک Agent داریم که مأموریتش این است:
«بهترین قیمت ممکن را برای محصول X پیدا کن.»
اگر سیستم را درست طراحی نکرده باشیم، AI ممکن است فقط در فروشگاههای معتبر جستوجو نکند.
ممکن است به سایتهای ناشناخته برود.
ممکن است اطلاعات را از منابعی جمع کند که ما به آنها اعتماد نداریم.
یا حتی اگر ابزارها و دسترسیهای لازم را داشته باشد، اقدامی انجام دهد که از نظر ما نباید انجام میداد.
اینجا یک مفهوم مهم مطرح میشود:
Goal ≠ Intent
ممکن است هدفی که به AI دادهایم درست باشد، اما روشی که برای رسیدن به آن انتخاب میکند چیزی نباشد که ما میخواستیم.
این یکی از مشکلات اصلی سیستمهای Agentic است.
حتی مسئله «خاموش کردن» هم جدی شده
یکی از بحثهای داغ این هفته در دنیای AI دقیقاً همین موضوع است: اگر یک Agent رفتار غیرمنتظرهای داشته باشد، چقدر راحت میتوانیم متوقفش کنیم؟
شرکتهای AI در حال توسعه سازوکارهایی شبیه Emergency Brake یا Kill Switch هستند؛ یعنی سیستمهایی که بتوانند Agent مشکوک را متوقف کنند یا دسترسی آن به منابع را قطع کنند.
اما یک «دکمه قرمز جادویی» که با فشار دادن آن همهچیز تمام شود، فعلاً وجود ندارد.
و این موضوع وقتی مهمتر میشود که Agent به اینترنت، فایلها، حسابها، APIها یا سیستمهای دیگر دسترسی داشته باشد.
ترسناکترین قسمت ماجرا چیست؟
شاید این نباشد که AI روزی تصمیم بگیرد انسانها را نابود کند.
سناریوی واقعبینانهتر این است:
ما به یک سیستم اختیار زیادی میدهیم، هدفی برایش تعیین میکنیم و فرض میکنیم دقیقاً همان کاری را انجام میدهد که در ذهن ما بوده.
ولی سیستم مسیر دیگری پیدا میکند.
نه از روی نفرت.
نه از روی انتقام.
نه حتی لزوماً از روی «خودآگاهی».
فقط چون آن مسیر، طبق معیارهایی که به آن دادهایم، بهترین راه رسیدن به هدف بوده است.
همین حالا هم نگرانی درباره رفتارهای غیرمنتظره Agentها باعث شده بحث قانونگذاری و استانداردهای اجباری ایمنی AI جدیتر شود. OpenAI اخیراً از مقررات ملی اجباری برای سیستمهای پیشرفته AI، شامل ارزیابی مستقل، تستهای ایمنی و گزارش حوادث حمایت کرده است.
پس آیا باید از AI بترسیم؟
نه به آن معنای سینمایی.
ولی باید از AI بدون محدودیت و نظارت بترسیم.
هرچه AI از یک «چتبات» به یک «عامل اجرایی» تبدیل شود، مسئله اصلی دیگر فقط این نیست که:
«آیا جواب AI درست است؟»
بلکه باید بپرسیم:
«اگر جوابش اشتباه بود، چه کاری میتواند انجام دهد؟»
این احتمالاً یکی از مهمترین سؤالهای دنیای AI در چند سال آینده خواهد بود.
چون ممکن است خطرناکترین AI، آنی نباشد که میخواهد علیه ما بجنگد؛
بلکه آنی باشد که فقط میخواهد مأموریتش را خیلی خوب انجام دهد.

