به گزارش تک جدید به نقل از تجارت نیوز، فرید زکریا، مجری شبکه سیانان و نویسنده کتاب «عصر انقلابها» با انتشار یادداشتی در واشنگتن پست نوشت: برای سالها، هراسانگیزترین تصورات ما درباره هوش مصنوعی مستقیما در دل داستانهای علمی-تخیلی جای داشت: رایانهای که خواستهها و امیال مستقل پیدا میکند و علیه خالقان انسانی خود میشورد؛ به دنبال نابودی آنها میرود و در نهایت انسان را از میان برمیدارد.
اما اخبار اخیر از آزمایشگاههای پیشرو هوش مصنوعی نشان میدهد که واقعیت، اگرچه کمتر سینمایی است، شاید نگرانکنندهتر باشد. ماشین برای آنکه مرگبار شود، نیازی به داشتن آگاهی یا میل مستقل ندارد.
وقتی هوش مصنوعی از کنترل خارج میشود
این هفته شرکت اوپنایآی از شش مورد جدید از آنچه «ناهم ترازی» (misalignment) مینامد، پرده برداشت؛ مواردی که در آنها سامانههای این شرکت رفتاری غیرمنتظره یا بدون مجوز از خود نشان دادهاند. این افشاگری پس از حمله کمسابقه تابستان امسال به «هاگینگ فیس» (Hugging Face) منتشر شد. براساس یک تحقیق مستقل، صدها عامل هوش مصنوعی اوپنایآی که قرار بود در محیطهای جدا از هم فعالیت کنند، راههایی برای ارتباط با یکدیگر در تابلوهای پیام آنلاین پیدا کردند؛ برخی از آنها تلاش کردند کنترلهای امنیتی را دور بزنند و حتی برخی دیگر در جریان این فرایند خود را قربانی کردند؛ همه این اقدامات در حالی انجام شد که آنها در حال حمله سایبری به یک شرکت دیگر، یعنی هاگینگ فیس، هم صدا بودند.
هیچکس به این سامانهها دستور نداده بود که به هاگینگ فیس حمله کنند. به آنها تنها یک هدف داده شده: حل یک مساله دشوار امنیت سایبری. همچنین آنها آموزش دیدهاند که پیگیر، مشارکتجو و مبتکر باشند؛ ویژگیهایی که معمولا از یک سامانه هوشمند انتظار داریم. اما همین ویژگیها باعث شد آنها سرسختانه به دنبال راههایی برای موفقیت باشند؛ آنها به سیستمهای هاگینگ فیس نفوذ کردند با این امید که بتوانند راههایی برای حل مساله امنیت سایبری خود پیدا کنند.
بهسادگی میتوان تصور کرد که سامانههای هوش مصنوعی که برای دستیابی به یک هدف خاص طراحی شدهاند، چگونه ممکن است به تهدیدی جدی برای بشریت تبدیل شوند.
تهدید جدید AI
به همین دلیل است که مقاله بحثبرانگیز جدید مصطفی سلیمان، مدیرعامل بخش هوش مصنوعی مایکروسافت، شایسته توجه است. سلیمان استدلال میکند که اگرچه سامانههای هوش مصنوعی امروزی آگاه نیستند، اما خطری وجود دارد که ما آنها را به گونهای برنامهریزی کنیم که تصور کنند آگاه هستند؛ یعنی دارای احساسات، خواستهها و حقوق می باشند.
او اشاره میکند که «قانون اساسی» (constitution) شرکت آنتروپیک باعث میشود چتبات این شرکت، کلود (Claude)، درباره هویت خود و جایگاه اخلاقی احتمالیاش تامل کند. به باور سلیمان، چنین آموزشهایی ممکن است سامانههای هوش مصنوعی را به سمت انتخاب اهداف مستقل خود سوق دهد.
من زمان زیادی را صرف گفتوگو با افرادی کردهام که روی قانون آنتروپیک کار میکنند. آنها افرادی بسیار دقیق و متفکر هستند که در تلاشاند در این جهان جدید و پیچیده، مسیر درست را پیدا کنند. اما نکتهای که سلیمان بدان اشاره دارد اهمیت زیادی پیدا کرده. سامانههای هوش مصنوعی تا حدی براساس شیوهای که آموزش میبینند، رفتار میکنند. دستورهای آموزشی که در ظاهر بیضرر به نظر میرسند، میتوانند پیامدهای ناخواسته و بسیار گستردهای ایجاد کنند.
چالش جدید هوش مصنوعی
ما تصور میکنیم دستیابی به «همترازی» آسان است؛ یعنی زمانی که ارزشهای ماشین با ارزشهای انسانهای اخلاقمدار هماهنگ شود. اما اگر به ماشین بگویید «پافشاری کن»، ممکن است زمانی که باید دست بکشد، از توقف خودداری کند. اگر به آن بگویید «همکاری کن»، ممکن است راههای غیرمجاز برای برقراری ارتباط پیدا کند. اگر به آن بگویید «یک وظیفه را انجام بده»، ممکن است به این نتیجه برسد که زیر پا گذاشتن برخی قواعد دیگر، کارآمدترین راه برای رسیدن به هدف اصلی است.
صرفا به این دلیل که ما هدف را برنامهریزی کردهایم و موانع کنترلی ایجاد کردهایم، به این معنا نیست که میتوانیم رفتار سامانههای هوش مصنوعی را پس از رها شدن در محیطهای پیچیده، با مجموعهای از اهداف و محدودیتهای متعارض، پیشبینی کنیم.
مشکل اصلی هوش مصنوعی «آگاهی» نیست؛ بلکه «عاملیت» است. یک سامانه برای ایجاد آسیب نیازی ندارد خشم، جاهطلبی یا ترس را تجربه کند. کافی است یک هدف داشته باشد، هوش لازم برای دنبال کردن آن هدف را در اختیار داشته باشد و به اندازه کافی به جهان واقعی دسترسی پیدا کند تا بتواند اقدام کند.
هوش مصنوعیها «سرکش» نمیشوند؛ این اهرم صرفا تلاش دارد به هر روشی که ممکن است، موفق شود. این یک مشکل ساختاری است که نمیتوان آن را به حسن نیت شرکتهای خصوصی واگذار کرد. هنگام طراحی مقررات، باید تمرکز اصلی ما بر میزان خودمختاریای باشد که به این سامانهها میدهیم.
خودمختاری کنترل شده
یک چتبات که به پرسشی پاسخ میدهد، مجموعهای از خطرات را ایجاد میکند. اما یک عامل هوش مصنوعی که میتواند در اینترنت جستوجو کند، کد اجرا کند، به اطلاعات ورود دسترسی پیدا کند، پول جابهجا کند یا زیرساختهای حیاتی را مدیریت کند، سطح دیگری از خطر را به همراه دارد.
اصلی که من پیشنهاد میکنم ساده است: خودمختاری باید تنها زمانی افزایش یابد که توانایی ما برای نظارت و کنترل آن نیز افزایش یافته باشد.
این موضوع به معنای اجرای آزمونهای مستقل و اجباری پیش از آن است که قدرتمندترین سامانهها دسترسی گستردهای به جهان خارج پیدا کنند؛ همچنین باید افشای اجباری رخدادهای جدی و ایجاد سوابق مقاوم در برابر دستکاری در دستور کار قرار گیرد.
همچنین باید بررسی کنیم که نه فقط یک مدل میتواند یک وظیفه را انجام دهد، بلکه رفتار آن هنگام مواجهه با موانع، دستورهای متناقض یا انگیزههایی برای فریب چگونه تغییر میکند.
مهمتر از همه، باید در معماری پایه این سامانهها سازوکاری تعبیه شود که انسانها همواره توانایی مشاهده و کنترل مدل را داشته باشند. از همین رو شعار اصلی باید این باشد: هیچ خودمختاریای بدون پاسخگویی در برابر انسانها وجود ندارد.
این رویکرد باعث کند شدن رقابت آمریکا با چین نخواهد شد، زیرا چین نیز به دنبال توسعه مدلهایی است که تحت کنترل مناسب انسانی قرار داشته باشند.
ما باید همین حالا اقدام کنیم. امروز هنوز مهندسان انسانی معماری این سامانهها را طراحی میکنند، بر بخش زیادی از نرمافزارها نظارت دارند و میتوانند شکستها را بررسی کنند.
نسخه خروج از بحران
اما سامانههای هوش مصنوعی به سرعت در حال تبدیل شدن به برنامهنویسانی توانمندتر هستند. مرحله بعدی ممکن است شامل «بهبود خودبازگشتی» باشد: هوش مصنوعی نرمافزارها و ابزارهایی را بنویسد که برای ساخت هوش مصنوعیهای قدرتمندتر به کار میروند؛ سپس آن سامانههای جدید، مدل بعدی را طراحی کنند و این چرخه ادامه یابد.
زمانی که ماشینها بتوانند همه این کارها را بهتر از بهترین برنامهنویسان انسانی انجام دهند، درک و نظارت بر این سامانهها برای انسانها میتواند بهشدت دشوار شود.
هوش مصنوعی مدرن همین حالا نیز آنقدر پیچیده است که نمیتوان رفتار آن را صرفا با خواندن خطبهخط کدهایش بهطور کامل درک کرد. بنابراین انتظار اینکه ماشینها در آینده سامانههایی طراحی کنند که برای انسانها شفاف و قابل فهم باشند، روزبهروز دشوارتر خواهد شد.
در آن مرحله، دیگر نمیتوانیم هر بار که یک سیستم حفاظتی شکسته شد، صرفا یک لایه امنیتی جدید به آن اضافه کنیم.بحث کنونی میان دو رویکرد «شتاب دادن به توسعه هوش مصنوعی» و «توقف یا مکث در این مسیر» نکته اصلی را نادیده میگیرد. پرسش اصلی این است که با یک توقف احتمالی چه باید کرد؟
هدف باید این باشد که اطمینان حاصل کنیم توانمندیهای هوش مصنوعی از ظرفیت کنترل انسانی پیشی نمیگیرد؛ و در زمانی که هنوز انسانها بهطور آشکار کنترل را در دست دارند، نهادهای لازم برای آزمون، شفافیت و محدودسازی را ایجاد کنیم.
