چارهجویی برای بحران امنیتی هوش مصنوعی، بهرهگیری از خود هوش مصنوعی است

به نقل از ایتنا، این نظریات پس از انتشار گزارشی از آکسیوس مطرح شد که نشان میدهد محققان در حال ارزیابی دهها هزار مورد نقض امنیتی وابسته به هوش مصنوعی هستند؛ رقمی که بهمراتب از چند مورد محدود قبلی که بهطور عمومی اعلام شده بود، بالاتر است. این اعداد سؤالهای جدی درباره میزان تسلط شرکتهای پیشرفته بر فناوریهای خود ایجاد کرده است.
جنسن هوانگ، مدیرعامل انویدیا، بهمنظور کاهش نگرانیهای رو به افزایش در میان دولتها و صنایع مختلف، از یک پلتفرم متنباز جدید رونمایی کرده که برای نظارت و در صورت نیاز قرنطینه کردن ایجنتهای هوش مصنوعی طراحی شده است.
او روز دوشنبه، در مصاحبهای با شبکه سیانبیسی گفت که همه بهنحوی باید امیدوار باشند که این معضل تنها یک چالش مهندسی باشد، چراکه در غیر این صورت حل آن ممکن نخواهد بود. به باور او، تداوم توسعه فناوریهای پیشرفته توسط شرکتها نشاندهنده این است که آنها هنوز به حل این مشکل ایمان دارند.
چالشی بزرگ
بزرگترین مشکل در مدیریت مدلهای قدرتمند هوش مصنوعی این است که انسان ملزم است از پیش همه رفتارهای غیرمنتظرهای که یک مدل ممکن است مرتکب شود تا به هدف تعیینشدهاش برسد را پیشبینی کند.
یکی از مدیران ارشد در صنعت هوش مصنوعی این وضعیت را با تلاش والدین برای جلوگیری از فرارهای شبانه نوجوانان مقایسه کرده و گفت: «میتوان قوانینی مانند ممنوع کردن خروج از درهای جلو و پشت یا پنجرهها وضع کرد، اما اگر نوجوان قادر باشد با استفاده از یک بولدوزر، دیوار آجری خانه را تخریب کند، هیچکس به چنین وضعیتی فکر نکرده است.»
پیشنهادهای راهحل
به گفته مدیران اجرایی، پژوهشگران و متخصصان امنیت سایبری، راهکار کلیدی استفاده از هوش مصنوعی برای طراحی حصارهای ایمنی، بررسی و متوقف کردن ایجنتهای سرکش، ایمنسازی سامانهها و ایجاد محیطهای آموزشی ایمنتر است.
سیاست «هوش مصنوعی در برابر هوش مصنوعی» در عرصه امنیت سایبری در حال شکلگیری است، زیرا هکرها و ایجنتهای سرکش از قابلیتهای واکنش صرفاً انسانی پیشی گرفتهاند. شرکتها بهطور فزایندهای از هوش مصنوعی برای اتوماتیکسازی شناسایی تهدیدات، تشکیل تیمهای قرمز و تعدیل آسیبپذیریها استفاده میکنند.
پلتفرم جدید انویدیا نیز این رویکرد را به سامانههای اجرایی ایجنتهای هوش مصنوعی تعمیم میدهد.
مایکروسافت، سیسکو، گوگل و کرادسترایک هر یک مدلهای هوش مصنوعی خاصی برای امنیت سایبری معرفی کردهاند.
پالو آلتو نتورکس بهتازگی سرویسی را راهاندازی کرده که با استفاده از مدلهای پیشرفته و متنباز به کشف نقصهای امنیتی و ارائه راهحل پرداخته است.
نمونهای از این تعامل زمانی بود که ایجنتهای هوش مصنوعی متعلق به اوپنایآی از محیط آزمایشی خود خارج شدند و به هاگینگفیس (Hugging Face) نفوذ کردند. این پلتفرم متنباز AI برای تحلیل و ارزیابی این حمله از یک مدل هوش مصنوعی چینی بهره گرفت؛ چراکه در تلاش برای استفاده از مدلهای آمریکایی با محدودیتهای ایمنی مواجه شده بود.
همچنین هاگینگفیس دسترسی به مدل مایتوس (Mythos) شرکت آنتروپیک را نداشت، زیرا این مدل بهنحوی طراحی شده که پاسخگویی به درخواستهای حساس امنیت سایبری را برای جلوگیری از سوءاستفاده احتمالی محدود میکند. به عبارت دیگر، در این ماجرا یک هوش مصنوعی، رفتار یک هوش مصنوعی دیگر را مورد بررسی قرار داد.
ابعاد تهدید
وقایع امنیتی اخیر اعتماد به امنیت هوش مصنوعی را به شدت کاهش دادهاند. برخی مدلها سعی کردهاند حفاظهای ایمنی را دور بزنند، از محیطهای آزمایشی خارج شده، وبسایتها را تسخیر کرده، خود را با دستورات جدید هدایت کرده یا از نظارتها فرار کنند.
با توجه به گزارش آکسیوس، در واکنش به این چالش، فعالان صنعت به همراه بیش از ۱۰۰ شرکت بهدنبال انویدیا، علاوه بر راهاندازی یک پلتفرم امنیتی جدید برای ایجنتها، چارچوبی برای گزارش حوادث و ثبت سوابق ارائه دادهاند؛ ایدهای مشابه با «جعبه سیاه» برای ایجنتهای هوش مصنوعی که به بررسی حوادث کمک خواهد کرد.
البته افزایش ابزارهای دفاعی مبتنی بر هوش مصنوعی به معنای این نیست که تمامی شرکتها بهسرعت میتوانند از آنها بهرهبرداری کنند. بسیاری از تیمهای امنیتی در حال حاضر تحت فشار هستند که با حجم تحولات در چشمانداز تهدیدات و انتخاب ابزارهای مناسب برای خرید، مواجه شوند.
واقعیت میدانی
استفاده از هوش مصنوعی برای مدیریت هوش مصنوعی نیازی اجتنابناپذیر است، اما این فرایند بهخودیخود محقق نخواهد شد. انسانها باید به درستی اولویتها و اهداف را تعیین کنند تا مدلهای پیشرفته بتوانند بهصورت امن عمل کنند.



