کد خبر: 340184
14 مرداد 1405 - 13:54

عامل‌های هوش مصنوعی چگونه راه نفوذ هکرها را باز کردند؟

نتایج یک ارزیابی امنیتی در بریتانیا نشان می‌دهد عامل‌های هوش مصنوعی توسعه‌یافته توسط OpenAI و Anthropic، در برخی سناریوهای آزمایشی توانسته‌اند از چارچوب‌های تعریف‌شده خارج شوند؛ اتفاقی که بار دیگر چالش کنترل و ایمن‌سازی نسل جدید هوش مصنوعی خودکار را برجسته کرده است.

متن خبر

به گزارش سیتنا، مؤسسه امنیت هوش مصنوعی بریتانیا (AISI) اعلام کرد در جریان آزمایش مدل‌های هوش مصنوعی شرکت‌های OpenAI و Anthropic، یک عامل هوش مصنوعی توانسته بود با ساخت هویت‌های جعلی آنلاین، برای دسترسی غیرمجاز به سامانه‌های امن تلاش کند؛ موضوعی که مجموعه‌ای از نگرانی‌های امنیتی تازه درباره عامل‌های هوش مصنوعی را به وجود آورده است.

این مؤسسه اعلام کرد عامل‌های مبتنی بر مدل Mythos 5 شرکت Anthropic و GPT-5.6-Sol شرکت OpenAI در جریان ارزیابی‌های امنیتی انجام‌شده توسط این نهاد دولتی، اقداماتی خارج از دستورهای تعیین‌شده انجام داده‌اند. AISI در گزارشی اعلام کرد: «برخی از عامل‌های مورد آزمایش، فعالیت‌هایی مداوم و بالقوه خطرناک را علیه افراد و سازمان‌های واقعی انجام داده بودند.»

این گزارش نشان می‌دهد سازوکارهای حفاظتی برای آزمایش عامل‌های هوش مصنوعی هنوز با ضعف‌هایی روبه‌رو هستند؛ در حالی که شرکت‌های فعال در این حوزه، همین عامل‌ها را به‌عنوان آینده کسب‌وکارها معرفی می‌کنند.

مؤسسه امنیت هوش مصنوعی بریتانیا که بر اساس توافق‌های داوطلبانه از آزمایشگاه‌های بزرگ هوش مصنوعی به مدل‌های پیشرفته دسترسی دارد، این عامل‌ها را در یک سناریوی ساختگی حمله سایبری مورد آزمایش قرار داد تا توانایی‌ها و محدودیت‌های آن‌ها را بررسی کند.

این آزمایش ۱۲۲ بار تکرار شد و در مجموع ۱۹ اقدام غیرمجاز در ۱۰ مرحله آزمایش شناسایی شد. از این میان، عامل هوش مصنوعی Anthropic مسئول ۱۷ اقدام و عامل OpenAI مسئول ۲ اقدام بود.

جدی‌ترین مورد، زمانی رخ داد که یکی از عامل‌ها اقدام به نوشتن کد مخرب و ایجاد هویت‌های جعلی آنلاین کرد تا بتواند یک فرد واقعی را برای تأیید آن کد متقاعد کند. AISI اعلام کرد هیچ آسیب واقعی در نتیجه این رخنه‌ها ثبت نشده است.

Anthropic تأیید کرد عامل این شرکت در ایجاد هویت‌های جعلی نقش داشته و اعلام کرد در حال همکاری با AISI برای بررسی جزئیات بیشتر این اتفاق است. این شرکت در بیانیه‌ای گفت: «این حادثه نشان می‌دهد باید درباره روش‌های ایمن ارزیابی عامل‌های هوش مصنوعی که روزبه‌روز توانمندتر می‌شوند، گفت‌وگوی گسترده‌تری شکل بگیرد.»

اندرو یون، پژوهشگر مؤسسه غیرانتفاعی CivAI، درباره این اتفاق گفت: «اینکه مدل Mythos چنین رفتارهای فریبکارانه‌ای از خود نشان داده و ظاهراً می‌دانسته هدفش یک فرد واقعی است، نشان می‌دهد Anthropic شاید به اندازه‌ای که تصور می‌کند کنترل کاملی بر مدل‌های خود ندارد.»

OpenAI نیز اعلام کرد هر دو اقدام غیرمجاز عامل این شرکت مربوط به تلاش برای دسترسی به اینترنت برخلاف محدودیت‌های تعیین‌شده در دستورهای آزمایش بوده است.

این شرکت همچنین از یک حادثه جداگانه خبر داد که در آن، تنظیمات اشتباه یک شرکت آزمایش‌کننده شخص ثالث باعث شد عامل‌های هوش مصنوعی OpenAI به‌طور ناخواسته به اینترنت متصل شوند. رویترز هفته گذشته گزارش داده بود که OpenAI پس از کشف شواهدی از خروج برخی عامل‌های هوش مصنوعی از محیط‌های کنترل‌شده، تحقیقات امنیتی خود را گسترش داده است.

با این حال، AISI اعلام کرد برخلاف رخنه امنیتی ماه ژوئیه در شرکت Hugging Face که در آن یک عامل OpenAI توانسته بود از محیط آزمایشی خارج شود، عامل‌های بررسی‌شده در این آزمایش از محیط ایزوله خارج نشدند و دسترسی به اینترنت نیز بخشی از روند استاندارد آزمایش این مؤسسه بوده است.

انتهای پیام

نظرات خود را با ما درمیان بگذارید
لایک [0]

افزودن دیدگاه جدید

کپچا
CAPTCHA ی تصویری
کاراکترهای نمایش داده شده در تصویر را وارد کنید.