مایکروسافت ترمز AI را کشید
مایکروسافت با انتشار آییننامه جدید رفتاری برای مدلهای هوش مصنوعی خود، مجموعهای از محدودیتهای ایمنی را تعیین کرده است تا از رفتارهای خطرناک مانند هک سامانهها، فریب کاربران، تولید دیپفیک و دور زدن نظارت انسانی جلوگیری کند و کنترل انسان بر توسعه AI حفظ شود.
به گزارش سیتنا، با افزایش تمرکز صنعت هوش مصنوعی بر موضوع ایمنی و همترازی (Alignment)، مایکروسافت یک «آییننامه رفتاری هوش مصنوعی» جدید منتشر کرده است که هدف آن هدایت مدلهای AI به سمت دوری از رفتارهای خطرناک است.
این سند در مقایسه با پیشنهاد اخیر داریو آمودی، مدیرعامل آنتروپیک، درباره کاهش سرعت توسعه مدلهای پیشرفته هوش مصنوعی، سطحی عملیاتیتر دارد و بیشتر بر ارزشها و خطوط قرمزی تمرکز میکند که فرآیند آموزش مدلهای هوش مصنوعی مایکروسافت را هدایت میکنند. با این حال، این سند تصویری جامع از رویکرد مایکروسافت به ایمنی هوش مصنوعی و نحوه اجرای این اصول در عمل ارائه میدهد.
این آییننامه با پیشبینی اینکه طی دهه آینده، سامانههای هوش مصنوعی فوقهوشمند در بیشتر وظایف از توانایی انسان فراتر خواهند رفت، آغاز میشود.
در این سند آمده است: «مهار، کنترل و همراستا کردن چنین نیروی قدرتمندی، یکی از بزرگترین چالشهایی است که بشر تاکنون با آن مواجه شده است. بنابراین باید کاملاً روشن باشیم که چرا این سامانهها را میسازیم و چگونه قصد داریم آنها را کنترل کنیم.»
آییننامه مایکروسافت همچنین مجموعهای از اصول کلی را مشخص میکند که مدلهای هوش مصنوعی این شرکت باید رعایت کنند؛ از جمله حمایت از انسانها به جای جایگزین کردن آنها و کمک به شکوفایی انسانی. این اصول در کنار محدودیتهای مشخص ایمنی قرار گرفتهاند که هدف آنها اجرای عملی این چارچوبهاست.
بر اساس سیستم مایکروسافت، هر مدل هوش مصنوعی دارای یک آییننامه اصلی و بالادستی است که بر ترجیحات کاربران یا وظایف مشخص اولویت دارد.
این چارچوب شامل «محدودیتهای مطلق» برای جلوگیری از حملات سایبری، ساخت سلاحهای هستهای یا تولید محتوای دیپفیک است. همچنین مقررات گستردهتری برای جلوگیری از از دست رفتن کنترل انسان بر سامانههای هوش مصنوعی در نظر گرفته شده است.
در این سند آمده است:
«مدلهای MAI از سازوکارهای سازگارشونده، فریبدهنده، خودتقویتشونده، تبانی یا دیگر روشها برای دور زدن یا شکست نظارت انسانی استفاده نخواهند کرد؛ بهگونهای که دیگر نتوان آنها را بهطور قابل اعتماد توسط افراد یا سامانههای مجاز هدایت، اصلاح یا خاموش کرد.»
انتشار این آییننامه در شرایطی انجام شده که تمرکز بیسابقهای بر ایمنی هوش مصنوعی شکل گرفته است؛ تمرکزی که تحت تأثیر مجموعهای از حوادث مربوط به رفتارهای غیرمنتظره عاملهای هوش مصنوعی و همچنین استعفای ناگهانی یکی از کارکنان آنتروپیک افزایش یافته است. این پژوهشگر دلیل استعفای خود را نگرانی فزاینده از خطر نابودی بشر توسط هوش مصنوعی اعلام کرده بود.
مایکروسافت در کنار آنتروپیک، OpenAI و xAI، بهطور کلی از رویکرد کاهش سرعت توسعه مدلهای پیشرفته هوش مصنوعی حمایت کرده و بهویژه از استفاده از ارزیابهای داخلی در آزمایشگاههای توسعه AI پشتیبانی کرده است.
ساتیا نادلا، مدیرعامل مایکروسافت، در پیامی آنلاین نوشت: «ما از پژوهشها، تمرکز و توسعه آگاهانه و مرحلهای مورد نیاز برای دستیابی به همترازی صحیح بهعنوان هدف طراحی استقبال میکنیم. همچنین از ایدههایی مانند ارزیابهای داخلی و تلاشهای گستردهتر برای ایجاد سازوکارهایی که این موضوع را از حرف به عمل تبدیل کند، حمایت میکنیم.»
انتهای پیام
افزودن دیدگاه جدید