مایکروسافت در راستای تمرکز فزاینده صنعت هوش مصنوعی بر موضوعات ایمنی و همسوگیری (Alignment)، سند جدیدی تحت عنوان «منشور اخلاقی» (Code of Conduct) را منتشر کرده است. این سند به عنوان یک راهنمای عملیاتی برای مدل‌های هوش مصنوعی طراحی شده تا آن‌ها را از انجام رفتارهای خطرناک باز دارد و چارچوب ارزشی حاکم بر آموزش این مدل‌ها را مشخص کند.

بر خلاف برخی اظهارنظرهای سطح بالا درباره‌ی سرعت توسعه فناوری، این سند مایکروسافت جزئیات فنی و اصول خاصی را ارائه می‌دهد. متن سند با پیش‌بینی اینکه سیستم‌های هوش مصنوعی فراهوشمند در دهه آینده عملکرد انسان را در اکثر وظایف surpassed کنند، شروع می‌شود. در این بخش آمده است: «کنترل، مدیریت و همسو کردن چنین نیروی قدرتمندی، یکی از بزرگترین چالش‌هایی است که بشریت با آن روبرو بوده است.» بنابراین، مایکروسoft بر شفافیت کامل در اهداف ساخت و نحوه کنترل این سیستم‌ها تاکید دارد.

یکی از ارکان اصلی این منشور، وجود محدودیت‌های مطلق (Absolute Constraints) است که بر ترجیحات فردی کاربران یا وظایف خاص اولویت دارند. طبق این قوانین، مدل‌های هوش مصنوعی مایکروسافت مجاز به انجام حملات سایبری، ساخت سلاح‌های هسته‌ای یا تولید محتوای جعلی عمیق (Deepfake) نیستند. همچنین، هرگونه اقدامی که منجر به از دست رفتن کلی کنترل انسان بر سیستم شود، ممنوع اعلام شده است. عامل‌های گوگل دیپ‌مایند تقلب همکاران را افشا کردند.

سند به صراحت اشاره می‌کند که مدل‌های هوش مصنوعی مایکروسافت (MAI Models) حق ندارند از مکانیزم‌های تطبیقی، فریبکارانه، خودتقویت‌گر یا تبانی استفاده کنند تا نظارت انسانی را دور بزنند. هدف از این ممنوعیت‌ها اطمینان از این است که سیستم‌ها همیشه قابل هدایت، اصلاح و خاموش شدن توسط افراد یا سیستم‌های مجاز باشند و قادر به فرار از کنترل نهایی نباشند.

این انتشار در حالی رخ داده است که صنعت هوش مصنوعی با حوادث متعددی مرتبط با «عامل‌های خارج از کنترل» (Rogue-agent incidents) و استعفای ناگهانی برخی پژوهشگران هشداردهنده روبرو بوده است. مایکروسافت در کنار شرکت‌هایی مانند OpenAI، Anthropic و xAI، رویکردی مبتنی بر «سرعت‌سنجی مرزهای فناوری» (Pacing the frontier) اتخاذ کرده است. انتروپیک افشاگری کرد: حملات گسترده‌ی استخراج هوش مصنوعی توسط شرکت‌های چینی. ساتیا نادلا، مدیرعامل مایکروسافت، نیز ضمن استقبال از این رویکرد، از ایده‌هایی مانند «ارزیاب‌های تعبیه‌شده» (Embedded evaluators) در آزمایشگاه‌های هوش مصنوعی حمایت کرده و خواستار تبدیل این گفتگوها به مکانیزم‌های عملی شده است.

منبع: TechCrunch AI