شرکت بیستین (Baseten)، ارائه‌دهنده خدمات استنتاج هوش مصنوعی، در روز چهارشنبه از معرفی یک استاندارد جدید برای زیرساخت ایمنی خبر داد. این شرکت با همکاری پلتفرم میزبانی مدل‌های متن‌باز، هاگینگ‌فیس (Hugging Face) و شرکت گودفایر (Goodfire AI)، تصمیم گرفته است زیرساخت‌هایی را برای ارزیابی و پایش ایمنی مدل‌های هوش مصنوعی با وزن باز توسعه دهد. این اقدام از طریق بازوی پژوهشی بیستین، یعنی «بیس لَبز» (Base Labs)، که اوایل امسال راه‌اندازی شده بود، انجام می‌شود.

پاسخ به چالش‌های ایمنی مدل‌های متن‌باز#

این همکاری در شرایطی اعلام شد که بحث‌های متعددی درباره ایمنی مدل‌های با وزن باز در جریان است. یکی از نگرانی‌های اصلی، استفاده از تکنیکی رو به رشد به نام «آبلیشن» (Abliteration) است که از طریق آن می‌توان لایه‌های ایمنی مدل‌ها را حذف کرد و آن‌ها را برای کاربردهای خطرناک تغییر داد. بر اساس گزارش‌های موجود، هاگینگ‌فیس که میزبان طیف وسیعی از مدل‌های هوش مصنوعی متن‌باز است، در حال حاضر بیش از ۶۰۰۰ مدل دستکاری‌شده یا آبلیشن‌شده را در فهرست خود دارد که نشان‌دهنده وسعت این چالش است.

گروه پژوهشی بیس لَبز برنامه دارد روش‌هایی را برای آموزش و پایش مدل‌های باز توسعه داده و منتشر کند. رویکرد این شرکت، تبدیل فرآیندهای ایمنی به یک «استاندارد» شفاف است که به‌جای اضافه شدن پس از توسعه مدل، از همان ابتدا در فرآیند آموزش و استقرار مدل‌ها تعبیه شود. بیستین در بیانیه‌ای در شبکه اجتماعی X اعلام کرد که باور دارد شفافیت و باز بودن، یک مزیت برای ایمنی هوش مصنوعی است، زیرا امکان دیدن رفتار مدل‌ها و تبدیل پژوهش‌های ایمنی به کنترل‌های عملیاتی و شفاف را فراهم می‌کند.

نقش شرکت‌ها و سرمایه‌گذاری‌ها#

اگرچه جزئیات فنی دقیق این همکاری هنوز فاش نشده است، اما گودفایر در پاسخ به پست بیستین، هدف اصلی را این‌گونه توصیف کرد که «ایمنی باید در مدل‌های باز ساخته شود و توسط ارائه‌دهندگان آن‌ها فراهم گردد.» گودفایر که در زمینه تفسیرپذیری مدل‌ها و باز کردن «جعبه سیاه» هوش مصنوعی تخصص دارد، احتمالاً نقش کلیدی در بخش «تعبیه‌شده» ایمنی خواهد داشت.

بیستین اخیراً در ماه ژوئن، دور سرمایه‌گذاری سری F به مبلغ ۱.۵ میلیارد دلار را جذب کرد که ارزش این شرکت را به ۱۳ میلیارد دلار رساند. شریک آن، گودفایر نیز امسال دور سرمایه‌گذاری سری B به مبلغ ۱۵۰ میلیون دلار را به رهبری بی‌کپیتال (B Capital) جذب کرده است تا پلتفرم تفسیرپذیری مدل‌های خود را پیشرفت دهد. بیستین همچنین از اکوسیستم توسعه‌دهندگان دعوت کرده است تا در این چارچوب جدید مشارکت کنند و اکوسیستمی از مدل‌های بازِ ایمن و در دسترس برای همه ایجاد نمایند.

منبع: TechCrunch AI