شرکت انترپیک (Anthropic) روز سه‌شنبه مدل جدید هوش مصنوعی خود به نام Opus 5.5 را منتشر کرد. این مدل که در حال حاضر قوی‌ترین و گران‌ترین نسخه در مجموعه سه‌لایه‌ی محصولات Claude است، طبق ادعای سازنده، رکورد جدیدی در عملکرد کدنویسی و کارهای دانشی ثبت کرده است. نکته قابل‌توجه این است که Opus 5.5 در بسیاری از بنچمارک‌ها از مدل بزرگ‌تر Fable پیشی گرفته و در انجام برخی تکالیف غیررسمی موفق عمل کرده که مدل Fable در آن‌ها شکست خورده بود.

یکی از مهم‌ترین تغییرات در این نسخه، کاهش قیمت‌هاست. هزینه‌ی هر میلیون توکن خروجی در Opus 5.5 به ۲۰ دلار رسیده است؛ در حالی که این رقم در نسخه قبلی ۲۵ دلار بود. سایر معیارهای هزینه نیز کاهش مشابهی داشته‌اند. همچنین، سرعت اجرای این مدل افزایش یافته که بازتابی از کاهش محاسبات مورد نیاز برای سرویس‌دهی به آن است.

در بخش ارتباطات، انترپیک تغییرات قابل‌توجهی در نحوه‌ی پاسخ‌دهی مدل ایجاد کرده است. Opus 5.5 کمتر از پیش از اصطلاحات تخصصی (Jargon) استفاده می‌کند و تمایل دارد اطلاعات کلیدی را در ابتدای پیام‌های خود قرار دهد.

تغییرات در استراتژی و ایمنی#

انتشار این مدل تنها دو ماه پس از عرضه‌ی Opus 5 در ۲۴ ژوئیه انجام می‌شود. انترپیک اعلام کرده که نسخه‌های بعدی یعنی Sonnet 5.5 و Haiku 5.5 در هفته‌های آینده با بهبودهای عملکردی مشابه عرضه خواهند شد.

از نظر ایمنی، انترپیک توضیح داده است که Opus 5.5 از همان محدودیت‌ها و محافظت‌هایی برخوردار است که برای مدل Fable اعمال می‌شود. این محدودیت‌ها شامل کنترل‌هایی بر روی کشف آسیب‌پذیری‌ها در برنامه‌های کامپایل‌شده و توسعه‌ی سلاح‌های زیستی است. این انتشار، نخستین عرضه‌ی مدل انترپیک پس از آن است که مدیرعامل این شرکت، داریو آمودی، بر لزوم «تنظیم سرعت» پیشرفت‌های هوش مصنوعی تأکید کرده بود تا زمان کافی برای توسعه‌ی راهکارهای همسوسازی (Alignment) فراهم آید.

تحلیل تحریریه#

انتشار Opus 5.5 پیام روشنی برای توسعه‌دهندگان و سازمان‌ها دارد: انترپیک تلاش می‌کند تعادلی بین «عملکرد برتر» و «هزینه‌ی منطقی» ایجاد کند. کاهش قیمت توکن‌ها در کنار افزایش سرعت، این مدل را به گزینه‌ای جذاب برای پروژه‌هایی تبدیل می‌کند که پیش‌تر به دلیل هزینه‌های بالای نسخه‌های Opus از آن صرف‌نظر می‌کردند. اما نکته‌ی کلیدی برای سازندگان ایجنت‌ها این است که این مدل با رویکرد «تنظیم سرعت» (Pacing) منتشر شده است؛ یعنی انترپیک عمداً جلوی برخی از قابلیت‌های خطرناک (مانند کشف اکسپلویت‌ها) را گرفته است. بنابراین، اگرچه عملکرد عمومی بهتر شده، اما در کاربردهای خاص امنیتی یا زیستی، دسترسی‌ها همچنان محدود و تحت نظارت باقی خواهد ماند.

منبع: TechCrunch AI