شرکت انترپیک (Anthropic) روز سهشنبه مدل جدید هوش مصنوعی خود به نام Opus 5.5 را منتشر کرد. این مدل که در حال حاضر قویترین و گرانترین نسخه در مجموعه سهلایهی محصولات Claude است، طبق ادعای سازنده، رکورد جدیدی در عملکرد کدنویسی و کارهای دانشی ثبت کرده است. نکته قابلتوجه این است که Opus 5.5 در بسیاری از بنچمارکها از مدل بزرگتر Fable پیشی گرفته و در انجام برخی تکالیف غیررسمی موفق عمل کرده که مدل Fable در آنها شکست خورده بود.
یکی از مهمترین تغییرات در این نسخه، کاهش قیمتهاست. هزینهی هر میلیون توکن خروجی در Opus 5.5 به ۲۰ دلار رسیده است؛ در حالی که این رقم در نسخه قبلی ۲۵ دلار بود. سایر معیارهای هزینه نیز کاهش مشابهی داشتهاند. همچنین، سرعت اجرای این مدل افزایش یافته که بازتابی از کاهش محاسبات مورد نیاز برای سرویسدهی به آن است.
در بخش ارتباطات، انترپیک تغییرات قابلتوجهی در نحوهی پاسخدهی مدل ایجاد کرده است. Opus 5.5 کمتر از پیش از اصطلاحات تخصصی (Jargon) استفاده میکند و تمایل دارد اطلاعات کلیدی را در ابتدای پیامهای خود قرار دهد.
تغییرات در استراتژی و ایمنی#
انتشار این مدل تنها دو ماه پس از عرضهی Opus 5 در ۲۴ ژوئیه انجام میشود. انترپیک اعلام کرده که نسخههای بعدی یعنی Sonnet 5.5 و Haiku 5.5 در هفتههای آینده با بهبودهای عملکردی مشابه عرضه خواهند شد.
از نظر ایمنی، انترپیک توضیح داده است که Opus 5.5 از همان محدودیتها و محافظتهایی برخوردار است که برای مدل Fable اعمال میشود. این محدودیتها شامل کنترلهایی بر روی کشف آسیبپذیریها در برنامههای کامپایلشده و توسعهی سلاحهای زیستی است. این انتشار، نخستین عرضهی مدل انترپیک پس از آن است که مدیرعامل این شرکت، داریو آمودی، بر لزوم «تنظیم سرعت» پیشرفتهای هوش مصنوعی تأکید کرده بود تا زمان کافی برای توسعهی راهکارهای همسوسازی (Alignment) فراهم آید.
تحلیل تحریریه#
انتشار Opus 5.5 پیام روشنی برای توسعهدهندگان و سازمانها دارد: انترپیک تلاش میکند تعادلی بین «عملکرد برتر» و «هزینهی منطقی» ایجاد کند. کاهش قیمت توکنها در کنار افزایش سرعت، این مدل را به گزینهای جذاب برای پروژههایی تبدیل میکند که پیشتر به دلیل هزینههای بالای نسخههای Opus از آن صرفنظر میکردند. اما نکتهی کلیدی برای سازندگان ایجنتها این است که این مدل با رویکرد «تنظیم سرعت» (Pacing) منتشر شده است؛ یعنی انترپیک عمداً جلوی برخی از قابلیتهای خطرناک (مانند کشف اکسپلویتها) را گرفته است. بنابراین، اگرچه عملکرد عمومی بهتر شده، اما در کاربردهای خاص امنیتی یا زیستی، دسترسیها همچنان محدود و تحت نظارت باقی خواهد ماند.
منبع: TechCrunch AI






دیدگاهها
برای گذاشتن دیدگاه وارد شو
دیدگاهها فقط از حسابهای کاربری پذیرفته میشوند.
ورود / ثبتنامهنوز دیدگاهی ثبت نشده — اولین نفر باش.