شرکت OpenAI امروز سرویس جدیدی به نام Agents API را در مرحله دسترسی عمومی (Public Beta) عرضه کرد. این سرویس، زیرساخت و چارچوب اجرایی (Harness) که مدل کدنویسی پیشرفته Codex از آن بهره میبرد را به عنوان یک سرویس مدیریتشده در دسترس توسعهدهندگان قرار داده است. هدف اصلی این انتشار، سادهسازی فرآیند ساخت عاملهای هوش مصنوعی قدرتمند است که بتوانند برای مدتهای طولانی فعال باشند و وظایف پیچیده را انجام دهند.
معماری و مفاهیم کلیدی#
این API بر چهار مفهوم اصلی استوار است: «عامل» (Agent) شامل مدل زبانی و ابزارهاست، «محیط» (Environment) فضای ایزولهای برای اجرای دستورات است، «نشست» (Session) نمونهای پایدار از عامل برای انجام کارهاست و «رویدادها» (Events) ورودیها و خروجیهای سیستم را تشکیل میدهند. یک نشست در چهار مرحله مدیریت میشود: ایجاد، پیگیری پیشرفت، تکمیل یا تغییر مسیر، و پاسخگویی به ورودیها. با توجه به پیچیدگیهای موجود در ارکستراسیون چندعاملی، بررسی راهکارهای رقبا مانند مدلهای Fugu Max و Ultra v2 ساکانا AI میتواند دیدگاه کاملتری به شما بدهد. ساکانا AI دو مدل جدید در این حوزه ارائه کرده است.
گزینههای اجرا و استقرار#
یکی از ویژگیهای متمایز Agents API، انعطافپذیری در محل اجرای عاملهاست. توسعهدهندگان میتوانند از سه گزینه استفاده کنند: محیط میزبانیشده توسط OpenAI که همان زیرساخت امنیتی Codex را دارد، محیط شخصی (Self-hosted) که در آن سرور codex exec-server در زیرساخت خود شرکت اجرا میشود، یا محیطهای شریکان تجاری مانند Cloudflare، DigitalOcean و Vercel که یکپارچهسازی سطح بالا ارائه میدهند. برای کاهش هزینههای توکن و بهبود عملکرد در این محیطها، استفاده از تکنیکهایی مانند کشیدن معنایی پیشنهاد میشود. ریسکد سرویس LangCache را برای کاهش هزینههای مدلهای زبانی معرفی کرد.
قابلیتهای فنی و نتایج اولیه#
زیرساخت مدیریتشده توسط OpenAI، وظایف پیچیدهای مانند فشردهسازی خودکار تاریخچه گفتگو (Context Compaction)، جستجوی هوشمند ابزارها و هماهنگی بین چندین عامل فرعی (Subagents) را به صورت پیشفرض انجام میدهد. این یعنی توسعهدهندگان نیازی به نوشتن منطقهای پیچیده برای مدیریت حافظه ندارند. همچنین ابزارهای سنجش عملکرد برای پلاگینها به ابزارهای توسعهدهنده افزوده شده است. آنتروپیک ابزار سنجش عملکرد پلاگینها را به Claude Code افزود.
OpenAI برخی اعداد گزارششده توسط مشتریان اولیه را منتشر کرده است. شرکت Ciridae گزارش کاهش ۴ برابری تأخیر در جریانهای عامل فرعی و افزایش نمره ارزیابی از ۰.۷۱ به ۰.۸۵ را اعلام کرده است. SafetyKit نیز ادعا کرده پس از مهاجرت به این سیستم، هزینه هر پرونده بررسی را ۶۰ درصد کاهش داده است. آنتروپیک پیشنهاد میدهد: سرعت پیشرفت هوش مصنوعی را با نظارت مستقل کنترل کنیم.
از نظر محدودیتها، دادههای ارسال شده به این سرویس صرفاً در ایالات متحده ذخیره میشوند و گزینه حذف کامل دادهها پس از پردازش (Zero Data Retention) در حال حاضر پشتیبانی نمیشود. هزینه استفاده از این سرویس اضافی نیست و کاربران تنها بابت توکنها، استفاده از ابزارها و زمان محاسباتی کانتینر پرداخت خواهند کرد.
منبع: MarkTechPost






دیدگاهها
برای گذاشتن دیدگاه وارد شو
دیدگاهها فقط از حسابهای کاربری پذیرفته میشوند.
ورود / ثبتنامهنوز دیدگاهی ثبت نشده — اولین نفر باش.