شرکت OpenAI امروز سرویس جدیدی به نام Agents API را در مرحله دسترسی عمومی (Public Beta) عرضه کرد. این سرویس، زیرساخت و چارچوب اجرایی (Harness) که مدل کدنویسی پیشرفته Codex از آن بهره می‌برد را به عنوان یک سرویس مدیریت‌شده در دسترس توسعه‌دهندگان قرار داده است. هدف اصلی این انتشار، ساده‌سازی فرآیند ساخت عامل‌های هوش مصنوعی قدرتمند است که بتوانند برای مدت‌های طولانی فعال باشند و وظایف پیچیده را انجام دهند.

معماری و مفاهیم کلیدی#

این API بر چهار مفهوم اصلی استوار است: «عامل» (Agent) شامل مدل زبانی و ابزارهاست، «محیط» (Environment) فضای ایزوله‌ای برای اجرای دستورات است، «نشست» (Session) نمونه‌ای پایدار از عامل برای انجام کارهاست و «رویدادها» (Events) ورودی‌ها و خروجی‌های سیستم را تشکیل می‌دهند. یک نشست در چهار مرحله مدیریت می‌شود: ایجاد، پیگیری پیشرفت، تکمیل یا تغییر مسیر، و پاسخگویی به ورودی‌ها. با توجه به پیچیدگی‌های موجود در ارکستراسیون چندعاملی، بررسی راهکارهای رقبا مانند مدل‌های Fugu Max و Ultra v2 ساکانا AI می‌تواند دیدگاه کامل‌تری به شما بدهد. ساکانا AI دو مدل جدید در این حوزه ارائه کرده است.

گزینه‌های اجرا و استقرار#

یکی از ویژگی‌های متمایز Agents API، انعطاف‌پذیری در محل اجرای عامل‌هاست. توسعه‌دهندگان می‌توانند از سه گزینه استفاده کنند: محیط میزبانی‌شده توسط OpenAI که همان زیرساخت امنیتی Codex را دارد، محیط شخصی (Self-hosted) که در آن سرور codex exec-server در زیرساخت خود شرکت اجرا می‌شود، یا محیط‌های شریکان تجاری مانند Cloudflare، DigitalOcean و Vercel که یکپارچه‌سازی سطح بالا ارائه می‌دهند. برای کاهش هزینه‌های توکن و بهبود عملکرد در این محیط‌ها، استفاده از تکنیک‌هایی مانند کشیدن معنایی پیشنهاد می‌شود. ریسکد سرویس LangCache را برای کاهش هزینه‌های مدل‌های زبانی معرفی کرد.

قابلیت‌های فنی و نتایج اولیه#

زیرساخت مدیریت‌شده توسط OpenAI، وظایف پیچیده‌ای مانند فشرده‌سازی خودکار تاریخچه گفتگو (Context Compaction)، جستجوی هوشمند ابزارها و هماهنگی بین چندین عامل فرعی (Subagents) را به صورت پیش‌فرض انجام می‌دهد. این یعنی توسعه‌دهندگان نیازی به نوشتن منطق‌های پیچیده برای مدیریت حافظه ندارند. همچنین ابزارهای سنجش عملکرد برای پلاگین‌ها به ابزارهای توسعه‌دهنده افزوده شده است. آنتروپیک ابزار سنجش عملکرد پلاگین‌ها را به Claude Code افزود.

OpenAI برخی اعداد گزارش‌شده توسط مشتریان اولیه را منتشر کرده است. شرکت Ciridae گزارش کاهش ۴ برابری تأخیر در جریان‌های عامل فرعی و افزایش نمره ارزیابی از ۰.۷۱ به ۰.۸۵ را اعلام کرده است. SafetyKit نیز ادعا کرده پس از مهاجرت به این سیستم، هزینه هر پرونده بررسی را ۶۰ درصد کاهش داده است. آنتروپیک پیشنهاد می‌دهد: سرعت پیشرفت هوش مصنوعی را با نظارت مستقل کنترل کنیم.

از نظر محدودیت‌ها، داده‌های ارسال شده به این سرویس صرفاً در ایالات متحده ذخیره می‌شوند و گزینه حذف کامل داده‌ها پس از پردازش (Zero Data Retention) در حال حاضر پشتیبانی نمی‌شود. هزینه استفاده از این سرویس اضافی نیست و کاربران تنها بابت توکن‌ها، استفاده از ابزارها و زمان محاسباتی کانتینر پرداخت خواهند کرد.

منبع: MarkTechPost