قابلیتهای جدید Claude Managed Agents: dreaming، outcomes و هماهنگی چند-عاملی
خلاصهٔ کاملتر
آنتروپیک بهتازگی چند قابلیت مهم برای پلتفرم Claude Managed Agents معرفی کرده که هدفشون اینه ایجنتها بتونن کارهای پیچیدهتر رو با کمترین دخالت انسانی انجام بدن. این قابلیتها شامل dreaming (در مرحلهی پیشنمایش تحقیقاتی)، outcomes، multiagent orchestration و webhooks میشن.
Dreaming یه فرآیند زمانبندیشدهست که سشنها و حافظهی ذخیرهشدهی ایجنت رو بررسی میکنه، الگوهای تکراری رو شناسایی میکنه و حافظه رو طوری مرتب میکنه که همیشه بهروز و پرمحتوا بمونه. این قابلیت الگوهایی رو کشف میکنه که یه ایجنت تنها نمیتونه ببینه؛ از جمله اشتباهات مکرر، روشکارهایی که ایجنتها بهشون میرسن، و ترجیحاتی که در کل یه تیم مشترکه. توسعهدهنده میتونه تعیین کنه که dreaming بهصورت خودکار حافظه رو آپدیت کنه یا قبل از اعمال تغییرات، مرور دستی انجام بشه.
قابلیت outcomes بهت این امکان رو میده که یه معیار (rubric) بنویسی که موفقیت رو تعریف میکنه. ایجنت بر اساس این معیار کار میکنه و یه ارزیاب مجزا (grader) با context window مستقل خودش، خروجی رو ارزیابی میکنه؛ این یعنی ارزیاب تحتتأثیر استدلال ایجنت قرار نمیگیره. اگه چیزی درست نبود، ارزیاب دقیقاً مشخص میکنه چی باید تغییر کنه و ایجنت دوباره تلاش میکنه. در تستهای داخلی آنتروپیک، outcomes نرخ موفقیت تسکها رو تا ۱۰ امتیاز بالاتر از یه حلقهی prompt معمولی برد، و کیفیت تولید فایل هم بهتر شد: +8.4% برای فایلهای docx و +10.1% برای pptx.
Multiagent orchestration برای وقتی طراحی شده که یه تسک خیلی بزرگه که یه ایجنت نمیتونه بهتنهایی انجامش بده. یه ایجنت اصلی (lead agent) کار رو تقسیم میکنه و هر بخش رو به یه ایجنت متخصص با مدل، پرامپت و ابزارهای مخصوص خودش واگذار میکنه. این ایجنتهای متخصص روی یه فایلسیستم مشترک بهصورت موازی کار میکنن. همهی مراحل هم در Claude Console قابل ردیابیه: کدوم ایجنت چه کاری کرده، به چه ترتیبی، و چرا.
تیمهای مختلف از این قابلیتها استفاده کردن و نتایج جالبی گزارش دادن:
- Harvey برای کارهای حقوقی پیچیده از Managed Agents استفاده میکنه. با dreaming، ایجنتهاشون بین سشنها یاد میگیرن و نرخ تکمیل تسکها حدود ۶ برابر شده.
- تیم پلتفرم Netflix یه ایجنت تحلیل لاگ ساخته که لاگهای صدها build از منابع مختلف رو پردازش میکنه و با orchestration موازی، فقط الگوهای ارزشمند رو گزارش میده.
- Wisedocs یه ایجنت بررسی کیفیت اسناد ساخته که با outcomes، هر بررسی رو با دستورالعملهای داخلیشون مقایسه میکنه. بررسیها الان ۵۰٪ سریعتر انجام میشن.
- Spiral از Haiku بهعنوان ایجنت اصلی استفاده میکنه که درخواستها رو مدیریت میکنه و نوشتن را به subagentهای Opus واگذار میکنه. هر پیشنویس با outcomes و یه rubric از اصول سردبیری و صدای کاربر ارزیابی میشه.
Dreaming در مرحلهی پیشنمایش تحقیقاتیه و برای دسترسی باید درخواست بدی. بقیهی قابلیتها (outcomes، multiagent orchestration و memory) در نسخهی بتای عمومی Managed Agents در دسترسن.
نکات کلیدی:
- dreaming حافظهی ایجنتها رو بین سشنها پالایش میکنه و الگوهای مشترک رو استخراج میکنه
- outcomes یه ارزیاب مستقل داره که خروجی ایجنت رو با معیار موفقیت مقایسه میکنه و تا ۱۰ امتیاز بهبود در تسکها ثبت شده
- multiagent orchestration کار بزرگ رو بین ایجنتهای متخصص موازی تقسیم میکنه
- Harvey نرخ تکمیل ۶ برابری، Wisedocs سرعت ۵۰٪ بیشتر با این قابلیتها گزارش دادن
- همهی مراحل اجرا از Claude Console قابل ردیابیه




