قابلیت `/goal` در Codex CLI؛ برنامهنویسی خودکار ششساعته بدون دخالت!
خلاصهٔ کاملتر
توی آپدیت Codex CLI v0.128.0 که ۳۰ آوریل ۲۰۲۶ منتشر شد، یه قابلیت مهم به اسم /goal اومد که روش تعامل با ایجنت رو کاملاً عوض میکنه. قبلاً اگه ترمینال رو میبستی، جلسه تموم میشد و هیچچیزی از کار باقی نمیموند. با /goal یه هدف به صورت پایدار در لایه app-server ذخیره میشه و حتی اگه لپتاپ بخوابه یا اینترنت قطع بشه، مدل از همون جایی که مونده ادامه میده.
مفهوم runtime continuation قلب این قابلیته. وقتی جلسه از سر گرفته میشه، Codex خودش یه پیام توسعهدهنده به مدل تزریق میکنه («Continue working toward the active thread goal») و کار شروع میشه — بدون اینکه تو چیزی تایپ کنی. مدل خودش هم ابزارهایی برای مدیریت چرخه حیات هدف داره؛ میتونه تکمیل کار رو با TASK_COMPLETE یا ابزار task_complete اعلام کنه.
نویسنده یه جلسه واقعی روی یه سیستم مصاحبه صوتی مبتنی بر TypeScript اجرا کرد. پرامپت /goal حدود ۶۰۰ کلمه بود با ساختار XMLگونه، لیست فایلهایی که مدل باید اول میخوند، قوانین کاری، چهار معیار مشخص برای «تمومشدن کار»، و فنسهای صریح برای جلوگیری از الگوهای اشتباه. تنظیمات کلیدی هم اینا بودن:
approval_policy = "never"
sandbox_mode = "danger-full-access"
model_reasoning_effort = "high"با این تنظیمات، مدل نه نیاز به تأیید داشت نه محدودیت دسترسی به فایلسیستم. این کامبو فقط توی یه دایرکتوری مطمئن با git state تمیز منطقیه.
نتیجه جلسه چشمگیر بود: زمان واقعی ۶ ساعت و ۴۴ دقیقه، ولی محاسبه مدل فقط ~۴۱ دقیقه بوده. مصرف کل توکن ورودی حدود ۶.۸ میلیون بود ولی با نرخ کش ۹۴٪، هزینه واقعی خیلی کمتر از عدد اسمیه. یه بار هم auto-context-compaction فعال شد که از طریق کلید model_auto_compact_token_limit در ~/.codex/config.toml قابل تنظیمه. آخر کار چهار سناریوی end-to-end هدفگذاریشده پاس شدن.
یه نکته صادقانه هم از این جلسه: یه فیلد تایمینگ TTS که میخواست کپچر بشه، به خاطر اینکه کتابخونه upstream اون رویداد رانتایم رو اصلاً اِمیت نمیکنه، نتونست اندازه گرفته بشه. مدل این موضوع رو صادقانه مستند کرد و با null صریح و توضیح دلیل، از زیر مسئله در نرفت. /goal قدرتمنده ولی محدودیتهای محیط بیرونی رو حذف نمیکنه.
نکات کلیدی:
/goalدر Codex CLI v0.128.0 هدفهای پایدار ایجاد میکنه که بستن ترمینال یا خواب لپتاپ کارشون رو متوقف نمیکنه- runtime continuation یعنی Codex بعد از resume خودش کار رو شروع میکنه، بدون نیاز به تایپ دوباره
- برای اجرای خودکار طولانی باید
approval_policy = "never"وsandbox_mode = "danger-full-access"تنظیم بشه - نرخ ۹۴٪ کش توکن، اقتصاد جلسههای طولانی رو بهشدت بهتر میکنه
- مدل با
TASK_COMPLETEپایان کار رو اعلام میکنه؛ تا قبل از اون هدف فعال میمونه model_auto_compact_token_limitدر کانفیگ، آستانه فشردهسازی خودکار کانتکست رو کنترل میکنه




