راهنمای تابستان ۲۰۲۶: کدوم هوش مصنوعی رو انتخاب کنیم؟
خلاصهٔ کاملتر
مولیک هر چند ماه یه راهنما برای آدمهایی مینویسه که میخوان با هوش مصنوعی کاری از پیش ببرن، و به گفتهٔ خودش این بار خیلی چیزها فرق کرده. تا همین اواخر «استفاده از AI» یعنی گفتوگوی رفتوبرگشتی با یه چتبات؛ حالا یعنی سیستم ایجنتی — مدل بهعلاوهٔ مجموعهای از ابزارها که بهش اجازه میده برنامه بریزه و عمل کنه. خلاصهاش اینه که به مدل یه کامپیوتر میدی.
توصیهاش دو بخش داره. برای دستور پخت و سؤالهای کماهمیت، مدلهای رایگان بهقدر کافی خوبن و هر کدوم رو دوست دارین انتخاب کنین. ولی برای موضوعهای پرریسک مثل نظر دوم دربارهٔ یه مسئلهٔ پزشکی یا حقوقی، نویسنده میگه باید سراغ پیشرفتهترین مدلهای در دسترس برین — Opus و Fable در Claude یا GPT-5.6 Sol در ChatGPT، با سطح تفکر بالا — چون نرخ خطاشون کمتره، هرچند هزینه دارن.
برای کار واقعی، به گفتهٔ او عملاً دو گزینه هست: ChatGPT یا Claude، از ماهی ۲۰ دلار. دو راه هم برای «کامپیوتر دادن» به مدل وجود داره: کامپیوتر مجازی خودِ شرکت (حالت Work در ChatGPT و Cowork در Claude) یا کامپیوتر شخصی خودتون (Codex و Claude Code). حالت اول نتیجهٔ آماده تحویل میده، حالت دوم خودِ فرایند — فایلهایی که عوض میشن، دستورهایی که اجرا میشن — رو نشون میده و برای پروژههای چندفایلی و طولانی قویتره.
نویسنده یه تجربهٔ مشخص تعریف میکنه: به هر دو سیستم گفته به ایمیلش وصل شن و برای سمینار دوشنبه آمادهاش کنن. هر دو حدود ده دقیقه کار کردن و کلی مواد آموزشی ساختن، ولی Claude فقط پیشنویس ایمیل آماده کرد و ChatGPT واقعاً ایمیل رو فرستاد — چون از قبل اجازهٔ ارسال گرفته بود. درس ماجرا از نظر او اینه که تنظیمات مجوز خیلی مهمن و تا وقتی به سیستم اعتماد ندارین، همهچی رو روی «اول بپرس» بذارین؛ این جلوی خطر دوم یعنی prompt injection رو هم میگیره، مشکلی که به گفتهٔ او هنوز حل نشده.
مولیک میگه کتاب تازهاش رو با اینکه ویراستاری حرفهای شده بود، به GPT-5.6 Sol در Codex داد؛ مدل نیم ساعت کار کرد، ۱۹۵ ارجاع رو بررسی کرد و صفحهها یادداشت داد، بدون حتی یه شمارهٔ صفحهٔ ساختگی — فقط بیشازحد ریزبین بود. تجربهٔ او اینه که کار با این سیستمها بیشتر شبیه مدیریت کردنه تا چت کردن.
دربارهٔ بقیه هم نظرش صریحه: Copilot برای اسناد آفیس قابل قبوله ولی در توانایی ایجنتی خیلی عقبه؛ مدلهای open weights چینی مثل Kimi K3، DeepSeek و Qwen شگفتآور توانان ولی استفاده ازشون تخصص میخواد؛ و گوگل به گفتهٔ او نه مدل پیشتاز داره نه چیزی نزدیک به Codex و Claude Code، هرچند Gemini Notebook برای پژوهش چندمنبعی بهترین رابطه و Gemini Omni میتونه ویدیو رو مستقیم ببینه و ویرایش کنه. جمعبندیاش سادهست: یکی رو انتخاب کن، ۲۰ دلار بده، و یه کار واقعی بهش بسپار.
نکات کلیدی:
- برای کارهای کماهمیت هر مدل رایگانی کافیه؛ برای موضوعهای پرریسک سراغ قویترین مدل برین
- دو مسیر ایجنتی: کامپیوتر ابری شرکت (Work/Cowork) یا کامپیوتر خودتون (Codex/Claude Code)
- تنظیمات مجوز حیاتیه و بهترین دفاع فعلی در برابر prompt injection ـه
- بازخوانی کتاب با ۱۹۵ ارجاع در نیم ساعت و بدون ارجاع ساختگی انجام شد
- گوگل از نظر نویسنده عقب افتاده، ولی Gemini Notebook و Gemini Omni هنوز برگ برندهان




