قیمت مدل تازهٔ دیپسیک دهها برابر زیر رقبای فرانتیره، ولی تو چند بنچمارک عاملی حتی بالاتر از همونها وایستاده؛ ضعفش یه جای دیگهست.
تیم Claude Code میگه با هر مدل جدید بخش بزرگی از سیستمپرامپتش رو حذف میکنه؛ چون دستورهای ریزی که برای مدل ضعیفتر نوشته شده بودن، حالا جلوی قضاوت خود مدل رو میگیرن.
تو استکهای تولیدی سازمانی بهطور میانگین ۱۴ مدل همزمان کنار هم کار میکنن؛ نویسنده میگه مهارت اصلی محصول دیگه انتخاب مدل نیست، چیدن اونها تو یه workflow قابلعرضهست.
الکس دنکو تو یادداشت جدیدش با کمک فلسفهی فرانسوی توضیح میده چرا انگ «۱۰۰٪ هوش مصنوعی» اینقدر جدی گرفته میشه، حتی از طرف طرفدارای خودِ هوش مصنوعی.
طبق صورتجلسهای درزشده از یه نشست چهارساعته، لیانگ ونفنگ که حالا از آلتمن و آمودی هم ثروتمندتره، داره کل شرطشو رو رسیدن به هوش عمومی مصنوعی میبنده، نه پول درآوردن از محصولای امروزی.
X کد اصلی الگوریتم رتبهبندی «For You» رو رو گیتهاب گذاشته و یه ابزار تازه هم اضافه کرده که باهاش میتونی بفهمی پستهات محدود شدن (شادوبن) یا نه.
علیبابا مدل Qwen3.8-2.4T-A95B رو با ۲.۴ تریلیون پارامتر متنباز کرده؛ رو چند تا آزمون کدنویسی از Opus 4.8 و GPT-5.6 Sol جلو زده، هرچند تو کارهای عمومیتر هنوز از Fable 5 عقبه.
نسخهٔ کامل V4 Pro بیسروصدا روی API اومد و تو بنچمارکهای ترمینال و اتوماسیون تا نوک جدول بالا رفت — با قیمتی که کسری از رقبای همردهشه.
دیپسیک یه فریمورک کدنویسی ایجنتی داده بیرون که ابزار و مدل و حتی ایجنتهای رقیب مثل Codex توش پلاگینان؛ تو یه تست واقعی هم ۲۰ میلیون توکن سوزوند.
قانونهای تازهٔ ایالتی آمریکا چتباتهای همدم رو موظف کردن مرتب بگن انسان نیستن. یه طراح محصول میگه این هشدارها خیلی زود به نویز پسزمینه تبدیل میشن.
دیپسیک یه بستر متنباز برای ساختن agent منتشر کرده که توش مدل، ابزار، سندباکس و رابط کاربری همه پلاگینان و با یه فایل کانفیگ عوض میشن.
چلسی فین میگه رباتها برخلاف چتباتها اجازهٔ اشتباه ندارن؛ راه رسیدن به اتکاپذیری بالای ۹۰ درصد از یادگیری تقویتی میگذره، ولی نه با روشهای مدلهای زبانی.
یه گفتوگوی کمسروصدا بین طراحهای باتجربه در جریانه: خیلیهاشون دارن به بازنشستگی زودهنگام فکر میکنن. Creative Boom سراغ چندتاشون رفته تا ببینه پشت این موج چی میگذره.
سازندههای ادیتور Zed یه اپلیکیشن تازه معرفی کردن که بهجای ادیتور، خودِ گفتگو با ایجنت رو مرکز کار میذاره و کل تیم همزمان توش کد و مکالمه رو میبینن.
قراره توی متن و تصویری که Claude تولید میکنه یه نشان نامرئی جاسازی بشه تا منشأ محتوا قابل تشخیص باشه؛ چیزی که قانون هوش مصنوعی اروپا از سازندهها خواسته.
تیموتی گاورز بعد از حل ده مسئلهٔ باز ریاضی توسط OpenAI دنبال یه الگو گشته: چرا مشهورترین دستاوردهای مدلها از جنس ساختن مثالن، نه اثبات قضیه؟
شرکت CData با Claude Code یه MCP سرور سازمانی ساخت و روی هشت معیار تولیدی تستش کرد؛ نتیجه نشون میده فاصلهٔ «وصل شدن به داده» تا «تحویل قابلاتکای داده» چقدر زیاده.
نسخهٔ تازهٔ مدل تصویرسازی مایکروسافت تو لیدربورد متنبهتصویر آرنا رتبهٔ دوم رو گرفت؛ نسبت به نسخهٔ قبلی ۷۹ امتیاز Elo بالا اومده.
گزارش CloudSEK میگه نسخهٔ آلودهٔ LiteLLM فقط ۴۰ دقیقه روی PyPI بود، ولی همون بازه برای در معرض قرار گرفتن بیش از ۴۳۴ هزار پایپلاین CI/CD کافی بود.
نسخهٔ جدید مدل سازندهٔ Grok اومد؛ ادعا میکنه تو کارهای چندمرحلهای و ساخت اپلیکیشنهای تعاملی از ۴.۵ جلوتره و از همین حالا تو Cursor در دسترسه.