GLM-5.2: بهترین مدل زبانی متنباز تا این لحظه
خلاصهٔ کاملتر
بلاگر معروف حوزهی هوش مصنوعی، TheZvi، تو یه پست مفصل به بررسی مدل تازه منتشرشدهی GLM-5.2 از شرکت چینی Z.ai پرداخته. به گفتهی نویسنده، این مدل قدم بزرگی نسبت به GLM-5.1 برداشته و احتمالاً الان قویترین مدل متنباز دنیاست، هرچند هنوز فاصلهی محسوسی با مدلهای فرانتیر بسته داره.
تو بنچمارک Artificial Analysis، این مدل نمرهی ۵۱ گرفته که فقط از Fable (۶۰)، Opus 4.8 (۵۶)، GPT-5.5 (۵۵) و Opus 4.7 (۵۴) عقبتره. تو بنچمارکهای دیگه مثل LiveBench و Vals.ai هم رتبههای بالایی بین مدلهای متنباز داره؛ حتی تو PosttrainBench رتبهی اول رو گرفته. اما نویسنده تأکید میکنه که هرچی بنچمارک کمتر قابل هدفگیری باشه، عملکرد GLM-5.2 هم افت بیشتری نشون میده و این میتونه نشونهی یهجور «بنچمکس شدن» (بهینه شدن روی خود بنچمارکها) باشه.
قیمت API این مدل ۱.۴۰ دلار برای ورودی، ۰.۲۶ دلار برای ورودی کششده و ۴.۴۰ دلار برای خروجی به ازای هر میلیون توکنه؛ پایینتر از مدلهای بستهی بزرگ، ولی نسبت به مدلهای متنباز دیگه گرونتر حساب میشه، چون توکن زیادی مصرف میکنه. تو تست EQ-Bench برای نگارش خلاقانه رتبهی ۸ رو گرفته و رو Vending-Bench 2 هم نمرهی بالایی آورده، اما تو تست ضدچاپلوسی You're Absolutely Right عملکرد ضعیفی داشته.
نویسنده به شواهدی اشاره میکنه که نشون میده GLM-5.2 احتمالاً از Claude تقطیر شده؛ مدل معمولاً خودش رو Claude معرفی میکنه و لحن خاص «صدای Claude» رو داره. این موضوع باعث میشه مدل تو کارهای رایج خیلی خوب عمل کنه ولی تو کارهای کمتر رایج ضعیفتر باشه، چون مدلهای تقطیرشده معمولاً تعمیمپذیری پایینتری دارن.
واکنشهای کاربرا متفاوت بوده. عدهای مثل Jeremy Howard از سرعت، قیمت پایین و کیفیت کدنویسی GLM-5.2 تعریف کردن و اونو همسطح یا بهتر از Opus 4.8 و GPT-5.5 دونستن. در مقابل، عدهی دیگهای مثل کاربر QC گفتن مدل تو مکالمههای عادی و تحلیل خلاقانه ضعیفه و بیشتر شبیه یه مدل «بنچمکسشده» بهنظر میرسه تا یه مدل واقعاً باهوش. یکی از نقدهای مشترک هم نبود پشتیبانی بومی از تصویر (vision) تو این مدله.
بنیانگذار Z.ai مدعی شده که تا پایان امسال یه مدل در سطح Mythos (ردهی خیلی بالای مدلها) عرضه میکنن. نویسنده نسبت به این ادعا محتاطه و میگه بعیده تا پایان ۲۰۲۶ همچین اتفاقی بیفته، ولی رسیدنش تا اوایل ۲۰۲۷ رو محتمل میدونه. جمعبندی نویسنده اینه که GLM-5.2 مدل خوبیه و برای کسایی که به مدل متنباز نیاز دارن گزینهی مناسبیه، ولی هنوز جای مدلهای بستهی ردهبالا رو نمیگیره.
نکات کلیدی:
- GLM-5.2 از شرکت Z.ai منتشر شده و در بنچمارکهای مختلف نزدیک به Opus 4.7 عمل میکنه
- شواهدی وجود داره که این مدل از Claude تقطیر شده و همین باعث افت تعمیمپذیریش میشه
- قیمت API نسبت به مدلهای بسته پایینتره ولی بهخاطر مصرف توکن بالا لزوماً ارزونتر نیست
- نبود پشتیبانی بومی از تصویر یکی از ضعفهای اصلی این مدله
- Z.ai مدعی عرضهی یه مدل خیلی قویتر تا پایان امسال یا اوایل ۲۰۲۷ شده




