Qwen-Image-3.0-Pro؛ تصویرسازی که به درد کار واقعی میخوره
خلاصهٔ کاملتر
Qwen-Image-3.0-Pro مدل تصویرساز تازهایه که تو مارکتپلیس مدلهای Qwen لیست شده و ورودی متن و تصویر میگیره و خروجیش تصویره. تو صفحهٔ رسمی مدل اومده که تا ۴.۵ هزار توکن ورودی رو قبول میکنه و میتونه چیدمانهای اطلاعاتی متراکم — از روزنامه و استوریبورد گرفته تا منوی رستوران و برگهٔ امتحان — رو تو یه پاس بسازه، حتی با تصویر داخل تصویر.
ادعای دوم دربارهٔ جزئیاته: رندر دقیق متن تا اندازهٔ ۱۰ پیکسل و بازسازی ریزهکاریهایی مثل ریزحالتهای چهره، منافذ پوست و تارهای مو، چیزی که به گفتهٔ همین صفحه به کیفیت عکاسی واقعی نزدیک میشه. بخش سوم هم دانش زمینهایه: پشتیبانی بومی از ۱۲ زبان و فونتهای مختلف، و شبیهسازی رابطهایی مثل صفحهٔ وب، بازی و لایو استریم.
جمعبندی خود صفحه اینه که مدل دنبال «خوب بهنظر رسیدن» نیست، دنبال «مفید بودن»ه — یعنی تولید تصویر رو به یه ابزار قابلاستقرار تو جریان کاری تبدیل کنه. کنارش امکانات معمول API هم فهرست شده: تکمیل از روی پیشوند (Partial Mode)، فراخوانی تابع، کش کانتکست برای پیشوندهای مشترک، خروجی ساختاریافته، پردازش دستهای، جستوجوی وب و فاینتیونینگ.
قیمتگذاری هم شفافه: ورودی تصویر ۱K و ۲K هرکدوم ۰.۰۰۳ دلار بهازای هر تصویر، خروجی ۱K برابر ۰.۰۴ دلار و خروجی ۲K برابر ۰.۰۷۵ دلار. نکتهای که موقع برنامهریزی باید حواست بهش باشه محدودیت نرخه: فقط یک درخواست در دقیقه، که برای کارهای دستهای سنگین یعنی باید سراغ حالت Batch بری.
نکات کلیدی:
- ورودی تا ۴.۵ هزار توکن و ساخت چیدمانهای متراکم مثل روزنامه، منو و برگهٔ امتحان تو یه پاس
- رندر متن تا ۱۰ پیکسل و پشتیبانی بومی از ۱۲ زبان و فونتهای متنوع
- امکانات API: خروجی ساختاریافته، فراخوانی تابع، کش کانتکست، دستهای و فاینتیونینگ
- خروجی ۱K هر تصویر ۰.۰۴ و ۲K هر تصویر ۰.۰۷۵ دلار، با سقف یک درخواست در دقیقه




