جنجال کیمی K3 و اتهام تقطیر از کلاد
خلاصهٔ کاملتر
تو این مقاله اومده که کیمی K3، مدل متنباز آزمایشگاه چینی Moonshot AI، تو چند ارزیابی مثل Program Bench، Automation Bench و Spreadsheet Bench 2 در ردهٔ مدلهای بستهٔ سطحبالا ظاهر شده. همین جهش باعث شد آنتروپیک ادعا کنه K3 با تقطیر (distillation) از کلاد ساخته شده، یعنی خروجیهای کلاد بهعنوان دادهٔ آموزشی استفاده شدن. مایکل کراتسیوس، مشاور علمی کاخ سفید، هم گفته مونشات ضمن استفاده از تراشههای تحریمی، خروجی کلاد رو کپی کرده.
تقطیر یعنی از یه مدل «معلم» حجم زیادی جفت پرسش-پاسخ میگیری و یه مدل «دانشآموز» رو روی همون داده آموزش میدی تا رفتارش رو تقلید کنه. نویسنده تأکید میکنه این تکنیک خودش عادی و رایجه — ایلان ماسک هم رسماً گفته xAI موقع ساخت Grok از مدلهای OpenAI تقطیر کرده. چیزی که جنجالی میشه، انجامش بدون اجازه و برخلاف شرایط استفادهٔ رقیبه.
ولی به گفتهٔ نویسنده، تایملاین ادعا رو سست میکنه: کلاد اوپوس تقریباً از اول ژوئن در دسترس عموم بوده و جمعآوری داده، آموزش یه مدل بزرگ جدید و عرضهش ظرف حدود دو هفته با روشهای امروزی شدنی نیست. نیتن لمبرت، پژوهشگر شناختهشدهٔ حوزهٔ هوش مصنوعی، هم معتقده تقطیر داره بیربطتر میشه: مدلهای چینی مثل GLM و K3 دارن با یادگیری تقویتی به مرز میرسن، نه با کپی کردن خروجی بقیه.
پشت این ماجرا یه پسزمینهٔ ژئوپلیتیک هست و بحث ممنوع کردن مدلهای متنباز چینی هم مطرح شده، ولی نویسنده میگه اجرای همچین ممنوعیتی عملاً غیرممکنه: وقتی وزنهای یه مدل منتشر شد، هزاران نفر دانلودش کردن و راهی برای جمع کردنش نمونده. در عمل هم تستهای دستی نشون داده K3 روی کارهای واقعی کدنویسی خوب جواب میده و تو اولین پرامپت یه کلون بازی با حرکت، تولید دشمن و سیستم لِوِل کارکرد ساخته.
نکات کلیدی:
- کیمی K3 مدل متنبازیه که تو چند بنچمارک همرده با مدلهای بستهٔ ردهبالا ظاهر شده
- آنتروپیک و مقامهای آمریکایی ادعای تقطیر از کلاد رو مطرح کردن
- پژوهشگرهای مستقل میگن حدود دو هفته برای جمعآوری داده و آموزش مدل کافی نیست
- تقطیر تکنیک رایجیه؛ xAI هم برای Grok ازش استفاده کرده
- ممنوع کردن مدلی که وزنهاش منتشر شده عملاً قابل اجرا نیست




