Brain2Qwerty v2؛ تایپ با مغز بدون جراحی
خلاصهٔ کاملتر
تو بلاگ AI متا اومده که نسخهٔ دوم Brain2Qwerty آمادهست؛ ادامهٔ همون پروژهای که پارسال معرفی شد و کارش اینه که فعالیت مغز رو بدون هیچ ایمپلنت و عمل جراحی به متن تبدیل کنه. به گفتهٔ تیم متا، این نسخه بهترین پایپلاین سرتاسری برای رمزگشایی بلادرنگ جمله از روی ضبطهای غیرتهاجمی مغزه و داره به دقتی نزدیک میشه که تا حالا فقط از راه جراحی به دست میاومد.
مسئلهای که نویسندهها دنبالشن روشنه: میلیونها نفر بهخاطر ضایعات مغزی توان حرف زدن رو از دست میدن. روشهای تهاجمی مثل الکتروکورتیکوگرافی نشون دادن که یه نوروپروتز بهعلاوهٔ یه رمزگشای هوش مصنوعی میتونه ارتباط رو برگردونه، ولی این روشها سخت مقیاسپذیرن — چون آخرش پای جراحی مغز وسطه. متا میگه رویکرد غیرتهاجمی میتونه همین شکاف رو پر کنه.
مدل روی حدود ۲۲ هزار جمله از ۹ داوطلب آموزش دیده؛ هر کدوم ۱۰ ساعت با دستگاه MEG (مگنتوانسفالوگرافی، که میدان مغناطیسی ناشی از فعالیت نورونها رو از بیرون جمجمه میخونه) روی سرشون مشغول تایپ بودن. نکتهٔ فنی مهم اینه که بهجای پایپلاینهای دستساز برای تشخیص رویدادهای عصبی، رمزگشایی مستقیم از سیگنال خام و با یادگیری عمیق سرتاسری انجام میشه.
بخش دیگهٔ ماجرا فاینتیون کردن مدلهای زبانی بزرگ روی دادهٔ عصبیه. این کار باعث میشه سیستم از بافت معنایی زبان استفاده کنه و بتونه از یه سیگنال پرنویز، جملهٔ منسجم دربیاره. تیم متا میگه برای بهینهسازی پایپلاین از ایجنتهای هوش مصنوعی هم کمک گرفته، ولی پیکربندی نهایی آموزش رو در نهایت خود مهندسها دستی انتخاب کردن.
نتیجهاش این شده: دقت واژهای ۶۱ درصد بهطور میانگین، در حالی که روشهای غیرتهاجمی قبلی حدود ۸ درصد بودن. برای بهترین شرکتکننده این عدد به ۷۸ درصد میرسه و بیشتر از نصف جملهها با حداکثر یک خطای واژه رمزگشایی میشن.
یافتهٔ جالب دیگه اینه که دقت رمزگشایی با حجم داده بهصورت لگاریتمی-خطی بهتر میشه. به گفتهٔ نویسندهها، همین نشون میده فاصلهٔ باقیمونده با روشهای جراحی رو شاید فقط با بیشتر کردن داده بشه کم کرد — بدون اینکه لازم باشه معماری عوض شه.
متا کد کامل آموزش v1 و v2 رو منتشر کرده و شریکش، مرکز BCBL، هم دیتاست نسخهٔ اول رو روی Hugging Face گذاشته. این کار بخشی از تلاش متا برای ساخت مدلهای پایهٔ متنباز از مغزه — کنار Tribev2، NeuralSet و NeuralBench — که با یه صندوق ۵ میلیون دلاری تو قالب Digital Brain Project پشتیبانی میشه.
نکات کلیدی:
- Brain2Qwerty v2 جملهها رو بدون جراحی و فقط از روی ضبط MEG رمزگشایی میکنه.
- دقت واژهای میانگین ۶۱ درصد و برای بهترین داوطلب ۷۸ درصد؛ روشهای غیرتهاجمی قبلی حدود ۸ درصد بودن.
- آموزش روی ۲۲ هزار جمله از ۹ داوطلب، هرکدوم ۱۰ ساعت ضبط.
- بهجای پایپلاین دستساز، یادگیری عمیق سرتاسری روی سیگنال خام + فاینتیون مدل زبانی.
- دقت با حجم داده لگاریتمی-خطی بالا میره؛ یعنی احتمالاً با دادهٔ بیشتر میشه به روشهای جراحی نزدیکتر شد.
- کد آموزش هر دو نسخه و دیتاست v1 منتشر شدن.




