شکار آسیبپذیری با هوش مصنوعی: وقتی Claude کد مینویسه و باگ پیدا میکنه
خلاصهٔ کاملتر
وقتی بیشتر وقتت صرف درستکردن ابزار میشه تا پیداکردن باگ، یهجایی از کار لنگ میزنه. این دقیقاً مشکلی بود که این محقق امنیتی باهاش دستوپنجه نرم میکرد: اتصال به VM، استیجکردن باینری، دیکامپایل، مپکردن attack surface، راهانداختن fuzzing، بررسی crash، نوشتن PoC و در نهایت گزارش افشا. هر مرحله ابزار خودش رو داشت و context خودش رو میخواست. راهحل؟ واگذار کردن این «کشتیگرفتن با ابزار» به Claude و نگهداشتن تفکر و نوشتن برای خودش.
MCP یا Model Context Protocol یه استاندارده که بهت اجازه میده ابزارهای خودت رو بهصورت توابع قابلفراخوانی در اختیار Claude Code بذاری. هر سرور MCP یه پروسه پایتونه که ابزارها رو ثبت میکنه و Claude مستقیماً اونها رو صدا میزنه — بدون copy-paste خروجی ترمینال، بدون جابهجایی پنجره.
این سیستم از ۸ سرور MCP روی ۵ ماشین مجازی تشکیل شده و بیش از ۳۰۰ ابزار داره. هر سرور یه نقش مشخص داره: Lab Controller برای مدیریت VMها، Hunter برای patch diffing و fuzzing، RE Tools برای Ghidra و radare2 و Frida، Exploit Dev برای shellcode و bypass، Debugger برای sessionهای پایدار WinDbg و GDB، RAG برای جستجوی معنایی در دادههای کمپین، Infra برای provisioning و Reporting برای نوشتن گزارشهای افشا. همه با FastMCP ساخته شدن و در یه فایل .mcp.json ثبتن.
لب تحقیقاتی روی Proxmox اجرا میشه با ۵ VM روی یه شبکه ایزوله: دو تا Windows 11 (آخرین پچ و نسخه قبلی برای binary diffing)، یه Windows Server 2022، یه Kali Linux برای ابزارهای RE، و یه VM اختصاصی برای fuzzing با WinAFL و Jackalope. نکته مهم: همه Windows VMها یه اکانت کاربر معمولی (lowpriv) دارن، چون باگی که فقط از SYSTEM قابل دسترسه ارزش عملی نداره.
شاید مهمترین تصمیم طراحی کل سیستم اینه: همه یافتههای جدید اول توهم (hallucination) فرض میشن. هر finding ابتدا توی پوشه hallucinations/ میره، نه findings/، و فقط بعد از گذشتن از چهار gate اعتبارسنجی ارتقا پیدا میکنه:
- Gate 0: PoC وجود داره و کامپایل میشه
- Gate 1: PoC روی یه snapshot تمیز از VM crash رو reproduce میکنه
- Gate 2: Crash واقعاً exploitableه، نه فقط یه null dereference ساده
- Gate 3: باگ بهعنوان کاربر معمولی تریگر میشه، نه SYSTEM یا admin
این رویکرد از ارسال گزارشهای اشتباه به vendorها جلوگیری میکنه. در یه جلسه اولیه، سیستم ۶ یافته از تحلیل دستی فلگ کرد که بعد از validation همه رد شدن — اگه این gateها نبودن، شش گزارش اشتباه فرستاده میشد. هنوز هم یه انسان در pipeline هست تا مطمئن بشه سیستم برنامهها و شرکتها رو با گزارشهای بیمحتوا غرق نمیکنه.
نکات کلیدی:
- سیستم شکار آسیبپذیری خودکار با Claude Code و MCP ساخته شده
- ۸ سرور MCP با بیش از ۳۰۰ ابزار، کل pipeline از RE تا افشا رو پوشش میده
- Binary diffing بین دو نسخه پچ Windows برای هدفگیری دقیقتر
- همه یافتههای اولیه «توهم» فرض میشن تا اعتبارسنجی بشن
- اکانت کاربر معمولی در تمام VMها برای تضمین exploitability واقعی




