محمد رئوف عابدینی
پژوهش امنیت هوش مصنوعی · تیم قرمز عاملهای LLM · مهندسی امنیت تهاجمی و دفاعی
محقق امنیتی متمرکز بر سنجش و مهار توانمندیهای سایبری هوش مصنوعی پیشرو، آمادهی جابهجایی از هماکنون. این کار عمومی، امضاشده و بازتولیدپذیر است: یک چارچوب متنباز گواهی مهار، پنج پیشچاپ دارای DOI در Zenodo (نمایهشده زیر ORCID) و کار ارزیابی در برنامهی ارزیابی ایمنی Anthropic.
سازندهی Project Simurgh، یک چارچوب گواهی مهار مستقل از ارائهدهنده که عاملهای LLM را تحت یک مدل تهدید خصمانه و مبتنی بر تولیدکنندهی نادرست تیم قرمز میکند و شواهد امضاشده با Ed25519 و قابلتأیید بهصورت آفلاین دربارهی آنچه یک عامل پس از عبور از یک محافظ انجام داده تولید میکند: مهار ۱۳۸/۱۳۸ موردِ ازقلمافتادهی دستهبند در برابر یک Llama Guard 4 واقعی، کاهش موفقیت حملهی یک عامل زنده از ۹/۱۴۰ به ۰/۱۴۰ روی AgentDojo، و پنج قضیهی ماشینبررسیشده در Lean. تحت AGPL-3.0، با ۹۸۹ آزمون در ۴۴ نسخه.
همچنین نویسندهی اصلی The Invisible Window (فرار ۱۰۰ درصدی چندپلتفرمی از ضبط صفحه، افشاشده بهصورت مسئولانه بر پایهی راهنمای OWASP/FIRST/CISA) و Aion-BibleQA (یک معیار سنجش وفاداری استناد برای مدلهای زبانی تقویتشده با بازیابی: R@5 برابر ۰٫۹۴۱، بدون هیچ استناد بدونپشتوانه). خروجیهای Claude را از نظر کد قابلبهرهبرداری و دور زدن محافظها در برنامهی ارزیابی ایمنی Anthropic (از طریق Alignerr، ۲۰۲۶) ارزیابی کرده است. همبنیانگذار یک استارتاپ هوش مصنوعی دانشگاهی مورد حمایت شتابدهنده. متمرکز بر کاهش خطرات فاجعهبار هوش مصنوعی پیشرفته از طریق سنجش ارتقای توانمندی، مشخصسازی مرزهای ایمنی و ساخت ابزارهای دفاعی.

تخصصها
پژوهش و افشای آسیبپذیری
- توسعه اکسپلویت چندپلتفرمی (Win32 API، macOS ScreenCaptureKit)
- افشای مسئولانه (چارچوبهای OWASP/FIRST/CISA)
- پژوهش امنیتی با فرمت IEEE
- تست نفوذ و بازبینی کد امن
- مشخصات فنی W3C Screen Capture
ایمنی هوش مصنوعی و امنیت مدلهای زبانی بزرگ
- یکپارچهسازی و ارزیابی مدلهای زبانی بزرگ (Claude، از طریق Alignerr)
- پژوهش آسیبپذیری با کمک هوش مصنوعی
- سنجش ارتقای توانمندی هوش مصنوعی
- ارزیابی ریسک دوکاربردی
- تعیین مرز ایمنی نیت در برابر مصنوع
برنامهنویسی پایتون و سیستمی
- Python (اصلی)، C، C++، TypeScript، Swift
- سیستمهای C/C++ با کارایی بالا (بیش از ۱ میلیون عملیات بر ثانیه)
- پردازش بستههای شبکه (libpcap)
- Linux (Ubuntu/Kali)، CMake، Docker
- GitHub Actions CI/CD، Google Test
امنیت تهاجمی
- مدلسازی تهدید (MITRE ATT&CK، OWASP Top 10)
- سامانههای تشخیص نفوذ شبکه
- Wireshark، Nmap، Burp Suite
- شبیهسازی فیشینگ مبتنی بر NLP
- چارچوب و انطباق NIST
ماتریس مهارتها
عملیاتهای فعال
تحصیلات
لیسانس امنیت سایبری
2024–2026Macquarie University · WAM 76.27
جرمشناسی دیجیتال · امنیت شبکه · امنیت سیستمها · NLP و یادگیری ماشین · تحلیل داده حافظ حریم خصوصی · رایانش ابری
دیپلم فناوری اطلاعات
2023–2024Macquarie University · WAM 71.75
پایههای سیستمها، شبکهسازی و مهندسی نرمافزار.