/Currículum
Descargar CurrículumMohammad Raouf Abedini
Investigación de Seguridad de IA · Red-Teaming de Agentes LLM · Ingeniería de Seguridad Ofensiva y Defensiva
Sobre Mí
Investigador de seguridad que desarrolla sistemas para medir y contener las capacidades cibernéticas de la IA de frontera. Creador de Project Simurgh, un marco de atestación de contención independiente del proveedor que somete a red-teaming a agentes LLM bajo un modelo de amenaza adversario de productor deshonesto y produce evidencia firmada con Ed25519, verificable sin conexión, de lo que hizo un agente tras un fallo de las barreras de seguridad: 138/138 casos no detectados por el clasificador contenidos, la tasa de éxito de ataque de un agente en vivo reducida de 9/140 a 0/140 en AgentDojo, cinco teoremas Lean verificados por máquina. Evaluó las salidas de Claude en busca de código explotable y elusión de barreras de seguridad en el programa de evaluación de seguridad de Anthropic (a través de Alignerr). Posicionado como la capa de defensa en profundidad complementaria a los clasificadores en línea: estos gobiernan lo que un modelo puede decir; esto atestigua lo que se permitió hacer a un agente. Entregó detección de extremo a extremo: ML de phishing en el dispositivo con F1 del 87% y detección de intrusiones en tiempo real con más de 500K paquetes/s. Cofundador de una startup de IA universitaria respaldada por una incubadora; más de 70 proyectos publicados.
Investigación de Seguridad
Project Simurgh
2026Project Simurgh — Atestación de Contención Verificable para IA Agéntica (Creador · AGPL-3.0)
Competencias Técnicas
> Lenguajes
Python (principal), C, C++, TypeScript, JavaScript, Swift, Kotlin, Bash, SQL, Go (familiarizado)
> Seguridad y Ofensiva
Investigación de vulnerabilidades, desarrollo de exploits multiplataforma (Win32 API, macOS ScreenCaptureKit), modelado de amenazas, revisión de código seguro, pruebas de penetración, divulgación responsable (OWASP/FIRST/CISA), Wireshark, Nmap, Burp Suite
> IA y ML
Integración y evaluación de modelos de lenguaje grande (LLM), evaluación de generación aumentada por recuperación (RAG), evaluación de fidelidad de citas, investigación de vulnerabilidades asistida por IA, procesamiento de lenguaje natural (NLP), herramientas de IA generativa, evaluación de modelos de ML, evaluación de riesgos de doble uso
> Sistemas y Herramientas
Linux (Ubuntu/Kali), CMake, Docker, Git/GitHub, GitHub Actions CI/CD, Google Test, FastAPI, Cloudflare Workers, libpcap
> Marcos
OWASP Top 10, MITRE ATT&CK, Marco NIST, Especificación W3C Screen Capture
Educación
Licenciatura en Ciberseguridad
Macquarie UniversityDiploma de Tecnología de la Información
Macquarie UniversityProyectos Selectos de Investigación e Ingeniería
The Invisible Window [DIVULGACIÓN]
2026Investigación de vulnerabilidades en formato IEEE: descubrí de forma independiente y divulgué responsablemente una clase de evasión de captura de pantalla multiplataforma que explota las APIs de afinidad de visualización a nivel de SO (Windows/macOS), la cual derrota la captura basada en navegador y los pipelines de visión por IA — evasión del 100% en todas las plataformas probadas sin artefactos visuales en más de 10,000 fotogramas analizados, con divulgación coordinada a proveedores de SO y de sistemas de supervisión de exámenes. DOI: 10.5281/zenodo.20376495.
Aion [RAG BÍBLICO]
2026Construí un compañero bíblico impulsado por IA y redacté Aion-BibleQA, un preprint de 8 páginas que introduce un banco de pruebas de 40 preguntas para la fidelidad de citas y la robustez ante premisas falsas — R@5 = 0.941, soporte medio de citas = 0.978, cero citas sin respaldo y 6 de 6 rechazos de premisas falsas. DOI: 10.5281/zenodo.20522874.
NanoMatch [SISTEMAS]
2026Diseñé un motor de emparejamiento de alto rendimiento que procesa más de 1M de órdenes por segundo con latencia submicrosegundo — implementando niveles de precio con árbol rojo-negro, un asignador de memoria personalizado y una suite de pruebas exhaustiva con benchmarks de latencia p50/p99.
SentinelFlow [IDS]
2026Construí un motor de procesamiento de paquetes de red en tiempo real que analiza más de 500K paquetes por segundo — disección de protocolos (Ethernet/IPv4/TCP/UDP/ICMP/DNS), motor de detección basado en firmas y análisis con estado (escaneos de puertos, inundaciones SYN).
Nexus Archive [FULL-STACK]
2025Lancé una plataforma de datos full-stack con motor de recomendaciones impulsado por IA, diseño de API basado en eventos, limitación de tasa y análisis de seguridad automatizado — propiedad de extremo a extremo desde el esquema de la base de datos hasta la infraestructura de despliegue.
Mehr Guard [KOTLINCONF]
2024Construí una herramienta de detección de amenazas sin conexión y multiplataforma con clasificación basada en ML local — presentada en la conferencia mundial de desarrolladores KotlinConf.
Experiencia Profesional
Ingeniero de Seguridad y Desarrollador Full-Stack Freelance
Autónomo · Ene 2024 – PresenteGerente de TI
Farmacia Irán · Ago 2019 – May 2024Seguridad de la IA, Liderazgo y Comunidad
- ● Evaluador de Seguridad de IA, Claude (Alignerr, programa de evaluación de seguridad de IA de Anthropic, 2026): evalué las salidas de Claude en busca de código explotable y analicé cómo se pueden eludir las barreras de seguridad, entregando hallazgos estructurados basados en rúbricas (continúa el trabajo previo de evaluación de Claude Code de 2024)
Co-Founder · Macquarie Persian Students Society
2026 – PresentFundé y ayudo a dirigir la comunidad de estudiantes persas de la universidad: eventos, apoyo entre pares y programación cultural.
Licencias y certificaciones
> Anthropic
AI Fluency for Students
AI Fluency for Educators
Introduction to Model Context Protocol
Building with the Claude API
AI Fluency: Framework & Foundations
Claude Code in Action
Introduction to Claude Cowork
Claude Platform 101
Claude Code 101
Claude 101
> Macquarie University
Cyber Security: GRC Part 2 — Risk Management and Compliance
99.20%Cyber Security: GRC Part 1 — Governance
95%Cyber Security: Mobile Security
99.28%Cyber Security: Applied Cryptography
98.56%Cyber Security: Data Security and Information Privacy
97.84%Cyber Security: Digital Forensics
95%Cyber Security: Identity Access Management and Authentication
100%Cyber Security: DevSecOps
99.10%Cyber Security: Application of AI
99.20%Cyber Security: Security of AI
95.50%Cyber Security: Essentials for Managers and Leaders
99.40%Cyber Security: Essentials for Workplace
92.80%Cyber Security: Essentials
96%