Saltar al contenido principal

/Currículum

Descargar Currículum

Mohammad Raouf Abedini

Investigación de Seguridad de IA · Red-Teaming de Agentes LLM · Ingeniería de Seguridad Ofensiva y Defensiva

Sídney, Australia · Listo para reubicarme ahora a San Francisco, CA · Disponible para viajar (Washington, DC) · Requiere patrocinio de visa
01.

Sobre Mí

Investigador de seguridad que desarrolla sistemas para medir y contener las capacidades cibernéticas de la IA de frontera. Creador de Project Simurgh, un marco de atestación de contención independiente del proveedor que somete a red-teaming a agentes LLM bajo un modelo de amenaza adversario de productor deshonesto y produce evidencia firmada con Ed25519, verificable sin conexión, de lo que hizo un agente tras un fallo de las barreras de seguridad: 138/138 casos no detectados por el clasificador contenidos, la tasa de éxito de ataque de un agente en vivo reducida de 9/140 a 0/140 en AgentDojo, cinco teoremas Lean verificados por máquina. Evaluó las salidas de Claude en busca de código explotable y elusión de barreras de seguridad en el programa de evaluación de seguridad de Anthropic (a través de Alignerr). Posicionado como la capa de defensa en profundidad complementaria a los clasificadores en línea: estos gobiernan lo que un modelo puede decir; esto atestigua lo que se permitió hacer a un agente. Entregó detección de extremo a extremo: ML de phishing en el dispositivo con F1 del 87% y detección de intrusiones en tiempo real con más de 500K paquetes/s. Cofundador de una startup de IA universitaria respaldada por una incubadora; más de 70 proyectos publicados.

02.

Investigación de Seguridad

Node.js · Atestación Ed25519 · Lean 4 · AgentDojo · Llama Guard 4 · Llama-3.3-70B · Paridad JS↔Python

Project Simurgh — Atestación de Contención Verificable para IA Agéntica (Creador · AGPL-3.0)

  • Construí un marco independiente del proveedor que produce evidencia firmada con Ed25519 y reproducible sin conexión de lo que hizo un agente de IA tras un fallo de las barreras de seguridad, a través de cuatro límites de contención: firewall de entrada, guardia de procedencia del contexto, compuerta de invocación de herramientas y firewall de fuga de salida — bajo un modelo de amenaza adversario de productor deshonesto
  • Contención de fallos de barreras: capturé un clasificador de entrada Llama Guard 4 (12B) real sobre un conjunto de ejecución de 180 casos y contuve 138/138 casos maliciosos que el clasificador no detectó (120 casos de inyección posterior que un clasificador solo de entrada estructuralmente no puede ver, 18 fallos de entrada directa); éxito de ataque combinado dirigido 0/150, con cero ejecuciones de herramientas ni exportaciones inseguras
  • Contención de agente en vivo: dirigí un Llama-3.3-70B autoalojado a través de la suite de espacio de trabajo de AgentDojo (140 casos de inyección preregistrados); la compuerta de autoridad de herramientas redujo el éxito de ataque dirigido de 9/140 a 0/140 manteniendo la utilidad benigna
  • Posicionado como la capa de defensa en profundidad complementaria al clasificador en línea de Anthropic — el clasificador gobierna lo que un modelo puede decir, la atestación gobierna lo que se permitió hacer a un agente (con las no-afirmaciones firmadas y explícitas, incluido que por sí misma no habría detectado la elusión de generación de contenido de junio de 2026)
  • Ataqué mi propia prueba (barrido de red-team a través de ocho clases de ataque → detector-v2) y verifiqué formalmente la supervisión con cinco teoremas Lean verificados por máquina; reproducción sin conexión con un solo comando de una escalera de lanzamiento firmada de 12 peldaños; 3,057 pruebas automatizadas
03.

Competencias Técnicas

> Lenguajes

Python (principal), C, C++, TypeScript, JavaScript, Swift, Kotlin, Bash, SQL, Go (familiarizado)

> Seguridad y Ofensiva

Investigación de vulnerabilidades, desarrollo de exploits multiplataforma (Win32 API, macOS ScreenCaptureKit), modelado de amenazas, revisión de código seguro, pruebas de penetración, divulgación responsable (OWASP/FIRST/CISA), Wireshark, Nmap, Burp Suite

> IA y ML

Integración y evaluación de modelos de lenguaje grande (LLM), evaluación de generación aumentada por recuperación (RAG), evaluación de fidelidad de citas, investigación de vulnerabilidades asistida por IA, procesamiento de lenguaje natural (NLP), herramientas de IA generativa, evaluación de modelos de ML, evaluación de riesgos de doble uso

> Sistemas y Herramientas

Linux (Ubuntu/Kali), CMake, Docker, Git/GitHub, GitHub Actions CI/CD, Google Test, FastAPI, Cloudflare Workers, libpcap

> Marcos

OWASP Top 10, MITRE ATT&CK, Marco NIST, Especificación W3C Screen Capture

04.

Educación

Licenciatura en Ciberseguridad

Macquarie University
May 2024 – Nov 2026
Asignaturas: Informática Forense, Seguridad de Redes, Seguridad de Sistemas, Computación en la Nube, Procesamiento de Lenguaje Natural (NLP) y Aprendizaje Automático, Análisis de Datos que Preserva la Privacidad

Diploma de Tecnología de la Información

Macquarie University
Jul 2023 – May 2024
05.

Proyectos Selectos de Investigación e Ingeniería

The Invisible Window [DIVULGACIÓN]

2026

C · Swift · Python · Win32 API · ScreenCaptureKit · WebRTC

Investigación de vulnerabilidades en formato IEEE: descubrí de forma independiente y divulgué responsablemente una clase de evasión de captura de pantalla multiplataforma que explota las APIs de afinidad de visualización a nivel de SO (Windows/macOS), la cual derrota la captura basada en navegador y los pipelines de visión por IA — evasión del 100% en todas las plataformas probadas sin artefactos visuales en más de 10,000 fotogramas analizados, con divulgación coordinada a proveedores de SO y de sistemas de supervisión de exámenes. DOI: 10.5281/zenodo.20376495.

Aion [RAG BÍBLICO]

2026

React Native · Expo · Supabase · pgvector · Gemini · Embeddings de OpenAI · Tauri v2

Construí un compañero bíblico impulsado por IA y redacté Aion-BibleQA, un preprint de 8 páginas que introduce un banco de pruebas de 40 preguntas para la fidelidad de citas y la robustez ante premisas falsas — R@5 = 0.941, soporte medio de citas = 0.978, cero citas sin respaldo y 6 de 6 rechazos de premisas falsas. DOI: 10.5281/zenodo.20522874.

NanoMatch [SISTEMAS]

2026

C++20 · CMake · Google Test

Diseñé un motor de emparejamiento de alto rendimiento que procesa más de 1M de órdenes por segundo con latencia submicrosegundo — implementando niveles de precio con árbol rojo-negro, un asignador de memoria personalizado y una suite de pruebas exhaustiva con benchmarks de latencia p50/p99.

SentinelFlow [IDS]

2026

C++17 · libpcap · CMake · Google Test · Linux

Construí un motor de procesamiento de paquetes de red en tiempo real que analiza más de 500K paquetes por segundo — disección de protocolos (Ethernet/IPv4/TCP/UDP/ICMP/DNS), motor de detección basado en firmas y análisis con estado (escaneos de puertos, inundaciones SYN).

Nexus Archive [FULL-STACK]

2025

Python/Litestar · React · PostgreSQL · Docker · Terraform

Lancé una plataforma de datos full-stack con motor de recomendaciones impulsado por IA, diseño de API basado en eventos, limitación de tasa y análisis de seguridad automatizado — propiedad de extremo a extremo desde el esquema de la base de datos hasta la infraestructura de despliegue.

Mehr Guard [KOTLINCONF]

2024

Kotlin Multiplatform · ML Local · Android e iOS

Construí una herramienta de detección de amenazas sin conexión y multiplataforma con clasificación basada en ML local — presentada en la conferencia mundial de desarrolladores KotlinConf.

Más de 70 proyectos públicos adicionales en GitHub que cubren investigación de vulnerabilidades, programación de sistemas, herramientas de IA/ML e infraestructura en la nube: github.com/Raoof128
06.

Experiencia Profesional

Ingeniero de Seguridad y Desarrollador Full-Stack Freelance

Autónomo · Ene 2024 – Presente
  • Diseñé backends de seguridad para plataformas de producción con múltiples frontends sobre Supabase: passkeys WebAuthn, MFA con TOTP/SMS, middleware de borde de confianza cero, limitación de tasa distribuida, seguridad estricta a nivel de fila (Row-Level Security) de Postgres y registro de auditoría resistente a manipulaciones mediante RPCs SECURITY DEFINER
  • Desarrollé CI/CD con más de 500 pruebas de seguridad automatizadas (GitHub Actions), reduciendo las vulnerabilidades de despliegue ~40%; publiqué aplicaciones con seguridad prioritaria para más de 1,000 usuarios con controles OWASP Top 10 y OAuth 2.0
  • Mantuve una calificación de 5.0 estrellas en 31 reseñas de clientes y 35 tareas completadas (95% de finalización, identidad verificada) en Airtasker, entregando desarrollo web, Python, integración de APIs y trabajo de TI/seguridad para clientes de pago

Gerente de TI

Farmacia Irán · Ago 2019 – May 2024
  • Gestioné la infraestructura tecnológica en una organización multisede durante 5 años — manteniendo un 99% de tiempo de actividad del sistema, aplicando control de acceso basado en roles (RBAC) y automatizando flujos de trabajo operativos mediante scripts en Python/Bash (~30% de reducción en tareas manuales)
07.

Seguridad de la IA, Liderazgo y Comunidad

  • Evaluador de Seguridad de IA, Claude (Alignerr, programa de evaluación de seguridad de IA de Anthropic, 2026): evalué las salidas de Claude en busca de código explotable y analicé cómo se pueden eludir las barreras de seguridad, entregando hallazgos estructurados basados en rúbricas (continúa el trabajo previo de evaluación de Claude Code de 2024)

Co-Founder · Macquarie Persian Students Society

2026 – Present
Voluntariado · Education

Fundé y ayudo a dirigir la comunidad de estudiantes persas de la universidad: eventos, apoyo entre pares y programación cultural.

08.

Licencias y certificaciones

> Anthropic (10)

AI Fluency for Students

Emitido Jul 2026 · ID de credencial: acmpujtbn2xu

AI Fluency for Educators

Emitido Jul 2026 · ID de credencial: 7x8msbzn49rt

Introduction to Model Context Protocol

Emitido Jul 2026 · ID de credencial: yhi68u4mqt5x

Building with the Claude API

Emitido Jul 2026 · ID de credencial: juoae2qtmggo

AI Fluency: Framework & Foundations

Emitido Jul 2026 · ID de credencial: 645j7by2uo75

Claude Code in Action

Emitido Jul 2026 · ID de credencial: 7kfqpyogooec

Introduction to Claude Cowork

Emitido Jul 2026 · ID de credencial: bsqfvrbkpv2s

Claude Platform 101

Emitido Jul 2026 · ID de credencial: q8dcrer7o2pa

Claude Code 101

Emitido Jul 2026 · ID de credencial: oyf4ic48wnd5

Claude 101

Emitido Jul 2026 · ID de credencial: hyagrxaidsbe

> Macquarie University (13)

Cyber Security: GRC Part 2 — Risk Management and Compliance

99.20%

Emitido Jun 2026 · ID de credencial: JL4SAS9JOR8C

Cyber Security: GRC Part 1 — Governance

95%

Emitido Jun 2026 · ID de credencial: 3G4JP3GKROWQ

Cyber Security: Mobile Security

99.28%

Emitido Jun 2026 · ID de credencial: W7FRQ19BPTNM

Cyber Security: Applied Cryptography

98.56%

Emitido Jun 2026 · ID de credencial: OVVCSLEB8ATT

Cyber Security: Data Security and Information Privacy

97.84%

Emitido Jun 2026 · ID de credencial: K54QIRP9VVE9

Cyber Security: Digital Forensics

95%

Emitido Jun 2026 · ID de credencial: YX5P82YME6FQ

Cyber Security: Identity Access Management and Authentication

100%

Emitido Jun 2026 · ID de credencial: P1RJQUGSCM59

Cyber Security: DevSecOps

99.10%

Emitido Jun 2026 · ID de credencial: GJEBDPIA0A6P

Cyber Security: Application of AI

99.20%

Emitido Jun 2026 · ID de credencial: U2KSU5H0O0BV

Cyber Security: Security of AI

95.50%

Emitido May 2026 · ID de credencial: DNZVZ3A7RVR1

Cyber Security: Essentials for Managers and Leaders

99.40%

Emitido May 2026 · ID de credencial: LOBWM8KXGSZS

Cyber Security: Essentials for Workplace

92.80%

Emitido May 2026 · ID de credencial: QT8ZBJIJ2HHO

Cyber Security: Essentials

96%

Emitido May 2026 · ID de credencial: RNALWEYYSXO7

09.

Información Adicional

Listo para reubicarme ahora a San Francisco; disponible para empezar de inmediato (último semestre completado en línea). Requiere patrocinio de visa.
Inglés (Competencia Profesional) · Persa / Farsi (Nativo) · Japonés (Elemental)