Invisible Window Research
ورقة بحثية بتنسيق IEEE تكشف عن ثغرة أمنية هيكلية في مراقبة الاختبارات القائمة على WebRTC. تهرب بنسبة ١٠٠٪ على نظامي التشغيل Windows و macOS باستخدام واجهات برمجة تطبيقات عرض نظام التشغيل الموثقة.
"اسألوا تعطوا، اطلبوا تجدوا" — متى ٧:٧بناء أنظمة لقياس واحتواء القدرات السيبرانية للذكاء الاصطناعي المتقدّم. مبتكر Project Simurgh — إطار عمل لإثبات الاحتواء يُجري اختبارات الفريق الأحمر على وكلاء نماذج اللغة الكبيرة ويُنتج أدلّة موقَّعة وقابلة للتحقّق دون اتصال حول ما كان الوكيل مسموحًا له بفعله بعد تجاوز أحد الحواجز: احتواء 138/138 حالة أغفلها المصنِّف، وخفض نجاح هجوم الوكيل الحيّ من 9/140 إلى 0/140 على AgentDojo. قيّم مخرجات Claude ضمن برنامج تقييم السلامة لدى Anthropic. يعمل على منح المدافعين الأفضلية في مواجهة المخاطر السيبرانية للذكاء الاصطناعي المتقدّم.
ورقة بحثية بتنسيق IEEE تكشف عن ثغرة أمنية هيكلية في مراقبة الاختبارات القائمة على WebRTC. تهرب بنسبة ١٠٠٪ على نظامي التشغيل Windows و macOS باستخدام واجهات برمجة تطبيقات عرض نظام التشغيل الموثقة.
إطار عمل لإثبات الاحتواء القابل للتحقق ومستقل عن المزوّد للذكاء الاصطناعي الوكيلي، تطوّر عن النظير الدفاعي لأبحاث The Invisible Window. يُنتج أدلة موقّعة بـ Ed25519 وقابلة لإعادة الإنتاج دون اتصال حول ما سُمح لوكيل الذكاء الاصطناعي بفعله بعد إخفاق الحاجز — احتوى ١٣٨ من ١٣٨ حالة فاتت المصنّف، وخفّض نجاح هجوم وكيل حي من ٩ من ١٤٠ إلى ٠ من ١٤٠ على AgentDojo.
محرك معرفة محلي يعمل بالذكاء الاصطناعي. يستوعب أي مستند، يستخرج المعرفة المنظمة (ادعاءات، مفاهيم، كيانات، قرارات)، ويعرضها لعوامل الذكاء الاصطناعي عبر خادم MCP. ١٨٣ اختباراً ناجحاً.
ماسح ضوئي أمني لرموز QR وعناوين URL يعمل بدون اتصال بالإنترنت مع إعطاء الأولوية للخصوصية، تم بناؤه باستخدام Kotlin Multiplatform. تحليل بنسبة ١٠٠٪ بدون اتصال بالإنترنت مع استهداف ٥ منصات.
نظام تشغيل جامعي يعتمد على الذكاء الاصطناعي يحول المناهج الدراسية بتنسيق PDF إلى بيانات منظمة قابلة للقراءة من قبل الوكلاء. مقبول في حاضنة جامعة ماكواري كشركة ناشئة رسمية. حزمة كاملة لعمليات الطلاب مع ٥٠٣ اختبارات.
عميل Git مدعوم بالذكاء الاصطناعي لإدارة هويات متعددة وإنشاء تعهدات (commits) دلالية. تم بناؤه باستخدام Electron و React.
خزنة وسائط شخصية بأسلوب السايبربانك مع واجهة أمامية React وواجهة برمجة تطبيقات Litestar ومصادقة Supabase. توصيات مدعومة بالذكاء الاصطناعي ومصادقة قوية تعتمد على ملفات تعريف الارتباط.
إجراء اختبارات الفريق الأحمر على وكلاء نماذج اللغة الكبيرة وقياس ارتقاء القدرات السيبرانية للذكاء الاصطناعي المتقدّم. تحديد حدود السلامة، واحتواء تجاوزات الحواجز بأدلّة موقَّعة قابلة للتحقّق دون اتصال، ونشر نتائج قابلة للتكرار.
دفاع متعدّد الطبقات يمنح المدافعين الأفضلية. تتحوّل الأبحاث الهجومية — فئات الثغرات وحملات مهاجمة الوكلاء — إلى احتواء قابل للتحقّق وأدوات دفاعية في العالم الحقيقي.
أبحاث عملية في الثغرات وتجارب سلامة الذكاء الاصطناعي. العمل الحالي: تطوير الثغرات العابرة للمنصات، قياس ارتقاء قدرات الذكاء الاصطناعي، وتوصيف حدود السلامة.