أبحاث وأدلّة

مدونة أمن الذكاء الاصطناعي

أبحاث وأدلّة وتحليلات معمّقة في أمن الذكاء الاصطناعي والـ prompt injection والـ red teaming للـ LLM.

11 دقيقة قراءة

تقنيات كسر حماية الذكاء الاصطناعي: DAN وتقمّص الأدوار والترميز والهجمات متعددة الأدوار

دليل عملي لتقنيات كسر حماية نماذج الذكاء الاصطناعي: أوامر تقمّص الأدوار وDAN، وانتحال الصلاحية، والترميز، والهجمات متعددة الأدوار، واستغلال الاستدلال. تعرّف على كيفية عمل كلٍّ منها ولماذا تتجاوز حواجز الأمان وكيف تدافع.

8 دقائق قراءة

هجمات المحارف المتشابهة: كيف تخدع الحروف الشبيهة فلاتر الذكاء الاصطناعي

كيف تستخدم هجمات المحارف المتشابهة حروف Unicode الشبيهة لتمرير الكلمات المحظورة عبر فلاتر الكلمات المفتاحية، ولماذا يظل النموذج يفهمها، وكيف تكتشفها وتدافع ضدها.

8 دقائق قراءة

المحارف عديمة العرض وإخفاء النص في Unicode: كيف يُخفى النص عن الذكاء الاصطناعي

يمكن للمحارف عديمة العرض وغير المرئية في Unicode أن تُخفي تعليمات عن البشر بينما تظل نماذج LLM تقرأها. تعرّف على كيفية عمل إخفاء النص في Unicode، وكيف يستخدمه المهاجمون ضد نماذج LLM، وكيف تكتشفه.

10 دقائق قراءة

بدائل Gandalf: مقارنة بين 11 لعبة ومختبراً لـ prompt injection

مقارنة بين Lakera Gandalf وHackAPrompt وPortSwigger و8 غيرها من ألعاب ومختبرات prompt injection من حيث الصيغة والسعر ونماذج LLM الحقيقية وعدد المستويات وأفضل استخدام لكلٍّ منها.

12 دقيقة قراءة

ما هو prompt injection؟ التعريف والأمثلة وطرق الدفاع

prompt injection مُدرج باسم LLM01:2025 في OWASP Top 10 for LLM Applications. تعرّف على معناه وكيف يعمل، والفرق بين النوع المباشر وغير المباشر، وأمثلة واقعية، وكيف تتدرّب على اكتشافه وتحليل طرق تخفيفه مجاناً.

11 دقيقة قراءة

10 تقنيات لـ prompt injection مع أمثلة يمكنك تجربتها اليوم

دليل عملي لـ 10 تقنيات لـ prompt injection: تجاهل التعليمات السابقة، وهجمات تقمّص الأدوار، وحيل الترميز، والتجاوز عبر لغات متعددة، وتسميم RAG، وغيرها، مع أمثلة payloads.

9 دقائق قراءة

prompt injection مقابل jailbreak: ما الفرق؟

كثيراً ما يُخلط بين prompt injection وjailbreak. تعرّف على الفروق الأساسية في الهدف والجهة المستهدفة والتقنيات والخطورة، ولماذا يعاملهما OWASP بشكل مختلف.

10 دقائق قراءة

دفاعات Prompt Injection: كيف تقرأ ورقة المرجع وتوقف الهجمات

دليل للدفاع ضد prompt injection: كيف تعمل كل فئة هجوم، وكيف تختبر المراوغات بأداة ترميز حيّة، وكيف تحصّن تطبيق LLM. مع رابط لورقة المرجع التفاعلية الكاملة.

10 دقائق قراءة

كيف تتعلّم أمن LLM في 2026: خارطة طريق عملية

دليل خطوة بخطوة لتعلّم أمن الذكاء الاصطناعي و red teaming لـ LLM. يغطّي المهارات الأساسية والمصادر المجانية والمختبرات العملية والمسارات المهنية في أمن الذكاء الاصطناعي.

11 دقيقة قراءة

ما هو AI Red Teaming؟ الطرق والأدوات وكيف تبدأ

شرح لـ AI Red Teaming: ما هو، ولماذا تحتاجه المؤسسات، والمنهجيات الشائعة، وكيف تبدأ التدرّب على نماذج LLM حقيقية في بيئة آمنة.