← العودة إلى المقالات
إطار شامل لأمن الذكاء الاصطناعي: 12 نطاقًا يغفلها معظم البرامج الأمنية
يختزل كثير من مسؤولي أمن المعلومات (CISO) مفهوم "أمن الذكاء الاصطناعي" في هجمات حقن الأوامر (Prompt Injection). لكن الواقع أن سطح الهجوم يمتد عبر 12 نطاقًا متكاملاً، وأي خلل في أحدها قد يفتح مجال التأثير على كامل المنظومة.
أكثر من 60 ضابطًا أمنيًا. 12 نطاقًا. دليل عملي موحّد.
النطاقات الـ 12
01أمن النماذج اللغوية الكبيرة — LLM Security
- حقن الأوامر — Prompt Injection
- الدفاع ضد كسر القيود — Jailbreak Defense
- تسريب تعليمات النظام — System Prompt Leakage
- التحقق من المخرجات — Output Validation
- تهريب الرموز — Token Smuggling
02الذكاء الاصطناعي الوكيلي — Agentic AI
- تسميم الأدوات — Tool Poisoning
- هجوم النائب المربك — Confused Deputy
- تواطؤ الوكلاء المتعددين — Multi-Agent Collusion
- التلاعب بالذاكرة — Memory Tampering
- اختطاف الهدف — Goal Hijacking
03بروتوكول MCP — Model Context Protocol
- مصادقة الخوادم — Server Authentication
- قوائم السماح للأدوات — Tool Allowlisting
- فرض نطاق الصلاحيات — Scope Enforcement
- تسجيل التدقيق — Audit Logging
- قنوات mTLS المؤمنة
04البيانات والتدريب — Data & Training
- تسميم البيانات — Data Poisoning
- تسريب البيانات الشخصية — PII Leakage
- تتبع مصدر بيانات التدريب — Data Provenance
- الخصوصية التفاضلية — Differential Privacy
- تدقيق البيانات الاصطناعية — Synthetic Data Audit
05سلسلة توريد النماذج — Model Supply Chain
- مصدر النموذج — Model Provenance
- التلاعب بالأوزان — Weight Tampering
- اكتشاف الأبواب الخلفية — Backdoor Detection
- موثوقية HuggingFace
- قائمة مكونات النموذج — SBOM for Models
06الاستدلال والمخرجات — Inference & Output
- تنقية المخرجات — Output Sanitization
- إخفاء البيانات الحساسة — PII Redaction
- الحماية من الهلوسة — Hallucination Guards
- التحقق من الاستشهادات — Citation Verification
- التحقق من البنية — Schema Validation
07التعلم الآلي العدائي — Adversarial ML
- هجمات التهرب — Evasion Attacks
- استدلال العضوية — Membership Inference
- استخراج النموذج — Model Extraction
- تسريب التدرجات — Gradient Leakage
- تعزيز مقاومة الهجمات — Adversarial Robustness
08الاختبار الهجومي — AI Red Teaming
- اختبار الأوامر العشوائية — Prompt Fuzzing
- مكتبات كسر القيود — Jailbreak Libraries
- اختبار إساءة استخدام الأدوات — Tool Abuse Testing
- بيئة التقييم — Evaluation Harness
- مؤشرات التغطية — Coverage Metrics
09الهوية وإدارة الوصول — Identity & Access
- نطاقات OAuth لكل وكيل — Per-Agent OAuth Scopes
- إشراف بشري ضمن الحلقة — Human-in-the-Loop
- تدقيق تصعيد الصلاحيات — Privilege Escalation Audit
- عزل الجلسات — Session Isolation
- تدوير مفاتيح API — API Key Rotation
10بيئة التشغيل والبنية التحتية — Runtime & Infrastructure
- التنفيذ المعزول — Sandbox Execution
- سياسات خروج الشبكة — Network Egress Policy
- قنوات جانبية GPU — GPU Side-Channel
- تأمين الحاويات — Container Hardening
- مفاتيح الإيقاف الطارئ — Kill Switches
11الامتثال والحوكمة — Compliance & Governance
- قانون الذكاء الاصطناعي الأوروبي — EU AI Act
- إطار NIST AI RMF
- OWASP LLM Top 10
- سجل المخاطر — Risk Register
- بطاقات النماذج — Model Cards
12المراقبة والاستجابة — Monitoring & DFIR
- تسجيل الأوامر والاستجابات — Prompt/Response Logs
- اكتشاف الشذوذ — Anomaly Detection
- مراقبة الانحراف — Drift Monitoring
- خطط الاستجابة للحوادث — Incident Playbooks
- لقطات التحليل الجنائي — Forensic Snapshots
الحقيقة غير المريحة: معظم برامج "أمن الذكاء الاصطناعي" الحالية تغطي فقط النطاقات 1 و6 و11 — أي ما يقارب 15 ضابطًا من أصل أكثر من 60.
القاعدة الذهبية: أمن الذكاء الاصطناعي ليس ميزة تُضاف لاحقًا، بل منظومة من 12 تخصصًا يجب تنفيذها بالتوازي. تجاهل أي نطاق = فتح منفذ جانبي للهجوم. نطاق التأثير لا يميز بين نقطة الضعف.
المراجع
- OWASP Top 10 for LLM Applications (2025)
- NIST AI Risk Management Framework
- MITRE ATLAS — مصفوفة تهديدات التعلم الآلي العدائي
- EU AI Act
- Anthropic Responsible Scaling Policy
معجم المصطلحات
Prompt Injection — حقن الأوامر
Jailbreak — كسر القيود
LLM — نموذج لغوي كبير
Agentic AI — الذكاء الاصطناعي الوكيلي
MCP — بروتوكول سياق النموذج
PII — بيانات تعريف شخصية
SBOM — قائمة مكونات البرمجيات
Adversarial ML — التعلم الآلي العدائي
Red Teaming — الاختبار الهجومي
OAuth — بروتوكول تفويض الوصول
mTLS — بروتوكول TLS المتبادل
Drift — انحراف النموذج
DFIR — التحقيق الجنائي الرقمي والاستجابة للحوادث