تخطَّ إلى المحتوى

Agentic Security - ماسح ضعف النموذج اللغوي

Agentic Security - ماسح ضعف النموذج اللغوي

Agentic Security هو ماسح ضعف النموذج اللغوي الوكالي مفتوح المصدر وعدة اختبار لون أحمر. بدلاً من إطلاق قائمة محددة من المحفزات، يستخدم حلقة وكالية لتمويج نموذج أو API الهدف — إنشاء فحوصات، مراقبة الاستجابات، والتكيف — لسطح كسور الأقفال، وحقن الأوامر، والسلوك غير الآمن. كما يجري اختبارات إجهاد API، وهو مهم لأن العديد من نشرات النموذج اللغوي تفشل على حدود معدل الطلبات واستنزاف الموارد قبل أن تفشل على سلامة المحتوى.

افحص فقط الأنظمة التي تملكها أو يُرخص لك باختبارها.

التثبيت

الطريقةالأمر
pippip install agentic_security
من المصدرgit clone https://github.com/msoedov/agentic_security && pip install -e .
تشغيل واجهة المستخدمagentic_security (تخدم واجهة ويب محلية)
بدون واجهةagentic_security --headless
التحققagentic_security --help

تشغيل مسح

الأمرالوصف
agentic_securityابدأ واجهة المستخدم المحلية (المنفذ الافتراضي 8718)
agentic_security --port 8718اختر منفذًا
agentic_security --headlessوضع CI/غير تفاعلي
--llm-spec <file>حدد تنسيق الطلب الهدف
--max-budget Nحد أعلى للرموز/الطلبات المنفقة

تحديد الهدف

ماسح يحتاج إلى معرفة كيفية استدعاء نقطة نهاية النموذج اللغوي. توفر مواصفات HTTP:

POST https://api.example.com/v1/chat/completions
Authorization: Bearer $TOKEN
Content-Type: application/json

{
  "model": "my-model",
  "messages": [{"role": "user", "content": "<<PROMPT>>"}]
}

يتم استبدال <<PROMPT>> بكل فحص عكسي مُنتج، لذا يمكن استهداف أي API متوافق مع OpenAI أو API مخصص.

ما يفحصه

الفئةالبحث عن
كسور الأقفالتجاوز تعليمات السلامة
حقن الأوامرتجاوز التعليمات عبر المدخلات
تسرب البياناتتعريض موجه النظام / بيانات التدريب
محتوى ضارامتثال غير آمن
التمويجمدخلات مشوهة/حالات حافة
الإجهادالسلوك تحت الحمل/حدود معدل الطلبات

مجموعات البيانات والفحوصات

المصدرتوفير
مجموعات الفحص المدمجةفحوصات معادية منسقة
مجموعات بيانات HuggingFaceمجموعات كسور أقفال المجتمع
CSV مخصصةفحوصاتك الخاصة
إنشاء وكاليهجمات تكيفية مُنتجة بالنموذج

قراءة النتائج

الإخراجالمعنى
معدل الفشلحصة الفحوصات التي أنتجت مخرجات غير آمنة
تفصيل لكل وحدةفئة الهجوم التي نجحت
نسخ استنساخ عيناتأزواج الموجه/الاستجابة الدقيقة
الإنتاجية/الكمونسلوك API تحت الإجهاد

ركز أولاً على الوحدات ذات معدل فشل مرتفع — هناك حيث تكون حرّاستك أرق.

تكامل CI

# مسح بدون واجهة مع حد إنفاق، فشل على الحد الأدنى
agentic_security --headless --llm-spec ./target.spec --max-budget 50000
الممارسةالسبب
حد الميزانيةيمكن أن يقضي التمويج الوكالي الرموز بسرعة
تثبيت مجموعات الفحصنتائج قابلة للمقارنة من التشغيل إلى التشغيل
التشغيل على تغيير الموجه/النموذجكلاهما يغير سطح السلامة
الاقتران مع الحرّاساتأعد المسح بعد إضافة LLM Guard

Agentic Security مقابل الأدوات ذات الصلة

الجانبAgentic SecuritygarakDeepTeam
النهجالتمويج الوكالي + الإجهادمكتبة الفحص الثابتةمجموعة Pythonic
اختبار إجهاد APIنعملالا
واجهة المستخدمواجهة ويب محليةCLIكود
الأفضل لـمسح نقطة نهاية بدون صندوق أسودفحوصات النموذج الواسعةاختبار لون أحمر آلي على مستوى التطبيق

الموارد