项目介绍
基本能力
产品定位
Agentic Security 是一款专注于人工智能系统安全的漏洞扫描工具,旨在帮助用户通过多模态攻击模拟、越狱测试和模糊测试来发现并修复大型语言模型(LLMs)中的安全漏洞。
核心特性
- 多模态攻击测试:支持文本、图像和音频输入模拟。
- 多步骤越狱测试:模拟复杂的迭代攻击序列以测试 LLM 的安全机制。
- 全面模糊测试:通过随机化输入对 LLM 进行压力测试,以揭示边缘情况。
- API 集成与压力测试:无缝连接到 LLM API,用于高容量的真实世界攻击场景。
- 基于强化学习的攻击:使用强化学习生成自适应攻击向量。
使用案例
- AI 系统开发:在开发过程中测试 LLM 安全性。
- 安全研究:研究新的攻击向量和防御机制。
- 持续集成/持续部署(CI/CD)集成:在持续集成管道中自动化安全扫描。
使用教程
依赖项
确保已安装 Python 和 pip。
安装
通过 pip 安装:
pip install agentic_security
调试
启动服务并查看日志:
agentic_security
或使用帮助命令:
agentic_security --help
工具列表
- Garak:集成的越狱测试工具。
- InspectAI:集成的人工智能模型检查工具。
- llm-adaptive-attacks:集成的自适应攻击工具。
- 自定义 Huggingface 数据集:支持自定义数据集。
- 本地 CSV 数据集:支持本地 CSV 数据集。