~/home / tags / AI安全

# AI安全

19 个相关产品 · 中文解读 · 按热度排序
Don't trust our identity provider. Try to break it. ($1,000 Bug Bounty)
一个面向开发者和安全研究人员的开源身份验证系统挑战项目,鼓励用户尝试攻破其身份提供商以发现漏洞并赢取奖金,旨在提升系统安全性与可信度
Claw Patrol, a security firewall for agents
为 AI 代理(Agent)提供安全防护的防火墙系统,防止代理行为失控或越权访问
HOL Guard
首个专为AI代理设计的防火墙,防止AI在执行任务时越权、泄露或误操作,保障AI系统安全运行。
Fikry
一个故意“训练失败”的AI,基于错误数据与过度自信输出荒诞内容,用反向方式揭示AI的脆弱性。
CyberStrikeAI
CyberStrikeAI 是面向 AI 原生安全的作战系统,将安全意图转化为可执行动作,实现自动化响应与持续学习,主要面向企业安全团队和 SOC 运维。
TokenVeil
一个自托管数据代理工具,将敏感信息替换为令牌再发送给大模型,响应后再还原真实值,保护企业数据隐私,适合对数据安全要求高的团队。
Occulta
一个AI数据安全防护工具,能在AI调用前自动识别并替换敏感信息(如姓名、身份证号),确保数据隐私,适用于企业或个人处理敏感内容时的安全交互。
Cerberus
一款AI代理安全防护工具,监控AI执行过程中的数据读取、内容输入与外部调用,提前拦截提示注入攻击,保障私有数据安全。
TrustLoopGuard
开源的 AI 行为控制层,可在执行关键操作(如支付、退款、账户变更)前对 AI 代理的决策进行审批、拦截或升级,增强 AI 安全性与可控性。
The AI Lethal Trifecta
探讨AI在自动化攻击中的三大致命组合,警示技术滥用风险
QuantmLayer – kernel-enforced containment for AI coding agents
为AI编程代理提供内核级强制隔离的系统层安全方案,防止AI在开发环境中越权操作,解决AI代理失控风险,适用于企业级AI开发团队。
Gumpbox
Mac/iOS原生应用,作为Linux服务器与AI工作流之间的本地MCP代理桥接器,支持Claude、Codex等AI工具安全运行,无需共享私钥
AgentGuard
AgentGuard 为AI代理设定安全规则,防止其绕过支出限制,即使意图变更也能强制执行,确保AI代理在合规边界内运行,尤其适用于高风险金融场景
OnLeash
在AI执行操作前设置安全检查点,自动拦截高风险行为,确保系统安全,适用于开发者和自动化流程中的可信AI代理场景。
Aitori, see and govern the AI traffic leaving your machine
监控并管理本地设备发出的 AI 请求流量,解决用户对 AI 数据外泄和使用成本的隐忧,面向开发者与隐私敏感型 AI 用户
Stinger – Catch secret-stealing activity via local traps on macOS/Linux
在macOS/Linux系统上部署本地陷阱,主动检测并捕获窃取敏感信息的恶意行为,专为安全团队和开发者提供主动防御能力
A sandbox for running real jailbreak techniques against local LLMs
一个用于在本地大模型上测试真实越狱攻击的技术沙盒,帮助研究人员和开发者评估模型安全性,解决AI安全测试缺乏真实场景的问题
promptShield
在将客户文档输入AI前自动匿名化处理,保护隐私数据,防止敏感信息泄露
Insight IT Solutions PrismGuard
生产环境LLM应用的提示注入防火墙,防止恶意输入导致系统被操控或泄露数据
其他标签