A sandbox for running real jailbreak techniques against local LLMs 是一个用于测试大模型安全边界的实验性沙盒环境,帮助研究人员评估和防御模型越狱攻击。
▲2
为什么值得关注
访问 Hacker News 页面 →
为 LLM 安全研究提供可控实验平台,推动对抗性测试标准化,是当前 AI 安全领域的重要基础设施。
手机端点「分享」直达微信/朋友圈/小红书;桌面端用「复制文案」后到 App 内粘贴发布