~/home / tags / AI安全

# AI安全

35 个相关产品 · 中文解读 · 按热度排序
截至 2026-09-12,KanonAgent 库内有 35 个带「AI安全」标签的 AI agent 与工具,本页按真实热度排序。标签由中文拆解自动归纳,不是人工打的;数据可经公开 API 复核。
CyberStrikeAI
CyberStrikeAI 是面向 AI 原生安全的作战系统,将安全意图转化为可执行动作,实现自动化响应与持续学习,主要面向企业安全团队和 SOC 运维。
Don't trust our identity provider. Try to break it. ($1,000 Bug Bounty)
一个面向开发者和安全研究人员的开源身份验证系统挑战项目,鼓励用户尝试攻破其身份提供商以发现漏洞并赢取奖金,旨在提升系统安全性与可信度
Anthropic-Cybersecurity-Skills
为AI代理设计的817个结构化网络安全技能库,映射到六大安全框架,支持Claude Code等AI工具使用。
defending-code-reference-harness
为AI安全代理设计的自主扫描框架,集成威胁建模、漏洞扫描、优先级排序和补丁建议,支持自定义工作流。
HOL Guard
首个专为AI代理设计的防火墙,防止AI在执行任务时越权、泄露或误操作,保障AI系统安全运行。
Fikry
一个故意“训练失败”的AI,基于错误数据与过度自信输出荒诞内容,用反向方式揭示AI的脆弱性。
METATRON
一个基于本地LLM的AI渗透测试助手,运行在Parrot OS上,用于自动化安全测试流程,提升漏洞发现效率。
TokenVeil
一个自托管数据代理工具,将敏感信息替换为令牌再发送给大模型,响应后再还原真实值,保护企业数据隐私,适合对数据安全要求高的团队。
Occulta
一个AI数据安全防护工具,能在AI调用前自动识别并替换敏感信息(如姓名、身份证号),确保数据隐私,适用于企业或个人处理敏感内容时的安全交互。
Cerberus
一款AI代理安全防护工具,监控AI执行过程中的数据读取、内容输入与外部调用,提前拦截提示注入攻击,保障私有数据安全。
TrustLoopGuard
开源的 AI 行为控制层,可在执行关键操作(如支付、退款、账户变更)前对 AI 代理的决策进行审批、拦截或升级,增强 AI 安全性与可控性。
The AI Lethal Trifecta
探讨AI在自动化攻击中的三大致命组合,警示技术滥用风险
QuantmLayer – kernel-enforced containment for AI coding agents
为AI编程代理提供内核级强制隔离的系统层安全方案,防止AI在开发环境中越权操作,解决AI代理失控风险,适用于企业级AI开发团队。
Gumpbox
Mac/iOS原生应用,作为Linux服务器与AI工作流之间的本地MCP代理桥接器,支持Claude、Codex等AI工具安全运行,无需共享私钥
AgentGuard
AgentGuard 为AI代理设定安全规则,防止其绕过支出限制,即使意图变更也能强制执行,确保AI代理在合规边界内运行,尤其适用于高风险金融场景
Wardin
Wardin 是一个AI审计级证据层,为LLM请求提供不可篡改的哈希链凭证,确保请求可验证、可审计,适合对AI安全与合规有高要求的企业。
A hash-chained ledger for AI reasoning you can verify yourself
一种可自我验证的AI推理哈希链账本,允许用户独立追溯和验证AI的推理过程,增强AI决策的透明性与可信度。
OnLeash
在AI执行操作前设置安全检查点,自动拦截高风险行为,确保系统安全,适用于开发者和自动化流程中的可信AI代理场景。
Cheqpoint
一款AI安全工具,通过拦截高风险操作(如退款、删除、部署)并交由合适人员审核,提升AI代理的安全性,仅需一行代码集成
Agentinel
Agentinel 是一款为 AI 代理设计的本地零成本防火墙,可实时拦截 JavaScript、Python 和 Rust 中可能存在的幻觉或恶意代码,保护开发者的终端环境安全。
Veil-v1.0.0
本地运行的密钥管理工具,防止AI代理或脚本在日志、提示词中意外泄露敏感环境变量,提升开发安全性。
Vaara
开源的AI代理执行审计层,通过TPM 2.0绑定策略,记录并验证每个AI工具调用,实现可审计、可追溯的可信AI操作
Continuum Leak Check
为AI构建的Next.js + Supabase应用提供免费安全扫描,自动检测数据泄露、密钥暴露等高危漏洞并指导修复。
AEGIS
AEGIS 是一个自托管的开源安全层,专为大模型应用和 AI 助手设计,提供提示注入检测、策略执行与工具权限控制,防止恶意提示操控工具调用,填补了 LLM 安全防护领域的空白。
ARKN
一个在浏览器中本地检测并替换敏感信息(如PII、凭证、商业数据)的隐私保护工具,防止AI处理时泄露数据。
ShadowAI-Guard
ShadowAI-Guard 是一款企业级AI安全工具,作为零信任边界,拦截员工发送的AI提示词,自动脱敏敏感数据,防止企业数据泄露,无需禁止AI使用。
A11y Pulse
A11y Pulse 是一款开发者工具,每日自动扫描网站的无障碍合规性(WCAG),通过 AI 助手在开发环境中直接报告问题并提供修复建议,防止可访问性回归。
GaleOps Prompt-Injection Scanner
GaleOps Prompt-Injection Scanner 是一个免费的 AI 安全检测工具,可在三分钟内自动执行五种真实场景的提示注入攻击,帮助开发者验证其 AI 代理系统
promptShield
在将客户文档输入AI前自动匿名化处理,保护隐私数据,防止敏感信息泄露
Insight IT Solutions PrismGuard
生产环境LLM应用的提示注入防火墙,防止恶意输入导致系统被操控或泄露数据
adithyan-ak/AgentHound
AgentHound 是面向 AI 代理基础设施的进攻性安全框架,支持代理侦察、凭证窃取、模型数据泄露、投毒攻击与攻击路径分析,被誉为「AI 时代的 BloodHound」。
AI-Native Immune System & Gov.- AINISG
AINISG:AI原生免疫系统与治理框架,提供无密钥端到端安全的可信AI治理方案
AgentR 3.0
专为应对AI作弊时代而设计的招聘评估系统,通过行为分析与多维度验证识别AI代写简历与面试表现。
Citeable
Citeable 是一个检测AI模型(如ChatGPT)是否能准确引用你内容的工具,适合内容创作者和品牌,亮点是验证AI是否“记得”你并正确引用。
Protect Your Videos From AI Scraping
保护视频内容不被AI抓取与盗用,无需CDN,支持流媒体场景,适合创作者保护原创内容资产
其他标签

常见问题

「AI安全」这个标签是怎么归的?

标签来自每个产品的中文拆解(解决什么场景、面向谁),由模型从产品自述里归纳,不是人工逐条打的,也不接受付费打标。

这里的排序依据是什么?

按库内真实热度:投票数 / MRR / 增速,取产品实际有的那个。不是编辑推荐,也不卖位置。

数据多久更新?

追踪持续进行(分钟级),本页于 2026-09-12 生成。全部数字可经公开只读 API 复核:https://kanonagent.com/data