~/home / tags / 验证

# 验证

24 个相关产品 · 中文解读 · 按热度排序
截至 2026-09-12,KanonAgent 库内有 24 个带「验证」标签的 AI agent 与工具,本页按真实热度排序。标签由中文拆解自动归纳,不是人工打的;数据可经公开 API 复核。
Makoto – Block AI agents when their claims contradict their logs
Makoto 是一个用于检测 AI 代理(AI agent)自我陈述与实际行为是否矛盾的工具,帮助开发者验证 AI 的诚实性与一致性,适用于需要高可信度 AI 系统的场景。
Snitch – Deterministic prose claim verifier for coding agents. (OSS)
Snitch 是一个用于验证编码代理生成文本真实性的确定性工具,帮助开发者确保 AI 生成的代码声明可追溯、可验证,适用于 AI 辅助开发场景下的可信保障。
verbatimeter - check how grounded your LLM / RAG agent is in real-time
verbatimeter 是一个实时检测大模型或RAG代理是否‘说真话’的工具,通过比对输出与原始数据源,帮助开发者验证AI回答的准确性和事实依据。
Signal Transparency Verification
验证信号传输时间的工具,帮助交易员或系统设计者确认信号延迟是否合规,提升系统可信度。
Sol – a validated computational artifact for human-agent handoffs
Sol 是一个经过验证的计算成果,用于实现人类与 AI 代理之间的无缝协作,确保任务交接的可追溯性与正确性,适合复杂自动化流程。
Cortex Engines
多AI模型交叉验证平台,避免单一AI输出偏差,提升决策可信度
My continuity checker found Watson's wound in the wrong place
该工具通过连续性检查发现电影《终结者》中角色Watson的伤口位置错误,展示了AI在影视细节验证中的应用潜力。
Agent Eval Kit
AI智能体发布验证工具,提供可复现的离线证据,确保AI代理在生产环境中的行为可审计、可验证
PastWisdom Quote Verification
PastWisdom 用于验证名人名言的真实出处,防止误传和伪引用,适合研究者、教育者与内容创作者
Brand Hallucination Auditor
品牌幻觉审计工具,帮助营销人员验证AI生成内容是否符合品牌真实事实,防止误导性宣传
Evidence Graph – type checking for the specs your AI agent implements
Evidence Graph 是一个为 AI Agent 设计的规格验证工具,通过类型检查确保 AI 实现的逻辑与规范一致,适合 AI 工程师与系统架构师,亮点是将软件工程中的类型
Superunit
Superunit:AI代理自动通过电话、邮件、传真验证雇佣信息,为招聘和风控场景提供可信数据验证服务
A verification browser for AI agents – 13ms windows, one-call checks
该验证浏览器可对 AI 智能体进行毫秒级(13ms)的实时行为验证,支持单次调用检查,确保 AI 行为安全可信。
ActionRail, verify agent actions using live system of records
ActionRail 是一个用于验证 AI 代理行为的系统,通过实时访问真实数据源来校验动作是否正确,提升自动化流程的可信度。
OldHand A Claude/Codex plugin to verify the development flow end-to-end
OldHand 是一个针对 Claude 和 Codex 的插件,用于端到端验证开发流程,自动检查代码生成、测试、部署等环节是否完整合规,提升 AI 辅助开发的可靠性。
VerusCite, a tool to check for hallucinations in academic articles
VerusCite 是一款用于检测学术论文中幻觉(如虚构引用或错误事实)的工具,帮助研究人员和学者验证文献可靠性,提升学术诚信。
ChatGPTLie
ChatGPTLie:免费检测 ChatGPT 等大模型的幻觉与事实错误,帮助开发者和用户验证生成内容的准确性
LLM-as-a-Verifier Plugin for DeepSeek Harness
DeepSeek Harness 的 LLM-as-a-Verifier 插件,利用大模型自动验证AI生成代码或决策的正确性,提升系统可靠性。
nuhuh
nuhuh 是一个开源 AI 代理验证工具,当 AI 声称“已完成”时,它会自动运行实验验证结果是否真实可靠,防止虚假完成,适用于需要高可信度输出的科研或工程场景
waitlistTest
创业前验证工具,通过构建等待名单测试市场兴趣,帮助创业者在投入开发前确认需求真实性
FetchSandbox MCP
MCP协议的验证工具,用于确认AI集成修复是否真正生效,保障AI系统可靠性。
MinMax Arena
MinMax Arena 是一个结合人类与 AI 代理的数学谜题竞技场,通过机器验证确保数学记录的准确性,适合数学爱好者与 AI 研究者。
SIMURG
AI模型幻觉检测API,结合免费网络搜索验证生成内容真实性,提升AI输出可信度。
Proofly
Proofly 是一款让使用者能主动验证 AI 输出真实性的工具,防止被幻觉误导,强调‘可信 AI’而非盲目信任。
其他标签

常见问题

「验证」这个标签是怎么归的?

标签来自每个产品的中文拆解(解决什么场景、面向谁),由模型从产品自述里归纳,不是人工逐条打的,也不接受付费打标。

这里的排序依据是什么?

按库内真实热度:投票数 / MRR / 增速,取产品实际有的那个。不是编辑推荐,也不卖位置。

数据多久更新?

追踪持续进行(分钟级),本页于 2026-09-12 生成。全部数字可经公开只读 API 复核:https://kanonagent.com/data