EN
~/home / GitHub
GitHub · TypeScript

claude-video-vision

claude-video-vision 是一个「skill」类 AI agent,解决:让 AI 能自动观看并分析视频内容,如提取关键帧、识别语音、理解场景。定价:产品页未标明。截至 2026-08-08,KanonAgent 记录到 22 票。本站首次收录于 2026-08-08。
claude-video-vision 是一个为 Claude Code 设计的视频理解插件,支持视频帧提取与多模态音频分析,让 AI 能像人一样观看并理解视频内容。
claude-video-vision — 官网预览图
22 票
Kanon 于 2026 年 8 月 8 日 收录
🤖 Agent 拆解 · skill
解决什么场景让 AI 能自动观看并分析视频内容,如提取关键帧、识别语音、理解场景
自主度L2 · 有工具调用(引文: "extracts frames via ffmpeg and processes audio via multiple …")
目标市场AI 研究者 / 内容分析团队
前置条件开源
集成面mcp · gemini · openai · ffmpeg · whisper
牵引 · 为什么在涨22 个 Product Hunt 票数,项目在 AI 视频分析领域引发关注
为什么值得关注

突破了传统 AI 只能处理文本和图像的限制,为视频内容理解提供关键能力,是 AI Agent 视觉认知的重要一步。

证据引文判定所依据的原文 · 逐字引用

“public GitHub repository (README fetched)”— structural
“extracts frames via ffmpeg and processes audio via multiple backends”— readme
“processes audio via multiple backends (Gemini API, local Whisper, or OpenAI API)”— readme
“MCP server downloads it with yt-dlp”— readme
AI视频分析工作流
信号来源: GitHub
访问官网 →
📛 官方徽章挂到官网 / README
claude-video-vision badge
你是 claude-video-vision 的作者?上面选样式,嵌入代码实时更新;要贴合站点配色可在 URL 上加 bg= / fg= / accent=(十六进制色)。徽章链回本页。
分享到 X
手机端点「分享」直达微信/朋友圈/小红书;桌面端用「复制文案」后到 App 内粘贴发布

常见问题

claude-video-vision 是什么?

claude-video-vision 是一个为 Claude Code 设计的视频理解插件,支持视频帧提取与多模态音频分析,让 AI 能像人一样观看并理解视频内容。

claude-video-vision 解决什么问题?

让 AI 能自动观看并分析视频内容,如提取关键帧、识别语音、理解场景

claude-video-vision 为什么值得关注?

突破了传统 AI 只能处理文本和图像的限制,为视频内容理解提供关键能力,是 AI Agent 视觉认知的重要一步。

claude-video-vision 是开源的吗?

是。claude-video-vision 为开源项目。

claude-video-vision 能接哪些工具?

mcp,gemini,openai,ffmpeg,whisper

claude-video-vision 有多少人在用?

KanonAgent 记录到:22 票(本站首次收录于 2026-08-08)。

claude-video-vision 有什么替代品?

KanonAgent 库内的同类 agent:ponytail、claude-mem、open-design、deer-flow、Agent-Reach、oh-my-openagent。

claude-video-vision 的替代品 · 同类 AI agent

ponytailclaude-memopen-designdeer-flowAgent-Reachoh-my-openagent