一个开源的多模态 AI 模型,能生成带立体声的 2K 视频,支持文本、图像、音频输入,擅长精准文字渲染与复杂指令执行。
346 票
Kanon 于 2026 年 7 月 31 日 收录
🤖 Agent 拆解 · video
解决什么场景基于多模态输入,自动生成高质量、带立体声的 2K 视频,用于内容创作或 AI 实验。
目标市场To B (开发者、AI 创作者)
定价Free (open source)
为什么值得关注
开源 + 高质量视频生成能力,为开发者提供可定制的视频生成基座,具备生态构建潜力。
信号来源: ProductHunt
在 ProductHunt 查看 →
手机端点「分享」直达微信/朋友圈/小红书;桌面端用「复制文案」后到 App 内粘贴发布