speech-to-speech 是一个「voice」类 AI agent,解决:在本地环境中构建可离线运行的语音交互AI助手。定价:产品页未标明。截至 2026-09-10,KanonAgent 记录到 26 票。本站首次收录于 2026-07-24。
基于开源模型构建本地语音代理,支持离线运行,适合隐私敏感的语音交互场景
26 票
Kanon 于 2026 年 7 月 24 日 收录
还没有信号事件 —— 状态是未知,不是「平静」。
📈 时间线什么时候变了什么
- 首次观测 Kanon 开始为它保留永久历史
🔎 已知 / 未知
23 个字段里 11 个未知
| 可机器调用 | — | 未知 | — |
| 开源 | 1 | 已核实 | 1 条引文 |
| 可自托管 | 1 | 推断 | 1 条引文 |
| 需自带 key | 1 | 推断 | 1 条引文 |
| 自主度 | 2 | 推断 | 1 条引文 |
| 计费模式 | — | 未知 | — |
| 集成面 | openai | 推断 | 1 条引文 |
「未知」= 我们没核实过,**不等于「否」**。硬性筛选永远不会把未知当成否。
🤖 Agent 拆解 · voice
解决什么场景在本地环境中构建可离线运行的语音交互AI助手
自主度L2 · 有工具调用(引文: "VAD -> STT -> LLM -> TTS, exposed through an OpenAI Realtime…")
目标市场To B
前置条件开源 · 可自托管 · 需自带 API key
集成面openai
牵引 · 为什么在涨1482 votes on Product Hunt
为什么值得关注
本地化语音代理方案,兼顾隐私与实时性,适合嵌入式或企业级应用
证据引文判定所依据的原文 · 逐字引用
“public GitHub repository (README fetched)”— structural
“point it at a hosted provider, at HF Inference Providers, or at a vLLM or llama.cpp server on your own hardware for a fully local, fully open stack.”— readme
“export OPENAI_API_KEY=...”— readme
“VAD -> STT -> LLM -> TTS, exposed through an OpenAI Realtime-compatible WebSocket API”— readme
信号来源: GitHub
访问官网 →
📛 官方徽章挂到官网 / README
你是 speech-to-speech 的作者?上面选样式,嵌入代码实时更新;要贴合站点配色可在 URL 上加 bg= / fg= / accent=(十六进制色)。徽章链回本页。
手机端点「分享」直达微信/朋友圈/小红书;桌面端用「复制文案」后到 App 内粘贴发布
常见问题
speech-to-speech 是什么?
基于开源模型构建本地语音代理,支持离线运行,适合隐私敏感的语音交互场景
speech-to-speech 解决什么问题?
在本地环境中构建可离线运行的语音交互AI助手
speech-to-speech 为什么值得关注?
本地化语音代理方案,兼顾隐私与实时性,适合嵌入式或企业级应用
speech-to-speech 是开源的吗?
是。speech-to-speech 为开源项目。
speech-to-speech 能自托管吗?
可以。speech-to-speech 支持自托管部署。
speech-to-speech 能接哪些工具?
openai
speech-to-speech 有多少人在用?
KanonAgent 记录到:26 票(本站首次收录于 2026-07-24)。
speech-to-speech 有什么替代品?
KanonAgent 库内的同类 agent:SoundBoost.ai (formerly Diktatorial)、airi、voice clone、agents、Personapp.io、Voxdub。