SEMANTIC DIRECTORY · plugin-directory-semantic-v3-18

实时语音对话

提供持续、流式或全双工的语音对话:语音输入、语音回复、唤醒词、打断、实时 turn-taking 和 agent 通话模式等输入输出闭环能力。单纯听写或朗读插件不属于此类。

使用关键词搜索
来源目录 discovery.composite.2026-09-06.v1-0-5.b92b985e31df规范结构 · 823 个节点 · 14829 个插件

叶子目录成员

31 个插件

dsh-voicezhuiyueya/dsh-voice目录 已分析Voice for DeepSeek Harness(dsh) — speech-to-text input + read-aloud TTS for text-only DeepSeek, zero API key.语音与音频GitHub兼容性DSH 0.1.2-rc.1 · web依赖审计未测试制品未解析证据更新2026-09-10公开信号4 starsdsh-voice-agentWayneYu430/dsh-voice-agent目录 已分析a full duplex voice mode for DSH语音与音频GitHub兼容性DSH 0.1.2-rc.1 · web依赖审计未测试制品未解析证据更新2026-09-10公开信号1 starsdsh-voice-agent#voice-app@wayneyu430227/dsh-voice-agent目录 已分析dsh 的对话式语音前端 Agent:通过 ByteDance Duplex 自然对话,把语音请求委派给后台任务,并用语音回报异步结果。语音与音频npmGitHub兼容性DSH 0.1.2-rc.1 · web依赖审计未测试制品0.1.2证据更新2026-09-08公开信号1 stars · 449 downloadsdsh-voice-ai-girlfriendbeiyege-01/dsh-voice-ai-girlfriend目录 已分析语音 AI 女友(Voice AI girlfriend for DeepSeek Harness):Whisper 语音输入 + Qwen3-TTS 声音克隆 + 句子级流式朗读 + 数字人动画窗。插话/排队双模式,说话即打断。语音与音频GitHub兼容性DSH 0.1.2-rc.1 · web依赖审计未测试制品未解析证据更新2026-09-10公开信号73 starsdsh-voice-by-edgeastr0mfly/dsh-voice-by-edge目录 已分析一个可以在edge上使用进行语音对话的dsh-plugin语音与音频GitHub兼容性DSH 0.1.2-rc.1 · web依赖审计未测试制品未解析证据更新2026-09-10公开信号1 starsdsh-voice-calldsh-voice-call目录 已分析agent 主动打来的语音电话:`offer_call` 向人类振铃(接听/拒接/稍后再说),接听后由本地 CrispASR + Qwen3-TTS 合成并播放(9 个音色,含 2 个中文方言);拒接则把决定返回给 agent。语音与音频npmGitHub兼容性DSH 0.1.2-rc.1 · web依赖审计有限审计报告 0 项制品0.2.0证据更新2026-09-07公开信号3 stars · 596 downloadsdsh-voice-callbiliye/dsh-voice-call目录 已分析这是一个deepseek专属的语音通话插件语音与音频GitHub兼容性DSH 0.1.2-rc.1 · web依赖审计未测试制品未解析证据更新2026-09-10公开信号1 starsdsh-voice-chatdsh-voice-chat目录 已分析豆包式语音对话插件:聊天框麦克风按钮(按住说话)语音转文字并自动发送,AI 回复自动朗读。可选 LLM 转述精简(长回复压缩成口语再播,跟随当前对话模型)、朗读前清洗 markdown/emoji/特殊符号、Edge TTS 多种音色、静音自动结束时长可调,设置嵌入 DSH 自带设置弹窗(voice chat 类目)。语音与音频npmGitHub兼容性DSH 0.1.2-rc.1 · web依赖审计有限审计报告 0 项制品0.3.1证据更新2026-09-07公开信号1 stars · 390 downloadsdsh-voice-dictationbigfurma-bot/dsh-voice-dictation目录 已分析Push-to-talk voice dictation for DeepSeek Harness: mic button in the composer transcribes via local Parakeet STT into your message draft语音与音频GitHub兼容性DSH 0.1.2-rc.1 · web依赖审计未测试制品未解析证据更新2026-09-10公开信号0 starsdsh-voice-input-cnSchumchanvi/dsh-voice-input-cn目录 已分析国内可用的输入框语音输入。需要先启动本地 Python bridge(pip install dashscope websockets,运行 bridge/voice-bridge.py)——只装插件不可用。浏览器麦克风采集 16kHz PCM 流式转发给 bridge,由阿里云 DashScope ASR(paraformer-realtime-v2)识别;识别文字在光标处实时填入草稿,静音自动停止,可选识别后自动发送。语音与音频GitHub兼容性DSH 0.1.2-rc.1 · web依赖审计未测试制品未解析证据更新2026-09-10公开信号2 starsdsh-voice-input-qwen-asrdsh-voice-input-qwen-asr目录 已分析Voice input plugin (dual-face): mic button beside the composer send action, live recording bubble streaming PCM to a local Qwen3-ASR python service managed by the host, plus an ASR environment settings page (clone runtime/model repos, create venv, run ser语音与音频npmGitHub兼容性DSH 0.1.2-rc.1 · web依赖审计有限审计报告 0 项制品0.1.1证据更新2026-09-10公开信号暂无公开使用信号dsh-voice-livetangzheng202202/dsh-voice-live目录 已分析基于火山流式 ASR/TTS 的实时双工语音:回复朗读、打断、唤醒词、实时字幕、30 个中文音色与先响应后思考;在 DSH monorepo 内构建。语音与音频GitHub兼容性DSH 0.1.2-rc.1 · web依赖审计未测试制品未解析证据更新2026-09-10公开信号1 starsdsh-voice-mode#dsh-voice-modedsh-voice-mode目录 已分析DeepSeek Harness Web UI 全双工语音对话:按钮或 Ctrl+Shift+V 进入,持续聆听(停顿自动发送)或按住说话,zipformer2 流式识别入可编辑草稿、可选唤醒词;回复按句 Edge TTS 朗读并显示实时字幕,开口即打断播放与回合(真 barge-in);识别模型本地推理、Edge TTS 在线合成,无需 API Key。语音与音频npmGitHub兼容性DSH 0.1.2-rc.1 · web依赖审计有限审计报告 0 项制品0.7.5证据更新2026-09-06公开信号8 stars · 2127 downloads

分类属于公开语义索引事实,不是最终推荐;兼容性、权限与来源证据仍需分别核对。