DeepSeek Harness Plugin Hub

发布与管理完整 Harness Profiles,发现适合你的插件。

探索

插件目录环境预设文档中心动态

社区

发布插件联系我们报告问题

相关链接

Plugin Hub GitHubDeepSeek Harness 官方项目系统状态隐私说明
© 2026 DeepSeek Harness Plugin HubPowered byPaxTech

独立、非官方社区项目,与 DeepSeek 官方无隶属、授权或背书关系。

Plugin Voice — DeepSeek Harness 插件(DSH Plugin)
DeepSeek Harness Plugin Hub
ProfilesPlugins分类动态文档登录管理 Profiles
ProfilesPlugins分类动态文档登录
← Plugins

dsh-plugin-voice

Plugin Voice

DeepSeek Harness 插件:语音 + 通知出口——agent 通过云端 TTS(火山 seed-tts / 小米 MiMo V2.5,失败自动回退 SAPI)/ 桌面通知 / 提示音主动联系用户。融合 dsh-plugin-notify 的 DSH 原生深度集成与 agent-voice-mcp-minus 的云端 TTS 调优,零 Python 依赖,Windows 原生。

插件会安装到这里;不确定时保持 web。

npx -y @deepseek-ai/dsh plugin --profile web add dsh-plugin-voice@0.2.5
README兼容性版本

兼容性与来源证明

Plugin Voice 以 dsh-plugin-voice 发布,当前版本为 0.2.5。Plugin Hub 会校验它的 manifest,并保存精确安装来源,便于复现安装结果。

DSH 兼容范围
*
运行环境
web
发布来源
npm
Registry 更新时间
2026/9/1

版本

0.2.5stable
2026/9/1
0.2.4stable
2026/9/1
0.2.3stable
2026/8/29
查看其余 2 个版本收起版本
0.2.2stable
2026/8/29
0.1.2stable
2026/8/29

相关插件

正在加载相关插件…

最新版
0.2.5
DSH
*
HMR
重启进程
Tree shaking
未声明可安全裁剪
解包体积
491 kB
文件数
18
Surface
web
许可证
MIT
发布源
npm
GitHub
★ 0
周下载
0
最近提交
2026/9/1
查看源码 ↗
README Badge

点击下方 Badge 复制 Markdown,粘贴到 README 即可。

这是你的 Plugin?认领权益 · 优先安全扫描

验证 package.json 声明的 GitHub 仓库,即可管理这个公开页面。认领后,Hub 会优先安排当前版本的安全扫描,并在通过后公开展示结果。

认领这个 Plugin →
报告问题

相关插件

继续浏览 vision-media 分类下经过校验的插件。

Tool Describe Image@linxin666/dsh-tool-describe-image面向模型的 describe_image 工具,用于 dsh Web GUI:通过在兼容 OpenAI 的端点调用视觉语言模型,为文本模型提供图像理解能力,以描述一张图像(本地路径、http(s) URL 或附件引用)。可热插拔 —Modlens@liustack/modlens面向仅支持文本的 LLM 的插件视觉能力,由免费的 Antigravity CLI 提供支持Deepseek Ivideodeepseek-ivideoiPolloWork HyperFrames Video Studio,以及 27 个可编辑视频模板,以原生 DeepSeek Harness 对话视图呈现。Image Gendsh-image-gen将类似 ChatGPT 的图像生成功能带到 DeepSeek Harness——支持 Gemini、OpenAI、Seedream、DashScope、本地 ComfyUI 等。

README

dsh-plugin-voice

DeepSeek Harness 插件:语音 + 通知出口——agent 通过云端 TTS(火山 seed-tts / 小米 MiMo V2.5,失败自动回退 SAPI)/ 桌面通知 / 提示音主动联系用户。Windows 原生,零 Python 依赖。

功能

  • 云端高质量 TTS:火山 seed-tts 大模型流式合成 + 小米 MiMo V2.5(OpenAI 兼容,预置音色),情绪声学/指令映射
  • 智能兜底:云端引擎失败(断网 / 额度 / Key 失效)自动回退 Windows SAPI 离线语音
  • 场景化提示音:5 场景各配一个内置 WAV 音效,播完立即接语音
  • 智能呼叫:回合结束通知 → 60 秒确认窗口 → 超时且你离开 → 语音叫你回来;agent 提问等待过久也自动呼叫
  • 长文案优化:按句切分并行合成 + 文本清洗(不读代码块 / URL / Markdown 标记)
  • 设置面板:引擎 / 音色 / 音量 / 语速 / Key / 场景模板与提示音,实时生效,支持试听
  • 测试页:浏览器打开 /voice,选模式 / 场景 / 情绪点发送

安装

dsh plugin --profile web add dsh-plugin-voice
dsh web   # 重启生效

要求:Windows 10 / 11 + Node.js 22.5+(PowerShell 系统自带)。

pnpm 用户:推荐用上面的 registry 安装(npm 包自带构建产物,零配置秒装)。git 方式安装需克隆仓库(较慢),且 pnpm 的 allowBuilds 只认「包名@精确 tarball URL」(URL 含 commit hash,仓库每次更新都会变),供应链门禁还可能改写你的 pnpm-workspace.yaml。本仓库已提交 lib/,git 安装无需现场构建;若仍被 ERR_PNPM_GIT_DEP_PREPARE_NOT_ALLOWED 拦截,改用 registry 安装即可。

使用

模型主动播报(核心场景)——直接对话即可:

"查一下项目状态,完成后用语音叫我"

手动播报 / 通知:

/voice 任务完成了
/voice --scene=task_complete --emotion=happy 搞定了

配置

设置面板(DSH 设置 → 语音)即可完成全部常用配置,引擎可自选(默认 auto)。支持两个云端引擎(可同时配置 Key,auto 按 MiMo → 火山 → SAPI 顺序自动选择已配 Key 的引擎):

  • 小米 MiMo:在 mimo.mi.com 控制台获取 API Key → 面板填入(或环境变量 MIMO_API_KEY),预置音色开箱即用(mimo_default / 冰糖 / 茉莉 / 苏打 / 白桦 / Mia / Chloe / Milo / Dean)
  • 火山:注册火山引擎 → 开通「语音合成大模型」→ 创建 X-Api-Key → 面板填入(或环境变量 VOLCANO_API_KEY)

未配置任何 Key 自动用 SAPI 离线语音(不报错)。

高级参数(角色 / 场景音色 / 云端音质微调)见 config.example.json。

致谢

  • dsh-plugin-notify by huguangyu666 —— DSH 原生集成骨架
  • agent-voice-mcp-minus —— 云端 TTS 引擎
  • 火山引擎 · 豆包语音合成大模型

License

MIT(继承两源项目协议,保留原作者署名)