DeepSeek Harness Plugin Hub

发布与管理完整 Harness Profiles,发现适合你的插件。

探索

插件目录环境预设文档中心动态

社区

发布插件联系我们报告问题

相关链接

Plugin Hub GitHubDeepSeek Harness 官方项目系统状态隐私说明
© 2026 DeepSeek Harness Plugin HubPowered byPaxTech

独立、非官方社区项目,与 DeepSeek 官方无隶属、授权或背书关系。

Voice Control — DeepSeek Harness 插件(DSH Plugin)
DeepSeek Harness Plugin Hub
ProfilesPlugins分类动态文档登录管理 Profiles
ProfilesPlugins分类动态文档登录
← Plugins
V

dsh-voice-control

Voice Control

DSH web 的语音控制:通过 Web Speech API 将语音转为文本输入编辑器(支持自动发送),并播放助手回复

插件会安装到这里;不确定时保持 web。

npx -y @deepseek-ai/dsh plugin --profile web add github:SuCriss/dsh-voice-control#866da1bdfb6253fc2f4d1d3995ea044a569928c0
README兼容性版本

兼容性与来源证明

Voice Control 以 dsh-voice-control 发布,当前版本为 1.0.0。Plugin Hub 会校验它的 manifest,并保存精确安装来源,便于复现安装结果。

DSH 兼容范围
*
运行环境
web
发布来源
github
Registry 更新时间
2026/8/31

版本

1.0.0stable
2026/8/31

相关插件

正在加载相关插件…

最新版
1.0.0
DSH
*
HMR
重启进程
Tree shaking
未声明可安全裁剪
解包体积
未提供
文件数
未提供
Surface
web
许可证
MIT
发布源
github
GitHub
★ 0
周下载
0
最近提交
2026/9/1
查看源码 ↗
README Badge

点击下方 Badge 复制 Markdown,粘贴到 README 即可。

这是你的 Plugin?认领权益 · 优先安全扫描

验证 package.json 声明的 GitHub 仓库,即可管理这个公开页面。认领后,Hub 会优先安排当前版本的安全扫描,并在通过后公开展示结果。

认领这个 Plugin →
报告问题

相关插件

继续浏览 vision-media 分类下经过校验的插件。

Tool Describe Image@linxin666/dsh-tool-describe-image面向模型的 describe_image 工具,用于 dsh Web GUI:通过在兼容 OpenAI 的端点调用视觉语言模型,为文本模型提供图像理解能力,以描述一张图像(本地路径、http(s) URL 或附件引用)。可热插拔 —Modlens@liustack/modlens面向仅支持文本的 LLM 的插件视觉能力,由免费的 Antigravity CLI 提供支持Deepseek Ivideodeepseek-ivideoiPolloWork HyperFrames Video Studio,以及 27 个可编辑视频模板,以原生 DeepSeek Harness 对话视图呈现。Image Gendsh-image-gen将类似 ChatGPT 的图像生成功能带到 DeepSeek Harness——支持 Gemini、OpenAI、Seedream、DashScope、本地 ComfyUI 等。

README

dsh-voice-control

DSH Web 声控插件:语音输入 + 语音播报,把 DeepSeek Harness 变成桌面 Jarvis。

  • 🎙 输入框麦克风:麦克风图标嵌在 composer 发送键左侧,样式与原生按钮统一,零额外占位
  • 说话即发送:Web Speech API 实时识别(Chrome/Edge 内置),说完直接发出;关闭自动发送则填入草稿供编辑
  • 🔊 回复播报:语音指令的回复自动朗读——1.5s 文本稳定去抖判定回复完成(流式输出、工具调用都不怕),Markdown 自动清洗成口语
  • 音色动态适配:音色列表按浏览器/系统实时获取(Edge 附赠微软在线自然语音),按语言分组,跨设备自动回落
  • ⚙ 按需设置:右键麦克风弹出设置(自动发送/自动朗读/语速/音色/试听),localStorage 持久化
  • Ctrl+M 全局快捷键;录音中麦克风两侧音波动效
  • 纯浏览器实现,零依赖、零后端、零 API Key

安装

dsh plugin --profile web add dsh-voice-control

也可以从 GitHub 源码安装:dsh plugin --profile web add github:SuCriss/dsh-voice-control。

重启 dsh web 生效(新增 bundle 行需重组配置树;之后改源码刷新页面即可热载)。

语音识别使用浏览器内置服务(Chrome/Edge),需要网络;TTS 播报完全本地。不支持 Firefox(无 Web Speech 识别)。

卸载

dsh plugin --profile web remove dsh-voice-control

实现说明

  • 浏览器半区通过 data-composer-card / data-input-scroll 稳定属性定位 composer 工具行,portal 注入麦克风按钮,MutationObserver 兜底重挂
  • 发送走会话作用域 conversation.send();填入走 conversation.input.for().actions.setDraft()
  • 朗读源为会话快照中最新的助手文本节点,按指纹去抖触发

已知边界(v1.0)

  • 语音指令的回复自动朗读:发送后 3 分钟内到达的最后一条助手回复;长回复最多读 1200 字符
  • 推式(push-to-talk)而非常驻监听,避免拾取 TTS 声音形成回环
  • 未适配多会话并排视图下的非活动输入框

MIT © SuCriss