DeepSeek Harness Plugin Hub

发布与管理完整 Harness Profiles,发现适合你的插件。

探索

插件目录环境预设文档中心动态

社区

发布插件联系我们报告问题

相关链接

Plugin Hub GitHubDeepSeek Harness 官方项目系统状态隐私说明
© 2026 DeepSeek Harness Plugin HubPowered byPaxTech

独立、非官方社区项目,与 DeepSeek 官方无隶属、授权或背书关系。

Voice Input — DeepSeek Harness 插件(DSH Plugin)
← Plugins
V

@difimim/dsh-voice-input

Voice Input

DeepSeek Harness 语音输入插件:在输入框加入麦克风按钮,用浏览器 Web Speech API 把语音实时转成文字填入输入框。

插件会安装到这里;不确定时保持 web。

npx -y @deepseek-ai/dsh plugin --profile web add github:difimim/dsh-voice-input-npm#28ce76701d6d5f98f025fc925d3bee8a40ab7475
README兼容性版本

兼容性与来源证明

Voice Input 以 @difimim/dsh-voice-input 发布,当前版本为 1.0.1。Plugin Hub 会校验它的 manifest,并保存精确安装来源,便于复现安装结果。

DSH 兼容范围
*
运行环境
web
发布来源
github
Registry 更新时间
2026/8/30

版本

1.0.1stable
2026/8/30

相关插件

正在加载相关插件…

最新版
1.0.1
DSH
*
HMR
重启进程
Tree shaking
未声明可安全裁剪
解包体积
未提供
文件数
未提供
Surface
web
许可证
MIT
发布源
github
GitHub
★ 1
周下载
0
最近提交
2026/8/30
查看源码 ↗
README Badge

点击下方 Badge 复制 Markdown,粘贴到 README 即可。

这是你的 Plugin?认领权益 · 优先安全扫描

验证 package.json 声明的 GitHub 仓库,即可管理这个公开页面。认领后,Hub 会优先安排当前版本的安全扫描,并在通过后公开展示结果。

认领这个 Plugin →
报告问题
DeepSeek Harness Plugin Hub
ProfilesPlugins分类动态文档登录管理 Profiles
ProfilesPlugins分类动态文档登录

相关插件

继续浏览 vision-media 分类下经过校验的插件。

Tool Describe Image@linxin666/dsh-tool-describe-image面向模型的 describe_image 工具,用于 dsh Web GUI:通过在兼容 OpenAI 的端点调用视觉语言模型,为文本模型提供图像理解能力,以描述一张图像(本地路径、http(s) URL 或附件引用)。可热插拔 —Modlens@liustack/modlens面向仅支持文本的 LLM 的插件视觉能力,由免费的 Antigravity CLI 提供支持Deepseek Ivideodeepseek-ivideoiPolloWork HyperFrames Video Studio,以及 27 个可编辑视频模板,以原生 DeepSeek Harness 对话视图呈现。Codexdsh-codexChatGPT OAuth、Codex 模型、搜索、read_image URL 支持,以及适用于 DeepSeek Harness 的 gpt-image-2 生成

README

DSH Voice Input · DeepSeek Harness 语音输入插件

在 DeepSeek Harness(DSH)输入框底部加入一个麦克风按钮:点击后用浏览器内置的 Web Speech API 把语音实时转成文字并填入输入框。零成本、零服务端部署。

A DeepSeek Harness plugin that adds a microphone button to the composer. Click it to transcribe speech into the input box using the browser's built-in Web Speech API — zero cost, zero server.


安装

这是一个标准的 DSH 插件 bundle,用一条命令安装:

dsh plugin --profile web add @difimim/dsh-voice-input

装完重启 DSH(dsh web),按钮就会出现在输入框工具行左侧。

其他 profile(如 tui)同理:dsh plugin --profile tui add @difimim/dsh-voice-input。

从本地 / 未发布源码安装

还没发布到 npm 时,可以按路径安装:

dsh plugin --profile web add file:/path/to/dsh-voice-input
# 或
dsh plugin --profile web add link:/path/to/dsh-voice-input

功能特性

  • 🎙️ 输入框工具行左侧新增麦克风按钮,点击开始 / 停止收音
  • ⚡ 实时识别:边说边把中间结果写进输入框草稿
  • ➕ 追加式写入:不清空已有文字,识别结果追加到当前草稿末尾
  • 🌐 零成本零服务端:直接复用浏览器内置 Web Speech API
  • 🎨 跟随主题:按钮颜色使用 DSH 主题变量,自动适配明暗色

使用

  1. 点麦克风图标 → 按钮变红并出现脉冲动画,开始收音;
  2. 直接说话,文字会实时出现在输入框里;
  3. 再点一下(图标变方块)→ 停止收音;
  4. 确认文字无误后,正常回车发送。

工作原理

部分说明
识别引擎浏览器内置 Web Speech API(SpeechRecognition / webkitSpeechRecognition)
识别语言默认 zh-CN(中文),可在 lib/client.js 里改 rec.lang
写入方式通过输入框 Slot 提供的 inputActions.setDraft() 写入草稿,与手打内容共存
按钮位置conversation.input.left(输入框工具行左侧,模型选择那一行)

浏览器兼容性

浏览器支持
Chrome / Edge✅(推荐)
Safari✅(较新版本,行为略有差异)
Firefox❌(不支持 Web Speech API)
  • 首次点击会弹出麦克风授权,请点「允许」。
  • 需联网:Web Speech API 会把音频交给浏览器厂商的识别服务器。

隐私说明

当前方案(Web Speech API)为了“零成本、零部署”,会把语音发到浏览器厂商的识别服务。若你在意隐私或需要完全离线,请参考下方 Roadmap 的 Vosk 接入计划。

目录结构

dsh-voice-input/
├── package.json      # dsh.client + dsh.bundle.patch 声明
├── cordis.patch.yml  # bundle patch:把本插件挂进 host 组合
├── lib/
│   ├── index.js      # Node 半(纯 UI 插件,空 apply)
│   └── client.js     # 浏览器半(麦克风按钮 + Web Speech 识别)
├── README.md
└── LICENSE

Roadmap

  • Web Speech API 实时语音输入
  • 语言切换(中文 / 英文 / 自动)
  • Vosk 离线识别接入(通过 host 侧 Remote 服务)
  • 语音输入过程中的可视化状态条

License

MIT