DeepSeek Harness Plugin Hub

发布与管理完整 Harness Profiles,发现适合你的插件。

探索

插件目录环境预设文档中心动态

社区

发布插件联系我们报告问题

相关链接

Plugin Hub GitHubDeepSeek Harness 官方项目系统状态隐私说明
© 2026 DeepSeek Harness Plugin HubPowered byPaxTech

独立、非官方社区项目,与 DeepSeek 官方无隶属、授权或背书关系。

Voice Scribe — DeepSeek Harness 插件(DSH Plugin)
← Plugins
V

dsh-voice-scribe

Voice Scribe

DSH 专属语音输入插件:点按或按住 Alt 说话、松开/再点按转文字,支持热词替换表(hot.txt)、自定义润色提示词、录音电平指示。默认本地离线识别(SenseVoice,零配置零 key、音频不出本机),自动回退浏览器 Web Speech,可选云端 ASR 与润色(复用 DSH 模型)。Voice input for DeepSeek Harness: tap or hold Alt to talk, get text in the composer — local SenseVoice by default, zero config, zero API key.

插件会安装到这里;不确定时保持 web。

npx -y @deepseek-ai/dsh plugin --profile web add github:PensiveFei/dsh-voice-scribe#3147a3b40df6574bd8d8d72e7c18692e04a85221
README兼容性版本

兼容性与来源证明

Voice Scribe 以 dsh-voice-scribe 发布,当前版本为 0.4.10。Plugin Hub 会校验它的 manifest,并保存精确安装来源,便于复现安装结果。

DSH 兼容范围
*
运行环境
web
发布来源
github
Registry 更新时间
2026/9/15

版本

0.4.10stable
2026/9/15
0.4.9stable
2026/9/9
0.4.7stable
2026/9/4
查看其余 9 个版本收起版本
0.4.6stable
2026/9/1
0.4.4stable
2026/9/1
0.4.3stable
2026/8/31
0.4.2stable
2026/8/30
0.4.1stable
2026/8/29
0.4.0stable
2026/8/28
0.3.0stable
2026/8/27
0.2.0stable
2026/8/26
0.1.1stable
2026/8/25

相关插件

正在加载相关插件…

最新版
0.4.10
DSH
*
HMR
重启进程
Tree shaking
未声明可安全裁剪
解包体积
未提供
文件数
未提供
Surface
web
许可证
MIT
发布源
github
GitHub
★ 0
周下载
0
查看源码 ↗
README Badge

点击下方 Badge 复制 Markdown,粘贴到 README 即可。

这是你的 Plugin?认领权益 · 优先安全扫描

验证 package.json 声明的 GitHub 仓库,即可管理这个公开页面。认领后,Hub 会优先安排当前版本的安全扫描,并在通过后公开展示结果。

认领这个 Plugin →
报告问题
DeepSeek Harness Plugin Hub
ProfilesPlugins分类动态文档登录管理 Profiles
ProfilesPlugins分类动态文档登录

README

dsh-voice-scribe

DSH 专属语音输入插件:点按或按住 Alt 说话、松开/再点按转文字,结果追加到输入框草稿末尾(不覆盖已输入内容)。 Voice input for DeepSeek Harness: tap or hold Alt to talk, get text in the composer.

⚠️ 非官方插件,与 DeepSeek / 深度求索公司无关联。使用前请阅读 SECURITY.md。

安装 Install

dsh plugin --profile web add dsh-voice-scribe   # 重启 dsh web 后生效

使用 Usage

  • 麦克风按钮:输入框右侧 🎤 图标,点击开始说话、再点停止并转写(按钮录音中变红)
  • 热键:点输入框 → 按 Alt 开始说话 → 再按 Alt 结束并转写(备选 Alt+空格,设置可切换)
  • 按住说话:设置 → 语音输入 → 触发方式 可选「按住说话」——按住热键录音、松开自动转写(麦克风按钮同样支持)
  • 实时中间结果:说话时识别文本实时出现在草稿里(浏览器引擎逐字、本地引擎每 3 秒刷新),停止后替换为最终结果
  • 录音电平指示:录音中状态条下方显示实时电平条
  • 最长录音时长:本地引擎约 4 分钟、云端 10 分钟,到时长自动停止并转写
  • 切窗取消:录音中切到其他窗口自动取消本次录音(Alt+Tab 误触不会留下录音)

识别引擎 Engine(默认「自动」,零配置)

引擎说明
自动(默认)本地离线识别优先;不可用时自动回退浏览器识别
本地离线识别SenseVoice,零配置零 key、音频不出本机;首次使用自动下载模型(约 230MB,国内镜像,只需一次)
浏览器 Web Speech零配置;依赖 Google/Microsoft 服务(国内 / Edge Stable 可能不可用)
云端 ASR(可选)服务链:可配置多个 OpenAI 兼容端点按序尝试、失败自动切换;需在设置中配置 API key

浏览器识别依赖外部语音服务(Chrome 在大陆被墙、Edge Stable 有已知回归),故默认以本地识别为主。

云端 ASR 服务链示例:Groq(免费层)→ 硅基流动 SenseVoice → 阿里云百炼,任一失败自动尝试下一个(设置 → 语音输入 → 云端 ASR)。

识别语言 Languages

支持 中文 / English / 粤语 / 日本語 / 한국어(设置 → 语音输入 可选)。本地离线识别自动检测语言;所选语言作用于浏览器与云端识别。

热词替换表 Hot Words(可选)

把识别错的人名、术语、项目名替换回来:编辑 $DSH_HOME/voice/hot.txt(每行一条,修改后下次转写生效):

# 字面替换(不区分大小写):正确词=错误词1|错误词2
DeepSeek=deep seek|迪普西克
王小明=王小铭

# 正则替换(标准 $1 语义;未写 flags 时默认全局替换,写 g/y 则按原样使用)
/老\s*师/老师/
/\{([^}]+)\}/【$1】/
/deep\s*seek/DeepSeek/gi

设置 → 语音输入 页面会显示热词表状态(规则条数 / 文件路径 / 解析错误)。云端与本地离线引擎的转写结果统一应用。

自定义润色提示词(可选)

设置 → 语音输入 → 开启润色后:

  • 润色模型:下拉选择复用的 DSH 模型(选项来自 DSH 已配置的 provider,首次开启自动选中第一个)
  • 润色提示词:可自定义(多行,保存在服务端);留空或「恢复默认」使用内置的最小必要修正提示词

润色时会先做一步本地规则预润色(去「嗯/呃」等口头禅、折叠多余空格),再把更短更干净的文本交给 LLM,省 token;LLM 失败时仍保留原始转写。

隐私 Privacy

本地引擎音频不出本机;Web Speech 由浏览器语音服务处理;云端 ASR 的 key 只存服务端。

与同类插件对比 Compare

同为 DSH 的语音 / 输入增强插件,主要差异(截至 2026-09):

dsh-voice-scribe(本插件)dsh-better-input
定位专注语音输入输入增强套件(语音 + 提示词优化 + 文件转 Markdown 等)
本地离线识别✅ SenseVoice,零 key,音频不出本机❌ 仅浏览器原生识别
浏览器 Web Speech✅ 回退✅
云端 ASR 服务链✅ 多 provider 故障切换❌
热词替换表 hot.txt✅❌
本地规则预润色(省 token)✅ 0.4.2 起❌
AI 润色(复用 DSH 模型)✅✅
按住说话 / 录音电平✅录音自动停止(无电平)
提示词优化 / 文件转 Markdown❌✅

只想要更省心、更私密的语音输入 → dsh-voice-scribe;需要一整套输入增强(提示词优化、文件转 Markdown) → dsh-better-input。两者可并存。

已知限制 Known limitations

  • 输入框里含 @ 引用芯片(如 @文件)时,DSH 只提供「整段替换草稿」的接口,转写结果插入会把芯片展开成纯文本;先发送或清空草稿再听写可避免。
  • 浏览器 Web Speech 依赖外部语音服务,国内网络下通常需要改用本地离线或云端引擎。

兼容性 Compatibility

  • 需要 DSH 0.1.0-rc.6 及以上;peer 范围显式列出每条已发布的预发布线(0.1.1-rc / 0.1.2-alpha / 0.1.3-alpha / 0.1.5-alpha / 0.1.6-alpha),semver 的预发布规则要求逐条列出元组,否则该线宿主会一直收到 unmet-peer 告警。
  • 输入框插槽 conversation.input.right 在 DSH 0.1.2 起由 <textarea> 改为 Lexical contenteditable:0.4.8 起两种形态都支持(读取实时草稿走 useInput,写入走 inputActions.setDraft)。
  • 界面没有麦克风按钮(旧壳子没有该插槽)时,Alt 热键仍然可用。
  • 实测核对:0.4.10 逐文件对照了 DSH 0.1.5-rc.1 与 0.1.2-rc.1 —— 宿主端 dsh-host-webserver 两份字节一致,webServer / webRuntime / llm 三个服务与 ctx.llm.prepareCall / 流式 text-delta / finish.reason 均无变化;客户端 dsh-client-modules / dsh-client-ui-renderer / dsh-client-locale / dsh-client-ui-settings 四份字节一致,插槽注册、setDraft、useInput(s => s.draft)、[data-composer-card] + contenteditable 的 DOM 形态全部不变。

开发 Dev

npm test          # 测试
npm run lint      # 语法检查
npm run security  # 密钥/路径泄露扫描

License

MIT

相关插件

继续浏览 vision-media 分类下经过校验的插件。

Tool Describe Image@linxin666/dsh-tool-describe-image面向模型的 describe_image 工具,用于 dsh Web GUI:通过在兼容 OpenAI 的端点调用视觉语言模型,为文本模型提供图像理解能力,以描述一张图像(本地路径、http(s) URL 或附件引用)。可热插拔 —Modlens@liustack/modlens面向仅支持文本的 LLM 的插件视觉能力,由免费的 Antigravity CLI 提供支持Deepseek Ivideodeepseek-ivideoiPolloWork HyperFrames Video Studio,以及 27 个可编辑视频模板,以原生 DeepSeek Harness 对话视图呈现。Imagegen@dickpy/dsh-imagegendsh Web GUI 的 AI 图像生成插件:通过可配置的提供商渠道实现文生图和图生图(gpt-image-2 / grok-imagine-image / nanobanana series / seedream-5.0-pro / dall-e-3,支持原生 xAI Grok Imagine、Google Nano Banana a