DeepSeek Harness Plugin Hub

发布与管理完整 Harness Profiles,发现适合你的插件。

探索

插件目录环境预设文档中心动态

社区

发布插件联系我们报告问题

相关链接

Plugin Hub GitHubDeepSeek Harness 官方项目系统状态隐私说明
© 2026 DeepSeek Harness Plugin HubPowered byPaxTech

独立、非官方社区项目,与 DeepSeek 官方无隶属、授权或背书关系。

Voice Input — DeepSeek Harness 插件(DSH Plugin)
DeepSeek Harness Plugin Hub
ProfilesPlugins分类动态文档登录管理 Profiles
ProfilesPlugins分类动态文档登录
← Plugins

@opensquad/dsh-voice-input

Voice Input

SenseVoice 语音输入插件 for DeepSeek Harness:在对话输入框旁添加麦克风按钮,录音后调用本地 SenseVoice 服务转成文本填入输入框。首次使用自动下载模型并显示进度,后端由插件自动启动。

插件会安装到这里;不确定时保持 web。

npx -y @deepseek-ai/dsh plugin --profile web add @opensquad/dsh-voice-input@0.3.3
README兼容性版本

兼容性与来源证明

Voice Input 以 @opensquad/dsh-voice-input 发布,当前版本为 0.3.3。Plugin Hub 会校验它的 manifest,并保存精确安装来源,便于复现安装结果。

DSH 兼容范围
*
运行环境
web
发布来源
npm
Registry 更新时间
2026/9/22

版本

0.3.3stable
2026/8/16
0.3.2stable
2026/8/16
0.3.1stable
2026/8/16
查看其余 3 个版本收起版本
0.3.0stable
2026/8/16
0.2.0stable
2026/8/16
0.1.0stable
2026/8/16

相关插件

正在加载相关插件…

最新版
0.3.3
DSH
*
HMR
重启进程
Tree shaking
未声明可安全裁剪
解包体积
67.6 kB
文件数
14
Surface
web
许可证
MIT
发布源
npm
GitHub
★ 0
周下载
58
最近提交
2026/8/16
查看源码 ↗项目主页 ↗
README Badge

点击下方 Badge 复制 Markdown,粘贴到 README 即可。

这是你的 Plugin?认领权益 · 优先安全扫描

验证 package.json 声明的 GitHub 仓库,即可管理这个公开页面。认领后,Hub 会优先安排当前版本的安全扫描,并在通过后公开展示结果。

认领这个 Plugin →
报告问题

README

@opensquad/dsh-voice-input

DeepSeek Harness 语音输入插件:在 Web 对话输入框旁添加一个麦克风按钮,录音后调用本地 SenseVoice 服务转写成文本,自动填入输入框。首次使用会引导下载模型并显示实时进度。

英文版 / English: README_EN.md

功能

  • 🎤 输入框旁麦克风按钮,一键录音转文字
  • ⬇️ 首次使用自动下载模型(约 230MB),按钮上显示圆环进度 + 实时百分比
  • ⚙ 独立管理按钮:查看/卸载已安装的语音模型
  • 自动拉起本地 SenseVoice 服务(模型就绪时)

依赖

这是一个全自动插件:Python 后端(依赖安装 + 进程启动)由插件在 dsh 启动时自动完成,首次使用模型也自动下载。 你只需要:

前置说明
Python 3.10+唯一需要手动装的软依赖(插件会自动 pip install 其余依赖)
ffmpeg(可选/推荐)仅用于异常音频的兜底转码,正常使用不需要;winget install ffmpeg 或官网安装并加入 PATH

手动安装 Python 3.10+

插件会自动安装剩下的 Python 依赖(flask / onnxruntime 等),你只需装好 Python 本身。

  1. 打开 python.org/downloads,下载最新的 Python 3.10+(Windows 选 Windows installer (64-bit))。
  2. 运行安装程序,务必勾选底部的 Add python.exe to PATH,再点 Install Now。
  3. 安装完成后,重新打开一个终端(PowerShell / CMD),验证安装成功:
    python --version
    # 期望输出类似: Python 3.12.x(3.10 或更高即可)
    

手动安装 ffmpeg(可选)

浏览器端会把录音转成标准 WAV,正常使用不需要 ffmpeg。它仅在服务端收到异常/无法识别的音频时作为兜底转码使用,建议安装以免个别浏览器录音无法转写。

  • Windows:在 PowerShell 里执行
    winget install ffmpeg
    
    安装完成后重启终端,验证:
    ffmpeg -version
    
  • macOS(需先装 Homebrew):
    brew install ffmpeg
    
  • Linux (Debian/Ubuntu):
    sudo apt update && sudo apt install -y ffmpeg
    
  • 通用方式:也可访问 ffmpeg.org/download.html 下载,解压后把 bin 目录加入系统的 PATH 环境变量。

插件启动时自动完成:

  1. 探测 Python → 自动安装 flask / onnxruntime / librosa / soundfile / pyyaml 等依赖(首次较慢)
  2. 自动拉起下载网关(gateway.py :7102)
  3. 首次使用 → 自动下载模型(约 230MB)并启动转写服务(service.py :7101)

安装插件

dsh plugin --profile web add @opensquad/dsh-voice-input

重启 dsh 后,插件会在后台自动准备后端,输入框旁会出现麦克风按钮。

使用

  1. 重启 dsh 后稍等片刻(首次会自动装 Python 依赖并启动后端)。
  2. 点击麦克风 → 首次会确认下载模型 → 等待进度完成 → 自动启动服务。
  3. 再次点击麦克风开始录音,再点一次停止并转写,文字自动填入输入框。

模型已安装时,点旁边的 ⚙ 可卸载后重新下载。

兼容性

  • Node.js ≥ 22.19.0
  • Python 3.10+(且 python 在 PATH)
  • DeepSeek Harness(Web profile)
  • 浏览器需支持 MediaRecorder / getUserMedia

License

MIT

相关插件

继续浏览 vision-media 分类下经过校验的插件。

Tool Describe Image@linxin666/dsh-tool-describe-image面向模型的 describe_image 工具,用于 dsh Web GUI:通过在兼容 OpenAI 的端点调用视觉语言模型,为文本模型提供图像理解能力,以描述一张图像(本地路径、http(s) URL 或附件引用)。可热插拔 —Vision Routerdsh-vision-router为纯文本 DeepSeek Harness 代理提供视觉能力:内置免费视觉链(无需密钥)+ 像素级视觉工具(问答、定位、裁剪、像素差异、颜色、OCR、SVG 描摹、抠图、截图)。一条命令安装,无需 Python,图像回合的工作方式与普通工具相同Deepseek Ivideodeepseek-ivideoiPolloWork HyperFrames Video Studio,以及 27 个可编辑视频模板,以原生 DeepSeek Harness 对话视图呈现。Imagegen@dickpy/dsh-imagegendsh Web GUI 的 AI 图像生成插件:通过可配置的提供商渠道实现文生图和图生图(gpt-image-2 / grok-imagine-image / nanobanana series / seedream-5.0-pro / dall-e-3,支持原生 xAI Grok Imagine、Google Nano Banana a