DeepSeek Harness Plugin Hub

发布与管理完整 Harness Profiles,发现适合你的插件。

探索

插件目录环境预设文档中心动态

社区

发布插件联系我们报告问题

相关链接

Plugin Hub GitHubDeepSeek Harness 官方项目系统状态隐私说明
© 2026 DeepSeek Harness Plugin HubPowered byPaxTech

独立、非官方社区项目,与 DeepSeek 官方无隶属、授权或背书关系。

Tts Flash — DeepSeek Harness 插件(DSH Plugin)
DeepSeek Harness Plugin Hub
ProfilesPlugins分类动态文档登录管理 Profiles
ProfilesPlugins分类动态文档登录
← Plugins
T

dsh-tts-flash

Tts Flash

DSH 语音阅读器:在 LLM 回复流式输出时朗读内容。内置 Edge-tts,可通过设置面板接入任何兼容 OpenAI 的云端 TTS,并在模型思考时播放带语音的等待短语滚动提示。

插件会安装到这里;不确定时保持 web。

npx -y @deepseek-ai/dsh plugin --profile web add github:2021Heei/dsh-tts-flash#a96a38cd90207900cd6cd59a559a0a1353da8414
README兼容性版本

兼容性与来源证明

Tts Flash 以 dsh-tts-flash 发布,当前版本为 0.1.0。Plugin Hub 会校验它的 manifest,并保存精确安装来源,便于复现安装结果。

DSH 兼容范围
*
运行环境
web
发布来源
github
Registry 更新时间
2026/9/9

版本

0.1.0stable
2026/9/9

相关插件

正在加载相关插件…

最新版
0.1.0
DSH
*
HMR
重启进程
Tree shaking
未声明可安全裁剪
解包体积
未提供
文件数
未提供
Surface
web
许可证
MIT
发布源
github
GitHub
★ 0
周下载
0
最近提交
2026/9/10
查看源码 ↗
README Badge

点击下方 Badge 复制 Markdown,粘贴到 README 即可。

这是你的 Plugin?认领权益 · 优先安全扫描

验证 package.json 声明的 GitHub 仓库,即可管理这个公开页面。认领后,Hub 会优先安排当前版本的安全扫描,并在通过后公开展示结果。

认领这个 Plugin →
报告问题

相关插件

继续浏览 vision-media 分类下经过校验的插件。

Tool Describe Image@linxin666/dsh-tool-describe-image面向模型的 describe_image 工具,用于 dsh Web GUI:通过在兼容 OpenAI 的端点调用视觉语言模型,为文本模型提供图像理解能力,以描述一张图像(本地路径、http(s) URL 或附件引用)。可热插拔 —Modlens@liustack/modlens面向仅支持文本的 LLM 的插件视觉能力,由免费的 Antigravity CLI 提供支持Deepseek Ivideodeepseek-ivideoiPolloWork HyperFrames Video Studio,以及 27 个可编辑视频模板,以原生 DeepSeek Harness 对话视图呈现。Imagegen@dickpy/dsh-imagegendsh Web GUI 的 AI 图像生成插件:通过可配置的提供商渠道实现文生图和图生图(gpt-image-2 / grok-imagine-image / nanobanana series / seedream-5.0-pro / dall-e-3,支持原生 xAI Grok Imagine、Google Nano Banana a

README

dsh-tts-flash

给 DeepSeek Harness(DSH)桌面端做的 LLM 回复语音朗读插件:AI 边流式输出,本地边把句子合成语音播放,随读随停;AI 思考等待期间还有"文字+语音"双通道的趣味短语反馈。

  • 零配置可用:内置微软 edge-tts,能联网就能用(几十种音色)
  • 云端引擎即插即用:任何 OpenAI 兼容 TTS 服务(OpenAI / 小米 MiMo / 硅基流动…)在设置面板里填 baseURL + API Key + 模型 id 即可添加,双协议自适应
  • 等待期语音:模型思考时浮条轮换趣味短语并同步朗读("让子弹飞一会…"),等待不再干瞪眼

功能总览

模块说明
无损流式朗读llm/stream 旁路 tap → 中英日分句 → 短句合并 → 串行合成 → SSE 推送;队列带背压上限,长回复自动追赶
多引擎edge-tts(内置)+ OpenAI 兼容云端 TTS(双协议自适应:/audio/speech → chat/completions)
引擎即插即用设置面板二级弹窗添加,或往 ~/.dsh/tts-flash/engines/ 放一个 JSON 声明自动出现
等待期语音体系AI 思考时轮换 5 条内置趣味短语(文字+语音同步,host 统一驱动);语音按「模型-音色」前缀缓存只生成一次;等待语音模型可独立选择(默认 Edge 小艺)
语音设置面板朗读开关 / 语音模型 / 音量 / 语速 / 字幕流光与字号 / 云端引擎管理(二级弹窗)/ 试听区,全部实时生效
朗读悬浮条纯文字胶囊,可拖动、位置记忆(相对聊天输入框锚点,窗口缩放自动适应)、长句单程滚动字幕(滚动时长 = 真实音频时长)
持久化运行时设置独立 JSON 文件,重启、重装插件均不丢失

安装

npm install && node build.mjs && npm test   # 构建 + 单测
npm pack                                    # → dsh-tts-flash-0.1.0.tgz
# 用 DSH 的插件安装流程注册该 tgz(cordis.patch.yml 会把 host 引擎 + 客户端浮条注入 profile)

日常迭代最快路径:把 lib/*.js 覆盖复制到 ~/.dsh/profiles/desktop/node_modules/dsh-tts-flash/lib/ 再重启应用。

使用

引擎

  • Edge TTS(默认):零配置,音色几十种(晓晓/云希/小艺…),「语音模型」下拉选择即可
  • 添加云端引擎:设置面板「云端引擎」按钮 → 弹窗填 baseURL、API Key、模型 id(别名可选,默认与模型 id 一致)→ 点「添加」。模型 id 必须与厂商文档完全一致(如 MiMo 全小写)
  • 也可以不经过面板:往 ~/.dsh/tts-flash/engines/ 放一个 JSON 声明:
{
  "id": "my-engine",
  "label": "我的引擎",
  "kind": "openai",
  "url": "https://api.example.com/v1",
  "apiKey": "sk-...",
  "model": "tts-model-id",
  "stylePrompt": "可选:音色描述/风格指令(voicedesign 类模型需要)"
}
  • API Key 保存在本机 ~/.dsh/tts-flash/engines/(单用户本机场景);请勿把该目录内容分享给他人

等待期语音

AI 思考(已开始生成但还没有音频)时,浮条每 2.6~3.5 秒轮换一条短语并同步朗读(文字与语音由 host 统一驱动,显示什么就说什么):

  • 语音文件缓存在 ~/.dsh/tts-flash/cache/thinking/<引擎id>-<音色>.p<序号>.mp3,首次用到自动补齐整池,之后直接回放
  • 「等待期语音模型」可独立选择发声引擎(默认 Edge 小艺 zh-CN-XiaoyiNeural);「批量生成语音」可预生成;「清理语音文件」删除全部
  • 短语池在 src/thinking-phrases.ts(5 条),host/client 共享,改完短语后请重新生成音频文件
  • 第一句正文出现时短语循环立即停止,无缝切换为正文朗读

语音设置面板

控件行为
朗读开关与朗读管线实时同步(SSE 广播)
语音模型自动检测(Edge)+ 各引擎,实时探测可用性
人声跟随模型刷新(edge 拉微软实时列表)
语速-75% ~ +200%;edge 服务端封顶 +100%,MiMo 式引擎翻译为自然语言控速指令
音量0% ~ 200%,≤100% 播放端衰减,>100% edge 走 SSML 增益
字幕流光/字号两个渐变色 + 流光速度 + 字号(10~30px),即时同步
云端引擎二级弹窗添加/说明;选中引擎后可编辑音色描述、删除引擎
等待期语音独立发声引擎选择 + 批量生成/清理
悬浮条位置可拖动 + 「设为默认」/「重置」
试听区预设文案 + 自由输入 + 测试朗读

架构

src/
  index.ts                # host 入口:HTTP 路由 + llm/stream tap + 等待短语循环
  provider.ts             # TtsProvider 接口
  speak-queue.ts          # 串行合成队列:epoch 取消 + 预合成音频直通 + onTextEnqueue 钩子
  segmenter.ts            # 中英日分句 + markdown/emoji 清洗(复用 dsh-voice,MIT)
  thinking-phrases.ts     # 等待短语池(host/client 共享,文本↔音频 1:1)
  settings-store.ts       # 设置持久化 + 引擎声明发现
  providers/
    edge-tts.provider.ts  # 微软 Edge 云端语音
    openai-tts.provider.ts# OpenAI 兼容云端 TTS(双协议自适应)
  client.tsx              # shell.overlay 朗读浮条
  settings-section.tsx    # settings.section 语音设置面板(含添加引擎二级弹窗)
  client-api.ts           # 面板 ↔ host fetch 封装
build.mjs                 # esbuild:lib/index.js(host)+ lib/client.js(浏览器)

引擎接口(换/加引擎 = 新增一个 provider 文件,核心零改动):

interface TtsProvider {
  id: string; label: string; streaming: boolean
  synthesize(text, opts?): Promise<Buffer>   // 一句 → 音频字节
  listVoices(): Promise<VoiceInfo[]>
  isAvailable(): Promise<boolean>
  dispose(): Promise<void>
}

HTTP API(均在 /dsh-tts-flash 下)

GET  /config            → 设置快照 + engines[] + voices[]
POST /config            → 设置补丁(enabled/engine/voice/rate/thinkingEngine/…/resetPos)
POST /preview           → { text, engine?, voice?, rate? } → { audio: base64, mime, … }
POST /engines           → 添加云端引擎 { baseUrl, apiKey, model, alias?, stylePrompt? }
POST /engines/style     → 编辑音色描述/风格指令
POST /engines/delete    → 删除引擎
POST /thinking/generate → 批量生成等待语音文件
POST /thinking/clear    → 清理等待语音文件
POST /cancel            → { sessionId } 停止该会话朗读
GET  /stream            → SSE:audio 帧 + config/status 广播

已知限制

  • 未点开过页面前浏览器可能拦截有声自动播放(DSH 内发过一条消息后即解除)。
  • edge-tts 是微软未公开接口:无 SLA,断网即不可用;语速服务端封顶 +100%。
  • client 的 BASE 与 host basePath 默认值绑定(/dsh-tts-flash),改 host 配置需同步 client。
  • 桌面端 web server 只放行 DSH 渲染进程的请求(外部 curl 一律 forbidden,属正常)。

License

MIT