CATEGORY
该分类下经过 manifest 校验、精确版本的插件。
dsh-dictate
适用于 DeepSeek Harness 的上下文感知语音输入,支持 Web Speech、本地 SenseVoice 转录、模型润色、可编辑的 Composer 草稿以及由用户控制发送
dsh-sound-lab
DSH 声音工坊(Sound Lab):对话事件音效、AI 角色语音生成、音效库上传管理,全程可视化点选;内置明日方舟安洁莉娜角色桌宠(60fps 精灵图动画、边缘停靠、悬浮窗配置)。Hot-pluggable dsh plugin.
dsh-sight
为纯文本 DeepSeek Harness (dsh) 模型提供插件视觉能力:包含内置的低成本/免费 VLM 预设、批量分析多张图像、粘贴至提示词的图像接入功能,以及支持热重载的网页设置页面。
dsh-screenshot-feedback-hook-mcp
DeepSeek Harness 的截图反馈——让你的编码代理能够看到它构建的内容
dsh-auto-vision
DeepSeek Harness 视觉桥:自动发现你已配置的多模态模型,给纯文本主模型装上 vision 工具,识别结果以纯文本返回。零配置,一条命令安装。
dsh-multimodal-bridge
DeepSeek Harness 插件包:为仅支持文本的模型提供 qwen_vision(Qwen-VL 图像理解)和 qwen_generate(Qwen-Image 文生图与图像编辑)工具
dsh-tool-vision
DeepSeek Harness 外置视觉模型插件:inspect_image 把本地图片或 http(s) 图片 URL 发给任意 OpenAI 兼容端点,视觉模型看图的文字回答直接带回对话;附 Web UI 设置栏。
dsh-vision-recognizer
DeepSeek Harness 的自适应图像路由:将图像直接传递给原生多模态模型,仅对纯文本模型进行转录。
dsh-tool-generate-image
面向模型的 DeepSeek Harness(dsh)generate_image 工具:通过 Antigravity CLI 使用 Google Gemini 图像生成服务生成全新图像,保存图像并返回路径。支持热插拔——使用 `dsh plugin --profile web add
dsh-mac-vision
适用于 DeepSeek Harness 的原生 macOS OCR 和视觉工具
dsh-windows-ocr
dsh 插件:使用内置的 Windows OCR 引擎(Windows.Media.Ocr)识别附件中的图像,并仅将识别出的文本发送给模型。文本模型永远不会接收图像字节;视觉透传需选择启用。
@eric.wen/dsh-sight
DeepSeek Harness 插件:直接的多模态图像传输声明 + 每个会话的图像清除、推理强度自动填充,以及渐进式 Figma MCP 桥接(设计转代码 + AI 驱动的设计)。
@omdp/dsh-vision-bridge
DSH 视觉桥插件:自动区分多模态/文本模型。多模态模型直接看图;文本模型通过可配置的多模态端点(baseUrl + apiKey + model)代看,支持粘贴图片、read_image 工具、请求时图片转证据。
dsh-ui-spec
将 UI 截图转换为可用于实现的网页规范的 DeepSeek Harness 插件,使用 OCR、确定性几何、场景图、资源和渲染对比。
dsh-plugin-qwen-image
DeepSeek Harness 外部插件:通过 ctx.llm 将图像路由到 Qwen-VL (DashScope) 路由,并返回文本,让纯文本编码模型能够理解图像。
@chang416/deepsee
DeepSee:DeepSeek Harness 视觉能力、多模型路由,以及交付前的 Gemini 视觉自检
dsh-seedance2
通过 Seedance 2 AI API 在 DeepSeek Harness 中生成图像和 Seedance 视频
dsh-vision-plugin
dsh-vision-plugin:让 DeepSeek Harness 的纯文本模型拥有一双眼睛——粘贴的图像会先由视觉模型转录,再传递给纯文本主模型;此外还提供 vision_analyze 工具和双语设置页面。
dsh-vision-subagent
为 DeepSeek Harness 提供基于能力的视觉支持:多模态模型原生支持图像输入,纯文本模型则使用隔离的一次性视觉路由回退方案。
@woyeshishen/dsh-vision-plugin
为 DeepSeek Harness 提供外部视觉模型能力:纯文本主模型通过 describe_image 工具调用外部视觉模型看图,拿到纯文字描述(多模态补全)。静态 Cordis 插件,随 DSH 启动自动加载。
dsh-quicksight
为 DeepSeek Harness 中的纯文本模型提供两级图像读取:首先使用快速本地 OCR(RapidOCR,离线),失败时再通过 modlens 使用视觉模型。
dsh-gemini-multimodal
DeepSeek Harness 插件:通过 Gemini API 或本地 Antigravity CLI 提供多模态工具(图像/音频/视频/文档理解、转录、图像生成)。
dsh-web-voice-input
DeepSeek Harness (DSH) Web GUI 的语音输入:聊天编辑器中的麦克风按钮可录制音频,并通过兼容 OpenAI 的 Whisper API(Groq / OpenAI / SiliconFlow)进行转录,然后将识别出的文本插入输入框。
mimo-vision
DeepSeek Harness (DSH) 原生插件:describe_image 工具,通过 ctx.fs / ctx.credentials 接口提供视觉桥接(图像 -> mimo-v2.5 -> 文本描述)
dsh-speech-plugin
DeepSeek Harness 的语音插件:提供逐消息朗读按钮、编辑器语音输入和自动播报开关,使用云端 TTS/ASR,并以 Web Speech API 作为后备方案
dsh-glm-vision
GLM 视觉模型插件:注册 glm-vision 供应商路由(glm-4.6v 系列,image+text 输入声明)并提供 glm_vision 工具,让 DeepSeek 等文本主模型直接调用智谱视觉模型看图。
@muxiva/dsh-voice
本地优先的全双工语音,面向 DeepSeek Harness,由 Muxiva 编排
@alain-prot0s5/dsh-screenshot
DeepSeek Harness 的截图输入功能:编辑器相机按钮 + 全局快捷键(Alt+A)+ 绑定到应用生命周期的监听器,可在设置中配置。截图自动粘贴到 DSH 输入框:相机按钮 + 全局快捷键 + 生命周期绑定 + 设置页配置。
dsh-niulai-sound
牛来确认音 — 电影《牛来》中的 DSH 审批音效:请求用户确认时播放「妈妈」,用户批准时立即中断并播放「牛来!」。
@launchmaniac/dsh-media-tools
作为 dsh 工具提供 OpenRouter 图像、视频和语音生成,随树外配置文件包一同提供