CATEGORY
该分类下经过 manifest 校验、精确版本的插件。
@acc1143/dsh-vision-bridge
DSH 双模型路由插件:主对话留在 DeepSeek,图片任务自动分发到显式配置的视觉模型,再把分析结果交回 DeepSeek 继续。
dsh-tool-image-gen
DSH 工具插件:通过 ToAPIs 异步 GPT-Image-2 API 生成图像(提交任务、轮询、下载)。
@zzdream67/dsh-vision-bridge
让仅支持文本的模型在 DeepSeek Harness 中查看图像:拦截 llm/stream 数据流,并透明地将每张图像替换为视觉模型的描述。
dsh-vision-autoswitch
DeepSeek Harness 插件:自动将包含图像的请求路由至 deepseek-v4-flash-vision-exp,然后回退到原始模型。
dsh-tool-draw
一个使用 Volcengine ARK(Doubao Seedream)或 xAI Grok Imagine 添加 draw_picture 工具的 DeepSeek Harness 插件
@toddzheng024/vapor
Vapor 媒体框架:不可变制品、反馈、本地作业和可选的审阅服务
@svenyu/dsvu
dsvu(DeepSeek-Powered Video Understanding)低成本视频理解工具:B站链接/BV/本地视频 → 信息层(ASR+场景+对象轨迹+YOLO)→ 摘要+问答。基于 deepseek-v4-flash-vision-exp 同源即看即答 + grid 密集抽帧。问题驱动动态路由分层(L0/L1/L2)、语义层复用、预算上限。引擎自包含,无需外部依赖。
@zoytown/dsh-avatar
用于壁纸主题设置的 DeepSeek Harness (dsh) 插件——从设置页面上传图片,选择一张后,整个 dsh Web UI 将显示在其上方,并支持调整可读性遮罩和模糊效果。
dsh-bundle-vision
DeepSeek Harness 的视觉套件 + 插件:describe_image 工具读取本地图片,并请求任意已配置的多模态路由,无需修改核心
dsh-agent-voice
DeepSeek Harness 插件:为代理提供语音功能——通过本地 Piper / XTTS v2 朗读已完成的任务和需要关注的请求(不会朗读推理过程或中间报告),并提供设置面板和精选语音集。
@maxwell-feng/dsh-windows-ocr
dsh plugin:使用内置的 Windows OCR 引擎(Windows.Media.Ocr)识别附加图像,并仅将识别出的文本发送给模型。文本模型永远不会接收图像字节;视觉直通功能需选择启用。
@toddzheng024/vapor-images
Vapor 图像工具操作
@aetheri-ai/dsh-show-image
DeepSeek Harness 插件:一个面向模型的 show_image 工具,可在对话中向人类查看者展示本地图像。
@pzqian123/dsh-tool-vision
DSH 插件:当主模型路由无法接受图像输入时,通过用户配置的具备视觉能力的模型读取图像
dsh-eyes
DeepSeek Harness (dsh) 的视觉桥接配置包:通过将转录任务委托给具备视觉能力的模型,为非视觉模型提供图像读取能力,并支持 GUI 粘贴输入和用于选择视觉模型的网页设置页面。
@toddzheng024/vapor-editing
Vapor 编辑工具操作
@toddzheng024/vapor-vlm-modal
通过源版本、明确覆盖范围和可恢复的云端任务进行批量视觉检查
@toddzheng024/vapor-captions
Vapor 字幕工具操作
@toddzheng024/vapor-remotion
Vapor Remotion 渲染、静帧、完整音乐视频和动态分镜
@toddzheng024/vapor-motion-viggle
Vapor motion viggle 工具操作
@toddzheng024/vapor-generation-fal
Vapor 生成 fal 工具操作
@fzhiyu/dsh-image-view
在所属的工具行内联显示 read_image 调用返回的图像
@toddzheng024/vapor-review
Vapor 审查工具操作
@toddzheng024/vapor-audio
Vapor 音频工具操作
@try-works/dsh-vision-worker
DeepSeek Harness 插件:基于 Cloudflare Workers AI(@cf/moonshotai/kimi-k2.6)的视觉 worker,为仅支持文本的调用方路由图像请求,返回版本化的 righthand.vision.v1 信封,并支持后续问题。
@evan-williams/vision-tool
适用于 DeepSeek Harness 的对话式 UI/UX 视觉审查插件:由任何兼容 OpenAI 的多模态端点(例如 agnes-2.5-flash)支持 vision_review / vision_ask 工具
@toddzheng024/vapor-voice-local
Vapor 的可选 macOS 本地参考音色准备
@toddzheng024/vapor-music
Vapor 音乐工具操作
@aalongaa/dsh-tool-vision
面向模型的 DeepSeek Harness 视觉工具:通过任何兼容 OpenAI 的视觉 API 分析图像。
dsh-computer-use
Computer Use 插件:虚拟鼠标真人操作 + 原生视觉模型接入(deepseek-v4-flash-vision-exp 直读截图),screen_observe 等 12 个模型友好工具