CATEGORY
该分类下经过 manifest 校验、精确版本的插件。
dsh-periscope
DSH Desktop 插件:将纯文本模型(deepseek-v4-flash / deepseek-v4-pro)保留为会话默认模型,并自动将包含图像的请求路由到配置的视觉模型;同时提供通用文件附件功能(拖放/粘贴任意文件作为持久附件,代理通过路径读取),作为
dsh-handwritten-ocr
适用于 DSH 的本地 OCR:将手写中文和数学公式转换为带 LaTeX 的 Markdown。支持 GPU(DirectML)/ CPU / NPU 后端,由设置驱动,一键安装。
dsh-read-image-jpeg-fallback
DSH 配置插件:将 read_image 的 PNG/WebP 附件转换为不透明的 sRGB JPEG,以便 LM Studio 的 openai-completions 端点接受它们
dsh-ocr-plugin
DeepSeek Harness OCR 插件 — 基于小笨羊 OCR 能力,为纯文本模型提供图片文字识别功能
dsh-native-image-viewer
适用于 DeepSeek Harness 的原生缩放、平移、下载、图库和区域注释图像查看器
dsh-conversation-share
选择 DeepSeek Harness 对话中的一段内容,并将其分享为带品牌标识的 PNG 长图,支持拖动并磁性吸附的范围标记。
dsh-antv-ava
适用于 DeepSeek Harness 的 AntV AVA 和 GPT-Vis 插件:将数据密集型回答以叙述性文本、图表或两者结合的形式流式输出。
dsh-baidu-ocr
适用于 DeepSeek Harness Web 的 Baidu cloud OCR(PaddleOCR-VL + Unlimited-OCR):拖入图片/PDF,进行 OCR 并转换为 Markdown,将结果写入本地文件。
@blue/dsh-image-model-router
DeepSeek Harness 插件:当用户消息包含图像时,将智能体请求路由到视觉模型(deepseek-v4-flash-vision-exp),否则保留原始模型。
dsh-agnes
Agnes AI 图像和视频生成工具,用于 DSH(agnes_image_generate / agnes_video_generate)
dsh-image-conatiner
适用于 DeepSeek Harness 的 Codex 风格生成图像画廊和灯箱
dsh-image-resizer
在原生附件接纳前调整超大的 DSH Web 对话图片大小
vision-exp-tile
为 deepseek-v4-flash-vision-exp 量身定制的大图智能识图插件:整图预检 → 本地 OCR+像素网格(文字)+ 兴趣点按比例切块(最长边 800)→ 汇总;保留全图 800x800 网格切块模式。不统计 token、不计算费用。v0.4.2:picturereader 适应性优化(共存分工引导/视觉端点复用/OCR venv 共享)。
dsh-screenshot-capture
DeepSeek Harness 的指哪拍哪截图捕获:剪贴板监听 + 系统级悬浮窗(注释与要点、复制/保存文档/保存图片)+ 即时 OCR + Obsidian 按天合并 + 晚间 AI 整理并添加双链
dsh-image-read
DeepSeek Harness 插件:通过视觉 API 进行结构化图像分析(read_image_mimo 工具),并提供 Web UI 配置卡片。支持跨平台缩小图像和格式转换(可选 sharp,回退使用 sips)、累计负载预算和结果缓存。附件输入已移至 dsh-input-enhancement。
dsh-opencode-go-models
用于同步 opencode-go 模型目录并提供精准多模态支持的 DSH 插件
dsh-pdf-reader
DeepSeek Harness 的 AI 驱动 PDF 阅读器,支持批注、多 PDF 工作流、图像与文本混合证据,以及按需 OCR。
dsh-shots
DeepSeek Harness 的 Shots 标签页:在 workspace/shots/ 中,通过视频播放器视图(实时播放 + YouTube 风格的拖动条)查看浏览器守护进程的截图流
dsh-ds-vision-auto-route
将包含图像的回合路由到可配置的支持图像的模型,供 DeepSeek Harness 使用
duhai-vision
以 PaddleOCR-VL 为优先的 Codex 和 DeepSeek Harness 视觉模型适配器
jolly-dsh-vision
面向 DeepSeek Harness 的 ModLens 风格视觉桥接:以 deepseek-v4-pro 作为大脑,以 deepseek-v4-flash-vision-exp 作为眼睛。
dsh-vision-any
DeepSeek Harness 视觉插件:将图像粘贴到仅支持文本的模型中,并使用任何兼容 OpenAI、Anthropic 或 Gemini 的视觉 API 进行分析。
@dsh-external/dsh-vision
DSH 视觉子代理插件:将图像识别委托给 DeepSeek 视觉模型
@harness-flow/dsh-voice
dsh-voice — 面向 DeepSeek Harness 的轮流语音循环:支持可插拔的 Qwen / MiMo / 本地 ASR+TTS 引擎、由代理驱动的说话/聆听工具和浏览器 PTT 界面,针对采访者预设构建
dsh-voice-input-space
DeepSeek Harness 的语音输入:在任意可编辑字段中按住空格键说话,松开后将转录文本插入光标位置。零依赖,使用浏览器 Web Speech API。
dsh-imagegen
适用于 DeepSeek Harness 的提供商中立图像生成工具
@local/dsh-music-player-tui
DSH TUI 本地音乐播放器:/music 打开全屏场景,选择本地目录、扫描常见音频格式(mp3/flac/m4a/ogg/wav...),mpv/ffplay/afplay 后端出声,单曲/列表循环,可删除曲目,退出场景音乐不中断。
@bill9109/dsh-conversation-share
选择 DeepSeek Harness 对话中的一段内容,并将其分享为带品牌标识的 PNG 长图,支持拖动和磁吸对齐的范围标记。
dsh-vidgen-plugin
适用于 DeepSeek Harness (DSH) 的多提供商 AI 视频/图片生成插件。提供 ComfyUI 风格的节点画布工作室和多提供商设置,并包含 Agent 工具 list_video_models / generate_video / poll_video_task。
dsh-plugin-glm-vision
通过 GLM-4V-Flash 为非多模态模型进行图像翻译:拦截图像、生成描述并注入文本。