CATEGORY
该分类下经过 manifest 校验、精确版本的插件。
@toddzheng024/vapor-review-gemini
Vapor review gemini 工具操作
dsh-qr-toolkit
DeepSeek Harness 的二维码和条码工具箱:解码图像(PNG/JPEG、本地文件或 URL),并将二维码生成为 PNG。二维码/条码工具箱:解码与生成。
@gelomen/glm-vision-plugin
DSH Web 插件:调用智谱 GLM 视觉模型分析图片(analyze_image 工具 + 插件设置卡片)。
dsh-ros2
面向 DeepSeek Harness (DSH) 的 ROS2 调试工具和诊断技能:软件包/工作区/依赖项检查,节点/主题/服务/动作/参数/接口枚举,主题采样,TF 树,图拓扑 JSON,需经批准的构建和消息脚手架,GUI 截图和多模态视觉观察
dsh-media-skills
适用于 DeepSeek Harness v0.1.6 的免费图像读取和生成技能:视觉问答、插图生成、提供商回退,且不附带密钥。
dsh-visual-plugin
DeepSeek Harness 的视觉媒体插件:复制原生图像描述,并安全地规范化、检查和播放具备场景感知能力的视频。
dsh-vision-opencode
DeepSeek Harness 插件:可配置的视觉模型,提供 vision_read_image 工具、编辑器栏视觉模型选择器,并为仅支持文本的主模型自动将图像转换为文本。
dsh-chat-imagine
通过 API 通道或本地 CLI(mmx / codex / agy)在 DSH 聊天中内联生成和显示图像,并在任意模型上将图像读取为结构化 JSON 证据(OCR / 布局 / 语义),支持后端探测和内置恢复技能。
dsh-read-image-view
在 DeepSeek Harness Web GUI 中展示 read_image 工具读取的图片:专用的“读取图片”行,默认展开的消息样式图片卡片(PS 风格透明棋盘格),针对多图片请求合并显示“读取 N 张图片”行并以并排画框呈现,以及页内全分辨率灯箱(缩放按钮、鼠标滚轮、1:1 原始尺寸)。
dsh-highres-vision
DeepSeek Harness 视觉增强器:将图像限制提升至 DeepSeek 官方值,提高 DeepSeek-V4.1-Flash 的单模型请求图像预算,并通过专用工具提供高分辨率分块图像读取功能。
@nn12138/dsh-voice
DeepSeek Harness 的语音输入插件:麦克风 → 本地/浏览器语音识别 → 作为普通聊天消息提交文本(仅输入,不依赖预设)
@crosery/dsh-viewer
通过 display_file 工具在 dsh Web 界面中内嵌渲染图像、视频、音频、PDF 和 Office 文档,并通过支持范围请求的签名 HTTP 路由流式传输字节。
@paicat1/dsh-screenshot
DeepSeek Harness (dsh) 的独立屏幕捕获工具:提供浏览器快捷键以及面向代理的捕获并读取工具。源自 @liustack/modlens#48(上游拒绝了该功能)。
dsh-tool-see-image
DSH 的 see_image 工具:将图像文件发送到可配置的视觉模型(兼容 OpenAI API),并将其描述传回仅支持文本的模型
@haoku123/dsh-voice
DeepSeek Harness 的全双工语音模式:流式 ASR -> LLM -> TTS,支持抢话
@alger-ai/dsh-image-preview
dsh 会话中的图像预览:read_image 结果以缩略图呈现,并可打开支持缩放、旋转、平移、下载和跨行导航的全尺寸灯箱
dsh-wx-skin
DSH Web GUI 皮肤插件:侧栏「皮肤」面板,支持自选本地图片 / URL / 本地文件夹轮播(顺序或随机、一轮内不重复)作为全屏背景,含预设、暗化、模糊、关闭皮肤,跨刷新持久化(外部 client 插件,dsh-web-ui 风格)。
dsh-approval-voice
DSH Web GUI 审批语音提示:需要审批/回答的弹窗出现时,播放提示音并用语音播报,避免漏看
@f1star/dsh-research
一个用于 DeepSeek Harness 的研究工作区,支持归档 PDF 阅读、可选 OCR、人工审核、带引文的报告以及可恢复的研究任务。
dsh-paddleocr-skills
PaddleOCR 文本识别和文档解析技能,支持原生 DeepSeek Harness 工具和 GUI 配置。
@limccn/deepseek-vl-support
在 Claude Code、Codex 和 Agent Plugins 客户端中为 DeepSeek(仅文本)模型提供视觉能力:通过任何兼容 OpenAI 的视觉端点描述图像。
teach-math-with-manim
图书《Manim,让数学看得见》配套开源仓库:60+ 教学动画案例源码 + manim-teaching AI Skill(含 DeepSeek Harness 插件)
dsh-tool-describe-image
DSH 插件:通过任何兼容 OpenAI 的视觉 API 进行图像理解,粘贴图像即可描述,并提供带有状态气泡和浮动设置面板的动画鲸鱼桌面宠物
dsh-vision-tiler
面向 DeepSeek Harness 视觉模型的损失感知、全覆盖图像平铺
dsh-medomni
deepseek-harness 的医学影像专业工具:用于胸部 X 光/CT/MRI/视网膜(眼底)图像报告生成的 MAIRA-2 和 MedGemma、器官分割的 TotalSegmentator、超声零样本分类的 BiomedCLIP,以及针对 X 光、CT、MRI、超声和视网膜(眼底)图像进行文本提示分割的 BiomedParse
dsh-image-subagent
让纯文本主模型(DeepSeek V4 等)也能接收图片附件:抹除纯文本路由的模态声明放行 0.1.1 准入门禁,图片投影为携带完整 attachmentId 的占位文本,由主模型委托视觉子代理经 read_image 读取。
deepseek-vl-support
dsh-stt-input
DeepSeek Harness (DSH) 网页 GUI 的语音转文字输入:点击输入框中的麦克风按钮,将语音转换为文字。支持浏览器内置的 Web Speech API(无需配置,适用于 Chrome/Edge)以及兼容 OpenAI 的 Whisper 端点(OpenAI / Groq),可在设置 → 语音输入中选择 STT 模型。
dsh-file-convert
DeepSeek Harness 的本地优先文件转换——支持图像、PDF、数据、音频/视频和办公文档。无需 API 密钥、无需上传、无需令牌成本。
voco-input-sh
VocoType 用于 DSH Web 的语音输入桥接:编辑器中的麦克风按钮和录音面板,自动插入识别文本(去重、自动启动/部署、基于 mtime 优化的轮询)