DeepSeek Harness Plugin Hub

发布与管理完整 Harness Profiles,发现适合你的插件。

探索

插件目录环境预设文档中心动态

社区

发布插件联系我们报告问题

相关链接

Plugin Hub GitHubDeepSeek Harness 官方项目系统状态隐私说明
© 2026 DeepSeek Harness Plugin HubPowered byPaxTech

独立、非官方社区项目,与 DeepSeek 官方无隶属、授权或背书关系。

Auto Vision — DeepSeek Harness 插件(DSH Plugin)
DeepSeek Harness Plugin Hub
ProfilesPlugins分类动态文档登录管理 Profiles
ProfilesPlugins分类动态文档登录
← Plugins

dsh-auto-vision

Auto Vision

DeepSeek Harness 视觉桥:自动发现你已配置的多模态模型,给纯文本主模型装上 vision 工具,识别结果以纯文本返回。零配置,一条命令安装。

插件会安装到这里;不确定时保持 web。

npx -y @deepseek-ai/dsh plugin --profile web add github:NormanFxxkingRockwell/dsh-auto-vision#ae57b74c5d87df17d0b0f0601ebc25d00ba8cccb
README兼容性版本

兼容性与来源证明

Auto Vision 以 dsh-auto-vision 发布,当前版本为 0.4.1。Plugin Hub 会校验它的 manifest,并保存精确安装来源,便于复现安装结果。

DSH 兼容范围
*
运行环境
any
发布来源
github
Registry 更新时间
2026/9/20

版本

0.4.1stable
2026/9/15
0.4.0stable
2026/8/24
0.3.0stable
2026/8/24
查看其余 5 个版本收起版本
0.2.3stable
2026/8/19
0.2.2stable
2026/8/19
0.2.1stable
2026/8/18
0.2.0stable
2026/8/18
0.1.0stable
2026/8/17

相关插件

正在加载相关插件…

最新版
0.4.1
DSH
*
HMR
重启进程
Tree shaking
未声明可安全裁剪
解包体积
未提供
文件数
未提供
Surface
any
许可证
MIT
发布源
github
GitHub
★ 1
周下载
121
最近提交
2026/9/15
查看源码 ↗项目主页 ↗
README Badge

点击下方 Badge 复制 Markdown,粘贴到 README 即可。

这是你的 Plugin?认领权益 · 优先安全扫描

验证 package.json 声明的 GitHub 仓库,即可管理这个公开页面。认领后,Hub 会优先安排当前版本的安全扫描,并在通过后公开展示结果。

认领这个 Plugin →
报告问题

相关插件

继续浏览 vision-media 分类下经过校验的插件。

Tool Describe Image@linxin666/dsh-tool-describe-image面向模型的 describe_image 工具,用于 dsh Web GUI:通过在兼容 OpenAI 的端点调用视觉语言模型,为文本模型提供图像理解能力,以描述一张图像(本地路径、http(s) URL 或附件引用)。可热插拔 —Modlens@liustack/modlens面向仅支持文本的 LLM 的插件视觉能力,由免费的 Antigravity CLI 提供支持Deepseek Ivideodeepseek-ivideoiPolloWork HyperFrames Video Studio,以及 27 个可编辑视频模板,以原生 DeepSeek Harness 对话视图呈现。Codexdsh-codexChatGPT OAuth、Codex 模型、搜索、read_image URL 支持,以及适用于 DeepSeek Harness 的 gpt-image-2 生成

README

dsh-auto-vision

给 DeepSeek Harness 里的纯文本主模型装上眼睛:自动发现你已配置的多模态模型,一条命令装上 vision 工具,图片识别结果以纯文本返回。

快速开始

本插件已发布到 npm,两种安装方式任选:

方式一:npm 安装(推荐)

dsh plugin --profile <你的profile名> add dsh-auto-vision

方式二:GitHub 源码安装(纯 JS、零构建步骤,无需构建授权)

dsh plugin --profile <你的profile名> add github:NormanFxxkingRockwell/dsh-auto-vision

装好后,直接在主对话里说:

读这张图 C:\path\to\image.jpg 描述一下

主模型会自动调用 vision 工具,把识别结果以文本形式返回给你。

要求:你的 dsh 里已经配置了至少一个声明了图片输入的多模态模型(如何声明见下文「配置」)。没有的话,插件会在启动时报错并告诉你怎么办。

它解决什么问题

dsh 内置的 read_image 会把图片块直接塞进当前模型的上下文,所以只有当当前主模型本身支持图片时才能用。像 deepseek v4 flash 这样的纯文本模型,调用 read_image 会被直接拒绝。

本插件换了一条路:由插件内部转发给一个多模态模型,主模型全程只看到文本。它把两个"本来会卡住"的场景之一的文件路径读图变成了全自动:

  • 自动隐藏 read_image:纯文本主模型的会话里会藏掉必然失败的 read_image,让模型只能走 vision,不会先撞一次失败再换路;你给它一个图片文件路径(或让模型访问某个图片文件),它就会自动调 vision 读出来。

⚠️ 关于直接粘贴图片:dsh 官方当前在「消息准入层」硬编码拒绝了纯文本模型携带图片(报错 MODEL_DOES_NOT_SUPPORT_IMAGES,发生在任何插件钩子之前,且没有公开扩展点)。因此在聊天框直接粘贴图片,目前无法自动读——请把图片保存为文件,再把文件路径给模型(这段是全自动的)。插件内部已实现"粘贴图片自动转述",等官方开放准入扩展点后可立即生效(见下「实验性」)。

你(纯文本主模型)
   │  给一个图片文件路径
   ▼
vision 工具(本插件)
   │  把图片转给多模态模型(比如 qwen3.7-plus)
   ▼
识别结果 → 纯文本返回给你

工作原理

  • 自动发现模型:默认零配置。插件把已注册 provider 中所有声明 image 模态的模型列为候选项,按「显式 prefer → 你在 settings 配置的 provider → 其余已注册 provider」排序;调用失败会自动切换下一个候选(failover)——目录里声明了 image 但实际不可用(如未配 key 的官方占位模型)的不会被卡住。也可以手动指定(见下)。
  • 图片不进主会话:图片块只存在于插件内部的视觉请求中,你的主模型上下文里不会有任何图片,不会被污染、不会报错。
  • 走你自己的通道:识别请求走宿主自己的模型运行时(ctx.llm)——用你已配置的 key、重试策略,不需要任何额外的 API key 或服务。

配置

以下配置都是可选的,不配置也能用(自动发现)。

在 plugins 层配置(改 cordis.patch.yml 或 preset 行)

配置项说明
provider + model手动指定视觉模型(两个必须成对给出)。启动时会校验它确实支持图片,否则报错
prefer自动发现时优先尝试的 provider 顺序,例如 prefer: [bailian]
discovery: false关闭自动发现(此时必须手动指定 provider/model,否则插件报错)
autoHideReadImage: false关闭"自动隐藏 read_image"(默认开启:纯文本主模型会话藏 read_image,切多模态模型自动恢复)
transcribeImages: false关闭"粘贴图片自动转述"(实验性:受宿主准入限制,当前实际不生效,等官方开放后自动启用)

示例:

# 在你的 profile 的 cordis.patch.yml 里覆盖插件配置
- id: dsh-auto-vision
  config:
    provider: bailian
    model: qwen3.7-plus

给模型声明图片输入

自动发现靠的是「模型声明了 image 模态」。在 settings.yaml 里给支持图片的模型声明:

providers:
  bailian:
    models:
      - id: qwen3.7-plus
        name: Qwen3.7-Plus
        contextWindow: 100000
        input: [text, image]

功能与兼容性

  • 工具名 vision,参数:file_path(单图)或 file_paths(多图路径数组,一次请求最多 10 张,按编号逐张描述)、instruction(可选,识别要求)
  • 与 read_image 共用同一套附件管线和大小限制
  • 视觉模型 failover:候选模型按序尝试(失败:空内容 / 报错 / 中止),自动切换到下一个;记录上次成功项,下次优先
  • read_image 隐藏:自动跟随当前主模型——纯文本时藏掉 read_image 强制走 vision;切到多模态模型自动恢复原生 read_image,互不干扰
  • 粘贴图片转述(实验性):agent/pre-step 已实现把会话内消息的图片块自动转述为文字(【图片转述】开头,带缓存),但因宿主在消息准入层硬拒纯文本模型带图(无扩展点),该路径当前不可达;待官方放开后自动生效
  • 启动时会预检:手动指定的模型不支持图片、或自动发现落空,都会在启动时就报出可操作的错误,而不是等你调用时才崩
  • 零运行时依赖:不依赖任何 npm 包,只用宿主服务

更新日志

  • 0.4.0(2026-08-24):自动发现改为优先用户配置的 provider(不再乱选目录占位模型);新增视觉模型 failover——候选按序尝试,空内容/报错/中止自动切换下一个,并记忆上次成功项
  • 0.3.0(2026-08-24):多图批量——file_paths 一次最多 10 张图同请求识别,按编号逐张描述
  • 0.2.1(2026-08-18):README 与现状对齐:粘贴图片转述标记为「实验性」(受宿主准入限制,见正文说明)
  • 0.2.0(2026-08-18):read_image 动态隐藏(纯文本主模型自动藏、切多模态模型自动恢复);agent/pre-step 粘贴图片自动转述(实验性)
  • 0.1.0(2026-08-17):首个版本——vision 工具 + 自动发现多模态模型 + 纯文本返回;已收录 awesome-dsh-plugin

License

MIT