DeepSeek Harness Plugin Hub

发布与管理完整 Harness Profiles,发现适合你的插件。

探索

插件目录环境预设文档中心动态

社区

发布插件联系我们报告问题

相关链接

Plugin Hub GitHubDeepSeek Harness 官方项目系统状态隐私说明
© 2026 DeepSeek Harness Plugin HubPowered byPaxTech

独立、非官方社区项目,与 DeepSeek 官方无隶属、授权或背书关系。

Plugin Glm Vision — DeepSeek Harness 插件(DSH Plugin)
DeepSeek Harness Plugin Hub
ProfilesPlugins分类动态文档登录管理 Profiles
ProfilesPlugins分类动态文档登录
← Plugins
P

dsh-plugin-glm-vision

Plugin Glm Vision

通过 GLM-4V-Flash 为非多模态模型进行图像翻译:拦截图像、生成描述并注入文本。

插件会安装到这里;不确定时保持 web。

npx -y @deepseek-ai/dsh plugin --profile web add github:baldovinmarques391-design/dsh-plugin-glm-vision#bfa2f967cd40c51122ca01c1e6b7f7045d80cd76
README兼容性版本

兼容性与来源证明

Plugin Glm Vision 以 dsh-plugin-glm-vision 发布,当前版本为 2.1.0。Plugin Hub 会校验它的 manifest,并保存精确安装来源,便于复现安装结果。

DSH 兼容范围
*
运行环境
any
发布来源
github
Registry 更新时间
2026/8/21

版本

2.1.0stable
2026/8/21

相关插件

正在加载相关插件…

最新版
2.1.0
DSH
*
HMR
重启进程
Tree shaking
未声明可安全裁剪
解包体积
未提供
文件数
未提供
Surface
any
许可证
MIT
发布源
github
GitHub
★ 0
周下载
0
最近提交
2026/8/21
查看源码 ↗
README Badge

点击下方 Badge 复制 Markdown,粘贴到 README 即可。

这是你的 Plugin?认领权益 · 优先安全扫描

验证 package.json 声明的 GitHub 仓库,即可管理这个公开页面。认领后,Hub 会优先安排当前版本的安全扫描,并在通过后公开展示结果。

认领这个 Plugin →
报告问题

相关插件

继续浏览 vision-media 分类下经过校验的插件。

Tool Describe Image@linxin666/dsh-tool-describe-image面向模型的 describe_image 工具,用于 dsh Web GUI:通过在兼容 OpenAI 的端点调用视觉语言模型,为文本模型提供图像理解能力,以描述一张图像(本地路径、http(s) URL 或附件引用)。可热插拔 —Modlens@liustack/modlens面向仅支持文本的 LLM 的插件视觉能力,由免费的 Antigravity CLI 提供支持Deepseek Ivideodeepseek-ivideoiPolloWork HyperFrames Video Studio,以及 27 个可编辑视频模板,以原生 DeepSeek Harness 对话视图呈现。Codexdsh-codexChatGPT OAuth、Codex 模型、搜索、read_image URL 支持,以及适用于 DeepSeek Harness 的 gpt-image-2 生成

README

dsh-plugin-glm-vision

给 DSH (DeepSeek Harness) 加上"看图"能力的插件。

即使你用的模型本身不支持图片(比如纯文本的 DeepSeek),装了这个插件后,用户发送的图片会被自动转发给智谱 GLM-4V-Flash 视觉模型,生成的文字描述会注入对话中,让模型"看到"图片内容。

它能做什么

  • 自动图片翻译:用户上传图片 → 插件拦截 → 调用 GLM-4V-Flash 生成描述 → 作为文本发给模型
  • image_query 工具:模型可以主动调用这个工具来分析任意图片(支持多张)
  • 图片缓存:相同图片不会重复请求 API(SHA-256 去重)
  • 多图支持:一条消息里发多张图片,每张都会被分别描述
  • 旧对话兼容:已在进行中的对话也能识别新发的图片

安装

前提条件

  • DSH 已安装且可正常运行
  • pnpm 已安装
  • 智谱 AI 的 API Key(申请地址)

第一步:安装插件

dsh plugin --profile web add git+https://github.com/baldovinmarques391-design/dsh-plugin-glm-vision.git

安装后需要手动将 dsh-plugin-glm-vision 添加到 bundles 列表。编辑 $DSH_HOME/profiles/web/package.json,在 dsh.profile.bundles 数组中加入 "dsh-plugin-glm-vision":

"dsh": {
  "profile": {
    "bundles": [
      "@deepseek-ai/dsh-base",
      "@deepseek-ai/dsh-web-app",
      "dsh-plugin-glm-vision"
    ]
  }
}

第二步:配置 API Key

在 $DSH_HOME/.credentials.yaml 中添加:

GLM_API_KEY: 你的智谱API密钥

第三步:重启 DSH

重启后,控制台应出现以下日志,表示插件加载成功:

dsh-plugin-glm-vision: loaded (model: GLM-4V-Flash, cache: 0 entries).
dsh-plugin-glm-vision: image translation layer active.
dsh-plugin-glm-vision: all modules active.

配置项

插件安装后会自动在 DSH 设置界面中显示配置项。也可通过 cordis.patch.yml 手动配置:

配置项默认值说明
glmApiKeyEnvGLM_API_KEY存放 API Key 的环境变量名
toolTimeoutMs120000image_query 工具超时时间(毫秒)
modelGLM-4.1V-Thinking-Flash使用的 GLM 模型名
autoTranslatetrue是否自动翻译图片
enableTooltrue是否注册 image_query 工具

工作原理

用户发送图片
    ↓
插件拦截消息,提取图片
    ↓
调用 GLM-4V-Flash API 生成图片描述
    ↓
用文字描述替换原始图片
    ↓
模型收到文字描述,正常回复

同时,插件会注册 image_query 工具,模型可以在任何时候主动调用来分析图片。

测试结果

场景结果
单张图片✅ 正确识别并描述
两张图片同时发送✅ 分别描述每张图片
旧对话中发新图片✅ 描述图片 + 保持上下文
纯文本对话✅ 正常工作,不影响
进程稳定性✅ 无崩溃

已知限制

  • GLM-4V-Flash 的 max_tokens 上限为 1024,图片描述可能不够详细
  • 需要对 DSH 内置的 LLM 适配器进行源码级 patch(插件启动时自动处理,但 DSH 更新后 patch 会丢失)

许可证

MIT