DeepSeek Harness Plugin Hub

发布与管理完整 Harness Profiles,发现适合你的插件。

探索

插件目录环境预设文档中心动态

社区

发布插件联系我们报告问题

相关链接

Plugin Hub GitHubDeepSeek Harness 官方项目系统状态隐私说明
© 2026 DeepSeek Harness Plugin HubPowered byPaxTech

独立、非官方社区项目,与 DeepSeek 官方无隶属、授权或背书关系。

Siliconflow Vision — DeepSeek Harness 插件(DSH Plugin)
← Plugins

dsh-siliconflow-vision

Siliconflow Vision

DSH 插件:通过硅基流动(SiliconFlow)视觉大模型识别/分析图片,支持本地文件路径、http(s) 图片 URL 与 base64 data URL。含持久化的粘贴识别面板(web 端)。

插件会安装到这里;不确定时保持 web。

npx -y @deepseek-ai/dsh plugin --profile web add dsh-siliconflow-vision@1.1.1
README兼容性版本

兼容性与来源证明

Siliconflow Vision 以 dsh-siliconflow-vision 发布,当前版本为 1.1.1。Plugin Hub 会校验它的 manifest,并保存精确安装来源,便于复现安装结果。

DSH 兼容范围
*
运行环境
web
发布来源
npm
Registry 更新时间
2026/9/20

版本

1.1.1stable
2026/8/18
1.1.0stable
2026/8/18
1.0.0
stable
2026/8/16

相关插件

正在加载相关插件…

最新版
1.1.1
DSH
*
HMR
重启进程
Tree shaking
未声明可安全裁剪
解包体积
21.7 kB
文件数
6
Surface
web
许可证
MIT
发布源
npm
GitHub
★ 0
周下载
64
最近提交
2026/8/18
查看源码 ↗项目主页 ↗
README Badge

点击下方 Badge 复制 Markdown,粘贴到 README 即可。

这是你的 Plugin?认领权益 · 优先安全扫描

验证 package.json 声明的 GitHub 仓库,即可管理这个公开页面。认领后,Hub 会优先安排当前版本的安全扫描,并在通过后公开展示结果。

认领这个 Plugin →
报告问题
DeepSeek Harness Plugin Hub
ProfilesPlugins分类动态文档登录管理 Profiles
ProfilesPlugins分类动态文档登录

README

dsh-siliconflow-vision

DSH(DeepSeek Harness)插件:通过**硅基流动(SiliconFlow)**的视觉大模型识别/分析图片。

当前主模型通常只支持文本输入,无法直接"看"图。本插件注册一个 analyze_image 模型工具,把图片交给硅基流动的视觉模型(默认 Qwen/Qwen3-VL-32B-Instruct)识别, 再把结果返回给对话模型——从而让 DSH 会话获得完整的图片识别能力。

功能

  • ✅ 识别服务器本地图片文件(传路径)
  • ✅ 识别 http(s) 图片 URL
  • ✅ 识别 base64 data URL
  • ✅ 自定义识别指令(prompt),如"识别图中所有文字"、"图里有什么动物"
  • ✅ 可切换模型(Qwen3-VL 系列、GLM-4.5V、PaddleOCR-VL 等)
  • 🖼️ 可选:交互式"粘贴识别"面板(动态插件形态,见 dynamic/)

安装

方式一:作为 bundle 安装(推荐,持久生效)

把本目录(或 git clone 后的目录)通过 dsh plugin 安装到某个 profile:

dsh plugin --profile demo add ./dsh-siliconflow-vision

安装后 dsh --profile demo 启动即加载 analyze_image 工具。

方式二:作为动态插件加载(会话级)

把 dynamic/host.js 与 dynamic/client.js 的内容通过会话的 cordis 插件工具(cordis_define + cordis_run)加载, 可获得输入框上方的"粘贴识别"面板(浏览器端粘贴/选图 → 识别 → 结果自动发送到主会话)。 注意动态插件是会话级的,进程重启后需要重新激活。

配置 API Key

优先使用环境变量:

export SILICONFLOW_API_KEY="sk-xxxxxxxx"

或者写入密钥文件(任选其一,文件内容为纯文本 Key):

$DSH_HOME/siliconflow.key
~/.dsh/siliconflow.key

Key 在 硅基流动控制台 获取。

使用

在对话中让模型识别图片即可,例如:

分析一下 /root/data/photo.png 里有什么
识别这张图的文字:https://example.com/screenshot.png

模型会调用 analyze_image 工具,参数:

参数必填说明
image✅服务器本地路径 / http(s) URL / data URL
prompt—对图片的问题或指令,缺省为通用中文描述
model—硅基流动模型 ID,默认 Qwen/Qwen3-VL-32B-Instruct
maxTokens—输出 token 上限,默认 1024

可选模型

模型 ID特点
Qwen/Qwen3-VL-32B-Instruct默认,识别能力强
Qwen/Qwen3-VL-8B-Instruct更快、更省
Qwen/Qwen3-VL-30B-A3B-Instruct性价比
zai-org/GLM-4.5V通用视觉
PaddlePaddle/PaddleOCR-VL-1.5OCR 文字识别专用

技术说明

  • 运行环境:Node.js >= 18(使用原生 fetch,无需 python/shell)
  • 请求格式:OpenAI 兼容 POST https://api.siliconflow.cn/v1/chat/completions
  • 本地图片读取后转 base64 data URL 传入,不走磁盘临时文件
  • API Key 不会出现在插件代码里,从环境变量或密钥文件读取

License

MIT

相关插件

继续浏览 vision-media 分类下经过校验的插件。

Tool Describe Image@linxin666/dsh-tool-describe-image面向模型的 describe_image 工具,用于 dsh Web GUI:通过在兼容 OpenAI 的端点调用视觉语言模型,为文本模型提供图像理解能力,以描述一张图像(本地路径、http(s) URL 或附件引用)。可热插拔 —Modlens@liustack/modlens面向仅支持文本的 LLM 的插件视觉能力,由免费的 Antigravity CLI 提供支持Vision Toolkit@anionex/dsh-vision-toolkit面向 Harness 原生集成的 DeepSeek 与 agent-vision-toolkit:图像问答、OCR、定位、UI 还原、像素差异、Artifacts 和 Web UI。Deepseek Ivideodeepseek-ivideoiPolloWork HyperFrames Video Studio,以及 27 个可编辑视频模板,以原生 DeepSeek Harness 对话视图呈现。