DeepSeek Harness Plugin Hub

发布与管理完整 Harness Profiles,发现适合你的插件。

探索

插件目录环境预设文档中心动态

社区

发布插件联系我们报告问题

相关链接

Plugin Hub GitHubDeepSeek Harness 官方项目系统状态隐私说明
© 2026 DeepSeek Harness Plugin HubPowered byPaxTech

独立、非官方社区项目,与 DeepSeek 官方无隶属、授权或背书关系。

视觉与媒体 类 DSH 插件 — 第 12 页

CATEGORY

视觉与媒体 类 DSH 插件

该分类下经过 manifest 校验、精确版本的插件。

全部分类

全部 Plugins智能体与编排713记忆与上下文852编程与开发工具1.9k界面与个性化2.5k集成与通信1.3k视觉与媒体464搜索与研究617安全与访问控制857模型与用量1.1k效率与工作流1.5k

全部 Plugins

共 464 个
Sv0.4.0
dsh-speech

Speech

DeepSeek Harness (dsh) Web 主机的语音能力插件:通过令牌控制的 /s/api 路由系列,基于可配置的提供商提供音频转录(ASR)和语音合成(TTS)

↓ 0
更新于 2026/9/8
Mv1.0.0
dsh-model-modality

Model Modality

标明已配置的第三方模型是否接受图像(多模态)输入;将该模态写入所属提供商设置,并通过运行时模型解析进行验证。

↓ 0★ 0
更新于 2026/9/7
Vv0.2.1
dsh-videogen

Videogen

适用于 dsh Web GUI 的 AI 视频插件:多供应商视频生成渠道(OpenAI-compatible /v1/videos、Kling、MiniMax Hailuo、Volcengine ARK、自定义通用异步)、FFmpeg 视频处理(探测 / 帧提取 / GIF / 图像压缩)、轻量级分镜工作室(模板 + 镜头 + FFm

↓ 0★ 0
更新于 2026/9/7
Iv0.2.1
dsh-image2-draw

Image2 Draw

面向 DeepSeek Harness 的 Image2 (gpt-image-2) 生成插件,提供简单的中继设置、对话内预览、聊天停靠工作室(文生图 / 图生图 / 多视图角色一致性)以及可重复使用的提示词/流程预设库。JuneLearn/dsh-image2-draw 的社区分支,包含网关

↓ 0★ 0
更新于 2026/9/6
Ov0.5.0
dsh-ollama-vision-bridge

Ollama Vision Bridge

DSH 视觉桥接(DSH >= 0.1.2-rc.1):当选定的聊天模型仅支持文本时,使用本地 Ollama VL 模型(qwen3-vl:8b)描述附加图像,并通过 keep_alive 实现 VRAM 冷却。安装时修补 dsh-api-session-controller 的提示词接纳机制,并提供运行时状态伴侣。

↓ 0★ 0
更新于 2026/9/6
Vv0.1.1
@dsh-external/dsh-vision-bridge

Vision Bridge

DeepSeek Harness 视觉桥接:会话截图根据模型能力进行分流。支持图像的模型会以内联附件形式接收;仅支持文本的模型会看到标准占位符,桥接器则通过视觉语言模型读取图像——可通过 vision_bridge_read 工具按需读取,也可通过代理/步骤前上下文注入自动读取。

↓ 0★ 0
更新于 2026/9/6
Vv0.2.2
@lovstudio/dsh-video-studio

Video Studio

面向 DeepSeek Harness 的本地优先视频编辑工作台,支持 Remotion、GSAP 和可插拔 ASR

↓ 0★ 0
更新于 2026/9/6
Iv0.2.3
@goodandready/dsh-im-hub-media

Im Hub Media

面向 DeepSeek Harness 的多平台 IM 网关(带媒体功能的 dsh-im-hub 分支):支持 Telegram 语音/照片/文档/视频及回复处理,STT(Deepgram 为主要服务,HF Whisper 为备用),出站 MEDIA: 标记。Feishu/WeCom 保持不变。

↓ 0★ 0
更新于 2026/9/5
v0.1.1
dsh-voice-input-qwen-asr

Voice Input Qwen Asr

语音输入插件(双界面):麦克风按钮位于编写器发送操作旁,实时录音气泡将 PCM 流式传输至由主机管理的本地 Qwen3-ASR Python 服务;另提供 ASR 环境设置页面(克隆运行时/模型仓库、创建 venv、运行服务器)。双语界面(zh/en)

↓ 0★ 0
更新于 2026/9/5
Fv0.1.0
dsh-file-upload-local

File Upload Local

适用于 DeepSeek Harness 的本地文件上传插件:提供回形针按钮和拖放功能,将文件按会话存储在 .dsh-uploads/<sessionId>/ 下,并提供 read_document 工具来分页读取文本和对图像进行 OCR(tesseract.js),使仅支持文本的模型也能读取截图。

↓ 0★ 0
更新于 2026/9/5
Iv1.2.3
dsh-image-picker

Image Picker

DeepSeek Harness Web GUI 输入框 📎 选图按钮:通过系统文件选择器添加参考图,绕开拖拽环境问题,复用官方附件管线(缩略图/上限校验/随消息上传)。Image-picker button for the conversation composer.

↓ 0★ 0
更新于 2026/9/5
Bv0.1.0
@dsh-voice/bundle

Bundle

dsh-voice — 输入语音笔记,输出语音回答:口述音频会转换为用户消息(转录),让代理朗读回复(语音),并在长时间无头运行期间留下可供事后收听的旁白。优先使用本地处理,普通音频文件存放在 ~/.dsh/voice/

↓ 0★ 0
更新于 2026/9/5
Vv0.1.2
dsh-video-director

Video Director

面向 DeepSeek Harness 的项目级多模态视频导演插件。

↓ 0★ 0
更新于 2026/9/4
Kv0.1.0
@lamplitisles/kepos-speech

Kepos Speech

Kepos Speech 插件,用于在 DeepSeek Harness Web 中使用阿里巴巴和字节跳动的中文语音合成及短音频识别功能

↓ 0★ 0
更新于 2026/9/4
Gv0.3.1
dsh-grok-adaptation

Grok Adaptation

使用 Sharp 规范化尺寸过小的 Grok Responses 图像,同时保持受支持的大尺寸图像不变。

↓ 0★ 0
更新于 2026/9/3
v1.0.0
dsh-vision-pro-bridge

Vision Pro Bridge

让纯文本 DeepSeek-V4-Pro 获得真正的视觉能力,无需新增依赖,并且仅使用 DeepSeek 路由:图像由 deepseek-v4-flash-vision-exp(您现有的 DEEPSEEK_API_KEY)进行描述,然后将文本传递给 V4-Pro。

↓ 0★ 0
更新于 2026/9/3
Vv1.0.2
dsh-vision-toggle

Vision Toggle

DSH 模型视觉开关:设置页「模型视觉」行,为 llm-pi-ai 自定义路由下手写声明的模型切换 input 视觉模态(settings.mutate 官方通道,热生效)。

↓ 0★ 0
更新于 2026/9/3
Vv1.3.0
@dshp-inx/vision-bridge

Vision Bridgealt · @dshp-inx

DeepSeek Harness (DSH) 视觉桥接:通过 vision_describe 工具,让纯文本模型将图像理解任务交给多模态视觉模型,并提供持久化设置界面以及主模型/备用模型自动重试功能。

↓ 0★ 0
更新于 2026/9/3
Pv1.1.0
dsh-pdf-to-word

Pdf To Word

DeepSeek Harness 插件:将 PDF 转换为 Word(.docx),保持布局一致性(字体/表格/图像/边框),支持 OCR 扫描模式和可选的多模态 LLM 验证。注册 pdf_to_word 模型工具。

↓ 0★ 0
更新于 2026/9/3
Vv0.1.0
dsh-vision-patch

Vision Patch

模型页面自定义提供商卡片中按模型和按路由设置的图像输入(视觉)复选框,通过 llm-pi-ai 设置命名空间写入。

↓ 0★ 0
更新于 2026/9/3
Pv0.1.0
dsh-plugin-vision

Plugin Vision

给 DSH agent 装一双眼睛:调用在线 VLM(多供应商、OpenAI 兼容)分析本地图片、URL 与会话上传的附件;勾选的模型特色能力会实时注入系统提示

↓ 0★ 0
更新于 2026/9/3
Vv1.0.0
dsh-vision-assist

Vision Assist

DeepSeek Harness 视觉助手插件:给没有视觉能力的模型配一个可随时切换的多模态识别模型。输入框图片自动落盘并改写为文本提示,主模型调用 vision_recognize 工具即可完成看图;识别模型在 settings 的 vision-assist 命名空间热更新切换。

↓ 0★ 0
更新于 2026/9/2
Vv0.3.9
dsh-vision-bridge

Vision Bridgealt · alaxrpg

DSH 视觉桥接插件:复用 DSH Provider 或 OpenAI 兼容直连,支持可视化配置与图片粘贴

↓ 0★ 0
更新于 2026/9/2
Pv0.1.0
dsh-plugin-show-image

Plugin Show Image

通过全局 show_image 工具在 DSH 对话中内联渲染本地图像文件。

↓ 0★ 0
更新于 2026/9/1
Mv0.1.2
media-preview

Media Preview

DSH 插件:在聊天记录中自动将本地音视频/图片路径渲染为可播放的预览组件。当助手消息或工具结果包含本地媒体路径时,该路径会在原位置替换为由同源 /api/media-preview/* 路由提供支持的可播放 <audio>/<video>/<img> 元素。

↓ 0
更新于 2026/9/1
v0.2.5
dsh-plugin-voice

Plugin Voice

DeepSeek Harness 插件:语音 + 通知出口——agent 通过云端 TTS(火山 seed-tts / 小米 MiMo V2.5,失败自动回退 SAPI)/ 桌面通知 / 提示音主动联系用户。融合 dsh-plugin-notify 的 DSH 原生深度集成与 agent-voice-mcp-minus 的云端 TTS 调优,零 Python 依赖,Windows 原生。

↓ 0★ 0
更新于 2026/9/1
Mv0.1.3
@maiziman/dsh-model-capabilities

Model Capabilities

自动检测自定义 DeepSeek Harness 模型的推理和图像能力

↓ 0★ 0
更新于 2026/9/1
Lv0.1.0
dsh-llm-multimodal

Llm Multimodal

DSH 插件:在 DSH 中提供图像/视频生成工具,基于 OpenAI 兼容 API。模型自动从现有 llm-pi-ai 设置中发现。

↓ 0★ 0
更新于 2026/8/31
Mv0.1.1
@xiaokaizhou/dsh-media-preview

Media Previewalt · @xiaokaizhou

DSH 插件:在聊天记录中自动将本地音视频/图片路径渲染为可播放的预览组件。当助手消息或工具结果包含本地媒体路径时,该路径会在原位置替换为可播放的 <audio>/<video>/<img> 元素,并由同源 /api/media-preview/* 路由提供支持。

↓ 0
更新于 2026/8/31
Iv1.0.3
dsh-image-amnesia

Image Amnesia

保留原生视觉,在历史图像发送到中继提供商之前将其丢弃。面向每个代理的 Global DeepSeek Harness 捆绑包。

↓ 0★ 0
更新于 2026/8/31
← 上一页1…1011121314…16下一页 →
DeepSeek Harness Plugin Hub
ProfilesPlugins分类动态文档登录管理 Profiles
ProfilesPlugins分类动态文档登录