CATEGORY
该分类下经过 manifest 校验、精确版本的插件。
dsh-niulai-sound
牛来确认音 — 电影《牛来》中的 DSH 审批音效:请求用户确认时播放「妈妈」,用户批准时立即中断并播放「牛来!」。
dsh-video-lens
为纯文本 DeepSeek Harness agents 提供视频理解:场景感知抽帧 + VLM + 可选 ASR 转录,并融合为时间线证据。
dsh-vision-link
轻量且保留路由的 DSH 视觉连接:由配置的视觉模型负责视觉处理,同时保持所选文本模型的控制权。
local-ocr-cli
面向纯文本 LLM 的完全本地 OCR CLI:以 PaddleOCR-VL 作为首选引擎,并提供 tesseract 回退,包含 dsh 插件
@nextnowlabs/dsh-ark-toolkit
DSH Ark Toolkit:为 DeepSeek Harness 接入字节火山方舟的文生图与语音合成能力。内置豆包 Seedream 文生图(ark_generate_image)与豆包语音合成模型 2.0(ark_speak)。
auto-vision
DSH(DeepSeek Harness)图片一体化插件:粘贴图片只进对话不进模型请求(llm/stream 清洗),并注册 see_image 工具让文本模型通过任意 OpenAI 兼容视觉 API 按需看图
dsh-media-guard
请求为 DeepSeek Harness (DSH) 提供镜像优化、智能保留和可观测性
dsh-ocr-bridge
将图像粘贴到 DeepSeek Harness 聊天中,并在仅支持文本的 DeepSeek 模型回答前,由免费的本地后端(macOS Vision / Tesseract)读取图像内容
@oil-oil/dsh-vision
为仅支持文本的 DeepSeek Harness 模型提供接近原生的图像理解能力
dsh-kitt-voice
DSH KITT — 面向西班牙语的 DeepSeek Harness 网页界面语音插件:支持免提对话、按键说话(Whisper)、朗读回复,以及带全局快捷键的浮动叠加窗口。
vision-translation-dsh
用于 vision-translation 的原生 dsh (DeepSeek Harness) Cordis 插件适配器:通过 Python CLI(PROTOCOL v1)将图像信息映射到 <vision-context> 中。启动 cli.py,从不重新实现核心逻辑。
@freespace8/dsh-free-vision
DeepSeek Harness 的本地图像理解:通过 macOS Vision 进行 OCR、表格布局检测,以及对无文字图像的语义描述,完全在设备本地运行(图像绝不会离开你的 Mac)。本地化识图,图片不出本机。
@a9i5k4/dsh-ark9canvas
DSH 生图插件 Ark9canvas:Agent 生图(默认需用户批准) + 浮窗生图工作台(比例/透明背景/批量/提示词库/多渠道/生成记录),OpenAI 兼容图片 API 文生图/图生图。
@dsh-external/dsh-vision-toolkit
DeepSeek 面向 Harness 原生的 agent-vision-toolkit 集成:图像问答、OCR、定位、UI 恢复、像素差异、Artifacts 和 Web UI。
@goodandready/dsh-fal-image-gen
DeepSeek Harness 的图像生成:提供可插拔提供商的 generate_image 工具——支持 FAL 队列 API 或任何兼容 OpenAI 的图像 API。图片会以内联方式显示在对话中;模型接收链接(适用于任何聊天模型)或
dsh-nanobananapro
通过 NanoBananaPro API 在 DeepSeek Harness 中生成图像和视频
scientific-figure-library
本地图像代码知识库,提供原生 macOS 和本地 Web 客户端,以及适用于 Pi、DeepSeek Harness (dsh)、Claude、Codex、Cursor 和 Wisp 的 MCP 与 Skill。
dsh-vision-guard
DeepSeek Harness 的透明图像防护与视觉分析:让纯文本模型读取粘贴的图像,避免 400 会话死锁。
dsh-tool-accurate-vision
面向模型的 accurate_vision 工具:通过视觉模型进行精确的图像空间推理
dsh-local-vision
DeepSeek Harness 插件:一个可由模型调用的 local_vision 工具,通过 Ollama 使用本地视觉模型描述图像。不使用云服务,图像不会离开本机。提供两个级别:快速(文本/颜色/摘要)和详细(完整描述)。
texteye
DeepSeek Harness 插件:将图像转换为 ASCII 艺术和逐单元格颜色映射,使纯文本模型能够看到图像。
dsh-reelsmaker
DeepSeek Harness 插件:将主题制作成完整的竖屏短视频。免费神经语音旁白、烧录字幕,无需 API 密钥。
@motong/dsh-voice
给 DeepSeek Harness(DSH / DeepSeek Hermes)加语音能力的社区插件:输入框语音输入(可配快捷键)+ 回答朗读(微软 Edge 神经网络音色,可换音色、可试听),无需 API Key。
soyo-dsh-plugin
基于 DSH 原生的视频理解,支持可配置的多模态提供商
dsh-voice-studio
DeepSeek Harness 插件:提供本地 TTS、语音克隆和尽力而为的配音功能,带有设置 GUI 和 dsh_voice 工具(XTTS v2 + Piper、faster-whisper、ElevenLabs API 选项)。
dsh-plugin-vision-toolkit
DeepSeek Harness 的视觉工具包——glance、ground、detect、crop CLI 工具,帮助仅支持文本的智能体理解图像
dsh-image-studio
DeepSeek Harness 插件:支持本地文生图、画布式 GUI、图像修复、DeepSeek 视觉审查、OpenAI 兼容 API 选项,以及 Python Stable Diffusion 工作进程(diffusers/MPS)。
dsh-siliconflow-vision
DSH 插件:通过硅基流动(SiliconFlow)视觉大模型识别/分析图片,支持本地文件路径、http(s) 图片 URL 与 base64 data URL。含持久化的粘贴识别面板(web 端)。
dsh-photo-pet
DeepSeek Harness (DSH) Web GUI 的照片宠物插件:将上传的任意照片变成可拖动、换装并聊天的浮动宠物。
@mengruo/dsh-vision-toolkit
DeepSeek Harness 原生集成,用于 agent-vision-toolkit:图像问答、OCR、定位、UI 恢复、像素差异、Artifacts 和 Web UI。