CATEGORY
该分类下经过 manifest 校验、精确版本的插件。
aura-vision
Aura Vision — DeepSeek Harness 网页配置的免费视觉 OCR 插件:Zhipu GLM-4V-Flash(免费套餐)、适用于长文档的自适应分块识别、带收藏功能的历史记录,以及 Markdown/Excel/Word/PNG 导出。
dsh-villager-hmm
每当模型在其推理链中发出“嗯”声时,播放原版 Minecraft 村民的“嗯”声。
dsh-voice-input-cn
适用于 DeepSeek Harness web 的语音输入插件(面向中国):通过本地桥接使用 Alibaba Cloud DashScope ASR。编辑器中提供麦克风按钮,支持流式识别、根据光标位置插入文本和静音自动停止。
dsh-vision-tool
dsh 插件:视觉能力代理。将仅支持文本的主模型的图像理解请求路由到小型多模态模型;当活动模型声明支持多模态(inputModalities 包含 'image')时,则完全退出。
@wszhoho/dsh-file-attachment
文件附件:拖拽/粘贴/上传文件(支持多文件);图片与文档统一落盘到 .dsh-file-attachment 并以 @绝对路径 引用发送(文本模型可正常使用);输入框内联显示图片缩略图预览与文件条目,聊天区图片同样渲染为可点击放大的缩略图、文件保持芯片样式;非多模态模型下图片自动调用可配置 VLM 识别生成中文描述回填草稿;文档/代码/配置文件可上传类型可在设置页配置;支持 PC 与移动端浏览器
@mengli114/dsh-image-tiler
DSH 代理工具:将大图切分为带标签的图块(按尺寸或列数 × 行数),并提供概览和可视化工作台;read_tiles 仅选择视觉模型所需的内容——按区域、明确的 ID、用户在工作台中的选择,或视觉模型根据概览定位的命名目标。
@little-traincar/dsh-imagegen
用于 DeepSeek Harness 的图像生成工具——Doubao Seedream 5.0 Pro / qwen-image-3.0-pro,无水印,聊天内嵌显示。
dsh-reel
dsh Web UI 的媒体库:以网格或列表方式浏览配置的本地目录,在查看器中打开图片,并在页面全屏播放器中播放视频,支持滑动导航、顺序/随机播放列表和全屏壁纸。
dsh-minimax-asr
作为全局 DeepSeek Harness 插件的 MiniMax 语音转文本(asr-1.0)和文本转语音(speech-2.8-hd):transcribe_audio 工具、announce_speech 工具、设置卡片、撰写器语音输入、语音回合播报以及免手操作对话。
dsh-voice-talk
DeepSeek Harness Web GUI 的语音对话模式:支持麦克风输入并自动提交、流式语音播报回复,以及支持插话打断的免手操作多轮对话循环。
dsh-multi-tts
语音朗读(MiniMax / OpenAI 兼容 TTS,服务商与音色自选)——每条回复旁的朗读按钮、输入框自动朗读开关、设置页自选服务商与音色。零构建,纯 JS。
dsh-hold-to-talk
DeepSeek Harness Web 编辑器的按住说话语音输入:在输入框上按住鼠标说话,查看上方浮层中实时显示的文字,松开后将文字插入草稿。识别在本机运行(通过 sherpa-onnx 使用 SenseVoice)——无需 API 密钥,支持离线使用,音频不会离开本机。微
dsh-ui-background
一键切换 DSH Web 背景:渐变预设(极光/日落/翡翠绿)、本地图片上传、Bing 每日壁纸(4K/UHD、地区、每日自动更新)、不透明度/模糊/填充控制、光 streak 和粒子效果。
@lp181818/dsh-vision-plugin
DSH 视觉/图像识别插件:使用可配置的视觉模型让 AI 理解图像
@jcy2387/dsh-models-input-modalities
DeepSeek Harness Web 插件:在第三方(pi-ai)提供商的 Models 设置页面上,为每个模型提供输入模态选择器
dsh-vision-analysis
面向模型的 DeepSeek Harness analyze_image 工具:通过任何兼容 OpenAI 或 Anthropic 的视觉 API 实现多模态图像理解,支持 8 种分析模式、本地路径 / http(s) URL / data URL 输入,并提供 Web UI 提示,引导不具备图像处理能力的模型使用可靠的本地路径方案。
dsh-agnes-media
适用于 DeepSeek Harness 的 Agnes AI 图像和视频生成——通过 Agnes OpenAI-compatible gateway 提供 agnes_image 和 agnes_video 工具。
dsh-plugin-88api-image
88API Image Studio for DSH:六个 Image2、Image 2.5 和 Nano Banana 模型,支持文生图、多参考图编辑、2K/4K 输出和连续批处理。
dsh-grok-image
DeepSeek Harness 插件:Grok Imagine 图像生成模型工具(订阅)
dsh-product-preview
Finder 风格的 DeepSeek Harness 媒体工件预览
@ycp424c/dsh-luna-vision-bridge
DSH LLM 适配器使用 Codex Luna 转写原生图像附件,然后委托给 DeepSeek
dsh-image-serve
让 AI 助手能在会话里直接"看到"本地图片:/ws/<绝对路径> 把磁盘上任何位置的文件变成会话 markdown 可渲染的同源 http URL。Show any local file in DSH web sessions — no staging directory, any drive.
dshtools-sensevoice-input
由 SenseVoiceSmall 驱动的本地语音转文字功能,适用于 DSH Desktop 输入框:点击输入区域旁的麦克风,说话后,识别出的草稿(带有语言/情感标签)将写入输入框。
dsh-computer-use-windows
Windows Computer Use for DeepSeek Harness:窗口限定截图、高可靠 OCR、已验证点击、纯 OCR 模式、可插拔视觉模型。
dsh-imgdraw
DeepSeek Harness 的文生图功能:包括 `draw_image` 模型工具、输入栏中的生图按钮及提示词弹窗(异步生成、4 格结果、下载 / 保留 / 删除)、/imgdraw 图片路由,以及持久化历史记录。后端:DashScope wan2.7-image(默认免费)和 SiliconFlow Qwen-Image。
dsh-unlimited-ocr-skill
使用原生 DeepSeek Harness 工具和图形界面配置,实现无限制的 OCR 长文档解析。
dsh-media-serve
DeepSeek Harness 主机插件:通过 Web 服务器在 /media 下提供配置的工作区/媒体文件夹,因此任何对话都可以通过引用 http://<host>:<port>/media/<relative-path> 来显示本地图像。
agnes-media
在 DeepSeek Harness 中为 Agnes AI 媒体模型(agnes-image-2.1-flash、agnes-video-2.5-flash)注册 generate_image 和 generate_video 工具。支持通过 reference_image_urls 使用多图参考。
@local/dsh-tool-imagegen
DSH 对话内联生图插件:OpenAI 兼容接口,图片以 generated-image 块直接显示在对话框内,设置项在 设置→插件→可配置。
dsh-vox-input
通过浏览器 Web Speech API 为 DSH Web 编辑器提供语音(语音转文字)输入:点击麦克风,说话,转录文本会填入输入框。无需服务器,无需 API key,内容不会离开设备。