DeepSeek Harness Plugin Hub

发布与管理完整 Harness Profiles,发现适合你的插件。

探索

插件目录环境预设文档中心动态

社区

发布插件联系我们报告问题

相关链接

Plugin Hub GitHubDeepSeek Harness 官方项目系统状态隐私说明
© 2026 DeepSeek Harness Plugin HubPowered byPaxTech

独立、非官方社区项目,与 DeepSeek 官方无隶属、授权或背书关系。

Llm Ollama — DeepSeek Harness 插件(DSH Plugin)
DeepSeek Harness Plugin Hub
ProfilesPlugins分类动态文档登录管理 Profiles
ProfilesPlugins分类动态文档登录
← Plugins
L

@zhangyi/dsh-llm-ollama

Llm Ollama

DeepSeek Harness 的 Ollama 原生协议(/api/chat)提供程序:llm-ollama 设置命名空间、提供 LlmAdapter、通过 /api/tags 发现模型,以及整页 Ollama 设置部分。

插件会安装到这里;不确定时保持 web。

npx -y @deepseek-ai/dsh plugin --profile web add github:1035041186/dsh-llm-ollama#5374b0a912d9060a3abe6ef30ece7d426b07d4a1
README兼容性版本

兼容性与来源证明

Llm Ollama 以 @zhangyi/dsh-llm-ollama 发布,当前版本为 0.1.17。Plugin Hub 会校验它的 manifest,并保存精确安装来源,便于复现安装结果。

DSH 兼容范围
*
运行环境
web
发布来源
github
Registry 更新时间
2026/9/10

版本

0.1.17stable
2026/9/10
0.1.16stable
2026/8/31
0.1.9stable
2026/8/22

相关插件

正在加载相关插件…

最新版
0.1.17
DSH
*
HMR
重启进程
Tree shaking
未声明可安全裁剪
解包体积
未提供
文件数
未提供
Surface
web
许可证
MIT
发布源
github
GitHub
★ 3
周下载
0
最近提交
2026/9/10
查看源码 ↗
README Badge

点击下方 Badge 复制 Markdown,粘贴到 README 即可。

这是你的 Plugin?认领权益 · 优先安全扫描

验证 package.json 声明的 GitHub 仓库,即可管理这个公开页面。认领后,Hub 会优先安排当前版本的安全扫描,并在通过后公开展示结果。

认领这个 Plugin →
报告问题

相关插件

继续浏览 models-usage 分类下经过校验的插件。

Usage Stats@ychris12138/dsh-usage-statsdsh Web GUI 的令牌使用热力图、提供商余额和订阅配额Codex Connectdsh-codex-connect用于 DeepSeek Harness 的 ChatGPT OAuth 和 Codex 模型。Ui Usage Billing@kenz1117/dsh-ui-usage-billingDeepSeek Harness 的用量计费仪表板:侧边栏成本指标和完整的仪表板模态窗口,依据当前多提供商目录定价,并汇总会话日志中的实际用量。Codex Subscriptiondsh-codex-subscription通过 OAuth 在 DeepSeek Harness 中使用 ChatGPT 和 Codex 订阅,支持配额管理、安全重置、网页搜索、图像和快速模式

README

dsh-llm-ollama

DeepSeek Harness(dsh)的 Ollama 提供方插件:通过 Ollama 原生 /api/chat 协议接入本地或远程部署的 Ollama 服务,提供整页「Ollama」设置界面与一键模型发现。

功能特性

  • 整页设置界面:设置 → Ollama 管理提供方(通过 settings.section 扩展点实现)。
  • 原生协议对话:走 Ollama 原生 POST /api/chat(NDJSON 流式),支持工具调用(tool calls)、图片附件(多模态模型)与推理过程展示(把 Ollama 的 message.thinking 轨迹渲染为推理块)。
  • 模型发现:真实请求 GET /api/tags 拉取服务器上的模型,弹窗勾选加入模型目录;也可手动添加。
  • 参数直通 Ollama:
    • 模型级:上下文窗口 → options.num_ctx,最大输出 token → options.num_predict(填多少传多少;未填上下文窗口时默认发送 32K / 32768)。
    • 模型级:推理控制(thinkingCapable)→ 默认自动识别:按服务器 /api/tags 返回的每个模型 capabilities(含 thinking)判断,只有推理型模型才会在右下角模型选择器显示「推理等级」控制,非推理型不显示。自动识别在后台进行(绝不影响模型选择器加载)、结果带缓存;当服务器 /api/tags 响应慢/离线时按“非推理”安全处理,此时可用模型级 thinkingCapable: true/false 手动覆盖兜底;仅当自动判断不准时才需要手动覆盖为「始终显示 / 始终隐藏」。菜单默认只有开关两项(off → think: false、on → think: true)——这与大多数开源推理模型(Qwen3、DeepSeek-R1 / v3.1)只支持布尔 think 一致;仅当模型支持多档等级(如 GPT-OSS)时,把「推理等级类型」切到 levels,菜单才会多出 low / medium / high / max。可选默认推理等级作为该模型的默认值;不设置时菜单显示“Default”,请求不发送 think,跟随 Ollama 默认(支持推理的模型默认开启)。
    • 提供方级:保持时间 → keep_alive(如 5m,-1 表示常驻),温度 → options.temperature(范围 0–2),可选 API 密钥。
  • 会话级上下文覆盖:输入 /ollama-context 调出当前会话的上下文设置面板(预设 4K/8K/16K/32K/64K/128K、自定义值、跟随系统配置),覆盖值优先于模型配置作为 num_ctx;只作用于当前会话,新会话自动回到系统配置。右下角的上下文占用指示会同步反映覆盖值(仅对本插件管理的 Ollama 提供方会话生效,其他提供方的会话不受影响)。

接入 Ollama:本地或远程部署

Ollama 是本地/自托管的大模型运行平台。本插件通过其原生协议(/api/chat)接入,无论 Ollama 部署在哪里,配置方式完全一致——只需在设置页把提供方的 API 地址填成对应地址。

本地部署

  • ollama pull llama3.2:3b 拉取模型,ollama serve 启动服务,默认监听 http://localhost:11434。

远程部署

  • 把 Ollama 部署到另一台机器或 Docker 容器,确保 11434 端口对 dsh 可达;
  • API 地址填 http://<主机IP或域名>:11434 即可,本地与远程用法相同;
  • Ollama 自身不带鉴权,公网暴露时建议在前面加反向代理(nginx / caddy)做 TLS 与访问控制。

为什么走原生协议(而非 OpenAI 兼容端点)

  • 参数直通:上下文窗口 / 最大输出 / 保持时间 / 温度以原生 options 字段精确生效;OpenAI 兼容端点只暴露 OpenAI 参数子集,num_ctx、keep_alive 等 Ollama 专有参数无法直接控制。
  • 模型发现:GET /api/tags 直接列出服务器上已拉取的模型,设置页一键导入。
  • 无中间转换层:NDJSON 流式与工具调用都走 Ollama 原生实现,不受兼容层参数映射差异的影响。

环境要求

  • DeepSeek Harness web profile(已测试版本 0.1.0-rc.6;v0.1.9 起兼容 0.1.1-rc.2 及以上——该版本要求适配器实现 prepareCall)
  • Ollama 服务(本地默认 http://localhost:11434,远程填对应地址)
  • curl(Linux/macOS 自带;Windows 10+ 自带)

安装

通过 git 仓库安装到 web profile。插件自带的 bundle 补丁(cordis.patch.yml + package.json 的 dsh.bundle.patch)会在安装成功后自动把 llm-ollama 插件行挂进组合树,无需手动编辑 ~/.dsh/profiles/web/cordis.patch.yml:

dsh plugin --profile web add git+https://github.com/1035041186/dsh-llm-ollama.git
dsh --profile web --dump-config   # 可选:确认 llm-ollama 行已存在
dsh web                           # 重启生效

从旧版(≤0.1.2)升级:若此前按旧说明手动在 cordis.patch.yml 中添加过 llm-ollama 行,请先删除该行再重启,否则会触发 duplicate loader entry id: llm-ollama 启动错误。删除后若 dsh.profile.bundles 尚未包含本包,重跑一次 add 命令即可。

使用

  1. 刷新页面 → 设置 → Ollama。
  2. 配置提供方:API 地址填 http://localhost:11434(或你的服务器地址),可选保持时间 / 温度 / 密钥。
  3. 点击「获取可用模型」从服务器拉取模型,弹窗勾选加入;也可手动添加。
  4. 展开某个模型,填上下文窗口(如 32K)与最大输出 token(原样作为 num_ctx / num_predict 发送)。推理控制默认自动识别(按服务器能力判断,推理型模型自动显示「推理等级」菜单,非推理型不显示);仅当判断不准时手动改为「始终显示 / 始终隐藏」。菜单默认为开关(On/Off)两项;仅当模型支持多档等级(如 gpt-oss)时,把「推理等级类型」切到 levels,并可选默认推理等级作为默认(映射为 Ollama 的 think)。
  5. 保存后该提供方即出现在会话的模型选择器中;右下角选择模型后,对自动判定为推理型的模型显示「推理等级」菜单,可进一步调整(页面的默认值优先作为默认,未设置时为“Default”)。也可在 settings.yaml 的 agent-default-model 中设为默认模型。

按会话调整上下文

在会话输入框输入 /ollama-context 调出上下文设置面板:

  • 预设:4K / 8K / 16K / 32K / 64K / 128K 一键选择;
  • 自定义值:支持 4096、32K、1M 等写法;
  • 跟随系统配置:回到设置页中该模型配置的 Context window(未配置则用默认 32K)。

会话级覆盖的优先级高于设置页中每个模型的 Context window,且只对当前会话生效;覆盖值持久化在 llm-ollama 命名空间的 sessions.<sessionId>.contextWindow 字段中。

settings.yaml 等效配置

llm-ollama:
  providers:
    ollama:
      displayName: Ollama (local)
      api: ollama-chat
      baseURL: http://localhost:11434
      keepAlive: 5m
      temperature: 0.7
      models:
        - id: qwen3.5:9b          # auto-detected as thinking (capabilities contain "thinking"); default mode = on/off switch
          reasoningEffort: on
          contextWindow: 32768
          maxTokens: 4096
        - id: gpt-oss:20b        # auto-detected thinking; granular levels (thinkingMode: levels)
          thinkingMode: levels
          reasoningEffort: high
        - id: llama3.2:3b         # auto-detected as non-thinking -> no thinking menu

架构

  • Bundle 层(cordis.patch.yml + package.json 的 dsh.bundle.patch):安装后自动成为 profile 的一个 bundle 层,把 llm-ollama 插件行挂进组合树,免去手动补丁。
  • Host(lib/index.js):注册 llm-ollama 设置命名空间(其 schema 即「API 协议」下拉的数据来源);实现 LlmAdapter(/api/chat 流式)与 GET /api/tags 模型发现;维护可配置提供方目录——其中始终存在一个休眠的 ollama 条目,保证命名空间对 Web 客户端保持暴露。
  • Client(client.js):settings.section 整页「Ollama」设置页与 /ollama-context 命令,读写 llm-ollama 命名空间。

开发调试

无真实 Ollama 时可用内置 mock 服务器联调:它实现了 /api/tags 与流式 /api/chat(含工具调用示例与 images=N 图片回显),并把最近一次 /api/chat 请求体写入 /tmp/ollama-mock-last.json,便于断言 num_ctx / num_predict / keep_alive 的透传是否正确。

node scripts/mock-ollama.mjs   # 监听 127.0.0.1:11434

让已安装的插件实时跟随源码:dsh plugin add 通过 pnpm 的 file: / git 协议会把插件拷贝进 profile 的 node_modules——之后修改本仓库源码不会反映到已安装插件(file: 是安装时快照,不是链接)。本地联调时把 profile 的依赖声明改为 link: 指向本目录,安装后 node_modules 里就是软链,改代码只需重启 dsh web:

# 编辑 ~/.dsh/profiles/<name>/package.json:
#   "@zhangyi/dsh-llm-ollama": "link:/root/projects/src/dsh-llm-ollama"
cd ~/.dsh/profiles/<name> && pnpm install

已知限制

  • 社区插件(非官方出品)。
  • 图片需配合支持视觉的多模态模型(如 llava、llama3.2-vision、qwen2.5vl 等)使用;纯文本模型收到图片会由 Ollama 报错。
  • API 密钥字段当前仅保存凭据引用,尚未随请求发送;远程部署的鉴权请在 Ollama 前的反向代理层处理。