DeepSeek Harness Plugin Hub

发布与管理完整 Harness Profiles,发现适合你的插件。

探索

插件目录环境预设文档中心动态

社区

发布插件联系我们报告问题

相关链接

Plugin Hub GitHubDeepSeek Harness 官方项目系统状态隐私说明
© 2026 DeepSeek Harness Plugin HubPowered byPaxTech

独立、非官方社区项目,与 DeepSeek 官方无隶属、授权或背书关系。

Adaptive Effort — DeepSeek Harness 插件(DSH Plugin)
← Plugins
A

dsh-adaptive-effort

Adaptive Effort

DSH 插件:通过 MiniMax 复杂度评分器(带启发式回退)按每个用户回合自动选择 reasoning_effort(low/high/max),并提供类似 effort-router 的 token 账本,以及每条回复的元数据标签(模型 · effort · tokens · steps,点击可跳回)。模型弹窗中提供手动选择器;评分器仅在 Auto 下触发。

插件会安装到这里;不确定时保持 web。

npx -y @deepseek-ai/dsh plugin --profile web add github:imkingjh999/dsh-adaptive-effort#171bca6ee6f3e72542ad554c50959e50688498ec
README兼容性版本
回复标签:模型 · 档位 · tokens 与用时统计设置 → 插件 → 自适应思考档位 配置卡片

说明

DSH 插件:通过 MiniMax 复杂度评分器(带启发式回退)按每个用户回合自动选择 reasoning_effort(low/high/max),并提供类似 effort-router 的 token 账本,以及每条回复的元数据标签(模型 · effort · tokens · steps,点击可跳回)。模型弹窗中提供手动选择器;评分器仅在 Auto 下触发。GLM-5.3 安全规则:绝不选择 off/medium,在强制思考模型上会将手动选择的 off 限制为允许的选项。

兼容性与来源证明

Adaptive Effort 以 dsh-adaptive-effort 发布,当前版本为 0.3.0。Plugin Hub 会校验它的 manifest,并保存精确安装来源,便于复现安装结果。

DSH 兼容范围
*
运行环境
web
发布来源
github
Registry 更新时间
2026/8/26

版本

0.3.0stable
2026/8/26

相关插件

正在加载相关插件…

最新版
0.3.0
DSH
*
HMR
重启进程
Tree shaking
未声明可安全裁剪
解包体积
未提供
文件数
未提供
Surface
web
许可证
MIT
发布源
github
GitHub
★ 0
周下载
0
最近提交
2026/8/26
查看源码 ↗
README Badge

点击下方 Badge 复制 Markdown,粘贴到 README 即可。

这是你的 Plugin?认领权益 · 优先安全扫描

验证 package.json 声明的 GitHub 仓库,即可管理这个公开页面。认领后,Hub 会优先安排当前版本的安全扫描,并在通过后公开展示结果。

认领这个 Plugin →
报告问题
DeepSeek Harness Plugin Hub
ProfilesPlugins分类动态文档登录管理 Profiles
ProfilesPlugins分类动态文档登录

相关插件

继续浏览 models-usage 分类下经过校验的插件。

Usage@linxin666/dsh-usage用于 dsh Web GUI 的使用统计插件:检测各提供商的余额和编码计划配额,并提供实时令牌使用记录,同时在侧边栏条目中显示当前会话提供商今日的使用量Whale Widgetdsh-whale-widgetDSH Web 界面右下角的 DeepSeek 余额小鲸鱼挂件:余额/今日已用/峰谷定价、自定义泡泡点击序列(文本/余额/今日/峰谷/图片/随机语句与并列加权选择)、逐行样式与字体、悬浮快捷编辑、音效与每轮消耗、自定义角色/动图/音效、吸附与翻转自定义Usage Stats@ychris12138/dsh-usage-statsdsh Web GUI 的令牌使用热力图、提供商余额和订阅配额Codex Connectdsh-codex-connect用于 DeepSeek Harness 的 ChatGPT OAuth 和 Codex 模型。

README

dsh-adaptive-effort

回复标签:模型 · 档位 · tokens 与用时统计

每条回复末尾的徽标:glm-5.3 · 低 · 344 tok;右侧为宿主自带的用时统计。

DSH 宿主插件:用 MiniMax 给每条用户消息打复杂度分,自动选择 reasoning_effort(low / high / max),带 effort-router 风格的 token 记账(分档统计、降档节省估算、误路由标记),并在每条 AI 回复末尾挂元数据标签(模型 · 思考档位 · 输出 tokens · 步数,点击回到该回复开头)。GLM-5.3 安全:绝不自动选 off / medium,强制思考模型上的手动 off 会被钳制为 low。

English · 中文

它解决什么问题

  • effort 是会话级设置,没有程序化的逐轮调整手段:默认高档在琐碎改动上浪费 token,默认低档在难题上思考不足(effort-router 的问题陈述,同样适用于 DSH)。
  • GLM-5.3 强制思考(thinking.type: disabled 直接报错)且只认 low / high / max 三档(medium 报错)——自动切换器必须守住这条硬边界。

工作原理

用户消息 ──► MiniMax 复杂度打分(thinking 关闭,max_tokens≤64,严格 JSON)
                │  失败/超时/无 key ──► 启发式回退(长度+代码块+关键词)
                ▼
            tier ∈ {low, high, max}(按消息缓存:一条消息最多打一次分)
                │  + 近期工具重负载只升不降(≥3200 字符参数 → max)
                ▼
       agent/request 瀑布注入 reasoningEffort(prepend,模型选择器手动档优先)
                ▼
       JSONL 账本(~/.dsh/adaptive-effort/ledger-<会话>.jsonl)
                ▼
       中文报表:分档 token 统计 / 降档节省估算 / 误路由标记
  • 打分后端:默认 minimax(LLM 判分,准);可切 heuristic(零依赖纯规则)。MiniMax 调用带 thinking: {type:"disabled"}——打分要快要便宜。
  • 手动优先:模型选择器里选了 off/low/high/max 就不干预;插件往选择器里注入 Auto 档,选 Auto 才启用自动调度。
  • GLM-5.3 钳制:强制思考模型(glm-5.3+ / glm-4.7)上的手动 off 会被替换成 low 并记日志,避免 API 报错。
  • 记账:每次请求记录(tier、effort、原因、打分来源),每步的 assistant/message usage(input/output tokens)延迟入库;报表给出「疑似低估」(low 档输出爆炸)与「疑似高估」(high/max 档输出极小)标记。

回复标签(v0.3)

每条已定稿的 AI 回复的 IconActions 行里渲染一枚徽标:

[ glm-5.3 · 低 · 1.5k tok ]
  • 模型 · 思考档位 · 输出 tokens;点击平滑滚到该回复;
  • 挂官方 conversation.chat.assistant-actions list 插槽(additive,与 feedback 等共存;不走 turnTail 链——那是 first-match-wins 互斥链,会被 better-sidebar/deliverables 挡掉);
  • 数据 = 会话快照 legacy nodes(usage)join trajectory 视图(requestConfig:model/reasoningEffort,按 turn+step 对齐)——零 RPC;
  • 标签上的「思考」就是实际注入档位——配合自动调度,一眼核验每条回复真的跑在哪档。

档位入口:模型选择弹窗(v0.2.1 起)

像选 DeepSeek 推理等级一样:点开模型选择弹窗 → 模型下方「推理等级」列表 → 多出一项 「自动」(副标题:自适应档位,MiniMax 打分消息复杂度,在 low/high/max 间自动调度)。

模型弹窗「推理等级」行为
自动MiniMax 打分 + 调度(low/high/max,重负载工具只升不降)
Off / Low / High / Max原生手动档,插件不介入、不打分
未选不介入(走适配器默认)

GLM-5.3 等强制思考模型上,任何来源的 off 都会被钳制为 low 并记日志。

设置 → 插件卡片只放后端配置(打分后端 MiniMax/启发式、API Key、打分模型、启用开关、重负载升级开关);高级用户可用 cordis.yml 的 level 强制全局档位。

设置 → 插件 → 自适应思考档位 配置卡片

设置 → 插件 →「自适应思考档位」:打分后端 / API Key / 打分模型 / 总开关 / 重负载升档。

安装(本地开发)

cd dsh-adaptive-effort
pnpm install && pnpm build
dsh plugin add ./dsh-adaptive-effort   # 或按你的 profile 方式挂载

刷新 DSH 页面后生效。

配置(cordis.yml 或设置命名空间 adaptive-effort)

键默认说明
enabledtrue总开关
levelauto插件级档位:auto(跟随模型选择器,双 Auto 才打分)或强制档 off/low/high/max
modeminimaxminimax / heuristic
minimaxApiKey''为空时读环境变量 MINIMAX_API_KEY,再为空回退启发式
minimaxBaseUrlhttps://api.minimaxi.com/v1国际站;国内换成 https://api.minimax.chat/v1
minimaxModelMiniMax-M3打分模型
scoreTimeoutMs4000打分超时,超时回退启发式
allowToolUpgradetrue允许重负载工具参数把档位升到 max
clampForcedThinkingOfftrueGLM-5.3 等强制思考模型上把手动 off 钳制为 low
ledgerDir''账本目录;空 = ~/.dsh/adaptive-effort

报表

node lib/report.js            # 会话索引
node lib/report.js --last     # 最近会话报表
node lib/report.js --session <id>
node lib/report.js --all      # 全部合并

输出示例:

== 自适应思考档位报表 ==
会话步骤数:42,总输出 tokens:318442

档位      步数    输出 tokens    均值/步
low       6       5222           870
high      21      330440         15735
max       15      276780         18452

降档节省估算(相对全程 max 的粗略反事实):约 36503 tokens

设计来源与致谢

  • 分类器形态参考 hermes-plugin-adaptive-effort(每轮打分→三档),打分后端换成 MiniMax LLM。
  • 记账参考 effort-router(分档 token 账本、节省估算、误路由标记)。
  • 宿主接入点与 auto 掩码模式参考 dsh-thinking-levels(agent/request prepend 瀑布、模型目录注入)。
  • GLM-5.3 档位约束来自智谱官方文档。

已知限制

  • 账本采集发生在下一次 agent/request:一轮的最后一个 assistant 步骤要等下一轮请求才入库(中断的轮次可能缺usage记录)。
  • 启发式回退是保守的长度+关键词规则,中文为主;MiniMax 后端可用时不参与定档。
  • 报表 CLI 只读本地 JSONL,不消耗 API。

License

MIT