dsh-our-free-model - 在 dsh 里免配置挂载免费前沿模型的插件
dsh-our-free-model 是维护者 zouyuxuan122 发布的一个 dsh 插件,项目自述其目标是让用户无需登录、注册或填写 API Key,装完即可调用上游网关提供的前沿模型。插件采用纯挂载方式,不改内核、无构建步骤,另附本地 OpenAI 兼容转发端口与本机用量看板。
dsh-our-free-model 是一个面向 dsh 的插件项目,由维护者 zouyuxuan122 发布在 GitHub 上。按项目自述,它的目标是省掉模型接入里最繁琐的那一段:用户只需在 dsh 中装上这个插件,不需要登录、注册、填写 API Key 或做其它操作,就能使用上游网关提供的前沿模型。它适合已经在使用 dsh、希望以插件方式接入模型而不想自己管理凭据与配置的用户,也适合想把本机模型能力再转发给其它本地工具的人。需要说明的是,以下关于功能与用法的描述均来自项目自述(README),并非第三方实测结论。
维护者与状态
该仓库由 zouyuxuan122 维护,创建时间为 2026-09-24,最后一次提交在 2026-10-01。最新 release 为 v1.3.1,发布于 2026-09-27。截至 2026-10-01,仓库星标数为 569。许可证为 MIT。
从时间线看,这是一个创建后一周左右就迭代到 v1.3.1 的项目,提交与发布都相当密集。README 中记录了多处针对内核行为的适配细节与一次围绕长思考截断的恢复机制(issue #12),可以看出维护者把不少精力放在与宿主环境的兼容性上。
主要能力
据项目说明,插件的能力大致可以分成几块:
- 装完即用:不需要账号、不需要 Key、不需要去后台开配额。上游来源在 README 中被写明为 OpenCode 的 Zen 网关,项目自述不经任何第三方中转。
- 模型清单跟随上游刷新:模型集合、上下文长度与能力每次刷新重新拉取,而不是写死在插件里的一份快照。上游清单点名但网关明确拒绝路由的模型会从下拉框移除,只在设置页留痕并写明拒因;网关自身的 5xx、429 或超时断网不被当作对模型的判定,地区门拦截的模型单独归入 region-limited 分组。
- 思考强度按输出预算下发:Light / Balanced / Deep 三档对应不同的输出 token 预算,且逐次调用留痕。项目自述其理由是实测发现向上游发送 reasoning-effort 字符串是空操作,因此改为硬性输出上限。
- 公告中心与实时推送:仓库主人在仓库里编辑 JSON 并推送,安装端在一个轮询周期内收到;内容按白名单渲染 HTML,urgent 级别会全屏弹窗,另可选系统级通知。
- 应用内升级与热重载:设置页一键升级,流程为下载、SHA-256 校验、备份、原子替换、校验回读、热重载,任一步失败自动回滚;升级与代码更新即时生效,无需重启应用。
- 本机用量看板:Token 热力图、总量曲线、输出速度与首字延迟逐次采样,项目自述不上传任何数据。
- OpenAI 兼容转发端口:本机其它工具用一个 base URL 加 Key 即可调用这些模型,支持
GET /v1/models、POST /v1/chat/completions(流式与非流式)以及POST /v1/responses。 - 无浏览器界面也能跑:插件只把
llm当作硬依赖,在没有 web server 的 composition 里照样启动、照样出模型。
README 还提到一项针对长思考截断的有界恢复机制:当第一段只有非空思考、没有正文或工具调用,且上游未给正常结束帧就关闭流时,插件会把已收到的思考作为检查点文本,与原始输入一起发起一个新请求,要求直接整理回答。项目自述这不是上游原生 resume,恢复段会关闭工具调用,且属于降级回答,原要求的长篇或逐步分析可能被简化。
使用入口
仓库地址:zouyuxuan122/dsh-our-free-model。
据项目说明,命令行安装方式为在纯 dsh web 环境下执行插件添加命令,指向插件的绝对路径,装完重启一次应用,--profile 填实际使用的那个。README 特别提示桌面端不要用 link: 依赖安装、也不要建 junction,因为桌面端启动前的 profile 闸门只放行 dsh 自己在 .dsh-module-fallback 下生成的链接,出现其它符号链接或目录 junction 会直接拒绝启动;手工安装应以真实目录复制发布文件,并在 dependencies 中写明确版本号、在 dsh.profile.bundles 末尾追加包名,同时不要再往 cordis.patch.yml 里加条目,否则会报重复的 loader entry id。
使用上,模型通过输入框的模型选择器选取,选择按会话持久;思考强度在同一菜单的 Effort 项调整。若要让其它本地工具调用,可在设置页的本地转发分区启用监听、复制 base URL 并生成 Key。
许可与限制
许可证为 MIT。
限制与前置条件方面,README 中写明了几点:桌面端安装受 profile 闸门约束,不能使用符号链接或 junction;整合包托管安装时,由安装方负责更新时机与字节,此时插件的应用内升级、公告 feed 与热重载会全部停用,模型 lane 不受影响;安装过程中若出现 ERR_PNPM_VIRTUAL_STORE_DIR_MAX_LENGTH_DIFF,项目自述这是目标 profile 的 pnpm 状态问题、与插件仓库无关,需要删除 profile 的 node_modules 与 pnpm-lock.yaml 让其重建后重新安装。此外,长思考截断后的恢复机制属于降级回答,恢复提示中「结论优先、最多 800 词」是提示约束而非硬性 token 限制,模型可能不遵守;每个逻辑回合最多两次物理请求,默认总时限 480 秒,恢复段最多 180 秒。