面向Google编程CHARLES ZHANG

AI DAILY / 2026-09-27

dsh-our-free-model:免登录免 Key 调用前沿模型

zouyuxuan122/dsh-our-free-model

Agent 开发GitHub · 2026-09-24

中文翻译暂未生成,以下为原文节选。

对应输出 token 预算 2 048 / 8 192 / 模型上限,且逐次调用留痕。思考关不掉的模型(MiMo V2.6 这类)三档整体翻倍为 4 096 / 16 384 / 模型上限,因为思考与正文抢的是同一份额度;设置页每张模型卡都直接印出这一档实际会下发的上限。它不是把一个 effort 字符串丢给上游然后假装有用(原因见为什么用预算而不是 reasoning_effort)。 无浏览器界面也能跑——插件只把llm当作硬依赖,没有 web server 的 composition(dsh-tui这类)里照样启动、照样出模型;看板半身挂在一条自己的 fiber 上,等webServer出现再挂载,所以既不会把模型车道拖下水,也不会因为插件先于 web 服务加载就永远丢掉设置页。 用量看板,全部留在本机——Token 热力图、总量曲线(可看总计或单个模型)、输出速度与首字延迟逐次采样。不上传任何东西。 OpenAI 兼容转发端口——本机其它工具用一个 base URL + Key 就能调用这些模型。 接口有鉴权围栏——插件的 HTTP 路由优先级高于内核/api,因此自带与内核一致的信任检查(优先复用 composition 的 connection 服务,缺失时退回结构化围栏)。 你会看到什么输入框的模型选择器分组内容Our Free Model当前网络出口可直接使用的模型Our Free Model · region-limited上游对该地区不放行的模型,保留可见但单独隔离被判定为「点名但不路由」的模型不出现在任何分组里——它们只在设置页的不在选择器中分组留痕,带上拒因与探测时间,某一次探测重新通过后会自动回到选择器。 设置页设置 → Our Free Model,六个分区: 模型清单——每个模型的可用性、视觉还是纯文本、上下文窗口、最长输出、各思考档位实际下发的输出上限、实测首字延迟,以及一次单调用基准测试按钮。 公告中心——仓库主人推送的公告流:未读计数、紧急徽章、单条/全部已读、检查新公告按钮、系统通知开关。公告正文按白名单渲染 HTML。 用量看板—