本地网关白嫖19个免费模型,实测2秒响应,跑通CC Switch

先说结论:我在 Windows 上部署了一个本地网关,把几家还能白嫖的大模型收拢到一个接口里。

实测请求 2 秒返回,已经接入 CC Switch,Codex 成功调用

它是干嘛的

你不用再记哪家模型当前免费、哪家限流。

客户端只填一个地址、一个模型名 free-best,它自动切换;这家挂了换下一家,一个不行就换下一个模型。

基于 Node.js 实现,零第三方依赖,拉下来不用装任何包。

本地网关把各家免费模型汇成一个统一接口

实测结果

装完发最普通的请求,返回如下:

HTTP/1.1 200 OK X-Free-Router-Provider: bai X-Free-Router-Model: qwen3.8-flash

一次请求进来,网关挑中可用的免费模型并返回

连测三次,耗时 2.0 到 2.4 秒

响应头 X-Free-Router-Provider 和 X-Free-Router-Model 直接标明上游与模型,不用猜。

加进 CC Switch provider 列表后,切换跑 Codex,调用成功。这是关键一步,不是理论上能用,是真正跑起来了。

CC Switch 里已能选到 free-best 模型

💡 接入 CC Switch 填四项:地址 http://127.0.0.1:8787/v1(别多写路径会 404);密钥任意非空字符串(不校验);接口格式选 OpenAI;模型名 free-best

怎么装,三步

嫌敲命令麻烦,可让 Codex 或 Claude 智能体自动拉代码、填 key、起服务并配好 CC Switch,打开切过去就能用。下面三步留给想自己动手的人。

1. 去 github.com/www222fff/free-router 拉代码,Node 20 以上即可。

2. 把你的 key 填进 .env,至少填一个,留空会自动跳过不报错。

3. 启动并检查健康接口:

cd free-router
node server.mjs
curl http://127.0.0.1:8787/health

💡 别把监听地址改成 0.0.0.0,该网关不校验调用方身份,绑到局域网等于把 key 开放出去。

把安装配置丢给智能体,它装好网关并配好 CC Switch,你打开即用

三个坑,我都踩了

现象 原因 对策
请求全部失败 上游域名没列进代理白名单,直连不算“DNS 失败”不触发降级 将几个上游域名显式加进配置 socksFirstHosts
隔三差五报 TLS 握手失败 Windows 自带 curl 走代理偶发抖动,纯随机 把单次超时从 45 秒压到 20 秒,让失败快点跳过
提示余额不足 该模型对这个账户要按量计费,免费是活动制 换个模型,或补一点额度

第二条单独说:改完超时,实测延迟从 32 秒掉到 2 秒出头。

原因很朴素:失败的候选会烧满整个超时时间才换下一个,超时越长,等得越久。

顺便多说两句

1. 补一个 OpenRouter 的 key,能解锁那十几个免费开源模型。额度是每天 50 次,一次性充 10 美元后涨到每天 1000 次,每分钟上限 20 次。

2. 免费档是限额度,不是无限。真要跑量还得掏钱,心态先摆正。

3. 目前只支持 OpenAI 那套接口协议,走别的协议的客户端暂时接不上。

4. 说白了:平时玩玩、薅薅羊毛还行。免费模型总在重试、换模型,偶尔连不上。真要干活、要稳定出活,直接上付费的才是正路。

FAQ

本地网关支持哪些模型?

支持 19 个当前有免费额度或可通过 OpenRouter 调用的模型,客户端统一填 free-best 自动选择可用上游。

CC Switch 接入后 Codex 能直接调用吗?

能。填入地址 http://127.0.0.1:8787/v1、任意非空密钥、选择 OpenAI 接口格式和 free-best 模型名,实测调用成功。

免费额度有没有限制?

OpenRouter 免费档每天 50 次,充值 10 美元后每天 1000 次,每分钟上限 20 次;其他上游免费额度按活动制,可能随时变动。

转自:https://mp.weixin.qq.com/s/KVGFHlEUg7XMqP8XrgcV6g