再见CC Switch,我找到了一款连API都不用申请的Agent配置管理助手

想用Agent,第一步就卡在"填表"

养虾、养马、玩Codex的人,大概率都有过这种经历:想给它们接上大模型,第一件事就是填表申请API


你要先去模型厂商的官网注册账号,做实名认证,翻出"申请 API"的入口,等审核,拿到一长串 API Key,再复制回来、配进环境变量、改配置文件。一套流程走完,半天可能就过去了。
这还算好的。如果你用的是 Codex 这类客户端,还会撞上另一道坎——手机号验证,还得是海外手机号
我不是不想用 先进生产力,是被"接入"这第一步,反复劝退。

CC Switch:解决了一部分,但没解决全部

后来看网上教程,我试了 CC Switch。它确实往前走了一步——把多个模型供应商收拢到一个入口,你不用再给每个 Agent 单独折腾配置,切换模型也方便了不少。


但它没解决最烦的那件事:API Key 还是得你自己去模型厂商申请。
CC Switch 帮你"管"通道,可通道的钥匙(API Key)要你亲自去各家官网注册、实名、等审核、复制回来。繁琐没有消失,只是从"每个客户端配一遍"变成了"每个厂商申请一遍"。本质上,你依然被困在厂商的 API 申请流程里。
一句话:CC Switch 把通道收拢了,但钥匙还得自己配。


直到我遇到 Token Router

三、Token Router 是什么:装在你电脑上的 AI 路由网关

Token Router 是 FlowyAIPC 推出的一款本地 AI 模型路由网关——就是你电脑上的"AI 流量调度中心"。
项目地址:https://flowyaipc.cn/login?inviteCode=9D5VV8FY
它只干一件事:让你的所有 Agent 共用一个入口,把每个任务自动分给"最合适、最便宜"的模型去算。
它的底层是 端云协同架构,一句话概括就是:云端做大脑,本地做小脑。
· 本地小脑 = 本地模型。端侧那些能独立完成的轻量任务,用你电脑上的本地模型直接跑。本地模型通过 Herdsman(牧马人)本地推理引擎快速部署启动,起来之后在 Token Router 里点一下就能配置使用——不联网也能跑,响应快、零云端 Token。


· 云端大脑 = 云端模型。复杂推理、长链条规划交给云端。云端模型由 FlowyAIPC 直接提供,覆盖 GLM 系列、千问(Qwen)系列、DeepSeek 系列、MiniMax 系列等国内常用大模型。你不用一家家去申请,这些在 Token Router 里现成可用。


它解决了三件我最在意的事:
1. 免申请 API,一键就能用。Token Router 已经托管了各家模型厂商的接入通道与密钥。你想接入 Codex、Claude Code、WorkBuddy、OpenClaw 这些客户端,唯一要做的,就是点一下「一键配置」。网关地址自动写进客户端,登录和调用全自动。


2. 省 Token,成本最高降 80%。简单任务(改格式、翻译、生成正则)全留在本地小模型,0 云端 Token;复杂任务才上云;重复请求走缓存。三重叠加,云端 Token 成本最高降 80%。


3. 快速配置,1 分钟上手。装好、选模式、点配置,结束。没有命令行,没有改配置文件的痛苦。
而且它不是"省了就完事",还把控制权交回你手里:
· 配额限制:云端模型可以设用量上限,超过设定的云端 Token 使用量就自动暂停,相当于一道成本护栏,再也不怕账单爆掉。


· 日志可追溯:Token Router 的日志能清楚看到,你的每一个问题,到底用的是端侧模型还是云端模型。省得明白,也控得住。

实操演示:用 Token Router 把大模型接入 Codex

光说没用,我把亲自接 Codex 的过程走一遍,把Codex的安装、配置,使用全过程进行详细教学。
前置准备
一台 Windows 系统的电脑,配置没有要求,不需要魔法
步骤 1:打开微软商店安装ChatGPT(原Codex)
打开微软商店搜索chatgpt


安装完成后,打开


步骤 2:API验证登录,进入ChatGPT首页
到了这一步,大家会经常被手机号验证以及API验证两种登录方式“吓跑”,但其实API登录你是可以随便写串数字就可以完成登录的,点击 [Sign in another way]


步骤 3:下载Token Router并进行安装
访问Token Router下载页面(下载地址:https://flowyaipc.cn/token-router),下载好以后,傻瓜式安装即可


步骤 4:一键配置 Codex
启动 Token Router,路由策略默认智能即可,在运行界面选择Codex一键配置


所有的token消耗以及对话日志都可以在Token Router进行查看
步骤 5:部署本地模型(如果你的硬件配置一般,忽略这一步)
如果你的硬件配置比较好,想用本地模型,也可以通过Token Router+Herdsman快速完成配置,只需要打开herdsman牧马人本地推理引擎部署一个多模态的本地模型,以Qwen3.6-35B-A3B为例,在Herdsman部署并启动


然后打开Token Router的端侧配置界面,便可以看到Herdsman模型列表,点击该模型,便可以完成本地模型配置


你可以把路由策略设置为端侧,这样就完全不消耗云端模型的token,所有任务都用本地模型,但是体验会差一点,我也是成功在ChatGPT用本地模型实现了文生视频

把钥匙也替你管了

大家经常被Agent劝退,不是因为不好用,而是"接入"这道门槛就有点磨人:申请 API、手机号验证、反复配置。
CC Switch 把通道收拢了,但钥匙还得自己配;Token Router 连钥匙都替你管了——本地模型用牧马人引擎快速起,云端模型在 FlowyAIPC 里现成挑,配额和日志把成本看得死死的。

转自:https://mp.weixin.qq.com/s/QQKH-HJ6PyHHIUsaqUpcBg