9Router:自带省 Token 神器的智能 LLM 代理
认识 9Router——一个开源智能代理,通过 RTK 压缩省下 20-40% 的 token,自动在 40+ 服务商之间故障转移,支持零成本编程组合。
- ⭐ 20625
- Docker
- Go
- Java
- JavaScript
- Rust
- TypeScript
- MIT
- 更新于 2026-05-15
Headroom:压缩 LLM 输入 60-95% • Mastra:24K+ Star——省 Token 的 TypeScript AI 框架
AI 编程助手的革命给开发者带来了一个悖论:我们通过 Claude Code、OpenAI Codex、Cursor 和 GitHub Copilot 这类工具,获得了前所未有的世界级语言模型访问权限——但在多个平台之间管理订阅、配额和速率限制正变得越来越昂贵、越来越让人烦躁。很多开发者会发现自己两周内就把 Claude Pro 的月度配额烧光了,冲刺截止日期临近时却只能盯着速率限制的墙发呆。
9Router 登场了——一个开源的智能代理和 token 管理系统,彻底消除了这个痛点。凭借超过 6,900 个 GitHub Star、1,200+ Fork 和迅猛的社区增长,9Router 已经成为想要获得最大 AI 能力、又不想为不必要的高级套餐买单的开发者的首选方案。它基于 Node.js 20+、Next.js 16 和 React 19 构建,提供一个统一界面,用智能故障转移逻辑和强大的省 token 压缩,把你的 AI 编程请求路由到 40+ 服务商。

9Router 是什么?怎么工作的? #
9Router 是一个本地托管的中间服务(默认跑在 localhost:20128),架在你的 AI 编程工具和底层模型服务商之间。你的工具不会把 API 请求直接发给 Claude、OpenAI 或任何单一服务商,而是和 9Router 对话——由它智能决定把请求路由到哪个后端服务商。
这套架构给你带来三大优势:
- 一处配置,多服务商接入:在一个仪表盘里配置 Claude、Gemini、GLM、MiniMax、Kiro、OpenCode、Vertex AI 等 40 多个服务商。你的 CLI 工具把请求发到 localhost,剩下的交给 9Router。
- 自动故障转移:当你的主力服务商配额用尽或宕机时,9Router 会无缝切换到下一档——不管是便宜的备用服务商,还是完全免费的选项。你的工作流零中断。
- 请求离开你机器之前先压缩 token:通过和 RTK(约 4 万 Star)集成,9Router 会在工具输出(git diff、grep 结果、目录列表、日志转储)到达 LLM 之前先压缩它们。仅这一项就能给每次请求省下 20-40% 的输入 token。
9Router 的核心差异化功能 #
🚀 RTK Token 压缩引擎 #
工具输出经常占到你总 prompt 预算的 30-50%。当 Claude Code 在大代码库里跑 git diff、ls -R 或 grep 时,它会把几兆字节的文本发给模型——其中很大一部分都是无关噪音。
9Router 内置的 RTK 集成会自动识别这些工具输出,并应用智能、无损的压缩过滤器:
- git-diff:把 diff 输出精简到核心改动行
- git-status:把状态压缩成摘要格式
- grep / find:剔除不相关的匹配项,保留上下文丰富的行
- tree / ls:有意义地折叠目录结构
- dedup-log:去除连续重复的日志条目
- smart-truncate:保留首尾,去掉冗余的中间部分
关键的是,如果某个过滤器失败,或者产出的结果比原文还差,RTK 会静默回退到未修改的原始文本。出错永远不会打断你的请求。压缩发生在格式转换之前,所以它能通用地适配所有支持的格式(OpenAI、Claude、Gemini、Cursor、Kiro、OpenAI Responses)。
不用 RTK:发给 LLM 4.7 万 token
用了 RTK:发给 LLM 2.8 万 token(省 40%,答案质量不变)
实践中,开发者反馈每一次请求都能省下 20-40% 的 token——相当于把每份订阅的可用寿命延长了几天甚至几周。
🪨 Caveman 模式(输出压缩) #
除了输入优化,9Router 还会减少 LLM 返回的内容。通过注入一个"穴居人风格"的系统提示词(灵感来自约 5.2 万 Star 的 Caveman),9Router 会让模型用更简洁的方式回答——保留全部技术实质内容,去掉闲聊式的填充语。
这最多能省下 65% 的输出 token。对于复杂重构任务或长代码生成会话,这些节省会在成百上千次 API 调用中迅速累积。
🎯 智能三档故障转移系统 #
这大概是 9Router 最厉害的功能。你定义"组合"——按不同价格档位排列的模型列表——9Router 会自动据此路由请求:
组合:"我的编程栈"
1. cc/claude-opus-4-6 → 你的 Claude Code Pro 订阅
2. glm/glm-4.7 → 便宜的备用(每百万 token 0.6 美元)
3. kr/claude-sonnet-4.5 → 通过 Kiro AI 的免费应急兜底
当 Opus 配额用尽(或出错时),9Router 会立刻切换到 GLM。如果 GLM 也用完了,就降级到 Kiro 的免费无限量档位。你永远不会撞墙。
这套系统支持五个不同的价格层级:
| 档位 | 服务商 | 典型成本 | 重置规律 |
|---|---|---|---|
| 订阅制 | Claude Code, Codex, Copilot, Cursor | 每月 10-200 美元 | 5小时滚动 + 每周/每月 |
| 便宜档 | GLM-5.1, MiniMax M2.7, Kimi K2.5 | 每百万 token 0.2-0.6 美元 | 每日/滚动/固定月度 |
| 免费档 | Kiro AI, OpenCode Free, Vertex AI | 0 美元 | 无限量 |
📊 实时配额追踪与分析 #
网页仪表盘展示每个服务商的实时 token 消耗、重置倒计时(5小时、每日、每周、每月),以及预估成本追踪。虽然仪表盘把"费用"显示为一个参照对比工具——9Router 本身是免费软件,永远不收费——但这些分析能帮你理解用量模式、优化开支。
如果你用着 Kiro 的免费档位,仪表盘却显示"总费用 290 美元",那 290 美元代表的是如果你直接用那些付费 API 本该花的钱。你实际的支付金额始终是 0 美元。它本质上是一个省钱追踪器,告诉你正在省下多少钱。
🔄 跨所有主流协议的格式转换 #
9Router 在 OpenAI、Claude、Gemini、Cursor、Kiro、Vertex AI、Antigravity、Ollama 和 OpenAI Responses 格式之间透明转换。你的 CLI 工具发送标准的 OpenAI 兼容请求体;9Router 把它转换成每个服务商各自期望的原生格式。这意味着任何支持自定义 OpenAI 端点的工具都能接入任意后端服务商。
👥 多账号支持 #
需要跨账号负载均衡或冗余备份?9Router 允许你为每个服务商添加多个账号,支持自动轮询分发或按优先级路由。如果某个账号触及配额,请求会自动转移到下一个可用账号。OAuth token 会自动刷新,省去手动重新认证的麻烦。
💾 云端同步 #
通过加密云存储,把你的整套配置——服务商、组合、别名、设置——在多台设备间同步。在本地机器上配好你的完美组合,然后在你的 VPS、Docker 部署或队友的工作站上访问同一份配置。
支持的编程工具和 IDE #
9Router 充当一个通用适配器,几乎支持所有主流 AI 编程工具:
- Claude Code(
~/.claude/config.json自定义 API base) - OpenAI Codex CLI(环境变量覆盖)
- Cursor IDE(自定义 OpenAI 端点设置)
- GitHub Copilot
- OpenClaw(WhatsApp、Telegram、Slack 消息)
- Cline
- Continue
- Roo Code
- Antigravity
- Droid
- Kilo Code
- OpenCode
任何支持自定义 OpenAI 兼容 API 端点的工具都能接入 9Router。这个服务在 http://localhost:20128/v1 暴露一个标准的 OpenAI 兼容接口。
快速上手:安装与配置 #
快速开始:本地部署(大多数用户推荐) #
# 克隆并安装
git clone https://github.com/decolua/9router.git
cd 9router
npm install
npm run build
# 可选的环境变量配置
export JWT_SECRET="your-secure-secret-change-this"
export INITIAL_PASSWORD="your-dashboard-password"
export PORT="20128"
export NODE_ENV="production"
# 启动服务
npm run start
启动后,打开 http://localhost:20128 访问网页仪表盘,从那里开始连接你的第一个服务商。
Docker 部署 #
对于生产环境或多设备场景,Docker 让部署变得毫不费力:
docker build -t 9router .
docker run -d \
--name 9router \
-p 20128:20128 \
--env-file ./.env \
-v 9router-data:/app/data \
-v 9router-usage:/root/.9router \
9router
接入你的第一个服务商 #
来搭建一套完全免费档位的组合——不需要任何支付方式:
- 在仪表盘里连接 Kiro AI(用 AWS Builder ID、Google 或 GitHub OAuth——不需要 API key)
- 连接 OpenCode Free(零认证,直通代理,自动拉取模型列表)
- 创建一个组合,命名为
free-dev,包含以下模型:kr/claude-sonnet-4.5(通过 Kiro 使用的 Claude Sonnet 4.5——免费无限量)kr/glm-5(通过 Kiro 使用的 GLM-5——免费无限量)vertex/gemini-3.1-pro-preview(Google Cloud——300 美元免费额度)
然后把你常用的工具指向 http://localhost:20128/v1,配上你的仪表盘 API key:
{
"anthropic_api_base": "http://localhost:20128/v1",
"anthropic_api_key": "your-9router-api-key"
}
配置 Cursor IDE #
在 Cursor 设置 → Models → Advanced 里:
OpenAI API Base URL: http://localhost:20128/v1
OpenAI API Key: [从 9Router 仪表盘复制]
Model: cc/claude-opus-4-7
现在 Cursor 发出的每一次模型调用都会经过 9Router 的智能路由。
真实使用场景 #
场景 A:最大化利用你现有的订阅 #
你每月花 20 美元订阅 Claude Pro。没有 9Router 的话,配额一用完就得等重置,没法继续写代码。
用上 9Router 的"maximize-claude"组合后:
- 主力:
cc/claude-opus-4-7(用满整个订阅额度) - 备用:
glm/glm-5.1(每百万 token 0.6 美元,每天上午 10 点重置) - 应急:
kr/claude-sonnet-4.5(Kiro 免费兜底)
结果:因为 RTK 省下了 20-40% 的 token,你的 20 美元订阅能用得更久;一旦真的用完,还有无缝的备用方案。整体有效成本大约只多了 5 美元的便宜档费用——比升级到 Claude Max(每月 200 美元)便宜太多。
场景 B:彻底的零月费预算 #
从 100% 免费模型开始:
gc/gemini-3-flash(Google 每月 18 万次免费查询)kr/claude-sonnet-4.5(Kiro 免费无限量)oc/<auto>(OpenCode Free,无需认证)
配合 RTK 压缩,这套配置能在字面意义上零月费的情况下,交付生产级质量的模型响应。
场景 C:不间断的 24/7 开发 #
对于赶deadline的团队和自由职业者,可以叠五档故障转移:
- Claude Opus(顶级质量)
- 通过 Codex 使用的 GPT-5.5(第二份订阅)
- GLM-5.1(便宜、每日重置)
- MiniMax M2.7(最便宜,每百万 token 0.2 美元,5小时滚动重置)
- Kiro 上的 Claude Sonnet 4.5(免费无限量)
五层保障能确保无论配额耗尽还是服务商宕机,都零停机。
价格透明度:这东西实际要花多少钱? #
评估 9Router 的人都会关心一个关键问题:9Router 会收我钱吗? 不会,永远不会。
实际的经济模式是这样的:
- 9Router 软件本身 = 永久免费(MIT 开源协议,跑在你自己的硬件上)
- 仪表盘上的费用 = 仅供展示/追踪(不是真正的账单)
- 你直接向服务商付费(订阅、API key,随你怎么配置)
- 免费服务商始终免费(Kiro AI、OpenCode Free、Vertex AI 额度)
9Router 纯粹是一个跑在你自己电脑上的本地代理路由器。它拿不到你的信用卡信息,生成不了发票,也没有任何计费系统。它只是转发请求,并可选地压缩 token。
仪表盘上的费用显示相当于一个"省钱追踪器"——展示的是如果你直接用付费 API,同等用量本该花多少钱。如果你全部配置成免费服务商,显示的费用可能是"290 美元",而你实际的银行流水是 0 美元。那 290 美元就是你实实在在省下来的钱。
9Router 与其他方案对比 #
9Router 和现有方案比怎么样?
| 功能 | 9Router | 直连服务商 | 其他代理工具 |
|---|---|---|---|
| 智能故障转移路由 | ✅ 自动 3+ 档 | ❌ 单一服务商 | 部分支持 |
| Token 压缩 (RTK) | ✅ 内置 | ❌ 无 | 很少见 |
| 多格式转换 | ✅ 8+ 种协议 | 不适用 | 有限 |
| 多账号轮换 | ✅ 轮询 | ❌ 手动 | 手动 |
| 免费服务商支持 | ✅ Kiro, OpenCode, Vertex | ❌ 不适用 | 通常不支持 |
| 实时分析 | ✅ 仪表盘 + 日志 | ❌ 服务商自己的后台 | 基础功能 |
| 自托管 | ✅ 完全掌控 | 不适用 | 因工具而异 |
| 成本 | 软件免费 + 服务商成本 | 全额服务商价格 | 通常收费 |
值得一提的主要替代方案是 OmniRoute,一个 9Router 的 TypeScript 分叉版本,追加了 36+ 服务商、四档自动故障转移、多模态 API(图像、嵌入、音频、TTS)、断路器模式、语义缓存、LLM 评估工具,以及带 368+ 单元测试的精致仪表盘。OmniRoute 通过 npm 和 Docker 提供,适合想要超出 9Router 核心功能集之外能力的用户。
为什么 9Router 现在很重要 #
我们正处在 AI 编程工具的黄金时代,但经济现实还没跟上。每个主流服务商都各自用付费墙、配额限制和速率上限把访问权限锁起来。在 Claude、OpenAI、Google、Anthropic、DeepSeek 和 xAI 之间管理六份不同的订阅,既造成财务负担,也带来运维复杂度。
9Router 把所有这些服务商当作可互换的商品,通过一个统一的智能层来路由,从而解决了这个问题。你能为每个任务拿到最合适的模型,为日常任务拿到最便宜的路径,配额耗尽时还能保证可用性——同时在 token 浪费离开你的机器之前就先把它压缩掉。
RTK token 压缩(省约 20-40%)、Caveman 模式输出压缩(省约 65%),加上智能多档故障转移,三者组合会产生复利效应。每天调用 500 次以上的开发者反馈,实际模型消耗下降了 40-60%,把一套每月 200 美元的 AI 技术栈变成每月 20-30 美元就能维持的水平。
技术架构亮点 #
9Router 构建在一套为可靠性优化的现代 JavaScript 技术栈上:
- 运行时:Node.js 20+,提供稳定高性能的异步 I/O
- 框架:Next.js 16 搭配 React 19 构建网页仪表盘
- 数据库:LowDB(基于 JSON 文件)——简单、可移植、可纳入版本控制的配置
- 流式传输:Server-Sent Events (SSE) 实现实时进度反馈
- 认证:带 PKCE 的 OAuth 2.0、JWT 会话 Cookie、HMAC 签名的 API key
- 代理:完整的 HTTP 直通,支持可配置的上游代理
环境变量提供细粒度的部署控制:
JWT_SECRET:生产环境务必修改以保证安全REQUIRE_API_KEY:在/v1/*路由上强制 Bearer token 认证ENABLE_REQUEST_LOGS:开启调试级别的请求/响应日志AUTH_COOKIE_SECURE:在 HTTPS 反向代理背后强制 Secure Cookie 标志HTTP_PROXY/HTTPS_PROXY:让上游请求走企业代理
这个服务默认监听 20128 端口,除了存储在 ${DATA_DIR} 里的 JSON 文件外,不需要任何外部依赖或数据库。
最后的思考 #
随着 AI 工具订阅数量不断增加,9Router 解决的是一个越来越多开发者能真切感受到的痛点。9Router 没有把不断上涨的成本和任意的速率限制当作 AI 辅助开发不可避免的代价来接受,而是反其道而行之:用好你已经拥有的服务商,用便宜或免费的替代方案补齐缺口,尽可能压缩一切,无论配额状态如何都保持连续的编程节奏。
对于预算紧张的独立开发者,“免费优先"策略能以恰好 0 美元的成本,交付功能完整的 AI 编程辅助。对于愿意投资高级订阅的团队,token 压缩和智能路由能最大化每一分钱的投资回报率。
它免费、开源,几分钟就能自托管起来。按当前 AI 工具定价的走势来看,把 9Router 加进你的开发基础设施,可能不仅仅是有用——而是正在变得必不可少。
仓库:github.com/decolua/9router 网站:9router.com
相关文章 #
Anthropic 金融服务:AI 驱动的 Claude 代理
Addy Osmani 的 Agent Skills:生产级 AI 编程代理
推荐工具 #
对于正在构建或部署开源 AI 工具的开发者,我们推荐:
- DigitalOcean — 新用户 200 美元免费额度,覆盖 14+ 全球区域,一键式 GPU/CPU Droplet,非常适合 AI 负载。
- Shiyunapi Claude API — Anthropic Claude / OpenAI / DeepSeek API 代理。单个 key 就能以官方定价约 30% 的成本访问多个顶级模型;在对比模型或你所在地区直连 API 被限速时特别好用。
联盟链接——你不用多花一分钱,还能支持 dibi8.com 运营。
💬 留言讨论