9Router:自带省 Token 神器的智能 LLM 代理

认识 9Router——一个开源智能代理,通过 RTK 压缩省下 20-40% 的 token,自动在 40+ 服务商之间故障转移,支持零成本编程组合。

  • ⭐ 20625
  • Docker
  • Go
  • Java
  • JavaScript
  • Rust
  • TypeScript
  • MIT
  • 更新于 2026-05-15

Headroom:压缩 LLM 输入 60-95%Mastra:24K+ Star——省 Token 的 TypeScript AI 框架

AI 编程助手的革命给开发者带来了一个悖论:我们通过 Claude Code、OpenAI Codex、Cursor 和 GitHub Copilot 这类工具,获得了前所未有的世界级语言模型访问权限——但在多个平台之间管理订阅、配额和速率限制正变得越来越昂贵、越来越让人烦躁。很多开发者会发现自己两周内就把 Claude Pro 的月度配额烧光了,冲刺截止日期临近时却只能盯着速率限制的墙发呆。

9Router 登场了——一个开源的智能代理和 token 管理系统,彻底消除了这个痛点。凭借超过 6,900 个 GitHub Star、1,200+ Fork 和迅猛的社区增长,9Router 已经成为想要获得最大 AI 能力、又不想为不必要的高级套餐买单的开发者的首选方案。它基于 Node.js 20+、Next.js 16 和 React 19 构建,提供一个统一界面,用智能故障转移逻辑和强大的省 token 压缩,把你的 AI 编程请求路由到 40+ 服务商。

9Router:自带省 Token 神器的智能 LLM 代理 — 砍掉 60% AI 成本,再也不用担心撞速率限制 — dibi8.com

9Router 是什么?怎么工作的? #

9Router 是一个本地托管的中间服务(默认跑在 localhost:20128),架在你的 AI 编程工具和底层模型服务商之间。你的工具不会把 API 请求直接发给 Claude、OpenAI 或任何单一服务商,而是和 9Router 对话——由它智能决定把请求路由到哪个后端服务商。

这套架构给你带来三大优势:

  1. 一处配置,多服务商接入:在一个仪表盘里配置 Claude、Gemini、GLM、MiniMax、Kiro、OpenCode、Vertex AI 等 40 多个服务商。你的 CLI 工具把请求发到 localhost,剩下的交给 9Router。
  2. 自动故障转移:当你的主力服务商配额用尽或宕机时,9Router 会无缝切换到下一档——不管是便宜的备用服务商,还是完全免费的选项。你的工作流零中断。
  3. 请求离开你机器之前先压缩 token:通过和 RTK(约 4 万 Star)集成,9Router 会在工具输出(git diff、grep 结果、目录列表、日志转储)到达 LLM 之前先压缩它们。仅这一项就能给每次请求省下 20-40% 的输入 token。

9Router 的核心差异化功能 #

🚀 RTK Token 压缩引擎 #

工具输出经常占到你总 prompt 预算的 30-50%。当 Claude Code 在大代码库里跑 git diffls -Rgrep 时,它会把几兆字节的文本发给模型——其中很大一部分都是无关噪音。

9Router 内置的 RTK 集成会自动识别这些工具输出,并应用智能、无损的压缩过滤器:

  • git-diff:把 diff 输出精简到核心改动行
  • git-status:把状态压缩成摘要格式
  • grep / find:剔除不相关的匹配项,保留上下文丰富的行
  • tree / ls:有意义地折叠目录结构
  • dedup-log:去除连续重复的日志条目
  • smart-truncate:保留首尾,去掉冗余的中间部分

关键的是,如果某个过滤器失败,或者产出的结果比原文还差,RTK 会静默回退到未修改的原始文本。出错永远不会打断你的请求。压缩发生在格式转换之前,所以它能通用地适配所有支持的格式(OpenAI、Claude、Gemini、Cursor、Kiro、OpenAI Responses)。

不用 RTK:发给 LLM 4.7 万 token
用了 RTK:发给 LLM 2.8 万 token(省 40%,答案质量不变)

实践中,开发者反馈每一次请求都能省下 20-40% 的 token——相当于把每份订阅的可用寿命延长了几天甚至几周。

🪨 Caveman 模式(输出压缩) #

除了输入优化,9Router 还会减少 LLM 返回的内容。通过注入一个"穴居人风格"的系统提示词(灵感来自约 5.2 万 Star 的 Caveman),9Router 会让模型用更简洁的方式回答——保留全部技术实质内容,去掉闲聊式的填充语。

这最多能省下 65% 的输出 token。对于复杂重构任务或长代码生成会话,这些节省会在成百上千次 API 调用中迅速累积。

🎯 智能三档故障转移系统 #

这大概是 9Router 最厉害的功能。你定义"组合"——按不同价格档位排列的模型列表——9Router 会自动据此路由请求:

组合:"我的编程栈"
  1. cc/claude-opus-4-6        → 你的 Claude Code Pro 订阅
  2. glm/glm-4.7               → 便宜的备用(每百万 token 0.6 美元)
  3. kr/claude-sonnet-4.5      → 通过 Kiro AI 的免费应急兜底

当 Opus 配额用尽(或出错时),9Router 会立刻切换到 GLM。如果 GLM 也用完了,就降级到 Kiro 的免费无限量档位。你永远不会撞墙。

这套系统支持五个不同的价格层级:

档位服务商典型成本重置规律
订阅制Claude Code, Codex, Copilot, Cursor每月 10-200 美元5小时滚动 + 每周/每月
便宜档GLM-5.1, MiniMax M2.7, Kimi K2.5每百万 token 0.2-0.6 美元每日/滚动/固定月度
免费档Kiro AI, OpenCode Free, Vertex AI0 美元无限量

📊 实时配额追踪与分析 #

网页仪表盘展示每个服务商的实时 token 消耗、重置倒计时(5小时、每日、每周、每月),以及预估成本追踪。虽然仪表盘把"费用"显示为一个参照对比工具——9Router 本身是免费软件,永远不收费——但这些分析能帮你理解用量模式、优化开支。

如果你用着 Kiro 的免费档位,仪表盘却显示"总费用 290 美元",那 290 美元代表的是如果你直接用那些付费 API 本该花的钱。你实际的支付金额始终是 0 美元。它本质上是一个省钱追踪器,告诉你正在省下多少钱。

🔄 跨所有主流协议的格式转换 #

9Router 在 OpenAI、Claude、Gemini、Cursor、Kiro、Vertex AI、Antigravity、Ollama 和 OpenAI Responses 格式之间透明转换。你的 CLI 工具发送标准的 OpenAI 兼容请求体;9Router 把它转换成每个服务商各自期望的原生格式。这意味着任何支持自定义 OpenAI 端点的工具都能接入任意后端服务商。

👥 多账号支持 #

需要跨账号负载均衡或冗余备份?9Router 允许你为每个服务商添加多个账号,支持自动轮询分发或按优先级路由。如果某个账号触及配额,请求会自动转移到下一个可用账号。OAuth token 会自动刷新,省去手动重新认证的麻烦。

💾 云端同步 #

通过加密云存储,把你的整套配置——服务商、组合、别名、设置——在多台设备间同步。在本地机器上配好你的完美组合,然后在你的 VPS、Docker 部署或队友的工作站上访问同一份配置。

支持的编程工具和 IDE #

9Router 充当一个通用适配器,几乎支持所有主流 AI 编程工具:

  • Claude Code~/.claude/config.json 自定义 API base)
  • OpenAI Codex CLI(环境变量覆盖)
  • Cursor IDE(自定义 OpenAI 端点设置)
  • GitHub Copilot
  • OpenClaw(WhatsApp、Telegram、Slack 消息)
  • Cline
  • Continue
  • Roo Code
  • Antigravity
  • Droid
  • Kilo Code
  • OpenCode

任何支持自定义 OpenAI 兼容 API 端点的工具都能接入 9Router。这个服务在 http://localhost:20128/v1 暴露一个标准的 OpenAI 兼容接口。

快速上手:安装与配置 #

快速开始:本地部署(大多数用户推荐) #

# 克隆并安装
git clone https://github.com/decolua/9router.git
cd 9router
npm install
npm run build

# 可选的环境变量配置
export JWT_SECRET="your-secure-secret-change-this"
export INITIAL_PASSWORD="your-dashboard-password"
export PORT="20128"
export NODE_ENV="production"

# 启动服务
npm run start

启动后,打开 http://localhost:20128 访问网页仪表盘,从那里开始连接你的第一个服务商。

Docker 部署 #

对于生产环境或多设备场景,Docker 让部署变得毫不费力:

docker build -t 9router .

docker run -d \
  --name 9router \
  -p 20128:20128 \
  --env-file ./.env \
  -v 9router-data:/app/data \
  -v 9router-usage:/root/.9router \
  9router

接入你的第一个服务商 #

来搭建一套完全免费档位的组合——不需要任何支付方式:

  1. 在仪表盘里连接 Kiro AI(用 AWS Builder ID、Google 或 GitHub OAuth——不需要 API key)
  2. 连接 OpenCode Free(零认证,直通代理,自动拉取模型列表)
  3. 创建一个组合,命名为 free-dev,包含以下模型:
    • kr/claude-sonnet-4.5(通过 Kiro 使用的 Claude Sonnet 4.5——免费无限量)
    • kr/glm-5(通过 Kiro 使用的 GLM-5——免费无限量)
    • vertex/gemini-3.1-pro-preview(Google Cloud——300 美元免费额度)

然后把你常用的工具指向 http://localhost:20128/v1,配上你的仪表盘 API key:

{
  "anthropic_api_base": "http://localhost:20128/v1",
  "anthropic_api_key": "your-9router-api-key"
}

配置 Cursor IDE #

在 Cursor 设置 → Models → Advanced 里:

OpenAI API Base URL: http://localhost:20128/v1
OpenAI API Key: [从 9Router 仪表盘复制]
Model: cc/claude-opus-4-7

现在 Cursor 发出的每一次模型调用都会经过 9Router 的智能路由。

真实使用场景 #

场景 A:最大化利用你现有的订阅 #

你每月花 20 美元订阅 Claude Pro。没有 9Router 的话,配额一用完就得等重置,没法继续写代码。

用上 9Router 的"maximize-claude"组合后:

  • 主力:cc/claude-opus-4-7(用满整个订阅额度)
  • 备用:glm/glm-5.1(每百万 token 0.6 美元,每天上午 10 点重置)
  • 应急:kr/claude-sonnet-4.5(Kiro 免费兜底)

结果:因为 RTK 省下了 20-40% 的 token,你的 20 美元订阅能用得更久;一旦真的用完,还有无缝的备用方案。整体有效成本大约只多了 5 美元的便宜档费用——比升级到 Claude Max(每月 200 美元)便宜太多。

场景 B:彻底的零月费预算 #

从 100% 免费模型开始:

  • gc/gemini-3-flash(Google 每月 18 万次免费查询)
  • kr/claude-sonnet-4.5(Kiro 免费无限量)
  • oc/<auto>(OpenCode Free,无需认证)

配合 RTK 压缩,这套配置能在字面意义上零月费的情况下,交付生产级质量的模型响应。

场景 C:不间断的 24/7 开发 #

对于赶deadline的团队和自由职业者,可以叠五档故障转移:

  1. Claude Opus(顶级质量)
  2. 通过 Codex 使用的 GPT-5.5(第二份订阅)
  3. GLM-5.1(便宜、每日重置)
  4. MiniMax M2.7(最便宜,每百万 token 0.2 美元,5小时滚动重置)
  5. Kiro 上的 Claude Sonnet 4.5(免费无限量)

五层保障能确保无论配额耗尽还是服务商宕机,都零停机。

价格透明度:这东西实际要花多少钱? #

评估 9Router 的人都会关心一个关键问题:9Router 会收我钱吗? 不会,永远不会。

实际的经济模式是这样的:

  • 9Router 软件本身 = 永久免费(MIT 开源协议,跑在你自己的硬件上)
  • 仪表盘上的费用 = 仅供展示/追踪(不是真正的账单)
  • 你直接向服务商付费(订阅、API key,随你怎么配置)
  • 免费服务商始终免费(Kiro AI、OpenCode Free、Vertex AI 额度)

9Router 纯粹是一个跑在你自己电脑上的本地代理路由器。它拿不到你的信用卡信息,生成不了发票,也没有任何计费系统。它只是转发请求,并可选地压缩 token。

仪表盘上的费用显示相当于一个"省钱追踪器"——展示的是如果你直接用付费 API,同等用量本该花多少钱。如果你全部配置成免费服务商,显示的费用可能是"290 美元",而你实际的银行流水是 0 美元。那 290 美元就是你实实在在省下来的钱。

9Router 与其他方案对比 #

9Router 和现有方案比怎么样?

功能9Router直连服务商其他代理工具
智能故障转移路由✅ 自动 3+ 档❌ 单一服务商部分支持
Token 压缩 (RTK)✅ 内置❌ 无很少见
多格式转换✅ 8+ 种协议不适用有限
多账号轮换✅ 轮询❌ 手动手动
免费服务商支持✅ Kiro, OpenCode, Vertex❌ 不适用通常不支持
实时分析✅ 仪表盘 + 日志❌ 服务商自己的后台基础功能
自托管✅ 完全掌控不适用因工具而异
成本软件免费 + 服务商成本全额服务商价格通常收费

值得一提的主要替代方案是 OmniRoute,一个 9Router 的 TypeScript 分叉版本,追加了 36+ 服务商、四档自动故障转移、多模态 API(图像、嵌入、音频、TTS)、断路器模式、语义缓存、LLM 评估工具,以及带 368+ 单元测试的精致仪表盘。OmniRoute 通过 npm 和 Docker 提供,适合想要超出 9Router 核心功能集之外能力的用户。

为什么 9Router 现在很重要 #

我们正处在 AI 编程工具的黄金时代,但经济现实还没跟上。每个主流服务商都各自用付费墙、配额限制和速率上限把访问权限锁起来。在 Claude、OpenAI、Google、Anthropic、DeepSeek 和 xAI 之间管理六份不同的订阅,既造成财务负担,也带来运维复杂度。

9Router 把所有这些服务商当作可互换的商品,通过一个统一的智能层来路由,从而解决了这个问题。你能为每个任务拿到最合适的模型,为日常任务拿到最便宜的路径,配额耗尽时还能保证可用性——同时在 token 浪费离开你的机器之前就先把它压缩掉。

RTK token 压缩(省约 20-40%)、Caveman 模式输出压缩(省约 65%),加上智能多档故障转移,三者组合会产生复利效应。每天调用 500 次以上的开发者反馈,实际模型消耗下降了 40-60%,把一套每月 200 美元的 AI 技术栈变成每月 20-30 美元就能维持的水平。

技术架构亮点 #

9Router 构建在一套为可靠性优化的现代 JavaScript 技术栈上:

  • 运行时:Node.js 20+,提供稳定高性能的异步 I/O
  • 框架:Next.js 16 搭配 React 19 构建网页仪表盘
  • 数据库:LowDB(基于 JSON 文件)——简单、可移植、可纳入版本控制的配置
  • 流式传输:Server-Sent Events (SSE) 实现实时进度反馈
  • 认证:带 PKCE 的 OAuth 2.0、JWT 会话 Cookie、HMAC 签名的 API key
  • 代理:完整的 HTTP 直通,支持可配置的上游代理

环境变量提供细粒度的部署控制:

  • JWT_SECRET:生产环境务必修改以保证安全
  • REQUIRE_API_KEY:在 /v1/* 路由上强制 Bearer token 认证
  • ENABLE_REQUEST_LOGS:开启调试级别的请求/响应日志
  • AUTH_COOKIE_SECURE:在 HTTPS 反向代理背后强制 Secure Cookie 标志
  • HTTP_PROXY / HTTPS_PROXY:让上游请求走企业代理

这个服务默认监听 20128 端口,除了存储在 ${DATA_DIR} 里的 JSON 文件外,不需要任何外部依赖或数据库。

最后的思考 #

随着 AI 工具订阅数量不断增加,9Router 解决的是一个越来越多开发者能真切感受到的痛点。9Router 没有把不断上涨的成本和任意的速率限制当作 AI 辅助开发不可避免的代价来接受,而是反其道而行之:用好你已经拥有的服务商,用便宜或免费的替代方案补齐缺口,尽可能压缩一切,无论配额状态如何都保持连续的编程节奏。

对于预算紧张的独立开发者,“免费优先"策略能以恰好 0 美元的成本,交付功能完整的 AI 编程辅助。对于愿意投资高级订阅的团队,token 压缩和智能路由能最大化每一分钱的投资回报率。

它免费、开源,几分钟就能自托管起来。按当前 AI 工具定价的走势来看,把 9Router 加进你的开发基础设施,可能不仅仅是有用——而是正在变得必不可少。

仓库github.com/decolua/9router 网站9router.com


相关文章 #


推荐工具 #

对于正在构建或部署开源 AI 工具的开发者,我们推荐:

  • DigitalOcean — 新用户 200 美元免费额度,覆盖 14+ 全球区域,一键式 GPU/CPU Droplet,非常适合 AI 负载。
  • Shiyunapi Claude API — Anthropic Claude / OpenAI / DeepSeek API 代理。单个 key 就能以官方定价约 30% 的成本访问多个顶级模型;在对比模型或你所在地区直连 API 被限速时特别好用。

联盟链接——你不用多花一分钱,还能支持 dibi8.com 运营。

参考与来源 #

📦 出现在以下合集中

💬 留言讨论