OmniRoute:21K Star AI 网关,237 个提供商 + 4 层自动故障转移 + Token 压缩
来源:微信公众号
"Never stop coding"——永不停止编码。
OmniRoute 是一个开源 AI 网关项目,GitHub ⭐ 21K,登上趋势榜 Top3。它的核心思想:把所有 AI 提供商都统一到一个 OpenAI 兼容的端点下,让 Claude Code、Cursor、Cline、Copilot 等所有工具无缝切换,毫秒级自动故障转移,永不断线。
核心亮点
免费 Tokens 池
OmniRoute 聚合了 40+ 个提供商池、500+ 个模型的免费额度。很多服务商共享同一个免费池,简单相加会严重夸大——OmniRoute 只计数一次,确保数字真实可信。
4 层自动故障转移
OmniRoute 设计了一套聪明的 4 层故障转移机制:
| 层级 | 说明 |
|---|---|
| 订阅层 | 优先使用你付费订阅的服务(Claude Code、Codex、Copilot) |
| API Key 层 | 订阅配额用完时,自动切换到你配置的 API Key |
| 便宜层 | 使用成本极低的模型(如 GLM,$0.5/1M tokens) |
| 免费层 | 最后兜底,使用永久免费的提供商 |
整个切换过程在毫秒级完成,你甚至感觉不到任何中断。
15-95% Token 压缩
AI 编码时,工具输出(git diff、日志、grep 结果)往往占据大量 tokens,但模型并不需要完整处理这些内容。
OmniRoute 集成了 RTK + Caveman 压缩技术,智能过滤和压缩这些内容,平均节省 15-95% 的 tokens。
17 种路由策略
| 策略 | 说明 |
|---|---|
| priority | 按优先级顺序使用,用尽一个再切换下一个 |
| cost-optimized | 自动选择成本最低的模型 |
| headroom | 优先选择配额最充足的提供商 |
| lkgp | 优先使用最近成功的提供商 |
| fusion | 并行请求多个模型,由"裁判"模型综合最优答案 |
你可以构建自定义 combo,灵活组合策略。
内置 MCP 服务器
OmniRoute 内置了 MCP(Model Context Protocol)服务器,支持 95 个工具和 30 个权限范围。
快速上手
安装
# npm 全局安装
npm install -g omniroute
# Docker 部署
docker run -p 20128:20128 diegosouzapw/omniroute
# Electron 桌面应用(支持 Windows/macOS/Linux)
启动服务
omniroute start
# 服务默认运行在 http://localhost:20128/v1
配置 AI 工具
将 Claude Code、Cursor 等工具指向 OmniRoute 端点:
- Claude Code:设置 API Base URL 为
http://localhost:20128/v1 - Cursor:配置自定义 API 端点
- 其他工具:将 base URL 指向本地网关
使用 Auto 模式
最简单的方式是使用 auto 模式:
auto/coding # 代码生成优化
auto/fast # 最低延迟优先
auto/cheap # 最低成本优先
auto/offline # 配额最充足优先
auto/smart # 质量优先 + 10% 探索
自定义 Combo 示例
Combo: "always-on"
Strategy: priority
1. cc/claude-code # 订阅层
2. cx/copilot # 备用订阅
3. ds/deepseek-chat # 便宜层
4. kg/kilo-code # 免费层
总结
OmniRoute 解决了开发者使用 AI 工具时最头疼的三个问题:
- 成本控制:聚合免费额度 + 智能路由,大幅降低 AI 使用成本
- 高可用性:4 层自动故障转移,永不因配额问题中断工作
- 简化管理:一个端点管理所有 AI 提供商,告别多个控制台
完全开源免费,零成本启动。
GitHub:https://github.com/diegosouzapw/OmniRoute
官网:https://omniroute.online