← 返回日报
🌐 机器翻译 · DeepSeek · GitHub

diegosouzapw OmniRoute


🚀 OmniRoute — 免费 AI 网关 💰 每月约 15.3 亿免费 Token

手动叠加免费套餐非常痛苦——数十个 SDK、数十个速率限制,而且你根本不知道自己实际有多少额度。OmniRoute 将 43 个提供商池 / 460 多个模型的已记录免费套餐汇总为一个真实数字,并在仪表盘(/dashboard/free-tiers)上实时显示。实时 /dashboard/free-tiers 页面的动画摘要。完整方法论(池去重、信用层级、提供商条款):docs/reference/FREE_TIERS.md。这些数据每两周根据实时目录重新审核一次,并且会双向变化——某个提供商结束免费套餐时数字下降;新的免费套餐出现时数字上升。我们发布的是目录实际计算的结果,从不取四舍五入的最佳情况。如果这个关键数字与代码不一致,CI 门控(check:docs-counts)会导致构建失败。⭐ 如果 OMNIROUTE 帮你省了钱、让工作更轻松,请给仓库点个星。💬 加入社区 问题、提供商技巧、路线图与支持 → Discord · Telegram · WhatsApp 🌍 全球 / 🇧🇷 巴西 🧩 可用 🚀 快速开始 • 🎯 组合 • 🌐 提供商 • 🔌 CLI 与 MCP • 🗜️ 压缩 • 🌍 网站 💥 承诺 • 🤔 为什么 • 🏆 与众不同之处 • 🤖 兼容的 CLI • 🖥️ 运行环境 • 🔒 私有 • 🎬 实际演示 • 📸 截图 • 📧 支持 🌐 支持 43 种语言 🇺🇸 🇧🇷 🇵🇹 🇪🇸 🇫🇷 🇮🇹 🇩🇪 🇳🇱 🇷🇺 🇺🇦 🇵🇱 🇨🇿 🇸🇰 🇷🇴 🇭🇺 🇧🇬 🇩🇰 🇫🇮 🇳🇴 🇸🇪 🇨🇳 🇹🇼 🇯🇵 🇰🇷 🇹🇭 🇻🇳 🇮🇩 🇲🇾 🇵🇭 🇮🇳 🇮🇳 🇮🇳 🇮🇳 🇮🇳 🇮🇳 🇧🇩 🇵🇰 🇮🇷 🇸🇦 🇮🇱 🇹🇷 🇦🇿 🇹🇿

💥 承诺

🤔 为什么选择 OmniRoute?

🎯 组合——旗舰功能

组合是 OmniRoute 自动跨模型路由的链条。配额耗尽、提供商故障或成本飙升——组合会静默切换到下一个模型。这就是 OmniRoute 坚不可摧的原因。🛡️

⚡ 零配置——只需使用 auto 无需创建组合。将模型设置为 auto(或某个变体),OmniRoute 会根据你连接的提供商实时构建一个虚拟组合,并按以下维度评分:

| 模型 ID | 优化目标 | | --- | --- | | auto | 🎯 平衡默认(LKGP——坚持使用你最后一个良好的提供商) | | auto/coding | 🧑‍💻 代码生成优先质量权重 | | auto/fast | ⚡ 最低延迟优先 | | auto/cheap | 💰 每个 Token 最便宜优先 | | auto/offline | 🔋 最多配额 / 速率限制余量优先 | | auto/smart | 🔭 质量优先 + 10% 探索以发现更好的模型 |

🔀 或者自己构建——18 种路由策略 所有 18 种策略——可按组合步骤混合搭配:

| # | 策略 | 作用 | | --- | --- | --- | | 1 | priority | 优先目标有序列表——逐个耗尽后再切换 🥇 | | 2 | fill-first | 完全填满每个目标的配额后再继续 | | 3 | weighted | 按每个目标权重的加权随机 | | 4 | round-robin | 按顺序循环遍历目标 | | 5 | p2c | 二选一随机负载均衡 | | 6 | least-used | 选择当前负载最低的目标 | | 7 | random | 均匀随机选择(去重) | | 8 | strict-random | 不去重重复的随机选择 🎲 | | 9 | cost-optimized | 根据实时目录定价最小化每次请求的成本 💸 | | 10 | headroom | 选择剩余配额最多的目标 | | 11 | reset-window | 优先选择配额窗口即将重置的目标 | | 12 | reset-aware | 按配额重置时间排序——短窗口优先 📊 | | 13 | context-relay | 在长对话中跨目标传递上下文 🧠 | | 14 | context-optimized | 根据当前上下文大小选择最佳匹配 | | 15 | lkgp | 最后已知良好路径——坚持最后一个成功的目标 | | 16 | auto | 12 因素实时评分每个连接 🤖 | | 17 | fusion | 向一组模型广播 + 一个裁判合成一个答案 🧬 | | 18 | pipeline | 链式步骤——每个目标的输出作为下一个的输入 🔗 |

Auto-Combo 引擎根据 12 个因素(健康度、配额、成本、延迟、成功率、新鲜度……)对每个候选进行评分——详见 docs/routing/AUTO-COMBO.md。

⚖️ 配额共享——在团队中分摊一个订阅 ✨ 新功能 多个密钥指向同一个上游账户(一个 Codex Pro 计划、一个 Kimi 密钥、一个 GLM Coding 席位)?一个密钥的突发可能耗尽整个 5 小时 / 每小时配额,导致其他人被锁定。Quota-Share 将提供商基于时间的配额公平分配给池中的各个密钥——并且是工作守恒的,因此空闲成员的份额会被借出而不是浪费。

| 旋钮 | 控制内容 | | --- | --- | | ⚖️ 分配权重 | 每个密钥在池中的份额——例如 50 / 30 / 20 | | 📐 维度 | 跟踪百分比 · 请求数 · Token 数 · 金额,按 5 小时 / 7 天 / 每个模型窗口 | | 🚦 策略 | 硬性(超额时阻止)· 软性(降低优先级)· 突发(使用空闲余量) | | 🧱 上限 | 每个密钥的绝对上限,独立于模式 |

在请求离开 OmniRoute 之前的热路径中强制执行,带有每个(密钥、模型)上限 + 会话粘性以保证提示缓存完整性(现在支持按组合 / 全局禁用开关)。📖 配额共享引擎

🧱 内置弹性(3 个独立层) 📖 Auto-Combo 引擎 · 弹性指南

🏆 OmniRoute 的与众不同之处

| 特性 | OmniRoute | 其他路由器 | | --- | --- | --- | | 🌐 提供商 | 278 | 20–100 | | 🆓 免费提供商 | 90+(40+ 永久免费) | 1–5 | | 🔀 路由策略 | 18(优先级、加权、成本优化、上下文中继、融合……) | 1–3 | | 🗜️ Token 压缩 | RTK + Caveman 叠加(15–95%) | 无 / 20–40% | | 🧰 内置 MCP 服务器 | 104 个工具、3 种传输、31 个作用域 | 罕见 | | 🤝 A2A 代理协议 | 6 项技能、JSON-RPC 2.0 | 无 | | 🧠 记忆(FTS5 + 向量) | 是 | 罕见 | | 🛡️ 护栏(PII、注入、视觉) | 是 | 罕见 | | ☁️ 云代理 | Codex、Cursor、Devin、Jules | 无 | | 🥷 TLS 指纹隐身 | 通过 wreq-js 实现 JA3/JA4 | 无 | | 🖥️ 多平台 | Web · 桌面 · Termux · PWA | 仅 Web | | 🌍 i18n | 43 种语言 | 0–4 |

详细对比 LiteLLM、OpenRouter 和 Portkey → docs/comparison/OMNIROUTE_VS_ALTERNATIVES.md

✨ 最新动态 v3.8.20 → v3.8.49 的近期亮点。完整历史记录在 CHANGELOG.md 中。

🗜️ 压缩加固——默认启用的膨胀防护、针对 DE / FR / JA + 中文(文言文)的 Caveman 包、针对 Gradle 和 .NET 的 RTK 过滤器。→ 压缩

💸 诚实固定费率成本——订阅 / 编码计划提供商在成本分析中显示为 $0;预算、配额和路由继续估算。→ API 参考

⚖️ 配额共享路由——根据可用配额在账户间分配负载:DRR 调度、每个连接的并发、多窗口桶、会话粘性。→ 弹性指南

🤖 一键 CLI/代理设置——setup-* 配置 12 个以上编码工具;omniroute launch / launch

📖 阅读原文 →