← 返回日报
🌐 机器翻译 · DeepSeek · GitHub

diegosouzapw OmniRoute


🚀 OmniRoute — 免费 AI 网关 💰 每月约 15.3 亿免费 Token

手动叠加免费套餐非常痛苦——数十个 SDK、数十个速率限制,而且你根本不知道自己实际有多少额度。OmniRoute 将 43 个提供商池 / 460+ 个模型的已记录免费套餐汇总为一个真实数字,并在仪表盘(/dashboard/free-tiers)上实时显示。

仪表盘(/dashboard/free-tiers)页面的动态摘要动画。完整方法论(池去重、信用等级、提供商条款):docs/reference/FREE_TIERS.md。这些数据每两周根据实时目录重新审核一次,并且会双向变化——某个提供商结束免费套餐时数字下降;新的免费套餐出现时数字上升。我们发布的是目录实际计算的结果,从不取四舍五入的最佳情况。如果这个标题数字与代码不一致,CI 门控(check:docs-counts)会使构建失败。

⭐ 如果 OMNIROUTE 帮你省了钱并让工作更轻松,请给仓库点星。 💬 加入社区 问题、提供商技巧、路线图与支持 → Discord · Telegram · WhatsApp 🌍 全球 / 🇧🇷 巴西

🧩 可用 🚀 快速开始 • 🎯 组合 • 🌐 提供商 • 🔌 CLI 与 MCP • 🗜️ 压缩 • 🌍 网站 💥 承诺 • 🤔 为什么 • 🏆 与众不同之处 • 🤖 兼容的 CLI • 🖥️ 运行环境 • 🔒 私有 • 🎬 实际演示 • 📸 截图 • 📧 支持 🌐 支持 43 种语言 🇺🇸 🇧🇷 🇵🇹 🇪🇸 🇫🇷 🇮🇹 🇩🇪 🇳🇱 🇷🇺 🇺🇦 🇵🇱 🇨🇿 🇸🇰 🇷🇴 🇭🇺 🇧🇬 🇩🇰 🇫🇮 🇳🇴 🇸🇪 🇨🇳 🇹🇼 🇯🇵 🇰🇷 🇹🇭 🇻🇳 🇮🇩 🇲🇾 🇵🇭 🇮🇳 🇮🇳 🇮🇳 🇮🇳 🇮🇳 🇮🇳 🇧🇩 🇵🇰 🇮🇷 🇸🇦 🇮🇱 🇹🇷 🇦🇿 🇹🇿

🆓 安装后立即生效——无需密钥,无需配置 安装 → 将你的工具指向端点 → 它就已经能响应了。OmniRoute 内置了无需密钥的免费提供商(OpenCode Free、Felo)并已接入自动组合,因此全新安装即可直接响应——无需 API 密钥、无需注册、无需配置。

全新安装,零凭证——auto 已经可用:

curl http://localhost:20128/v1/chat/completions \ -H "Content-Type: application/json" \ -d '{"model":"auto","messages":[{"role":"user","content":"Hello!"}]}'

✅ auto 立即响应——OmniRoute 从内置的无密钥免费提供商构建一个虚拟组合,并路由到一个健康的提供商,无需任何设置。

➕ 随时添加更多提供商——从仪表盘放入 Claude / GPT / Gemini 密钥(或 290 个提供商中的任意一个),它们会自动加入自动池。

🎛️ 构建你自己的免费组合——将你的免费套餐与 19 种路由策略中的任意一种串联起来,这样你就永远不会用完配额。偏好某个特定的免费后端?直接调用它,例如 oc/…(OpenCode Free)或 felo/…(Felo)。然后升级到 auto,让 OmniRoute 为你选择。

💥 承诺 🤔 为什么选择 OmniRoute?

🎯 组合——旗舰功能 组合是 OmniRoute 自动跨模型路由的模型链。配额用完、提供商故障或成本飙升——组合会静默地滑动到下一个模型。这就是 OmniRoute 坚不可摧的原因。🛡️

⚡ 零配置——只需使用 auto 无需创建组合。将你的模型设置为 auto(或某个变体),OmniRoute 会根据你连接的提供商构建一个虚拟组合,并实时评分:

| 模型 ID | 优化目标 | |---|---| | auto | 🎯 平衡默认(LKGP——坚持你上次使用的良好提供商) | | auto/coding | 🧑‍💻 代码生成优先考虑质量 | | auto/fast | ⚡ 最低延迟优先 | | auto/cheap | 💰 每 Token 最便宜优先 | | auto/offline | 🔋 最多配额/速率限制余量优先 | | auto/smart | 🔭 质量优先 + 10% 探索以发现更好的模型 |

🔀 或者自己构建——19 种路由策略 全部 19 种策略——每个组合步骤可混合搭配:

| # | 策略 | 作用 | |---|---|---| | 1 | priority | 优先目标有序列表——耗尽一个再进入下一个 🥇 | | 2 | fill-first | 完全填满每个目标的配额后再继续 | | 3 | weighted | 按每个目标的权重进行加权随机 | | 4 | round-robin | 按顺序循环遍历目标 | | 5 | p2c | 二选一随机负载均衡 | | 6 | least-used | 选择当前负载最低的目标 | | 7 | random | 均匀随机选择(去重) | | 8 | strict-random | 随机但不进行去重 🎲 | | 9 | cost-optimized | 根据实时目录定价最小化每次请求的成本 💸 | | 10 | headroom | 选择剩余配额最多的目标 | | 11 | reset-window | 偏好配额窗口即将重置的目标 | | 12 | reset-aware | 按配额重置时间排序——短窗口优先 📊 | | 13 | context-relay | 在长对话中跨目标传递上下文 🧠 | | 14 | context-optimized | 选择最适合当前上下文大小的目标 | | 15 | cache-optimized | 将每个可复用的提示前缀固定到同一账户——最大化提示缓存命中率 🎯 | | 16 | lkgp | 上次已知良好路径——粘性选择上次成功的那个目标 | | 17 | auto | 对每个连接进行 12 因素实时评分 🤖 | | 18 | fusion | 扇出到一组模型 + 一个裁判综合生成一个答案 🧬 | | 19 | pipeline | 链式步骤——每个目标的输出作为下一个目标的输入 🔗 |

自动组合引擎根据 12 个因素(健康状态、配额、成本、延迟、成功率、新鲜度……)对每个候选进行评分——参见 docs/routing/AUTO-COMBO.md。

⚖️ 配额共享——将一个订阅拆分给整个团队 ✨ 新功能 多个密钥同时使用同一个上游账户(一个 Codex Pro 计划、一个 Kimi 密钥、一个 GLM Coding 席位)?某个密钥的突发流量可能耗尽整个 5 小时/小时配额,导致其他人全部被锁在外面。配额共享将提供商基于时间的配额公平地分配给池中的各个密钥——并且它是工作守恒的,因此空闲成员的份额会被借出而不是浪费掉。

| 控制项 | 作用 | |---|---| | ⚖️ 分配权重 | 每个密钥在池中的份额——例如 50 / 30 / 20 | | 📐 维度 | 跟踪百分比 · 请求数 · Token 数 · 金额,按 5 小时 / 7 天 / 按模型窗口 | | 🚦 策略 | 硬性(超出份额则阻止)· 软性(降低优先级)· 突发(使用空闲余量) | | 🧱 上限 | 每个密钥的绝对上限,独立于模式 |

在请求离开 OmniRoute 之前的热路径中强制执行,带有每个(密钥、模型)上限 + 会话粘性以保证提示缓存完整性(现在有每个组合/全局禁用开关)。

📖 配额共享引擎

🧱 内置弹性(3 个独立层) 📖 自动组合引擎 · 弹性指南

🏆 OmniRoute 的与众不同之处

| 特性 | OmniRoute | 其他路由器 | |---|---|---| | 🌐 提供商 | 290 | 20–100 | | 🆓 免费提供商 | 90+(40+ 永久免费) | 1–5 | | 🔀 路由策略 | 19 种策略 | 1–3 | | 🗜️ Token 压缩 | RTK + Caveman 叠加(15 |

📖 阅读原文 →