跳到主要内容
项目档案应用项目

OmniRoute AI 网关:统一接入 60+ LLM 提供商,智能路由降低成本 | 安装与使用指南

OmniRoute 是开源 AI 网关,提供 OpenAI 兼容端点接入多提供商 LLM,实现智能路由、自动回退与负载均衡。适用于需要高可用、低成本 AI 推理的场景,支持 Docker 部署与 Electron 客户端。本文介绍项目定位、安装方式、API 使用及核心功能。

68,196TypeScriptStar 于 2026年3月19日2026年9月19日 更新

AI 总结

OmniRoute 是一个开源 AI 网关服务,提供统一 API 端点接入 60+ LLM 提供商,通过智能路由、自动回退和负载均衡实现低成本、高可用的 AI 推理,支持多模态与多种协议集成。

中文项目介绍

OmniRoute 是一个功能全面的 AI 网关服务,旨在简化多语言模型(LLM)的集成与使用。它通过一个统一的 OpenAI 兼容 API 端点,将请求智能路由到 60 多家提供商,自动选择免费或低成本模型,并在服务故障时无缝回退,从而解决多提供商集成复杂、成本不可控和服务不稳定等核心问题。 该服务适用于多种场景:为 AI 应用提供统一后端以降低开发复杂度;通过自动模型选择优化推理成本;利用自动回退机制确保高可用性;实施速率限制和策略控制 AI 使用;监控分析调用指标以辅助决策;并可在 Cursor、Claude Desktop 等工具中作为代理使用。 从技术实现看,OmniRoute 基于 Next.js 和 TypeScript 构建,采用模块化设计,包含认证授权(JWT)、缓存管理、审计日志、A2A 任务处理、ACP 代理注册和多样性分析等核心模块。它支持 Docker 和 Docker Compose 部署,提供 Electron 桌面客户端,并集成 MCP 服务器与 A2A 协议,覆盖文本、图像、视频、音频等多模态推理能力。

详细信息与使用说明

1. 项目定位与用途

OmniRoute 定位为智能 AI 网关,核心用途是作为统一入口代理多提供商 LLM 请求。它兼容 OpenAI API 协议,使现有应用无需修改即可接入 60+ 模型服务。通过智能路由算法,自动选择最优模型(优先免费/低成本),并结合负载均衡与自动故障转移,确保推理服务的高可用与成本效益。此外,它还扩展支持 MCP 服务器、A2A 协议及多模态生成,满足从简单聊天到复杂代理工作的多样化 AI 需求。

2. 解决的问题

多 LLM 提供商集成面临三大挑战:一是 API 差异大,需为每个服务商单独适配,开发维护成本高;二是模型价格与可用性波动,难以持续优化成本;三是单点故障导致服务中断。OmniRoute 通过统一协议层屏蔽差异,实现一次集成全网访问;内置成本感知路由,动态选择性价比最高的模型;配合自动重试与智能回退机制,在提供商故障时无缝切换,保障业务连续性。同时,策略、速率限制和缓存功能帮助控制使用量并降低重复请求开销,审计与分析模块则提供可观测性,便于追踪费用与性能。

3. 适用场景

OmniRoute 适用于需要稳定、经济 AI 能力的各类场景:AI 应用后端可统一管理多模型调用,简化开发;成本敏感项目能自动路由到免费或低价模型,显著降低 API 支出;高可用系统依赖自动回退避免单点故障;企业级部署可通过策略与速率限制规范 AI 使用;运维团队借助审计日志和多样性分析监控资源分布。此外,它直接支持 Cursor、Cline、Claude Desktop 等流行工具,可作为这些客户端的代理服务器,个人开发者也能通过 Electron 桌面应用获得本地化体验。

4. 安装方式

仓库中明确提供了多种安装途径:npm 包安装最简便,执行 `npm install omniroute` 即可集成到 Node.js 项目;容器化部署推荐使用 Docker,命令为 `docker run -p 20128:20128 diegosouzapw/omniroute`,或通过 `docker-compose up` 基于 docker-compose.yml 启动完整栈;本地开发需克隆仓库后运行 `npm run dev` 或 `npm start`;Electron 桌面客户端需从 GitHub Releases 页面下载对应系统版本。所有方式均需提前配置环境变量,参考 .env.example 文件设置 JWT 密钥、初始密码等参数。

5. 使用方式

服务启动后,客户端以 OpenAI 兼容格式调用,只需将 baseURL 指向 OmniRoute 地址(如 http://localhost:20128/v1),即可使用聊天补全、嵌入、图像生成等端点。Web 管理界面默认监听 20128 端口,提供可视化配置路由策略、查看缓存与审计日志。CLI 工具 `omniroute` 和 `omniroute-reset-password` 支持命令行管理。高级功能通过 REST API 配置:POST /api/auth/login 获取会话,GET /api/cache/entries 管理缓存,GET /api/audit 查询日志,GET /api/a2a/tasks 处理 A2A 任务,POST /api/acp/agents 注册自定义代理,GET /api/analytics/diversity 获取使用报告。详细参数参考 docs/ 目录文档。

6. 补充说明或实现特点

OmniRoute 采用 Next.js App Router 架构,API 路由集中于 app/api 目录,体现清晰的模块化分离。后端使用 SQLite 数据库存储配置与缓存,通过 getDbInstance 等函数访问,确保轻量部署。认证基于 bcrypt 与 JWT,令牌通过 httpOnly cookie 传递,支持安全与 SameSite 配置。代码库包含多语言 i18n 支持(docs/i18n/ 下 20+ 语言),便于全球用户。Turbopack 与 Webpack 配置处理原生模块兼容性,serverExternalPackages 列表排除无法打包的 Node 内置模块。项目同时提供 Web 服务、CLI 和 Electron 客户端,形成全栈解决方案。MCP 服务器与 A2A 协议集成显示其对新兴 AI 代理标准的前瞻性支持。

思维导图

OmniRoute
核心功能
智能路由与负载均衡
自动回退与故障转移
60+ 提供商支持
多模态推理(文本/图像/视频/音频)
成本优化(免费/低价模型)
技术架构
Next.js App Router
TypeScript 全栈
JWT 认证与 httpOnly cookie
SQLite 本地数据库
模块化 API 设计
部署方式
Docker 容器
Docker Compose 编排
npm 包集成
Electron 桌面客户端
本地开发模式
协议支持
OpenAI 兼容协议
MCP 服务器(25 工具)
A2A 协议任务管理
ACP 代理注册
管理界面
Web 控制台(端口 20128)
CLI 命令行工具
RESTful 管理 API
缓存与审计可视化
治理能力
策略与速率限制
语义缓存系统
审计日志与追踪
提供商多样性分析

常见问题

OmniRoute 是否免费?

项目本身开源免费(MIT 许可证),但调用底层 LLM 提供商可能产生费用。OmniRoute 会智能路由到免费或低成本模型以优化支出,实际成本取决于所选模型。

如何配置环境变量?

参考根目录 .env.example 文件,主要设置 JWT_SECRET、INITIAL_PASSWORD、数据库路径等。生产环境建议使用 docker-compose.prod.yml 覆盖默认配置,并确保敏感信息不泄露。

支持哪些 LLM 提供商?

仓库声称支持 60+ 提供商,包括 OpenAI、Anthropic、Google Gemini、Azure、Cohere 等主流服务,以及多种免费模型。具体列表和配置方式见 docs/API_REFERENCE.md。

能否自托管部署?

可以,提供 Docker 镜像和 Docker Compose 配置,也支持本地 Node.js 运行(需 Node 18-23 版本)。自托管时可完全控制数据与配置,适合企业内网或隐私敏感场景。

如何添加自定义模型或提供商?

通过 Web 管理界面或 API 配置路由规则,详细方法参考 docs/API_REFERENCE.md 中的提供商配置章节。也支持注册自定义 ACP 代理以扩展功能。