1. Project Overview
OmniRouteは、無料でMITライセンスのセルフホスト型AIゲートウェイであり、290以上のAIプロバイダーと500以上のモデルへのアクセスを単一のOpenAI互換エンドポイントに統合します。これにより、LLMを使用した開発時に複数のAPIキー、レート制限、プロバイダーの障害を管理する手間を解消します。
2. Background & Positioning
OmniRouteは、お気に入りのモデルがレート制限に達したり、無料枠を使い切ったり、完全にダウンしたりした場合でも、開発者が「コーディングを止めなくて済む」ようにするために作成されました。アプリケーションを1つのプロバイダーにハードコーディングする代わりに、開発者はツールをOmniRouteのローカルエンドポイントに一度向けるだけで、ゲートウェイが裏側でプロバイダーの選択、フェイルオーバー、コスト最適化を処理します。
OpenRouterやLiteLLMなどの類似ゲートウェイプロジェクトと比較して、OmniRouteは以下の特徴で差別化されています:
- 無料枠プロバイダーの圧倒的に多いカタログ(90以上のプロバイダーが無料アクセスを提供し、毎月約15.3億の無料トークンを追跡)
- ローカルファーストのアーキテクチャ — サードパーティのSaaSを経由してトラフィックをルーティングするのではなく、デフォルトでクラウドテレメトリゼロで開発者自身のマシン上で完全に動作します
- ルーティングやフォールバックに加えて、すべてのリクエストのコストを削減する組み込みのトークン圧縮パイプライン
- REST APIに加えてエージェントプロトコル(MCP、A2A)をネイティブサポートし、人間の開発者と自律型コーディングエージェントの両方に対するインフラとして位置づけられています
3. Feature Categories
🔀 スマートルーティング — 19の戦略、3〜5の例:優先度ルーティング、重み付きルーティング、コスト最適化ルーティング、「最後に正常だったパス」ルーティング、および「自動」コンボモード。目的:各リクエストに対して利用可能な最適なプロバイダーを自動的に選択します。
🛡️ 耐障害性とフェイルオーバー — 3層システム、例:プロバイダーごとのサーキットブレーカー、障害時の自動リトライ、クォータ認識フォールバック、ヘルスベースルーティング、リモートVPSフェイルオーバーモード。目的:個々のプロバイダーがレート制限やダウンした場合でも、リクエストを成功させ続けます。
🗜️ トークン圧縮 — 12エンジンパイプライン、例:RTK(ツール結果フィルタリング)、Caveman(散文圧縮)、LLMLingua-2(セマンティックプルーニング)、コード/URL/JSON保持ルール。目的:構造化コンテンツを壊すことなく、トークン使用量を15〜95%(平均約89%)削減します。
🔌 プロトコルと統合サポート — 4つの主要インターフェース、例:OpenAI互換REST API、MCPサーバー(104ツール)、A2Aプロトコル、Webhook、80以上のCLIコマンド。目的:人間が操作するIDEと自律型エージェントの両方が、同じ方法でゲートウェイと通信できるようにします。
🤝 コーディングエージェント互換性 — 33以上のサポートツール、例:Claude Code、Cursor、Cline、Continue、GitHub Copilot、OpenCode。目的:既存のエージェントツールが変更なしで動作するように、ドロップイン代替エンドポイントを提供します。
4. Key Highlights
- 1つのエンドポイントの背後にある290以上のプロバイダー、500以上のモデル — Claude、GPT、Gemini、DeepSeek、GLM、Kimi、MiniMaxなどが含まれ、数十の個別のAPIキーを管理することなくアクセスできます。
- 90以上の無料プロバイダー、毎月約15.3億の無料トークンを追跡 — 機械可読で定期的に再監査される無料枠のカタログ。約2週間ごとに更新されます。
- 12エンジンのトークン圧縮 — コード、URL、JSON構造を明示的に保持しながらリクエスト/レスポンスのペイロードを削減し、すべての呼び出しのコストを削減します。
- 3層サーキットブレーカーによる耐障害性 — 障害が発生したプロバイダーを自動的に検出し、トラフィックを再ルーティングするため、単一のプロバイダー障害が開発を停止させることはありません。
- ローカルファースト、テレメトリゼロの設計 — ゲートウェイとその暗号化された(AES-256-GCM)資格情報ストアは、ユーザー自身のマシンまたはセルフホストサーバー上で完全に動作します。
- エージェントネイティブプロトコル — REST APIと並んで、第一級のMCPサーバーとA2Aプロトコルをサポート。自律型コーディングエージェントの成長するエコシステム向けに構築されています。
5. Use Cases by Role
一般開発者 — OpenAI互換のIDEまたはCLIツールを http://localhost:20128/v1 に向け、auto モデルを使用することで、統合コードを書き換えることなく、無料および有料プロバイダー間での自動フォールバックを利用できます。
DevOps/SRE — Docker経由またはスコープ付きリモートトークンを持つVPSホスト型インスタンスとしてOmniRouteをデプロイし、チーム全体のLLM使用量、クォータ、プロバイダーの健全性を一元管理および監視します。
プロジェクトマネージャー — クォータプーリングと公平な共有分配を使用して、各メンバーが個別のプロバイダーアカウントを必要とせずに、チーム全体のAI支出を制御および追跡します。
6. Getting Started
必要なものを見つける — リポジトリの /docs ディレクトリにある無料枠プロバイダーカタログと比較ドキュメントを参照するか、アーキテクチャとガイドについては Wiki を確認してください。
インストール/統合:
npm install -g omniroute
omniroute
またはDocker経由:
docker run -d --name omniroute -p 127.0.0.1:20128:20128 diegosouzapw/omniroute
次に、OpenAI互換クライアントを http://localhost:20128/v1 に向けます。
コントリビュート:
git clone https://github.com/diegosouzapw/OmniRoute.git
cd OmniRoute
npm install && npm run dev
プロジェクトのコントリビューションガイドラインに従ってプルリクエストを開きます。
7. Project Structure
OmniRoute/
├── src/ # コアゲートウェイ、ルーティングエンジン、圧縮パイプライン
├── public/ # ダッシュボードアセットとプロバイダーアイコン
├── docs/ # ガイド: Docker、圧縮、プロバイダー、セキュリティ
├── tests/ # 自動テストスイート
├── electron/ # ネイティブデスクトップアプリ (Windows/macOS/Linux)
└── examples/ # コーディングエージェントとIDEの統合例
src/ にはゲートウェイの心臓部であるルーティングと圧縮ロジックが格納されており、docs/ にはプロジェクト全体で参照される継続的に更新される無料枠プロバイダーカタログが含まれています。
8. Related Ecosystem
- 上流の依存関係: ルーティング先の290以上のAIプロバイダー(OpenAI、Anthropic、Google、Moonshot AI/Kimi、DeepSeek、および多くの無料枠サービス)と、基盤となるアプリケーションフレームワークとしてのNext.js。
- 補完ツール: Claude Code、Cursor、Cline、Continue、OpenCode、GitHub CopilotなどのコーディングエージェントとIDE。これらはOmniRouteをモデルバックエンドとして接続します。
- 類似プロジェクト: 同様のマルチプロバイダールーティングのニーズに対応するOpenRouterとLiteLLM。
9. License
✅ 無料で使用、セルフホスト、改変、配布可能(MITライセンス)
✅ 商用利用許可
❌ 著作者による保証は提供されません
ℹ️ ソフトウェアの複製には元の著作権とライセンス表示を保持する必要があります
10. FAQ
Q: OmniRouteは私のAPIキーやトラフィックをサードパーティのクラウドサービスに送信しますか?
A: いいえ — デフォルトでクラウドテレメトリゼロ、暗号化されたローカル資格情報ストレージを備え、自身のマシンまたはサーバー上で動作するローカルファーストのゲートウェイとして設計されています。
Q: OmniRouteを使用するには支払いが必要ですか?
A: OmniRoute自体は無料でMITライセンスです。また、90以上のプロバイダーの無料枠をキュレーションしているため、有料のAPIキーなしで始められます。
Q: OmniRouteでどのコーディングツールを使用できますか?
A: Claude Code、Cursor、Cline、Continue、OpenCode、GitHub Copilotを含む、OpenAI互換クライアントがそのまま動作します。33以上のツールが明示的にサポートされています。
Q: 「auto」モデルはどのように機能しますか?
A: モデルを auto に設定すると、OmniRouteはルーティング戦略、クォータ、ヘルスに基づいて最適なプロバイダーを動的に選択し、プロバイダーが失敗した場合は自動的にフォールバックします。
Q: トークン圧縮で実際にどのくらい節約できますか?
A: プロジェクトのドキュメントによると、コンテンツタイプに応じて約15〜95%の節約が可能で、平均は約89%です。これは、コード、URL、JSONを常に保持する12段階の圧縮パイプラインによって達成されます。
11. Quick Links
- リポジトリ: https://github.com/diegosouzapw/OmniRoute
- Wiki / ドキュメント: https://github.com/diegosouzapw/OmniRoute/wiki
- ユーザーガイド: https://github.com/diegosouzapw/OmniRoute/blob/main/docs/guides/USER_GUIDE.md
- リリース: https://github.com/diegosouzapw/OmniRoute/releases
12. Summary
OmniRouteは、開発者に数百のAIプロバイダーとモデルへの単一のセルフホスト型ゲートウェイを提供し、複数のAPIキーを管理する運用オーバーヘッドと、すべてのリクエストのトークンコストの両方を削減します。AIコーディングエージェントに依存し、資格情報やトラフィックの制御を放棄することなく、プロバイダーのレート制限や障害に対する耐障害性を求める個人開発者やチームに最適です。