スマートルーティングとフェイルオーバー
自動フェイルオーバー遅延・ヘルス・価格に基づいて経路を動的に選択し、障害時は予備ノードへ自動で切り替えます。
統一されたモデルインターフェース、スマートルーティング、透明な課金。 重複した統合作業なしで、AI アプリをより速くリリースし、より安定して運用できます。
開発者のための AI インフラレイヤー。モデル接続・安定性・コスト・セキュリティをまとめて解決します。
遅延・ヘルス・価格に基づいて経路を動的に選択し、障害時は予備ノードへ自動で切り替えます。
モデル横断でトークン・費用・呼び出し傾向を確認し、プロジェクトとキー単位で予算や権限を分けられます。
OpenAI・Anthropic プロトコルをそのまま利用可能。Base URL と API Key を差し替えるだけで、既存の SDK やツールを書き直す必要はありません。
リクエスト経路、応答時間、エラー率、モデルのヘルス状態を 1 つのコンソールで追跡できます。
データマスキング内蔵:転送前にキーやメールなどの機微情報を自動で伏せ字化。通信は全経路暗号化、お客様のデータでモデルを学習することはありません。
テストから本番まで同じ入口をそのまま利用。マルチリージョンのエッジノードが最寄りから接続し、高負荷でも低遅延を維持します。
直接統合はもちろん可能です——3 つ目の SDK、5 本目のキー、また突合できない請求書を維持することになるまでは。分散統合のコストは初日ではなく、その後の毎日にかかります。
登録から本番モニタリングまで、4 ステップで SoleAPI に接続できます。
アカウントを登録し、体験クレジットを受け取って最初の API Key を作成します。
既存の SDK やツールに Base URL と API Key を設定するだけ。ほかの変更は不要です。
OpenAI・Anthropic プロトコルにネイティブ対応。Claude や Gemini などの主要モデルを直接呼び出せます。
コンソールで使用量・コスト・遅延をリアルタイムに確認。異常もひと目でわかります。
フルスタックエンジニアコーディングツールのヘビーユーザーClaude Code の Base URL を向けるだけで 1 分で完了。ある上流がレート制限された夜も気づかなかった——コンソールを見て 2 回自動切替されていたと知ったほど。
AI プロダクトチーム CTOマルチモデル本番環境3 社のモデルを同時に A/B しています。以前は認証も請求も 3 セット。今は 1 本のキーで完結し、月末のコストレポートはコンソールから直接エクスポート。
個人開発者従量課金ユーザー個人開発で一番怖いのはブラックボックスな課金。ここは呼び出しごとのトークン数と単価が明細に並び、モデルヘルスページで今週どのモデルが安定かも分かる。
導入を決める前に、よく聞かれること。
AI モデルゲートウェイです。アプリは SoleAPI の統一インターフェースに接続し、リクエストは Anthropic・OpenAI・Gemini などの最適チャネルへルーティングされます。フェイルオーバー・計量・請求も処理。コードから見れば、OpenAI・Anthropic プロトコルにネイティブ対応したエンドポイントです。
直接統合では、ルーティング・認証情報・可観測性が各クライアントに分散します。SoleAPI 経由ならそれらがひとつのコントロールプレーンに収束:コード変更なしのモデル切替、自動フェイルオーバー、請求は 1 枚。書くのはプロダクトであってインフラではありません。
従量課金です。チャージしてすぐ使え、月額・最低利用額はありません。各モデルの価格表のトークン単価で計算し、リクエスト単位の明細が出ます。モデルページの価格が実際の支払額で、割引は明示されます。
データマスキングを内蔵:有効にすると、上流へ転送する前にリクエストを走査し、API キー・トークン・メールアドレスなどの機微情報を自動で伏せ字にします。ルールセット(gitleaks 等のオープンソースルールに基づく)は定期的に自動更新され、個人設定でオン/オフを選べます。さらに、リクエストは全経路 TLS で中継され、お客様のデータをモデル学習に使うことはなく、ログには計量に必要なトークン数と時間メタデータのみを保持します。
各上流キーにサーキットブレーカーとスライディングウィンドウのヘルス指標があり、リクエスト単位で自動フェイルオーバー。さらに主要モデルへ定期プローブを送り、レイテンシと可用性は「モデルヘルス」ページで全ユーザーに公開されています。