New

APISIXでAIの未来を解き放つ – AIエージェントとLLMのための完全オープンソースAIゲートウェイ!詳細を見る

詳細を見る

Apache APISIX の原作者チームによる

AI を競争優位に —
コストセンターにしない。

AISIX は LLM とエージェントのためのオープンソース AI ゲートウェイです。あらゆるモデルの前に OpenAI 互換の API を 1 つ置くだけで、AI 機能を数日で本番へ。成果の出た機能だけをスケールできます。

python
from openai import OpenAI
client = OpenAI(
    base_url="https://your-aisix-gateway/v1",  # point to AISIX
    api_key="AISIX_API_KEY",
)
# your existing OpenAI code — unchanged
resp = client.chat.completions.create(
    model="gpt-4o",  # or claude, gemini, deepseek… 100+
    messages=[{"role": "user", "content": "Hello"}],
)
Sub-ms
プロキシオーバーヘッド
100+
LLM プロバイダー
100%
OpenAI-compatible
Apache-2.0
オープンソースのコア

AI の配管工事にロードマップを遅らせない

最初のプロンプトは簡単です。難しいのは 50 個目のサービス、10 個目のモデル、そして顧客の前で起きる最初の障害です。その複雑さを引き受けるのがゲートウェイであり、チームは開発を止めずに済みます。

プロバイダーに直接つなぐ場合

どのチームも同じ配管を作り直す

  • プロバイダーごとに違う SDK —— 連携のたびに一つのプロジェクト
  • 共有の制限がなく、暴走したループ 1 つで全体が停止
  • 請求書が届くまで見えないコスト
  • プロバイダーのキーが全サービスにコピーされる
  • ガードレールも監査証跡もなく、顧客に AI を出せない
AISIX を使う場合

AI をより速く届けるための単一プラットフォーム

  • OpenAI 互換の API 1 つ —— 一度つなげば書き直し不要
  • 組織全体の制限と予算 —— 想定外なくスケール
  • すべての呼び出しを記録 —— 何が効いているかが見える
  • キーを集中管理・暗号化 —— 秘密情報を漏らさず出荷
  • ガードレール、リトライ、フェイルオーバー —— 顧客の前に AI を置ける

コードを変えずにモデルを切り替える

既存の OpenAI SDK の向き先を AISIX にするだけで、主要プロバイダーすべてに到達できます。書き直しも、ベンダーごとの SDK も、ロックインもありません。

  • OpenAI 互換のチャット、ストリーミング(SSE)、埋め込み、リランク、音声、画像 —— さらに Anthropic 互換の /v1/messages にも対応。
  • 仮想モデル / ルーティングモデルにより、1 つのモデル名を複数のプロバイダーとリージョンに振り分けられます。
  • クラウドプロバイダー —— AWS Bedrock、Azure OpenAI、GCP Vertex AI —— も直接 API と並べて利用できます。
多数のプロバイダーを、1 つのインターフェースで
OpenAIAnthropicGoogle GeminiDeepSeek AWS BedrockAzure OpenAIVertex AIMistral GroqCohereQwenTogetherFireworks 他 100+ →

AI ゲートウェイのすべてを 1 つのコンソールで

リクエスト、レイテンシ、エラー、コスト、モデルの状態を全環境にわたってリアルタイムに。ダッシュボードを自作する必要はありません。

AISIX Cloud コンソールの概要: リクエスト数、p50/p99 レイテンシ、エラー率、本日のコスト、24 時間のリクエストとコストのグラフ、インスタンス横断の環境ヘルス。

AI を本番に載せるために必要なものすべて

最初の試作から本番規模まで —— 単一のプラットフォームに、必要な制御がすべて組み込まれています。

書き直さずにモデルを投入・切り替え。任意のモデル名を任意のプロバイダー(OpenAI、Anthropic、Bedrock、Vertex、Groq)に割り当て、重み付け負荷分散、自動フェイルオーバー、ヘルスチェック、セマンティックかつコスト最適なルーティングを利用できます。

AISIX のモデルページ。gpt-4o、claude-3-7-sonnet、bedrock-claude-prod、gemini-flash などを上流プロバイダーと API ベースに割り当てている様子。

想定外なく本番トラフィックへ。スライディングウィンドウ方式のリクエスト制限(RPM / RPD)とトークン制限(TPM / TPD)に加え、同時実行数の上限も設定可能。キー、チーム、プロバイダーアカウント単位で適用し、Redis を通じてレプリカ間で同期します。

AISIX のレート制限: キー単位のバースト、チーム単位の上限、そして分あたりのリクエストとトークンの予算によるプロバイダーアカウント保護。

自信を持って顧客の前に AI を。入力前と出力後の二段チェック —— キーワード / 正規表現によるブロックリスト、PII のマスキング(Presidio)、プロンプトインジェクションとモデレーション(Lakera、OpenAI Moderation、Llama-Guard)、そしてキー単位のモデルアクセス制御。

AISIX のガードレール: 競合名のブロックリスト、個人情報のマスキング、フェイルクローズのプロンプトインジェクション防御。キーまたはモデル単位で適用。

成果の出ているものに投資する。全環境・全キー・全メンバーの当月コストを把握。キー単位と組織単位の予算、75 / 90 / 100% でのアラート、モデル別のコスト追跡、上限到達時の強制停止に対応します。

AISIX の使用量とコスト: 月間上限に対する組織の支出、今月のリクエスト数、コスト上位のモデル、環境別とメンバー別の内訳。

本物のゲートウェイ —— Python プロキシではない

多くの AI ゲートウェイは、ホットパスに置かれたスクリプト言語の薄い層にすぎません。AISIX は AI 向けに作り直されたゲートウェイ基盤です。

Rs

Rust 製

サブミリ秒のオーバーヘッド、GC による停止なし、そしてトラフィックに応じて水平にスケールするステートレスなデータプレーン。

OS

オープンソース、Apache-2.0

ゲートウェイ全体を単一バイナリとして自社運用できます —— 無料、無期限、ロックインなし。フルマネージドの AISIX Cloud で動かすこともできます。

A6

Apache APISIX チームから

Apache APISIX の作者である API7.ai による 5 年以上の本番ゲートウェイ開発の蓄積を、LLM とエージェント向けに作り直しました。

VPC

クラウドでも、自社 VPC でも

マネージドクラウドなら数分で開始できます。コントロールプレーンとデータプレーンを自社インフラ内に完全に配置することも可能です。

スケール時にも備えあり
SOC 2 Type IIISO 27001GDPRHIPAASSO (SAML / OIDC)Audit logs

ビジネスを伸ばす AI を届ける

OpenAI 互換 —— SDK の向き先を AISIX にするだけで始められます。無料で開始でき、クレジットカードは不要です。