New

Entdecken Sie die Zukunft der KI mit APISIX – Das vollständig Open-Source KI-Gateway für KI-Agenten und LLMs!Mehr erfahren

Mehr erfahren

Vom Team hinter Apache APISIX

Kostenlos starten. Skalieren, sobald KI Ihre Zahlen bewegt.

Bringen Sie Ihre ersten KI-Funktionen kostenlos live und wachsen Sie mit steigendem Traffic in der Managed Cloud — alles bei unter einer Millisekunde Overhead. Open-Source-Kern, unternehmensreif, sobald Sie so weit sind.

Sub-ms
Proxy-Overhead
100+
LLM-Anbieter
100%
OpenAI-compatible
Apache-2.0
Open-Source-Kern

Preise, die mit Ihrer KI wachsen

Kostenlos starten und mit steigendem Traffic in der Managed Cloud wachsen — oder den Open-Source-Kern jederzeit selbst hosten.

Developer

Bringen Sie Ihre ersten KI-Funktionen live — kostenlos und vollständig verwaltet.

$0/ Monat
100 Tsd. erfasste Anfragen / Monat

Über 100 Tsd. hinaus fließt der Traffic weiter — zusätzliche Anfragen werden lediglich nicht erfasst.

Kostenlos starten
  • LLM-Anbieter direkt, OpenAI-kompatibel
  • 1 Umgebung · 1 Data Plane · 1 Mitglied
  • Anfrage-Logs (3 Tage Aufbewahrung)
  • API-Schlüsselrotation, Social Login
  • Community-Support
AM BELIEBTESTEN
Team

Bringen Sie erfolgreiche KI-Funktionen auf Produktionsniveau.

$149/ Monat
1 Mio. erfasste Anfragen / Monat

$100 je weitere 1 Mio., nie blockiert. Dauerhaft über 5 Mio./Monat wechselt zu Enterprise.

Loslegen
  • Alles aus Developer, zusätzlich:
  • Modell-Routing, Ensembles, Load Balancing & Failover
  • Budgets, Rate-Limits & Guardrails
  • RBAC, Teams & Antwort-Caching
  • 25 Mitglieder · 3 Umgebungen · 3 Data Planes
  • 30 Tage Aufbewahrung · Standard-SLA
Enterprise

KI im ganzen Unternehmen ausrollen — gesteuert, konform, unterstützt.

Custom
Über 10 Mio. erfasste Anfragen / Monat

Kontingent, Mehrverbrauch, Bereitstellung und SLA nach Maß.

Vertrieb kontaktieren
  • Alles aus Team, zusätzlich:
  • AWS Bedrock · Azure OpenAI · GCP Vertex AI
  • Organisationsverwaltung · SSO · Audit-Logs
  • Eigene Guardrail-Hooks · semantischer Cache
  • SOC 2 Type II / ISO 27001 / GDPR / HIPAA
  • Private / VPC-Bereitstellung · dedizierter Support
Open-Source-Projekt oder finanziertes Start-up? Möglicherweise haben Sie Anspruch auf einen kostenlosen Team-Tarif — alle Team-Funktionen kostenlos, vorbehaltlich Nutzungsgrenzen und Prüfung.
Kostenlos bewerben
Lieber selbst hosten? AISIX ist Open Source (Apache-2.0) — betreiben Sie das komplette Gateway selbst, kostenlos, dauerhaft.
Auf GitHub ansehen

Was ist eine erfasste Anfrage?

Jeder Aufruf, der über das Gateway geroutet und protokolliert wird, Fehler eingeschlossen. Eine Streaming-Antwort zählt als eine Anfrage.

Der kostenlose Tarif blockiert nie

In Developer fließt der Traffic auch über 100 Tsd. hinaus weiter — zusätzliche Anfragen werden schlicht nicht erfasst oder gezählt. Keine überraschenden Abschaltungen.

Mehrverbrauch bleibt planbar

Über 1 Mio. hinaus setzen wir automatisch $100 je weitere 1 Mio. auf Ihre Monatsrechnung. Der Traffic wird nie unterbrochen.

Alles, was Sie brauchen, um KI zu bauen, auszuliefern & zu skalieren

Wischen, um Tarife zu vergleichen →

Funktion Developer$0 Team$149/mo EnterpriseCustom
Nutzung & Limits
Erfasste Anfragen / Monat100K1M10M+
Mitglieder125Unbegrenzt
Umgebungen13Unbegrenzt
Data Planes13Unbegrenzt
Log-Aufbewahrung3 Tage30 TageIndividuell
Metrik-Aufbewahrung30 Tage90 TageIndividuell
Monatlicher MehrverbrauchNicht erfasst$100 / 1MIndividuell
KI-Gateway-Kern
Einheitliche OpenAI-kompatible API
Chat Completions + Streaming (SSE)
Anthropic-compatible /v1/messages
Embeddings · Rerank
Audio (Spracherkennung, TTS)
Bildgenerierung
Anbieter-Passthrough
Playground
Einzelmodell direkt
Virtuelle / routende Modelle
Modell-Ensembles (Panel + Judge)
MCP gateway
Modellanbieter
OpenAI · Anthropic · Gemini · DeepSeek
Über 20 gängige Anbieter
Über 100 via OpenAI-Kompatibilität
AWS Bedrock · Azure OpenAI · GCP Vertex AI
Routing & Zuverlässigkeit
Gewichtetes Load Balancing
Sticky Canary / A-B-Routing
Tag-basiertes bedingtes Routing · Wildcard-Aliase
Automatische Wiederholung
Fallback bei Fehlern / 429
Upstream-Health-Checks
Semantisches Routing
Kosten- / Latenz- / lastbewusstes Routing
Rate-Limiting
Anfragelimits (RPM / RPD)
Token-Limits (TPM / TPD)
Nebenläufigkeitslimits
Limits pro Team / pro Mitglied
Kosten & Budgets
Budgets pro Schlüssel (harter Stopp / Warnung)
Budgets für Organisation / Umgebung / Anbieter
Budget-Warnungen (75 / 90 / 100 %)
Kostenerfassung pro Modell
Caching
Antwort-Cache (exakte Übereinstimmung)
Arbeitsspeicher- + Redis-Backends
Telemetrie zu eingesparten Kosten
Semantischer Cache
Sicherheit & Guardrails
Guardrails per Schlüsselwort / Regex
Cloud-Sicherheits-Guardrails
Maskierung personenbezogener Daten · Inhaltsmoderation
Eigene Guardrail-Hooks
Observability
Zugriffslogs für Anfragen
Dashboard für Nutzung & KostenBasis
Prometheus metrics
OpenTelemetry-Trace-Export
Warnungen
Export in Data Lake / Bucket
Zugriffskontrolle & Organisation
API-Schlüsselverwaltung + Rotation
Virtuelle Schlüssel & Modell-Allowlist
Persönliche Zugriffstoken (CLI / CI)
Social Login (GitHub / Google)
RBAC
Teams
Organisationsverwaltung
SSO (SAML / OIDC)
Audit-Logs
Bereitstellung & Compliance
Verwaltetes SaaS-Hosting
Verschlüsselung der Anbieterschlüssel im Ruhezustand
Self-Hosting / On-Premises möglich
Private / VPC-Bereitstellung
SOC 2 Type II · ISO 27001 · GDPR · HIPAA
BAA · Datenisolierung
Support & SLA
SupportCommunityStandardDediziert
SLAStandardIndividuell

Sicherheit auf Unternehmensniveau, bereit für Ihr Wachstum

Betreiben Sie AISIX in Ihrer eigenen Cloud oder VPC, setzen Sie unternehmensweite Richtlinien durch und erfüllen Sie die Compliance-Anforderungen — abgesichert durch ein dediziertes Team und ein SLA.

SOC 2 Type II ISO 27001 GDPR HIPAA
SSOSAML / OIDC
Private / VPCIn Ihrer eigenen Cloud betreiben
OrganisationsverwaltungRichtlinien über alle Teams hinweg
Audit-LogsJede Änderung nachvollziehbar
DatenisolierungEnvelope-verschlüsselte Schlüssel, BAA
Dedizierter SupportOnboarding + SLA

Häufige Fragen

Berechnen Sie Token oder LLM-Nutzung?+

Nein. Sie bringen Ihre eigenen Anbieterschlüssel mit und zahlen Ihre LLM-Rechnung direkt an OpenAI, Anthropic und andere. AISIX Cloud berechnet ausschließlich das Tarifabonnement — auf Ihre Token gibt es keinen Aufschlag.

Worin unterscheidet sich AISIX von einem LLM-API-Relay oder Token-Wiederverkäufer?+

Ein Relay verkauft Modellzugang über eigene Konten und Server weiter — Ihre Prompts, Antworten und API-Schlüssel laufen über einen Dritten, den Sie nicht kontrollieren, und Sie erben dessen Aufschlag, geteilte Rate-Limits und das Risiko, dass das vorgelagerte Konto gedrosselt oder gesperrt wird. AISIX ist kein Wiederverkäufer, sondern Ihr eigenes Gateway. Sie verbinden Ihre eigenen Anbieterschlüssel und betreiben es in Ihrer Cloud oder VPC (oder auf einer verwalteten Ebene mit Envelope-verschlüsselten Schlüsseln), sodass Traffic und Daten unter Ihrer Kontrolle bleiben. Sie erhalten Routing, Failover, Rate-Limits, Guardrails, Budgets und vollständige Observability — und zahlen Anbieter direkt, ohne Token-Aufschlag. Es ist Open Source (Apache-2.0, in Rust entwickelt), produktionstauglich und bereit für SOC 2 / ISO 27001 / GDPR / HIPAA, sobald Sie skalieren.

Was zählt auf mein monatliches Anfragekontingent?+

Erfasste Anfragen — jeder Aufruf, der über das Gateway geroutet und protokolliert wird, Fehlerantworten eingeschlossen. Eine Streaming-Antwort zählt als eine Anfrage.

Was passiert, wenn ich das Limit erreiche?+

In Developer fließt Ihr Traffic auch über 100 Tsd. hinaus weiter — zusätzliche Anfragen werden schlicht nicht erfasst, tauchen also weder in Logs noch in Analysen auf, und nichts wird jemals blockiert. In Team setzen wir automatisch $100 je weitere 1 Mio. Anfragen an — der Traffic wird nie unterbrochen. Bei dauerhaft über 5 Mio./Monat ist der Wechsel zu Enterprise sinnvoll.

Kann ich AISIX selbst hosten statt die Cloud zu nutzen?+

Ja. AISIX ist Open Source unter Apache-2.0 — betreiben Sie das komplette Gateway als einzelne Rust-Binärdatei, kostenlos, mit Community-Support. Die Managed Cloud ergänzt gehostete Control Plane, Dashboard, Budgets, RBAC und SLAs. Enterprise kann den verwalteten Stack auch innerhalb Ihrer eigenen Cloud / VPC betreiben.

Welche LLM-Anbieter werden unterstützt?+

Über 100 Anbieter über eine einzige OpenAI-kompatible API, darunter mehr als 20 gängige Integrationen (OpenAI, Anthropic, Gemini, DeepSeek, Groq, Mistral, Cohere, Qwen, Together, Fireworks und weitere). Cloud-gehostete Anbieter — AWS Bedrock, Azure OpenAI und GCP Vertex AI — sind in Enterprise verfügbar.

Wie funktionieren SSO, Audit-Logs und Compliance?+

Organisationsverwaltung, SSO (SAML / OIDC), Audit-Logs sowie SOC 2 Type II / ISO 27001 / GDPR / HIPAA gehören zu Enterprise. Sprechen Sie mit dem Vertrieb, um Anforderungen und Bereitstellungsmodell abzustecken.

Wo werden meine Daten gespeichert und wie sind Anbieterschlüssel geschützt?+

In AISIX Cloud sind Anbieterschlüssel im Ruhezustand Envelope-verschlüsselt und werden erst zum Zeitpunkt der Anfrage entschlüsselt; jede Data Plane ist auf den Keyspace ihrer eigenen Umgebung beschränkt. Beim Self-Hosting bleiben sämtliche Daten und Schlüssel vollständig in Ihrer eigenen Infrastruktur.

Erhöht das Gateway die Latenz?+

Die Data Plane ist ein nativer Rust-Proxy mit veröffentlichter Leistungsbasis: rund 28.300 Anfragen/s bei Sättigung auf 4 vCPUs, unter einer Millisekunde p50-Gateway-Overhead bei niedriger bis mittlerer Last und etwa 0,65 ms zusätzliche Zeit bis zum ersten Token beim Streaming — vernachlässigbar gegenüber der LLM-Inferenzzeit.

Liefern Sie KI, die Ihr Geschäft wachsen lässt

OpenAI-kompatibel — richten Sie Ihr SDK auf AISIX und legen Sie los. Kostenloser Einstieg, ohne Kreditkarte.