New

Desbloqueie o futuro da IA com APISIX – O Gateway de IA totalmente open-source para Agentes de IA e LLMs!Saiba Mais

Saiba Mais

Dos criadores originais do Apache APISIX

Comece grátis. Escale quando a IA mover seus números.

Lance seus primeiros recursos de IA de graça e cresça na nuvem gerenciada conforme o tráfego aumenta — tudo com sobrecarga abaixo de um milissegundo. Núcleo de código aberto, pronto para a empresa quando você chegar lá.

Sub-ms
sobrecarga do proxy
100+
provedores de LLM
100%
OpenAI-compatible
Apache-2.0
núcleo de código aberto

Preços que crescem junto com sua IA

Comece grátis e cresça na nuvem gerenciada conforme o tráfego aumenta — ou hospede você mesmo o núcleo de código aberto quando quiser.

Developer

Lance seus primeiros recursos de IA — grátis e totalmente gerenciado.

$0/ mês
100 mil requisições registradas / mês

Acima de 100 mil, o tráfego continua fluindo — as requisições extras apenas não são registradas.

Começar grátis
  • Provedores de LLM diretos, compatível com OpenAI
  • 1 ambiente · 1 data plane · 1 integrante
  • Logs de requisição (retenção de 3 dias)
  • Rotação de chaves de API, login social
  • Suporte da comunidade
MAIS POPULAR
Team

Leve os recursos de IA que deram certo à escala de produção.

$149/ mês
1 milhão de requisições registradas / mês

$100 a cada 1 milhão adicional, sem bloqueios. Passar de 5 mi/mês de forma sustentada leva ao Enterprise.

Começar
  • Tudo do Developer, e mais:
  • Roteamento de modelos, ensembles, balanceamento de carga & failover
  • Orçamentos, limites de taxa & guardrails
  • RBAC, times & cache de respostas
  • 25 integrantes · 3 ambientes · 3 data planes
  • Retenção de 30 dias · SLA padrão
Enterprise

Leve a IA para toda a organização — governada, em conformidade e com suporte.

Custom
Mais de 10 milhões de requisições registradas / mês

Cota, excedente, implantação e SLA sob medida.

Falar com vendas
  • Tudo do Team, e mais:
  • AWS Bedrock · Azure OpenAI · GCP Vertex AI
  • Gestão da organização · SSO · logs de auditoria
  • Hooks de guardrail personalizados · cache semântico
  • SOC 2 Type II / ISO 27001 / GDPR / HIPAA
  • Implantação privada / em VPC · suporte dedicado
Projeto de código aberto ou startup com investimento? Você pode se qualificar para um plano Team gratuito — todos os recursos do Team, de graça, sujeito a limites de uso e análise.
Solicitar gratuitamente
Prefere hospedar você mesmo? O AISIX é código aberto (Apache-2.0) — rode o gateway completo por conta própria, de graça, para sempre.
Ver no GitHub

O que é uma requisição registrada?

Qualquer chamada roteada e registrada pelo gateway, incluindo erros. Uma resposta em streaming conta como uma única requisição.

O plano gratuito nunca bloqueia

No Developer, o tráfego continua fluindo acima de 100 mil — essas requisições extras apenas não são registradas nem contabilizadas. Sem cortes inesperados.

O excedente é previsível

Acima de 1 milhão, adicionamos automaticamente $100 a cada 1 milhão extra na sua fatura mensal. O tráfego nunca é interrompido.

Tudo o que você precisa para criar, lançar & escalar IA

Deslize para comparar os planos →

Recurso Developer$0 Team$149/mo EnterpriseCustom
Uso & limites
Requisições registradas / mês100K1M10M+
Integrantes125Ilimitado
Ambientes13Ilimitado
Data planes13Ilimitado
Retenção de logs3 dias30 diasSob medida
Retenção de métricas30 dias90 diasSob medida
Excedente mensalNão registrado$100 / 1MSob medida
Núcleo do gateway de IA
API universal compatível com OpenAI
Chat completions + streaming (SSE)
Anthropic-compatible /v1/messages
Embeddings · reordenação
Áudio (fala para texto, TTS)
Geração de imagens
Passagem direta ao provedor
Playground
Modelo único direto
Modelos virtuais / de roteamento
Ensembles de modelos (painel + juiz)
MCP gateway
Provedores de modelos
OpenAI · Anthropic · Gemini · DeepSeek
Mais de 20 provedores populares
Mais de 100 via compatibilidade com OpenAI
AWS Bedrock · Azure OpenAI · GCP Vertex AI
Roteamento & confiabilidade
Balanceamento de carga ponderado
Roteamento canário fixo / A-B
Roteamento condicional por tags · apelidos com curinga
Nova tentativa automática
Fallback em erros / 429
Verificações de integridade do upstream
Roteamento semântico
Roteamento por custo / latência / carga
Limitação de taxa
Limites de requisição (RPM / RPD)
Limites de token (TPM / TPD)
Limites de concorrência
Limites por time / por integrante
Custo & orçamentos
Orçamentos por chave (bloqueio / aviso)
Orçamentos por organização / ambiente / provedor
Alertas de orçamento (75 / 90 / 100%)
Acompanhamento de custo por modelo
Cache
Cache de respostas (correspondência exata)
Backends em memória + Redis
Telemetria de custo economizado
Cache semântico
Segurança & guardrails
Guardrails por palavra-chave / regex
Guardrails de segurança na nuvem
Ocultação de dados pessoais · moderação de conteúdo
Hooks de guardrail personalizados
Observabilidade
Logs de acesso das requisições
Painel de análise de uso & custoBásico
Prometheus metrics
Exportação de traces OpenTelemetry
Alertas
Exportação para data lake / bucket
Controle de acesso & organização
Gestão de chaves de API + rotação
Chaves virtuais & lista de modelos permitidos
Tokens de acesso pessoal (CLI / CI)
Login social (GitHub / Google)
RBAC
Times
Gestão da organização
SSO (SAML / OIDC)
Logs de auditoria
Implantação & conformidade
Hospedagem SaaS gerenciada
Criptografia em repouso das chaves de provedor
Opção auto-hospedada / on-premises
Implantação privada / em VPC
SOC 2 Type II · ISO 27001 · GDPR · HIPAA
BAA · isolamento de dados
Suporte & SLA
SuporteComunidadePadrãoDedicado
SLAPadrãoSob medida

Segurança de nível empresarial, pronta quando você escalar

Rode o AISIX na sua própria nuvem ou VPC, aplique política em toda a organização e atenda ao nível de conformidade exigido — com um time dedicado e um SLA por trás.

SOC 2 Type II ISO 27001 GDPR HIPAA
SSOSAML / OIDC
Private / VPCRode na sua própria nuvem
Gestão da organizaçãoPolítica para todos os times
Logs de auditoriaCada mudança, atribuível
Isolamento de dadosChaves com criptografia de envelope, BAA
Suporte dedicadoOnboarding + SLA

Perguntas frequentes

Vocês cobram por tokens ou pelo uso do LLM?+

Não. Você traz suas próprias chaves de provedor e paga a conta do LLM diretamente à OpenAI, à Anthropic e a outros. O AISIX Cloud cobra apenas a assinatura do plano — não há acréscimo sobre seus tokens.

Como o AISIX difere de um relay de API de LLM ou revendedor de tokens?+

Um relay revende acesso aos modelos por meio das próprias contas e servidores: seus prompts, respostas e chaves de API passam por um terceiro que você não controla, e você herda o acréscimo dele, os limites de taxa compartilhados e o risco de a conta de origem ser limitada ou banida. O AISIX não é revendedor — é o seu próprio gateway. Você conecta suas próprias chaves de provedor e o executa na sua nuvem ou VPC (ou em um plano gerenciado com chaves protegidas por criptografia de envelope), de modo que tráfego e dados continuam sob seu controle. Você tem roteamento, failover, limites de taxa, guardrails, orçamentos e observabilidade completa — e paga os provedores diretamente, sem acréscimo sobre tokens. É código aberto (Apache-2.0, feito em Rust), pronto para produção e preparado para SOC 2 / ISO 27001 / GDPR / HIPAA quando você escalar.

O que conta para minha cota mensal de requisições?+

Requisições registradas — qualquer chamada roteada e registrada pelo gateway, incluindo respostas de erro. Uma resposta em streaming conta como uma única requisição.

O que acontece quando eu atingir o limite?+

No Developer, seu tráfego continua fluindo acima de 100 mil — essas requisições extras apenas não são registradas, então não aparecem nos seus logs nem nas análises, e nada é bloqueado. No Team, adicionamos automaticamente $100 a cada 1 milhão de requisições extras — o tráfego nunca é interrompido. Passar de 5 mi/mês de forma sustentada é um bom momento para migrar ao Enterprise.

Posso hospedar o AISIX em vez de usar a nuvem?+

Sim. O AISIX é código aberto sob Apache-2.0 — rode o gateway completo como um único binário Rust, de graça, com suporte da comunidade. A nuvem gerenciada acrescenta o control plane hospedado, o painel, orçamentos, RBAC e SLAs. O Enterprise também pode rodar a stack gerenciada dentro da sua própria nuvem / VPC.

Quais provedores de LLM são suportados?+

Mais de 100 provedores por meio de uma única API compatível com OpenAI, incluindo mais de 20 integrações populares (OpenAI, Anthropic, Gemini, DeepSeek, Groq, Mistral, Cohere, Qwen, Together, Fireworks e outras). Provedores hospedados em nuvem — AWS Bedrock, Azure OpenAI e GCP Vertex AI — estão disponíveis no Enterprise.

Como funcionam SSO, logs de auditoria e conformidade?+

Gestão da organização, SSO (SAML / OIDC), logs de auditoria e SOC 2 Type II / ISO 27001 / GDPR / HIPAA fazem parte do Enterprise. Fale com vendas para dimensionar seus requisitos e o modelo de implantação.

Onde meus dados ficam armazenados e como as chaves de provedor são protegidas?+

No AISIX Cloud, as chaves de provedor são protegidas por criptografia de envelope em repouso e descriptografadas apenas no momento da requisição; cada data plane fica restrito ao keyspace do próprio ambiente. Na versão auto-hospedada, todos os dados e chaves permanecem inteiramente dentro da sua infraestrutura.

O gateway adiciona latência?+

O data plane é um proxy nativo em Rust com uma linha de base de desempenho publicada: cerca de 28.300 req/s em saturação com 4 vCPUs, sobrecarga p50 do gateway abaixo de um milissegundo em carga baixa a moderada e cerca de 0,65 ms a mais no tempo até o primeiro token em streaming — desprezível diante do tempo de inferência do LLM.

Entregue IA que faz seu negócio crescer

Compatível com OpenAI — aponte seu SDK para o AISIX e comece a entregar. Gratuito para começar, sem cartão de crédito.