New

APISIX के साथ AI का भविष्य खोलें – AI एजेंट्स और LLMs के लिए पूरी तरह से ओपन-सोर्स AI गेटवे!अधिक जानें

अधिक जानें

Apache APISIX के मूल निर्माताओं की ओर से

मुफ़्त शुरू कीजिए। जब AI आपके आँकड़े बदलने लगे तब स्केल कीजिए।

अपने पहले AI फ़ीचर मुफ़्त में रिलीज़ कीजिए, फिर ट्रैफ़िक बढ़ने के साथ प्रबंधित क्लाउड पर बढ़ते जाइए — और यह सब एक मिलीसेकंड से कम ओवरहेड पर। ओपन सोर्स कोर, और जब ज़रूरत पड़े तब एंटरप्राइज़ के लिए तैयार।

Sub-ms
प्रॉक्सी ओवरहेड
100+
LLM प्रदाता
100%
OpenAI-compatible
Apache-2.0
ओपन सोर्स कोर

ऐसी कीमत जो आपके AI के साथ बढ़े

मुफ़्त शुरू कीजिए, फिर ट्रैफ़िक बढ़ने के साथ प्रबंधित क्लाउड पर बढ़िए — या जब चाहें ओपन सोर्स कोर खुद होस्ट कीजिए।

Developer

अपने पहले AI फ़ीचर रिलीज़ कीजिए — मुफ़्त, पूरी तरह प्रबंधित।

$0/ माह
1 लाख दर्ज अनुरोध / माह

1 लाख के बाद भी ट्रैफ़िक चलता रहता है — अतिरिक्त अनुरोध बस दर्ज नहीं होते।

मुफ़्त शुरू करें
  • सीधे LLM प्रदाता, OpenAI-संगत
  • 1 परिवेश · 1 डेटा प्लेन · 1 सदस्य
  • अनुरोध लॉग (3 दिन प्रतिधारण)
  • API कुंजी रोटेशन, सोशल लॉगिन
  • सामुदायिक सहायता
सबसे लोकप्रिय
Team

कामयाब AI फ़ीचर को प्रोडक्शन स्केल तक ले जाइए।

$149/ माह
10 लाख दर्ज अनुरोध / माह

हर अतिरिक्त 10 लाख पर $100, कभी ब्लॉक नहीं। लगातार 50 लाख/माह से ऊपर रहने पर Enterprise पर चले जाते हैं।

शुरू करें
  • Developer का सब कुछ, साथ में:
  • मॉडल रूटिंग, एन्सेम्बल, लोड बैलेंसिंग & फ़ेलओवर
  • बजट, दर सीमाएँ & गार्डरेल
  • RBAC, टीमें & रिस्पॉन्स कैशिंग
  • 25 सदस्य · 3 परिवेश · 3 डेटा प्लेन
  • 30 दिन प्रतिधारण · मानक SLA
Enterprise

पूरे संगठन में AI पहुँचाइए — शासित, अनुपालक और सहायता के साथ।

Custom
1 करोड़+ दर्ज अनुरोध / माह

कोटा, अतिरिक्त उपयोग, परिनियोजन और SLA — सब आपके अनुसार।

सेल्स से बात करें
  • Team का सब कुछ, साथ में:
  • AWS Bedrock · Azure OpenAI · GCP Vertex AI
  • संगठन प्रबंधन · SSO · ऑडिट लॉग
  • कस्टम गार्डरेल हुक · सिमैंटिक कैश
  • SOC 2 Type II / ISO 27001 / GDPR / HIPAA
  • निजी / VPC परिनियोजन · समर्पित सहायता
ओपन सोर्स प्रोजेक्ट या फ़ंडेड स्टार्टअप? आप मुफ़्त Team प्लान के पात्र हो सकते हैं — Team की सारी सुविधाएँ मुफ़्त, उपयोग सीमाओं और समीक्षा के अधीन।
मुफ़्त के लिए आवेदन करें
खुद होस्ट करना चाहते हैं? AISIX ओपन सोर्स है (Apache-2.0) — पूरा गेटवे खुद चलाइए, मुफ़्त, हमेशा के लिए।
GitHub पर देखें

'दर्ज अनुरोध' क्या है?

गेटवे से होकर रूट और लॉग हुआ हर कॉल, त्रुटियों सहित। एक स्ट्रीमिंग रिस्पॉन्स एक ही अनुरोध गिना जाता है।

मुफ़्त प्लान कभी ब्लॉक नहीं करता

Developer में 1 लाख के बाद भी ट्रैफ़िक चलता रहता है — वे अतिरिक्त अनुरोध बस दर्ज या गिने नहीं जाते। कोई अचानक कटौती नहीं।

अतिरिक्त उपयोग का हिसाब पहले से पता होता है

10 लाख के बाद हम आपके मासिक बिल में हर अतिरिक्त 10 लाख पर $100 अपने आप जोड़ देते हैं। ट्रैफ़िक कभी नहीं रुकता।

AI बनाने, रिलीज़ करने & स्केल करने के लिए ज़रूरी सब कुछ

प्लान की तुलना के लिए स्वाइप कीजिए →

फ़ीचर Developer$0 Team$149/mo EnterpriseCustom
उपयोग & सीमाएँ
दर्ज अनुरोध / माह100K1M10M+
सदस्य125असीमित
परिवेश13असीमित
डेटा प्लेन13असीमित
लॉग प्रतिधारण3 दिन30 दिनअनुकूलित
मेट्रिक प्रतिधारण30 दिन90 दिनअनुकूलित
मासिक अतिरिक्त उपयोगदर्ज नहीं होता$100 / 1Mअनुकूलित
AI गेटवे कोर
एकीकृत OpenAI-संगत API
चैट कम्प्लीशन + स्ट्रीमिंग (SSE)
Anthropic-compatible /v1/messages
एम्बेडिंग · रीरैंक
ऑडियो (वाक्-से-पाठ, TTS)
इमेज जनरेशन
प्रदाता तक सीधा पासथ्रू
Playground
एकल मॉडल सीधे
वर्चुअल / रूटिंग मॉडल
मॉडल एन्सेम्बल (पैनल + जज)
MCP gateway
मॉडल प्रदाता
OpenAI · Anthropic · Gemini · DeepSeek
20+ लोकप्रिय प्रदाता
OpenAI-संगतता से 100+
AWS Bedrock · Azure OpenAI · GCP Vertex AI
रूटिंग & विश्वसनीयता
भारित लोड बैलेंसिंग
स्टिकी कैनरी / A-B रूटिंग
टैग-आधारित सशर्त रूटिंग · वाइल्डकार्ड उपनाम
स्वतः पुनःप्रयास
त्रुटि / 429 पर फ़ॉलबैक
अपस्ट्रीम हेल्थ चेक
सिमैंटिक रूटिंग
लागत / विलंबता / भार को ध्यान में रखकर रूटिंग
दर सीमा
अनुरोध दर सीमाएँ (RPM / RPD)
टोकन दर सीमाएँ (TPM / TPD)
समवर्तीता सीमाएँ
प्रति-टीम / प्रति-सदस्य सीमाएँ
लागत & बजट
प्रति-कुंजी बजट (सख़्त रोक / चेतावनी)
संगठन / परिवेश / प्रदाता बजट
बजट अलर्ट (75 / 90 / 100%)
प्रति-मॉडल लागत ट्रैकिंग
कैशिंग
रिस्पॉन्स कैश (पूर्ण मिलान)
मेमोरी + Redis बैकएंड
बची हुई लागत की टेलीमेट्री
सिमैंटिक कैश
सुरक्षा & गार्डरेल
कीवर्ड / रेगेक्स गार्डरेल
क्लाउड सुरक्षा गार्डरेल
PII छिपाना · कंटेंट मॉडरेशन
कस्टम गार्डरेल हुक
ऑब्ज़र्वेबिलिटी
अनुरोध एक्सेस लॉग
उपयोग & लागत विश्लेषण डैशबोर्डबुनियादी
Prometheus metrics
OpenTelemetry ट्रेस निर्यात
अलर्ट
डेटा लेक / बकेट निर्यात
एक्सेस नियंत्रण & संगठन
API कुंजी प्रबंधन + रोटेशन
वर्चुअल कुंजियाँ & मॉडल अनुमति-सूची
व्यक्तिगत एक्सेस टोकन (CLI / CI)
सोशल लॉगिन (GitHub / Google)
RBAC
टीमें
संगठन प्रबंधन
SSO (SAML / OIDC)
ऑडिट लॉग
परिनियोजन & अनुपालन
प्रबंधित SaaS होस्टिंग
प्रदाता कुंजियों का संग्रहण-समय एन्क्रिप्शन
सेल्फ़-होस्ट / ऑन-प्रिमाइस विकल्प
निजी / VPC परिनियोजन
SOC 2 Type II · ISO 27001 · GDPR · HIPAA
BAA · डेटा पृथक्करण
सहायता & SLA
सहायतासामुदायिकमानकसमर्पित
SLAमानकअनुकूलित

एंटरप्राइज़-स्तर की सुरक्षा, जब आप बढ़ें तब तैयार

AISIX को अपने ही क्लाउड या VPC में चलाइए, पूरे संगठन पर नीति लागू कीजिए और अनुपालन का स्तर पूरा कीजिए — पीछे एक समर्पित टीम और SLA के साथ।

SOC 2 Type II ISO 27001 GDPR HIPAA
SSOSAML / OIDC
Private / VPCअपने ही क्लाउड में चलाइए
संगठन प्रबंधनसभी टीमों पर एक ही नीति
ऑडिट लॉगहर बदलाव, जवाबदेही के साथ
डेटा पृथक्करणएन्वेलप-एन्क्रिप्टेड कुंजियाँ, BAA
समर्पित सहायताऑनबोर्डिंग + SLA

अक्सर पूछे जाने वाले प्रश्न

क्या आप टोकन या LLM उपयोग के लिए शुल्क लेते हैं?+

नहीं। आप अपनी ही प्रदाता कुंजियाँ लाते हैं और अपना LLM बिल सीधे OpenAI, Anthropic और दूसरों को चुकाते हैं। AISIX Cloud सिर्फ़ प्लान की सदस्यता लेता है — आपके टोकन पर कोई मार्कअप नहीं।

AISIX किसी LLM API रिले या टोकन पुनर्विक्रेता से कैसे अलग है?+

रिले अपने ही खातों और सर्वरों के ज़रिए मॉडलों तक पहुँच दोबारा बेचता है — आपके प्रॉम्प्ट, रिस्पॉन्स और API कुंजियाँ ऐसे तीसरे पक्ष से होकर जाती हैं जिस पर आपका नियंत्रण नहीं, और उसके साथ उसका मार्कअप, साझा दर सीमाएँ तथा ऊपरी खाते के थ्रॉटल या बैन होने का जोखिम भी आपके हिस्से आता है। AISIX पुनर्विक्रेता नहीं, आपका अपना गेटवे है। आप अपनी प्रदाता कुंजियाँ जोड़ते हैं और इसे अपने क्लाउड या VPC में चलाते हैं (या एन्वेलप-एन्क्रिप्टेड कुंजियों वाले प्रबंधित प्लेन पर), इसलिए ट्रैफ़िक और डेटा आपके नियंत्रण में रहते हैं। आपको रूटिंग, फ़ेलओवर, दर सीमाएँ, गार्डरेल, बजट और पूरी ऑब्ज़र्वेबिलिटी मिलती है — और आप प्रदाताओं को सीधे भुगतान करते हैं, बिना किसी टोकन मार्कअप के। यह ओपन सोर्स है (Apache-2.0, Rust में बना), प्रोडक्शन-स्तर का है, और स्केल करने पर SOC 2 / ISO 27001 / GDPR / HIPAA के लिए तैयार है।

मेरे मासिक अनुरोध कोटे में क्या गिना जाता है?+

दर्ज अनुरोध — गेटवे से होकर रूट और लॉग हुआ हर कॉल, त्रुटि रिस्पॉन्स सहित। एक स्ट्रीमिंग रिस्पॉन्स एक ही अनुरोध गिना जाता है।

सीमा तक पहुँचने पर क्या होता है?+

Developer में आपका ट्रैफ़िक 1 लाख के बाद भी चलता रहता है — वे अतिरिक्त अनुरोध बस दर्ज नहीं होते, इसलिए आपके लॉग या एनालिटिक्स में नहीं दिखते, और कुछ भी कभी ब्लॉक नहीं होता। Team में हम हर अतिरिक्त 10 लाख अनुरोध पर $100 अपने आप जोड़ देते हैं — ट्रैफ़िक कभी नहीं रुकता। लगातार 50 लाख/माह से ऊपर उपयोग हो तो Enterprise पर जाने का सही समय है।

क्या मैं क्लाउड के बजाय AISIX खुद होस्ट कर सकता हूँ?+

हाँ। AISIX, Apache-2.0 के तहत ओपन सोर्स है — पूरा गेटवे एक ही Rust बाइनरी के रूप में चलाइए, मुफ़्त, सामुदायिक सहायता के साथ। प्रबंधित क्लाउड इसके ऊपर होस्टेड कंट्रोल प्लेन, डैशबोर्ड, बजट, RBAC और SLA जोड़ता है। Enterprise में प्रबंधित स्टैक को आपके अपने क्लाउड / VPC के भीतर भी चलाया जा सकता है।

कौन-कौन से LLM प्रदाता समर्थित हैं?+

एक ही OpenAI-संगत API के ज़रिए 100 से ज़्यादा प्रदाता, जिनमें 20+ लोकप्रिय इंटीग्रेशन शामिल हैं (OpenAI, Anthropic, Gemini, DeepSeek, Groq, Mistral, Cohere, Qwen, Together, Fireworks और अन्य)। क्लाउड-होस्टेड प्रदाता — AWS Bedrock, Azure OpenAI और GCP Vertex AI — Enterprise में उपलब्ध हैं।

SSO, ऑडिट लॉग और अनुपालन कैसे काम करते हैं?+

संगठन प्रबंधन, SSO (SAML / OIDC), ऑडिट लॉग और SOC 2 Type II / ISO 27001 / GDPR / HIPAA — ये सब Enterprise का हिस्सा हैं। अपनी ज़रूरतें और परिनियोजन मॉडल तय करने के लिए सेल्स से बात कीजिए।

मेरा डेटा कहाँ रखा जाता है, और प्रदाता कुंजियाँ कैसे सुरक्षित रहती हैं?+

AISIX Cloud में प्रदाता कुंजियाँ संग्रहण के समय एन्वेलप-एन्क्रिप्टेड रहती हैं और सिर्फ़ अनुरोध के समय डिक्रिप्ट होती हैं; हर डेटा प्लेन अपने ही परिवेश के कीस्पेस तक सीमित रहता है। सेल्फ़-होस्ट में सारा डेटा और सारी कुंजियाँ पूरी तरह आपके अपने इन्फ़्रास्ट्रक्चर के भीतर रहती हैं।

क्या गेटवे विलंबता बढ़ाता है?+

डेटा प्लेन एक नेटिव Rust प्रॉक्सी है जिसका प्रदर्शन आधार सार्वजनिक है: 4 vCPU पर संतृप्ति के समय लगभग 28,300 req/s, कम से मध्यम भार पर एक मिलीसेकंड से कम p50 गेटवे ओवरहेड, और स्ट्रीमिंग में पहले टोकन तक का समय लगभग 0.65 ms अधिक — LLM के अनुमान समय के आगे नगण्य।

ऐसा AI रिलीज़ कीजिए जो आपका कारोबार बढ़ाए

OpenAI-संगत — अपने SDK को AISIX पर इंगित कीजिए और रिलीज़ करना शुरू कीजिए। शुरुआत मुफ़्त, क्रेडिट कार्ड की ज़रूरत नहीं।