हेर्मीज़ API: अपने क्लाइंट को तीन पंक्तियों में बदलें
मानक OpenAI SDKs का उपयोग करके मिनटों में हेर्मीज़ API शुरू करें। यह क्विकस्टार्ट गाइड कॉन्फ़िगरेशन, बेसिक अनुरोध, स्ट्रीमिंग और आपके बिना सेंसर LLM एकीकरण के लिए त्रुटि हैंडलिंग कवर करती है।
- प्रति 1M इनपुट टोकन
- $0.25
- आउटपुट टोकन / 1M
- $1.00
- कॉन्टेक्स्ट विंडो
- 100,000
- ट्रायल क्रेडिट
- $0.50
- प्रति मिनट अनुरोध
- 300
OpenAI SDK इंस्टॉल करें
चूंकि हमारा एंडपॉइंट OpenAI-संगत है, आप पहले से ज्ञात आधिकारिक SDKs का उपयोग कर सकते हैं। इस दृष्टिकोण से आप अन्य विक्रेताओं से बिना एप्लिकेशन लॉजिक बदले स्विच कर सकते हैं। हम Python और Node.js वातावरण के लिए मानक openai पैकेज का समर्थन करते हैं।
सुनिश्चित करें कि आप SDK का एक हालिया संस्करण उपयोग कर रहे हैं ताकि स्ट्रीमिंग और टूल कॉलिंग सुविधाओं के साथ संगतता की गारंटी मिल सके। क्लाइंट लाइब्रेरी स्वचालित रूप से JSON सीरियलाइजेशन और HTTP ट्रांसपोर्ट संभालती है, इसलिए आप नेटवर्क विवरणों पर ध्यान देने के बजाय मॉडल पैरामीटर पर ध्यान केंद्रित कर सकते हैं।
बेस URL और कुंजी कॉन्फ़िगर करें
प्रमाणीकरण Authorization हेडर में Bearer टोकन के माध्यम से किया जाता है। आप हमारे डैशबोर्ड पर ईमेल और पासवर्ड से साइन अप करके अपनी कुंजी प्राप्त करते हैं। ट्रायल के लिए क्रेडिट कार्ड की आवश्यकता नहीं है, और आप किसी भी समय एक्सेस रद्द करने के लिए अपनी कुंजी को पुनः उत्पन्न कर सकते हैं।
हमारे समर्पित एंडपॉइंट के लिए बेस URL सेट करें। यह सुनिश्चित करता है कि सभी अनुरोध डिफ़ॉल्ट OpenAI क्लाउड के बजाय हमारे बिना सेंसर मॉडल इंफ्रास्ट्रक्चर पर जाएं। आप साइनअप के तुरंत बाद 'API कुंजी प्राप्त करें' पेज पर अपनी API कुंजी पा सकते हैं।
अपना पहला अनुरोध भेजें
कनेक्टिविटी परीक्षण के लिए एक मानक चैट पूरक अनुरोध भेजें। मॉडल आईडी हमेशा uncensored होती है। यह मॉडल कानूनी वयस्क उपयोग के लिए सामग्री अस्वीकृति के बिना उत्तर देने के लिए ट्यून्ड है, जो रचनात्मक लेखन, रोलप्ले या असीमित शोध के लिए आदर्श है।
- टेक्स्ट जनरेशन के लिए
POST /v1/chat/completionsका उपयोग करें। - कॉन्टेक्स्ट विंडो प्रॉम्प्ट और पूर्णता के लिए 100,000 टोकन तक समर्थन करती है।
- अनुरोध इनपुट और आउटपुट टोकन गणना के आधार पर चार्ज किए जाते हैं।
curl https://api.hermesllmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
स्ट्रीमिंग (SSE) सक्षम करें
बेहतर उपयोगकर्ता अनुभव के लिए, स्ट्रीमिंग सक्षम करें ताकि जनरेट होने पर टोकन प्राप्त हों। यह लंबे उत्तरों के लिए अनुभूत लेटेंसी को कम करता है। सर्वर सर्वर-सेंट इवेंट्स (SSE) लौटाता है जिन्हें आपका क्लाइंट रियल-टाइम में पार्स कर सकता है।
अपने अनुरोध बॉडी में stream पैरामीटर को true पर सेट करें। SDK चंक प्राप्त होते ही उन्हें लौटाएगा। यह उन चैट इंटरफ़ेस के लिए विशेष रूप से उपयोगी है जहाँ आप पूरे प्रतिक्रिया के समाप्त होने का इंतज़ार करने के बजाय पाठ को क्रमबद्ध रूप से प्रदर्शित करना चाहते हैं।
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
टूल/फ़ंक्शन कॉलिंग का उपयोग करें
हमारी API फ़ंक्शन कॉलिंग का समर्थन करती है, जिससे मॉडल बाहरी टूल निष्पादन के लिए संरचित JSON आउटपुट कर सकता है। अपने फ़ंक्शनों को tools पैरामीटर में परिभाषित करें, और मॉडल यदि उचित हो तो प्रतिक्रिया में tool_calls लौटाएगा।
यह सुविधा OpenAI स्पेसिफिकेशन में दस्तावेज के अनुसार पूरी तरह से काम करती है। आप फ़ंक्शन नाम और तर्कों को पार्स कर सकते हैं, अपनी बैकएंड लॉजिक को एक्जीक्यूट कर सकते हैं, और परिणामों को बातचीत में वापस फीड कर सकते हैं। यह मानक OpenAI SDK टूल-कॉलिंग वर्कफ़्लो के साथ पूरी तरह संगत है।
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.hermesllmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
उपलब्ध मॉडल जाँचें
कनेक्टिविटी सत्यापित करने और उपलब्ध विकल्प देखने के लिए मॉडल्स एंडपॉइंट को क्वेरी करें। वर्तमान में, हम एक अकेले समर्पित मॉडल प्रदान करते हैं: uncensored। यह सरलता मॉडल रूटिंग या सामान्य इंफ्रास्ट्रक्चर की जटिलता से बचाती है, जो भविष्यवाणी योग्य व्यवस्था सुनिश्चित करती है।
आप प्रमाणीकरण मुद्दों को डिबग करने के लिए इस एंडपॉइंट का भी उपयोग कर सकते हैं। यदि अनुरोध विफल हो जाता है, तो अपनी API कुंजी वैधता और नेटवर्क कनेक्टिविटी की जाँच करें। प्रतिक्रिया मॉडल विवरण, कॉन्टेक्स्ट विंडो आकार और टोकन सीमाओं सहित सूचीबद्ध करेगी।
from openai import OpenAI
client = OpenAI(base_url="https://api.hermesllmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
रेट लिमिट और त्रुटियों को संभालें
हमारी API प्रति कुंजी प्रति मिनट 300 अनुरोधों की एक सीमा लागू करती है। यदि आप इससे अधिक हो जाते हैं, तो आपको 429 त्रुटि मिलेगी। हम जटिल प्रॉम्प्ट्स या बड़े कॉन्टेक्स्ट विंडो के लिए 8 MB अनुरोध बॉडी सीमा का भी समर्थन करते हैं।
सामान्य त्रुटियों में 401 (अवैध कुंजी) और 402 (अपर्याप्त क्रेडिट) शामिल हैं। प्रीपेड क्रेडिट कभी समाप्त नहीं होता, इसलिए आप अपनी सुविधानुसार टॉप-अप कर सकते हैं। बड़ी खरीदारी के लिए क्रेडिट बोनस स्वचालित रूप से लागू होते हैं: $50 से +5% और $100 से +10%।
तकनीकी विवरण
API की सभी असली सीमाएँ और सुविधाएँ एक जगह — क्रेडिट जोड़ने से पहले इन्हें देख लें।
| मद | मान |
|---|---|
| API फ़ॉर्मेट | OpenAI के अनुकूल: कोई भी OpenAI SDK चलेगा — बस base URL और कुंजी बदलें |
| मॉडल ID | uncensored |
| एंडपॉइंट | POST /v1/chat/completions · GET /v1/models |
| प्रमाणीकरण | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.hermesllmapi.com/v1 |
| अधिकतम आउटपुट | 100,000-टोकन विंडो के शेष हिस्से तक; max_tokens वैकल्पिक (अलग सीमा नहीं) |
| JSON मोड | response_format: {"type": "json_object"} |
| पैरामीटर | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| फ़ंक्शन कॉलिंग | हाँ — tools, tool_choice; जवाब में tool_calls, स्ट्रीमिंग में भी; नतीजे role: tool संदेश से भेजें |
| कॉन्टेक्स्ट विंडो | 100,000 टोकन (इनपुट + आउटपुट मिलाकर) |
| स्ट्रीमिंग | हाँ — server-sent events; आख़िरी हिस्से में टोकन उपयोग |
| समानांतर अनुरोध | प्रति कुंजी एक साथ 8 तक |
| रिस्पॉन्स हेडर | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| रेट लिमिट | प्रति कुंजी प्रति मिनट 300 अनुरोध |
| अनुरोध का आकार | 8 MB तक |
| कीमत | प्रति 10 लाख इनपुट टोकन $0.25 · प्रति 10 लाख आउटपुट टोकन $1.00 |
| बोनस | $50 से +5%, $100 से +10% |
| टॉप-अप | USDT (TRC20) या USDC (Base), $10 से $500 तक कोई भी पूरी राशि |
| मुफ़्त ट्रायल क्रेडिट | $0.50, 7 दिन, कार्ड की ज़रूरत नहीं · ट्रायल कुंजी: 2 समानांतर अनुरोध, 60 प्रति मिनट; पहले टॉप-अप के बाद पूरी सीमाएँ (8 और 300) |
| बिलिंग | प्रीपेड क्रेडिट, असली उपयोग के अनुसार; त्रुटियाँ और अस्वीकृतियाँ मुफ़्त |
| वैधता | भुगतान किया क्रेडिट कभी समाप्त नहीं होता, कोई सदस्यता नहीं |
| कुंजियाँ | हर खाते में एक सक्रिय कुंजी; नई कुंजी पुरानी की जगह लेती है |
| साइन इन | Google या ईमेल और पासवर्ड |
| सामग्री | वयस्क सामग्री की अनुमति; नाबालिगों से जुड़ी यौन सामग्री अस्वीकार |
त्रुटि कोड
त्रुटियाँ JSON में स्थिर type के साथ आती हैं; विफल या अस्वीकृत अनुरोधों का शुल्क नहीं लगता।
| कोड | प्रकार | अर्थ |
|---|---|---|
400 | bad_request | अमान्य JSON, खाली संदेश, गलत पैरामीटर या कॉन्टेक्स्ट विंडो से अधिक |
401 | missing_key · invalid_key · key_revoked | कुंजी नहीं, गलत कुंजी या नई कुंजी से बदली गई |
402 | no_credit | क्रेडिट ख़त्म — टॉप-अप करें, तुरंत चालू |
403 | content_blocked | नाबालिगों से जुड़ी यौन सामग्री — अस्वीकार, कोई शुल्क नहीं |
404 | not_found | अज्ञात एंडपॉइंट |
413 | request_too_large | बॉडी 8 MB से बड़ी |
429 | rate_limited · concurrency | 300/मिनट या 8 समानांतर से अधिक — रुककर फिर कोशिश करें |
503 | upstream_busy | मॉडल व्यस्त — कुछ सेकंड बाद फिर कोशिश करें |
प्रश्न और उत्तर
क्या हेर्मीज़ API इमेज या ऑडियो जनरेशन का समर्थन करता है?
नहीं, हम वर्तमान में केवल टेक्स्ट-आधारित चैट-कम्प्लीशन्स API प्रदान करते हैं। हम एम्बेडिंग्स, इमेज, ऑडियो या वीडियो जनरेशन का समर्थन नहीं करते हैं, न ही हम फाइन-ट्यूनिंग प्रदान करते हैं। हमारा फोकस मानक OpenAI-कम्पैटिबल क्लाइंट्स के लिए एक सरल, बिना सेंसर टेक्स्ट मॉडल प्रदान करने पर है।
बिना सेंसर मॉडल वयस्क सामग्री को कैसे संभालता है?
मॉडल कानूनी वयस्क, काल्पनिक या विवादास्पद विषयों को अस्वीकार नहीं करता है। हालाँकि, एक कठिन सामग्री सीमा है: किशोरों से संबंधित यौन सामग्री वाले अनुरोध हमेशा ब्लॉक किए जाते हैं। यह आपके प्रॉम्प्ट्स पर लागू एकमात्र कठोर प्रतिबंध है।
यदि मेरा क्रेडिट खत्म हो जाता है तो क्या होता है?
आपकी API कुंजी सक्रिय रहती है, लेकिन अनुरोध 402 त्रुटि लौटाएंगे जो अपर्याप्त फंड की ओर संकेत करते हैं। आप किसी भी समय क्रिप्टो (USDT या USDC) से अपने खाते में टॉप-अप कर सकते हैं। आपका प्रीपेड क्रेडिट कभी समाप्त नहीं होता, इसलिए आप तैयार होने पर फंड जोड़ सकते हैं।
आपकी कुंजी बस एक फ़ॉर्म दूर है
एक खाता बनाएं, कुंजी कॉपी करें, बेस URL बदलें। सेटअप यही है।