HI ▾
API कुंजी पाएँ

हेर्मीज़ API: अपने क्लाइंट को तीन पंक्तियों में बदलें

मानक OpenAI SDKs का उपयोग करके मिनटों में हेर्मीज़ API शुरू करें। यह क्विकस्टार्ट गाइड कॉन्फ़िगरेशन, बेसिक अनुरोध, स्ट्रीमिंग और आपके बिना सेंसर LLM एकीकरण के लिए त्रुटि हैंडलिंग कवर करती है।

प्रति 1M इनपुट टोकन
$0.25
आउटपुट टोकन / 1M
$1.00
कॉन्टेक्स्ट विंडो
100,000
ट्रायल क्रेडिट
$0.50
प्रति मिनट अनुरोध
300

OpenAI SDK इंस्टॉल करें

चूंकि हमारा एंडपॉइंट OpenAI-संगत है, आप पहले से ज्ञात आधिकारिक SDKs का उपयोग कर सकते हैं। इस दृष्टिकोण से आप अन्य विक्रेताओं से बिना एप्लिकेशन लॉजिक बदले स्विच कर सकते हैं। हम Python और Node.js वातावरण के लिए मानक openai पैकेज का समर्थन करते हैं।

सुनिश्चित करें कि आप SDK का एक हालिया संस्करण उपयोग कर रहे हैं ताकि स्ट्रीमिंग और टूल कॉलिंग सुविधाओं के साथ संगतता की गारंटी मिल सके। क्लाइंट लाइब्रेरी स्वचालित रूप से JSON सीरियलाइजेशन और HTTP ट्रांसपोर्ट संभालती है, इसलिए आप नेटवर्क विवरणों पर ध्यान देने के बजाय मॉडल पैरामीटर पर ध्यान केंद्रित कर सकते हैं।

बेस URL और कुंजी कॉन्फ़िगर करें

प्रमाणीकरण Authorization हेडर में Bearer टोकन के माध्यम से किया जाता है। आप हमारे डैशबोर्ड पर ईमेल और पासवर्ड से साइन अप करके अपनी कुंजी प्राप्त करते हैं। ट्रायल के लिए क्रेडिट कार्ड की आवश्यकता नहीं है, और आप किसी भी समय एक्सेस रद्द करने के लिए अपनी कुंजी को पुनः उत्पन्न कर सकते हैं।

हमारे समर्पित एंडपॉइंट के लिए बेस URL सेट करें। यह सुनिश्चित करता है कि सभी अनुरोध डिफ़ॉल्ट OpenAI क्लाउड के बजाय हमारे बिना सेंसर मॉडल इंफ्रास्ट्रक्चर पर जाएं। आप साइनअप के तुरंत बाद 'API कुंजी प्राप्त करें' पेज पर अपनी API कुंजी पा सकते हैं।

अपना पहला अनुरोध भेजें

कनेक्टिविटी परीक्षण के लिए एक मानक चैट पूरक अनुरोध भेजें। मॉडल आईडी हमेशा uncensored होती है। यह मॉडल कानूनी वयस्क उपयोग के लिए सामग्री अस्वीकृति के बिना उत्तर देने के लिए ट्यून्ड है, जो रचनात्मक लेखन, रोलप्ले या असीमित शोध के लिए आदर्श है।

  • टेक्स्ट जनरेशन के लिए POST /v1/chat/completions का उपयोग करें।
  • कॉन्टेक्स्ट विंडो प्रॉम्प्ट और पूर्णता के लिए 100,000 टोकन तक समर्थन करती है।
  • अनुरोध इनपुट और आउटपुट टोकन गणना के आधार पर चार्ज किए जाते हैं।
curl https://api.hermesllmapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

स्ट्रीमिंग (SSE) सक्षम करें

बेहतर उपयोगकर्ता अनुभव के लिए, स्ट्रीमिंग सक्षम करें ताकि जनरेट होने पर टोकन प्राप्त हों। यह लंबे उत्तरों के लिए अनुभूत लेटेंसी को कम करता है। सर्वर सर्वर-सेंट इवेंट्स (SSE) लौटाता है जिन्हें आपका क्लाइंट रियल-टाइम में पार्स कर सकता है।

अपने अनुरोध बॉडी में stream पैरामीटर को true पर सेट करें। SDK चंक प्राप्त होते ही उन्हें लौटाएगा। यह उन चैट इंटरफ़ेस के लिए विशेष रूप से उपयोगी है जहाँ आप पूरे प्रतिक्रिया के समाप्त होने का इंतज़ार करने के बजाय पाठ को क्रमबद्ध रूप से प्रदर्शित करना चाहते हैं।

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

टूल/फ़ंक्शन कॉलिंग का उपयोग करें

हमारी API फ़ंक्शन कॉलिंग का समर्थन करती है, जिससे मॉडल बाहरी टूल निष्पादन के लिए संरचित JSON आउटपुट कर सकता है। अपने फ़ंक्शनों को tools पैरामीटर में परिभाषित करें, और मॉडल यदि उचित हो तो प्रतिक्रिया में tool_calls लौटाएगा।

यह सुविधा OpenAI स्पेसिफिकेशन में दस्तावेज के अनुसार पूरी तरह से काम करती है। आप फ़ंक्शन नाम और तर्कों को पार्स कर सकते हैं, अपनी बैकएंड लॉजिक को एक्जीक्यूट कर सकते हैं, और परिणामों को बातचीत में वापस फीड कर सकते हैं। यह मानक OpenAI SDK टूल-कॉलिंग वर्कफ़्लो के साथ पूरी तरह संगत है।

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.hermesllmapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

उपलब्ध मॉडल जाँचें

कनेक्टिविटी सत्यापित करने और उपलब्ध विकल्प देखने के लिए मॉडल्स एंडपॉइंट को क्वेरी करें। वर्तमान में, हम एक अकेले समर्पित मॉडल प्रदान करते हैं: uncensored। यह सरलता मॉडल रूटिंग या सामान्य इंफ्रास्ट्रक्चर की जटिलता से बचाती है, जो भविष्यवाणी योग्य व्यवस्था सुनिश्चित करती है।

आप प्रमाणीकरण मुद्दों को डिबग करने के लिए इस एंडपॉइंट का भी उपयोग कर सकते हैं। यदि अनुरोध विफल हो जाता है, तो अपनी API कुंजी वैधता और नेटवर्क कनेक्टिविटी की जाँच करें। प्रतिक्रिया मॉडल विवरण, कॉन्टेक्स्ट विंडो आकार और टोकन सीमाओं सहित सूचीबद्ध करेगी।

from openai import OpenAI

client = OpenAI(base_url="https://api.hermesllmapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

रेट लिमिट और त्रुटियों को संभालें

हमारी API प्रति कुंजी प्रति मिनट 300 अनुरोधों की एक सीमा लागू करती है। यदि आप इससे अधिक हो जाते हैं, तो आपको 429 त्रुटि मिलेगी। हम जटिल प्रॉम्प्ट्स या बड़े कॉन्टेक्स्ट विंडो के लिए 8 MB अनुरोध बॉडी सीमा का भी समर्थन करते हैं।

सामान्य त्रुटियों में 401 (अवैध कुंजी) और 402 (अपर्याप्त क्रेडिट) शामिल हैं। प्रीपेड क्रेडिट कभी समाप्त नहीं होता, इसलिए आप अपनी सुविधानुसार टॉप-अप कर सकते हैं। बड़ी खरीदारी के लिए क्रेडिट बोनस स्वचालित रूप से लागू होते हैं: $50 से +5% और $100 से +10%।

तकनीकी विवरण

API की सभी असली सीमाएँ और सुविधाएँ एक जगह — क्रेडिट जोड़ने से पहले इन्हें देख लें।

मदमान
API फ़ॉर्मेटOpenAI के अनुकूल: कोई भी OpenAI SDK चलेगा — बस base URL और कुंजी बदलें
मॉडल IDuncensored
एंडपॉइंटPOST /v1/chat/completions · GET /v1/models
प्रमाणीकरणAuthorization: Bearer YOUR_KEY
Base URLhttps://api.hermesllmapi.com/v1
अधिकतम आउटपुट100,000-टोकन विंडो के शेष हिस्से तक; max_tokens वैकल्पिक (अलग सीमा नहीं)
JSON मोडresponse_format: {"type": "json_object"}
पैरामीटरtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
फ़ंक्शन कॉलिंगहाँ — tools, tool_choice; जवाब में tool_calls, स्ट्रीमिंग में भी; नतीजे role: tool संदेश से भेजें
कॉन्टेक्स्ट विंडो100,000 टोकन (इनपुट + आउटपुट मिलाकर)
स्ट्रीमिंगहाँ — server-sent events; आख़िरी हिस्से में टोकन उपयोग
समानांतर अनुरोधप्रति कुंजी एक साथ 8 तक
रिस्पॉन्स हेडरX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
रेट लिमिटप्रति कुंजी प्रति मिनट 300 अनुरोध
अनुरोध का आकार8 MB तक
कीमतप्रति 10 लाख इनपुट टोकन $0.25 · प्रति 10 लाख आउटपुट टोकन $1.00
बोनस$50 से +5%, $100 से +10%
टॉप-अपUSDT (TRC20) या USDC (Base), $10 से $500 तक कोई भी पूरी राशि
मुफ़्त ट्रायल क्रेडिट$0.50, 7 दिन, कार्ड की ज़रूरत नहीं · ट्रायल कुंजी: 2 समानांतर अनुरोध, 60 प्रति मिनट; पहले टॉप-अप के बाद पूरी सीमाएँ (8 और 300)
बिलिंगप्रीपेड क्रेडिट, असली उपयोग के अनुसार; त्रुटियाँ और अस्वीकृतियाँ मुफ़्त
वैधताभुगतान किया क्रेडिट कभी समाप्त नहीं होता, कोई सदस्यता नहीं
कुंजियाँहर खाते में एक सक्रिय कुंजी; नई कुंजी पुरानी की जगह लेती है
साइन इनGoogle या ईमेल और पासवर्ड
सामग्रीवयस्क सामग्री की अनुमति; नाबालिगों से जुड़ी यौन सामग्री अस्वीकार

त्रुटि कोड

त्रुटियाँ JSON में स्थिर type के साथ आती हैं; विफल या अस्वीकृत अनुरोधों का शुल्क नहीं लगता।

कोडप्रकारअर्थ
400bad_requestअमान्य JSON, खाली संदेश, गलत पैरामीटर या कॉन्टेक्स्ट विंडो से अधिक
401missing_key · invalid_key · key_revokedकुंजी नहीं, गलत कुंजी या नई कुंजी से बदली गई
402no_creditक्रेडिट ख़त्म — टॉप-अप करें, तुरंत चालू
403content_blockedनाबालिगों से जुड़ी यौन सामग्री — अस्वीकार, कोई शुल्क नहीं
404not_foundअज्ञात एंडपॉइंट
413request_too_largeबॉडी 8 MB से बड़ी
429rate_limited · concurrency300/मिनट या 8 समानांतर से अधिक — रुककर फिर कोशिश करें
503upstream_busyमॉडल व्यस्त — कुछ सेकंड बाद फिर कोशिश करें
01

प्रश्न और उत्तर

क्या हेर्मीज़ API इमेज या ऑडियो जनरेशन का समर्थन करता है?

नहीं, हम वर्तमान में केवल टेक्स्ट-आधारित चैट-कम्प्लीशन्स API प्रदान करते हैं। हम एम्बेडिंग्स, इमेज, ऑडियो या वीडियो जनरेशन का समर्थन नहीं करते हैं, न ही हम फाइन-ट्यूनिंग प्रदान करते हैं। हमारा फोकस मानक OpenAI-कम्पैटिबल क्लाइंट्स के लिए एक सरल, बिना सेंसर टेक्स्ट मॉडल प्रदान करने पर है।

बिना सेंसर मॉडल वयस्क सामग्री को कैसे संभालता है?

मॉडल कानूनी वयस्क, काल्पनिक या विवादास्पद विषयों को अस्वीकार नहीं करता है। हालाँकि, एक कठिन सामग्री सीमा है: किशोरों से संबंधित यौन सामग्री वाले अनुरोध हमेशा ब्लॉक किए जाते हैं। यह आपके प्रॉम्प्ट्स पर लागू एकमात्र कठोर प्रतिबंध है।

यदि मेरा क्रेडिट खत्म हो जाता है तो क्या होता है?

आपकी API कुंजी सक्रिय रहती है, लेकिन अनुरोध 402 त्रुटि लौटाएंगे जो अपर्याप्त फंड की ओर संकेत करते हैं। आप किसी भी समय क्रिप्टो (USDT या USDC) से अपने खाते में टॉप-अप कर सकते हैं। आपका प्रीपेड क्रेडिट कभी समाप्त नहीं होता, इसलिए आप तैयार होने पर फंड जोड़ सकते हैं।

आपकी कुंजी बस एक फ़ॉर्म दूर है

एक खाता बनाएं, कुंजी कॉपी करें, बेस URL बदलें। सेटअप यही है।

Get API keyRead the docs