Drop-In Compatibiliteit
Gebruik de officiële OpenAI SDK door simpelweg de base_url en API-sleutel aan te passen. Ondersteunt streaming via SSE en function calling vanaf de start.
Ongecensureerd open-weight model API
Een dedicated, ongecensureerd LLM endpoint compatibel met standaard OpenAI SDK's. Geen content filters voor wettelijk volwassen gebruik, geen complexiteit in model routing, gewoon tekst in en tekst uit.
Probeer het met één verzoek
curl https://api.hermesllmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'from openai import OpenAI
client = OpenAI(base_url="https://api.hermesllmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.hermesllmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Gebruik de officiële OpenAI SDK door simpelweg de base_url en API-sleutel aan te passen. Ondersteunt streaming via SSE en function calling vanaf de start.
Wij serveren één open-weight model getuned om zonder weigeringen te antwoorden op wettelijk volwassen, fictief of controversieel onderwerp. Het is geen GPT, Claude of DeepSeek.
Pay-as-you-go prepaid tegoed zonder maandelijkse kosten. Tokens worden gefactureerd tegen $0,25/1M input en $1,00/1M output. tegoed vervalt nooit.
Verwerk tot 100.000 tokens per verzoek (prompt + completion). Ideaal voor lange documenten, codebases of uitgebreide gesprekken zonder afkappen.
Meld je aan met alleen e-mail en wachtwoord. Je prompts worden niet gebruikt voor het trainen van je modelgegevens.
300 verzoeken per minuut per sleutel met een limiet van 8 MB voor het verzoeklichaam. Eén sleutel per account, direct intrekbaar.
Meld je aan met e-mail en wachtwoord om direct je API-sleutel te ontvangen; geen creditcard nodig voor de proefperiode.
Wijs je OpenAI-compatible client naar https://api.hermesllmapi.com/v1 en stel het model in op 'uncensored'.
Stuur standaard chat completion-verzoeken en ontvang ongecensureerde tekstantwoorden met volledige streaming-ondersteuning.
Genereer ongecensureerde verhalen, personagedialogen en verhalen met een volwassen thema zonder dat het model weigert op basis van inhoudsfilters. Ideaal voor fictieauteurs die grenzen verkennen.
Analyseer grote codebases of documenten op kwetsbaarheden zonder dat de API technische of controversiële bevindingen blokkeert. Ontvang ruwe, ongefilterde modeluitvoer.
Verwerk lange documenten tot 100k tokens om gestructureerde data te extraheren. Het open-weight model behandelt complexe instructies zonder voortijdige weigeringen.
Genereer grote volumes synthetische data voor het trainen van je eigen modellen. Gebruik de API om diverse, ongecensureerde voorbeelden voor specifieke domeinen te maken.
Veel ontwikkelaars hebben een uncensored DeepSeek-alternatief nodig of een open-source model dat geen wettelijk volwassen inhoud filtert. Terwijl grote leveranciers zoals OpenAI of Anthropic strikte veiligheidslagen toepassen, bedient Hermes API een enkel open-weight model dat is afgestemd op het direct beantwoorden van vragen. Deze aanpak vermijdt de complexiteit van model routing of generieke infrastructuur. Je krijgt een voorspelbare, eenvoudige API-ervaring. Het model is geen GPT, Claude, Gemini, Grok of DeepSeek; het is een apart open-weight model dat op onze servers draait. Dit zorgt voor consistent gedrag zonder onverwacht beleidswijzigingen van grote tech-bedrijven. Je betaalt voor tokens, niet voor een abonnement op een breder ecosysteem. De prijzen zijn eenvoudig: $0,25 per miljoen input tokens en $1,00 per miljoen output tokens. Prepaid tegoed vervalt nooit, dus je kunt gebruik pauzeren zonder geld te verliezen. Dit maakt het ideaal voor projecten waar kostenpredictabiliteit en inhoudsvrijheid belangrijker zijn dan merkherkenning.
De kernwaarde van Hermes API is het gebrek aan inhoudweigeringen voor wettelijk volwassen gebruik. Het model beantwoordt controversiële, seksuele of fictieve onderwerpen direct. Het pest je niet over veiligheidsbeleid. De enige harde limiet is dat seksuele inhoud met minderjarigen altijd wordt geblokkeerd. Dit is een open-weight model, wat betekent dat de gewichten openbaar beschikbaar zijn, maar wij hosten de inferentielaag voor jouw gemak. Je hoeft geen GPU's te beheren of vLLM in te stellen. De endpoint ondersteunt streaming-antwoorden via Server-Sent Events (SSE) en standaard tool/function calling. Dit stelt je in staat het te integreren in bestaande toepassingen die OpenAI-gedrag verwachten. Het model is geen fine-tune van GPT-4 of Llama 3; het is een aparte architectuur geoptimaliseerd voor responsiviteit. Je kunt de modelcard inspecteren als je de base weights wilt verifiëren. Het belangrijkste voordeel is eenvoud: één model, één endpoint, één prijs.
Hermes API is ontworpen als een drop-in vervanging voor de OpenAI SDK. Je kunt de officiële bibliotheken in Python, Node.js of Go gebruiken. Pas simpelweg de base_url aan naar https://api.hermesllmapi.com/v1 en lever je API-sleutel. De model-ID die je moet gebruiken is uncensored. Deze compatibiliteit strekt zich uit tot streaming en function calling. Als je een bibliotheek zoals LangChain of LlamaIndex gebruikt, kun je de provider waarschijnlijk met minimale code-aanpassingen wisselen. Dit is vooral handig als je al aan het bouwen bent met OpenAI maar ongecensureerd gedrag wilt testen zonder je datapipeline te herschrijven. De API ondersteunt POST /v1/chat/completions en GET /v1/models. Het ondersteunt geen embeddings, image generatie of audio. Als je applicatie afhankelijk is van die functies, is deze API geen volledige vervanging. Voor tekstgeneratie en tool use is de compatibiliteit echter bijna perfect. Je kunt eenvoudig terug- en overschakelen om outputs te vergelijken.
Wij geloven in transparante, eenvoudige prijzen. Er zijn geen maandelijkse abonnementen of verborgen kosten. Je laadt tegoed voor en tokens worden afgeschreven naarmate je ze gebruikt. Het tarief is $0,25 per miljoen input tokens en $1,00 per miljoen output tokens. Dit is concurrerend voor een ongecensureerde, gehoste service. Je kunt opwaarderen vanaf $10 met crypto (USDT of USDC). Als je $50 voorlaadt, ontvang je een bonus tegoed van 5%. Het voorladen van $100 geeft je een bonus van 10%. Je tegoed vervalt nooit, dus je kunt het in je eigen tempo gebruiken. Nieuwe accounts ontvangen $0,50 aan proeftegoed geldig voor 7 dagen, geen creditcard nodig. Dit stelt je in staat de API grondig te testen voordat je geld investeert. Het prepaid model zorgt ervoor dat je nooit een verrassende rekening krijgt. Als je tegoed op raakt, stoppen de verzoeken totdat je opwert. Dit is ideaal voor ontwikkelaars die hun uitgaven precies willen beheersen.
De API ondersteunt een contextvenster van 100.000 tokens, inclusief zowel de prompt als de completion. Dit stelt je in staat lange documenten, uitgebreide codebases of lange gesprekken in één verzoek te verwerken. De grootte van het verzoeklichaam is beperkt tot 8 MB, wat de meeste grote inputs verwerkt. Je bent beperkt tot 300 verzoeken per minuut per API-sleutel. Dit is voldoende voor de meeste ontwikkel- en gematigde productiewerklasten. Elk account heeft één API-sleutel, die je op elk moment kunt regenereren. Het regenereren van de sleutel maakt de oude sleutel direct ongeldig, dus zorg ervoor dat je client is bijgewerkt. Het systeem biedt geen fine-tuning of embeddings. Als je die nodig hebt, moet je een andere service gebruiken. De limieten zijn ontworpen om misbruik te voorkomen terwijl de kosten laag blijven voor legitieme gebruikers. Je kunt je gebruik monitoren via het dashboard, hoewel gedetailleerde logs momenteel niet worden aangeboden. Voor de meeste tekstgebaseerde taken is het 100k contextvenster meer dan genoeg om complexe instructies aan te kunnen.
Je privacy is een prioriteit. We vereisen alleen een e-mail en wachtwoord om een account aan te maken. Geen telefoonnummer of creditcard nodig voor de proefversie. Je prompts worden niet gebruikt om het model te trainen. Dit is een belangrijk verschil met sommige gratis diensten die je data gebruiken voor verbetering. We delen je gegevens niet met derden. Het model draait op onze eigen GPU-servers en wij beheren de infrastructuur end-to-end. Dit betekent dat je je geen zorgen hoeft te maken over datavertrek of opslag. De API is ontworpen voor ontwikkelaars die een schone, privé interface willen. We bieden geen SLA's of certificeringen zoals SOC2, dus als je garanties op enterprise-niveau nodig hebt, is dit misschien niet de juiste keuze. De service is onafhankelijk en niet gelieerd aan een grote tech-leverancier. Je gegevens zijn van jou en we respecteren dat. Je kunt je account op elk moment verwijderen om je gegevens te verwijderen.
Nee, dit is een onafhankelijke service. We hosten een open-weight model en bieden een OpenAI-compatible endpoint. We zijn niet de oorspronkelijke makers van de modelgewichten, noch zijn we gelieerd aan een grote leverancier zoals OpenAI of Together AI. We bieden gewoon de infrastructuur om er toegang toe te krijgen.
Dit betekent dat het model niet weigert om wettelijke volwassen, fictieve of controversiële onderwerpen te beantwoorden op basis van veiligheidsfilters. Het zal seksuele inhoud, scheldwoorden of politieke meningen genereren als daarom wordt gevraagd. De enige harde limiet is dat seksuele inhoud met minderjarigen altijd wordt geblokkeerd. Dit maakt het ideaal voor creatief schrijven en roleplay.
Ja. Je kunt de officiële OpenAI SDK gebruiken door de <code>base_url</code> in te stellen op <code>https://api.hermesllmapi.com/v1</code> en het model op <code>uncensored</code>. De API ondersteunt standaard chatcompleties, streaming en function calling. Het is ontworpen als een drop-in vervanging voor OpenAI-endpoints.
Nee, je prepaid tegoed verloopt nooit. Je kunt op elk moment opwaarderen en het tegoed gebruiken wanneer je maar wilt. Er zijn geen maandelijkse kosten of abonnementverlengingen. Dit maakt het kostenefficiënt voor lange-termijn projecten waarbij het gebruik intermitterend is.
Het contextvenster is 100.000 tokens, wat zowel de input prompt als de output completion omvat. Dit stelt je in staat grote documenten of lange gesprekken in één verzoek te verwerken. De maximale grootte van het verzoeklichaam is 8 MB.
Maak een account aan, kopieer de sleutel, verander de basis-URL. Dat is de hele setup.