Compatibilité prête à l’emploi
Utilisez le SDK OpenAI officiel en modifiant simplement le base_url et la clé API. Prend en charge le streaming via SSE et l'appel d'outils/fonctions dès le départ.
API de modèle à poids ouverts sans censure
Un endpoint LLM dédié et sans censure, compatible avec les SDK OpenAI standard. Aucun filtre de contenu pour une utilisation légale pour adultes, aucune complexité de routage de modèle, juste du texte en entrée et du texte en sortie.
Essayez avec une seule requête
curl https://api.hermesllmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'from openai import OpenAI
client = OpenAI(base_url="https://api.hermesllmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.hermesllmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Utilisez le SDK OpenAI officiel en modifiant simplement le base_url et la clé API. Prend en charge le streaming via SSE et l'appel d'outils/fonctions dès le départ.
Nous servons un seul modèle à poids ouverts ajusté pour répondre sans refus pour des sujets légaux pour adultes, fictifs ou controversés. Ce n'est pas GPT, Claude ou DeepSeek.
Crédit prépayé de paiement à l'usage sans frais mensuels. Les tokens sont facturés à 0,25 $ par million de tokens d'entrée et 1,00 $ par million de tokens de sortie. Le crédit n'expire jamais.
Traitez jusqu'à 100 000 tokens par requête (prompt + complétion). Idéal pour les longs documents, les bases de code ou les conversations prolongées sans troncature.
Inscription minimale avec uniquement e-mail et mot de passe. Vos prompts ne sont pas utilisés pour entraîner le modèle avec vos données.
300 requêtes par minute par clé avec une limite de corps de requête de 8 Mo. Une clé par compte, révocable instantanément.
Inscrivez-vous avec email et mot de passe pour recevoir votre clé API immédiatement ; aucune carte bancaire n'est requise pour l'essai.
Pointez votre client compatible OpenAI vers https://api.hermesllmapi.com/v1 et définissez le modèle sur « sans censure ».
Envoyez des requêtes standard de complétion de chat et recevez des réponses textuelles sans censure avec un support complet du streaming.
Générez des récits sans censure, des dialogues de personnages et des histoires à thème adulte sans que le modèle ne refuse en raison des filtres de contenu. Idéal pour les auteurs de fiction testant les limites.
Analysez de grandes bases de code ou des documents pour les vulnérabilités sans que l'API ne bloque les résultats techniques ou controversés. Obtenez des sorties de modèle brutes et sans filtre.
Traitez de longs documents jusqu'à 100k tokens pour extraire des données structurées. Le modèle à poids ouverts gère les instructions complexes sans refus prématurés.
Générez de grands volumes de données synthétiques pour entraîner vos propres modèles. Utilisez l'API pour créer des exemples diversifiés et sans censure pour des domaines spécifiques.
De nombreux développeurs recherchent une alternative à un deepseek sans censure ou un modèle open-source qui ne filtre pas le contenu adulte légal. Alors que les grands éditeurs comme OpenAI ou Anthropic appliquent des couches de sécurité strictes, l'API Hermes propose un seul modèle à poids ouverts ajusté pour répondre directement aux questions. Cette approche évite la complexité du routage de modèles ou d'une infrastructure générique. Vous bénéficiez d'une expérience API prévisible et simple. Le modèle n'est ni GPT, ni Claude, ni Gemini, ni Grok, ni DeepSeek ; c'est un modèle à poids ouverts distinct fonctionnant sur nos serveurs. Cela garantit un comportement constant sans mises à jour de politique inattendues de la part des grandes entreprises technologiques. Vous payez pour des tokens, pas pour un abonnement à un écosystème plus large. La tarification est simple : 0,25 $ par million de tokens d'entrée et 1,00 $ par million de tokens de sortie. Le crédit prépayé n'expire jamais, vous pouvez donc suspendre l'utilisation sans perdre vos fonds. Cela le rend idéal pour les projets où la prévisibilité des coûts et la liberté du contenu sont plus importantes que la notoriété de la marque.
La valeur principale de l'API Hermes est son absence de refus de contenu pour un usage adulte légal. Le modèle répond directement aux sujets controversés, sexuels ou fictifs. Il ne vous harcèle pas avec des politiques de sécurité. La seule limite stricte est que le contenu sexuel impliquant des mineurs est toujours bloqué. Il s'agit d'un modèle à poids ouverts, ce qui signifie que les poids sont publiquement disponibles, mais nous hébergeons la couche d'inférence pour votre commodité. Vous n'avez pas besoin de gérer des GPU ou de configurer vLLM. L'endpoint prend en charge les réponses en streaming via Server-Sent Events (SSE) et l'appel de fonctions standard. Cela vous permet de l'intégrer dans des applications existantes qui attendent un comportement de type OpenAI. Le modèle n'est pas un fine-tune de GPT-4 ou Llama 3 ; c'est une architecture distincte optimisée pour la réactivité. Vous pouvez consulter la fiche du modèle si vous souhaitez vérifier ses poids de base. L'avantage clé est la simplicité : un modèle, un endpoint, un prix.
L'API Hermes est conçue pour être un remplacement prêt à l'emploi du SDK OpenAI. Vous pouvez utiliser les bibliothèques officielles en Python, Node.js ou Go. Il suffit de modifier la valeur de base_url vers https://api.hermesllmapi.com/v1 et de fournir votre clé API. L'ID du modèle à utiliser est uncensored. Cette compatibilité s'étend au streaming et à l'appel de fonctions. Si vous utilisez une bibliothèque comme LangChain ou LlamaIndex, vous pouvez probablement échanger le fournisseur avec des modifications de code minimes. Cela est particulièrement utile si vous construisez déjà avec OpenAI mais souhaitez tester le comportement sans censure sans réécrire votre pipeline de données. L'API prend en charge POST /v1/chat/completions et GET /v1/models. Elle ne prend pas en charge les embeddings, la génération d'images ou l'audio. Si votre application dépend de ces fonctionnalités, cette API n'est pas un substitut complet. Cependant, pour la génération de texte et l'utilisation d'outils, la compatibilité est quasi parfaite. Vous pouvez passer facilement de l'un à l'autre pour comparer les sorties.
Nous croyons en une tarification transparente et simple. Il n'y a pas d'abonnements mensuels ni de frais cachés. Vous préchargez du crédit, et les tokens sont déduits à mesure que vous les utilisez. Le tarif est de 0,25 $ par million de tokens d'entrée et de 1,00 $ par million de tokens de sortie. C'est compétitif pour un service hébergé sans censure. Vous pouvez recharger à partir de 10 $ en utilisant des cryptomonnaies (USDT ou USDC). Si vous préchargez 50 $, vous recevez un bonus de crédit de 5 %. Précharger 100 $ vous donne un bonus de 10 %. Votre crédit n'expire jamais, vous pouvez donc l'utiliser à votre rythme. Les nouveaux comptes reçoivent 0,50 $ de crédit d'essai valable 7 jours, sans carte bancaire requise. Cela vous permet de tester l'API en profondeur avant d'engager des fonds. Le modèle prépayé garantit que vous ne recevrez jamais une facture surprise. Si vous manquez de crédit, les requêtes s'arrêtent jusqu'à ce que vous rechargiez. C'est idéal pour les développeurs qui souhaitent contrôler exactement leurs dépenses.
L'API prend en charge une fenêtre de contexte de 100 000 tokens, incluant à la fois le prompt et la complétion. Cela vous permet de traiter de longs documents, des bases de code étendues ou de longues conversations en une seule requête. La taille du corps de la requête est limitée à 8 Mo, ce qui convient à la plupart des grandes entrées. Vous êtes limité à 300 requêtes par minute par clé API. Cela suffit pour la plupart des charges de travail de développement et de production modérées. Chaque compte dispose d'une seule clé API, que vous pouvez régénérer à tout moment. La régénération de la clé invalide immédiatement l'ancienne, assurez-vous donc que votre client est mis à jour. Le système ne propose pas de fine-tuning ni d'embeddings. Si vous en avez besoin, vous devez utiliser un autre service. Les limites sont conçues pour prévenir les abus tout en maintenant des coûts bas pour les utilisateurs légitimes. Vous pouvez surveiller votre utilisation via le tableau de bord, bien que des journaux détaillés ne soient pas actuellement fournis. Pour la plupart des tâches basées sur le texte, la fenêtre de contexte de 100k est plus que suffisante pour gérer des instructions complexes.
Votre confidentialité est une priorité. Nous demandons uniquement un e-mail et un mot de passe pour créer un compte. Aucun numéro de téléphone ou carte bancaire n'est nécessaire pour l'essai. Vos prompts ne sont pas utilisés pour entraîner le modèle. C'est une différence clé par rapport à certains services de niveau gratuit qui utilisent vos données pour les améliorer. Nous ne partageons pas vos données avec des tiers. Le modèle s'exécute sur nos propres serveurs GPU, et nous gérons l'infrastructure de bout en bout. Cela signifie que vous n'avez pas à vous soucier de l'egress des données ou du stockage. L'API est conçue pour les développeurs qui souhaitent une interface propre et privée. Nous ne proposons pas de SLA ni de certifications comme SOC2, donc si vous avez besoin de garanties de niveau entreprise, cela pourrait ne pas convenir. Le service est indépendant et n'est affilié à aucun grand éditeur technologique. Vos données vous appartiennent, et nous le respectons. Vous pouvez supprimer votre compte à tout moment pour supprimer vos données.
Non, il s'agit d'un service indépendant. Nous hébergeons un modèle à poids ouverts et fournissons un endpoint compatible OpenAI. Nous ne sommes pas les créateurs originaux des poids du modèle, ni affiliés à aucun grand éditeur comme OpenAI ou Together AI. Nous fournissons simplement l'infrastructure pour y accéder.
Cela signifie que le modèle ne refuse pas de répondre à des questions légitimes sur des sujets adultes, fictifs ou controversés en raison de filtres de sécurité. Il générera du contenu sexuel, des vulgarités ou des opinions politiques si on le lui demande. La seule limite stricte est que le contenu sexuel impliquant des mineurs est toujours bloqué. Cela le rend idéal pour l'écriture créative et le jeu de rôle.
Oui. Vous pouvez utiliser le SDK OpenAI officiel en définissant la <code>base_url</code> sur <code>https://api.hermesllmapi.com/v1</code> et le modèle sur <code>uncensored</code>. L'API prend en charge les complétions de chat standard, le streaming et l'appel de fonctions. Elle est conçue pour être un remplacement prêt à l'emploi des endpoints OpenAI.
Non, votre crédit prépayé n'expire jamais. Vous pouvez recharger à tout moment et utiliser les fonds quand vous le souhaitez. Il n'y a pas de frais mensuels ni de renouvellement d'abonnement. Cela le rend rentable pour les projets à long terme où l'utilisation est intermittente.
La fenêtre de contexte est de 100 000 tokens, ce qui inclut à la fois le prompt d'entrée et la complétion de sortie. Cela vous permet de traiter de grands documents ou de longues conversations dans une seule requête. La taille maximale du corps de la requête est de 8 Mo.
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.