Compatibilidade Pronto para Usar
Use o SDK oficial da OpenAI simplesmente alterando o base_url e a chave de API. Suporta streaming via SSE e chamada de ferramentas/funções nativamente.
API de modelo de pesos abertos sem censura
Um endpoint LLM dedicado e sem censura compatível com SDKs padrão da OpenAI. Sem filtros de conteúdo para uso adulto legal, sem complexidade de roteamento de modelo, apenas texto entrando e texto saindo.
Teste com uma única requisição
curl https://api.hermesllmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'from openai import OpenAI
client = OpenAI(base_url="https://api.hermesllmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.hermesllmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Use o SDK oficial da OpenAI simplesmente alterando o base_url e a chave de API. Suporta streaming via SSE e chamada de ferramentas/funções nativamente.
Oferecemos um único modelo de pesos abertos ajustado para responder sem recusas a tópicos adultos legais, fictícios ou controversos. Não é GPT, Claude ou DeepSeek.
Crédito pré-pago com pagamento por uso e sem mensalidades. Os tokens são cobrados a $0,25 por 1M de entrada e $1,00 por 1M de saída. O crédito nunca expira.
Processe até 100.000 tokens por requisição (prompt + conclusão). Ideal para documentos longos, bases de código ou conversas extensas sem truncamento.
Cadastro mínimo com apenas e-mail e senha. Seus prompts não são usados para treinar os dados do seu modelo.
300 requisições por minuto por chave com limite de corpo de requisição de 8 MB. Uma chave por conta, revogável instantaneamente.
Cadastre-se com e-mail e senha para receber sua chave de API imediatamente; nenhum cartão de crédito necessário para o teste.
Aponte seu cliente compatível com OpenAI para https://api.hermesllmapi.com/v1 e defina o modelo como 'uncensored'.
Envie requisições padrão de conclusão de chat e receba respostas de texto sem censura com suporte completo a streaming.
Gere narrativas sem censura, diálogos de personagens e histórias com tema adulto sem que o modelo se recuse com base em filtros de conteúdo. Ideal para autores de ficção testando limites.
Analise bases de código ou documentos grandes em busca de vulnerabilidades sem que a API bloqueie descobertas técnicas ou controversas. Obtenha saídas de modelo cruas e sem filtros.
Processe documentos longos de até 100k tokens para extrair dados estruturados. O modelo de pesos abertos lida com instruções complexas sem recusas prematuras.
Gere grandes volumes de dados sintéticos para treinar seus próprios modelos. Use a API para criar exemplos diversos e sem censura para domínios específicos.
Muitos desenvolvedores precisam de uma alternativa uncensored deepseek ou de um modelo open-source que não filtre conteúdo adulto lícito. Enquanto grandes fornecedores como OpenAI ou Anthropic aplicam camadas rigorosas de segurança, a Hermes API oferece um único modelo de pesos abertos ajustado para responder perguntas diretamente. Essa abordagem evita a complexidade de roteamento de modelos ou infraestrutura genérica. Você tem uma experiência de API previsível e direta. O modelo não é GPT, Claude, Gemini, Grok ou DeepSeek; é um modelo distinto de pesos abertos executado em nossos servidores. Isso garante comportamento consistente sem atualizações inesperadas de políticas de grandes empresas de tecnologia. Você paga por tokens, não por uma assinatura para um ecossistema mais amplo. A precificação é simples: $0,25 por milhão de tokens de entrada e $1,00 por milhão de tokens de saída. O crédito pré-pago nunca expira, então você pode pausar o uso sem perder fundos. Isso o torna ideal para projetos onde a previsibilidade de custos e a liberdade de conteúdo são mais importantes do que o reconhecimento da marca.
O valor central da API Hermes é a falta de recusas de conteúdo para uso adulto legal. O modelo responde a tópicos controversos, sexuais ou fictícios diretamente. Ele não fica insistindo com você sobre políticas de segurança. O único limite rígido é que o conteúdo sexual envolvendo menores é sempre bloqueado. Este é um modelo de pesos abertos, o que significa que os pesos estão disponíveis publicamente, mas hospedamos a camada de inferência para sua conveniência. Você não precisa gerenciar GPUs ou configurar vLLM. O endpoint suporta respostas de streaming via Server-Sent Events (SSE) e chamada padrão de ferramentas/funções. Isso permite que você o integre em aplicativos existentes que esperam comportamento estilo OpenAI. O modelo não é um ajuste fino do GPT-4 ou Llama 3; é uma arquitetura distinta otimizada para responsividade. Você pode inspecionar o cartão do modelo se desejar verificar seus pesos base. O principal benefício é a simplicidade: um modelo, um endpoint, um preço.
A API Hermes é projetada para ser uma substituição pronta para usar para o SDK OpenAI. Você pode usar as bibliotecas oficiais em Python, Node.js ou Go. Basta alterar o base_url para https://api.hermesllmapi.com/v1 e fornecer sua chave de API. O ID do modelo a ser usado é uncensored. Essa compatibilidade se estende ao streaming e à chamada de funções. Se você estiver usando uma biblioteca como LangChain ou LlamaIndex, provavelmente poderá trocar o provedor com alterações mínimas de código. Isso é particularmente útil se você já estiver construindo com OpenAI, mas quiser testar o comportamento sem censura sem reescrever seu pipeline de dados. A API suporta POST /v1/chat/completions e GET /v1/models. Não suporta embeddings, geração de imagens ou áudio. Se seu aplicativo depende desses recursos, esta API não é uma substituição completa. No entanto, para geração de texto e uso de ferramentas, a compatibilidade é quase perfeita. Você pode alternar facilmente para comparar as saídas.
Acreditamos em preços transparentes e simples. Não há assinaturas mensais ou taxas ocultas. Você pré-carrega crédito e os tokens são deduzidos conforme o uso. A taxa é de $0,25 por milhão de tokens de entrada e $1,00 por milhão de tokens de saída. Isso é competitivo para um serviço hospedado sem censura. Você pode recarregar a partir de $10 usando criptomoedas (USDT ou USDC). Se você pré-carregar $50, receberá um bônus de crédito de 5%. Pré-carregar $100 lhe dá um bônus de 10%. Seu crédito nunca expira, então você pode usá-lo no seu próprio ritmo. Novas contas recebem $0,50 em crédito de teste válido por 7 dias, sem necessidade de cartão de crédito. Isso permite que você teste a API profundamente antes de comprometer fundos. O modelo pré-pago garante que você nunca receba uma conta surpresa. Se o crédito acabar, as requisições param até que você recarregue. Isso é ideal para desenvolvedores que querem controlar seus gastos exatamente.
A API suporta uma janela de contexto de 100.000 tokens, incluindo tanto o prompt quanto a conclusão. Isso permite processar documentos longos, bases de código extensas ou conversas longas em uma única requisição. O tamanho do corpo da requisição é limitado a 8 MB, o que acomoda a maioria das entradas grandes. Você está limitado a 300 requisições por minuto por chave de API. Isso é suficiente para a maioria dos trabalhos de desenvolvimento e cargas de trabalho moderadas de produção. Cada conta tem uma chave de API, que você pode regenerar a qualquer momento. Regenerar a chave invalida imediatamente a antiga, então certifique-se de atualizar seu cliente. O sistema não oferece ajuste fino ou embeddings. Se você precisar disso, deve usar um serviço diferente. Os limites são projetados para prevenir abusos enquanto mantêm os custos baixos para usuários legítimos. Você pode monitorar seu uso via painel, embora logs detalhados não sejam fornecidos atualmente. Para a maioria das tarefas baseadas em texto, o contexto de 100k é mais do que suficiente para lidar com instruções complexas.
Sua privacidade é uma prioridade. Precisamos apenas de um e-mail e senha para criar sua conta. Não é necessário número de telefone ou cartão de crédito para o teste. Seus prompts não são usados para treinar o modelo. Essa é uma diferença-chave em relação a alguns serviços de nível gratuito que usam seus dados para melhorias. Não compartilhamos seus dados com terceiros. O modelo roda em nossos próprios servidores GPU e gerenciamos toda a infraestrutura. Isso significa que você não precisa se preocupar com saída de dados ou armazenamento. A API é projetada para desenvolvedores que buscam uma interface limpa e privada. Não oferecemos SLAs ou certificações como SOC2, então, se você precisa de garantias de nível empresarial, este pode não ser o ajuste ideal. O serviço é independente e não afiliado a nenhum grande fornecedor de tecnologia. Seus dados são seus e respeitamos isso. Você pode excluir sua conta a qualquer momento para remover seus dados.
Não, este é um serviço independente. Hospedamos um modelo de pesos abertos e fornecemos um endpoint compatível com OpenAI. Não somos os criadores originais dos pesos do modelo, nem temos afiliação com grandes fornecedores como OpenAI ou Together AI. Simplesmente fornecemos a infraestrutura para acessá-lo.
Significa que o modelo não se recusa a responder perguntas adultas lícitas, fictícias ou controversas com base em filtros de segurança. Ele gerará conteúdo sexual, palavrões ou opiniões políticas se solicitado. A única restrição rígida é que o conteúdo sexual envolvendo menores é sempre bloqueado. Isso o torna ideal para escrita criativa e roleplay.
Sim. Você pode usar o SDK oficial da OpenAI definindo o <code>base_url</code> para <code>https://api.hermesllmapi.com/v1</code> e o modelo para <code>uncensored</code>. A API suporta completions de chat padrão, streaming e chamada de funções. É projetada para ser uma substituição drop-in para endpoints da OpenAI.
Não, seu crédito pré-pago nunca expira. Você pode recarregar a qualquer momento e usar os fundos quando quiser. Não há mensalidades ou renovações de assinatura. Isso o torna economicamente viável para projetos de longo prazo com uso intermitente.
A janela de contexto é de 100.000 tokens, o que inclui tanto o prompt de entrada quanto a conclusão de saída. Isso permite que você processe documentos grandes ou conversas longas em uma única requisição. O tamanho máximo do corpo da requisição é de 8 MB.
Crie uma conta, copie a chave e altere a URL base. Essa é toda a configuração necessária.