Compatibilidad Plug-and-Play
Usa el SDK oficial de OpenAI simplemente cambiando la base_url y la clave de API. Admite streaming vía SSE y llamadas a herramientas/funciones de forma predeterminada.
API de modelo de pesos abiertos sin censura
Un endpoint de LLM dedicado y sin censura compatible con SDKs estándar de OpenAI. Sin filtros de contenido para uso adulto legal, sin complejidad de enrutamiento de modelos, solo texto de entrada y texto de salida.
Pruébalo con una sola petición
curl https://api.hermesllmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'from openai import OpenAI
client = OpenAI(base_url="https://api.hermesllmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.hermesllmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Usa el SDK oficial de OpenAI simplemente cambiando la base_url y la clave de API. Admite streaming vía SSE y llamadas a herramientas/funciones de forma predeterminada.
Servimos un modelo de pesos abiertos ajustado para responder sin rechazos para temas adultos legales, ficticios o controvertidos. No es GPT, Claude ni DeepSeek.
Crédito prepago de pago por uso sin tarifas mensuales. Los tokens se cobran a $0,25/1M de entrada y $1,00/1M de salida. El crédito nunca caduca.
Procesa hasta 100.000 tokens por petición (prompt + finalización). Ideal para documentos largos, bases de código o conversaciones extendidas sin truncamiento.
Registro mínimo con solo correo electrónico y contraseña. Tus prompts no se utilizan para entrenar los datos de tu modelo.
300 peticiones por minuto por clave con un límite de cuerpo de petición de 8 MB. Una clave por cuenta, revocable al instante.
Regístrate con correo electrónico y contraseña para recibir tu clave de API inmediatamente; no se requiere tarjeta de crédito para la prueba.
Apunta tu cliente compatible con OpenAI a https://api.hermesllmapi.com/v1 y establece el modelo en 'uncensored'.
Envía peticiones estándar de finalización de chat y recibe respuestas de texto sin censura con soporte completo de streaming.
Genera narrativas sin censura, diálogos de personajes e historias de temática adulta sin que el modelo se niegue basándose en filtros de contenido. Ideal para autores de ficción que prueban límites.
Analiza bases de código o documentos grandes en busca de vulnerabilidades sin que la API bloquee hallazgos técnicos o controvertidos. Obtén salidas de modelo sin filtrar.
Procesa documentos largos de hasta 100k tokens para extraer datos estructurados. El modelo de pesos abiertos maneja instrucciones complejas sin rechazos prematuros.
Genera grandes volúmenes de datos sintéticos para entrenar tus propios modelos. Usa la API para crear ejemplos diversos y sin censura para dominios específicos.
Muchos desarrolladores necesitan una alternativa sin censura a deepseek o un modelo de código abierto que no filtre contenido adulto legal. Mientras que grandes proveedores como OpenAI o Anthropic aplican capas estrictas de seguridad, la API de Hermes sirve un único modelo de pesos abiertos ajustado para responder preguntas directamente. Este enfoque evita la complejidad del enrutamiento de modelos o la infraestructura genérica. Obtienes una experiencia de API predecible y sencilla. El modelo no es GPT, Claude, Gemini, Grok ni DeepSeek; es un modelo de pesos abiertos distinto que se ejecuta en nuestros servidores. Esto garantiza un comportamiento consistente sin actualizaciones inesperadas de políticas de grandes empresas tecnológicas. Pagas por tokens, no por una suscripción a un ecosistema más amplio. La tarifa es simple: $0,25 por millón de tokens de entrada y $1,00 por millón de tokens de salida. El crédito prepago no caduca, así que puedes pausar el uso sin perder fondos. Esto lo hace ideal para proyectos donde la previsibilidad de costos y la libertad de contenido importan más que el reconocimiento de marca.
El valor principal de la API de Hermes es su falta de rechazos de contenido para uso adulto legal. El modelo responde directamente a temas controvertidos, sexuales o ficticios. No te regaña por las políticas de seguridad. El único límite estricto es que el contenido sexual que involucra a menores siempre está bloqueado. Este es un modelo de pesos abiertos, lo que significa que los pesos están disponibles públicamente, pero alojamos la capa de inferencia para tu conveniencia. No necesitas gestionar GPUs ni configurar vLLM. El endpoint admite respuestas de streaming vía Server-Sent Events (SSE) y llamadas a herramientas/funciones estándar. Esto te permite integrarlo en aplicaciones existentes que esperan un comportamiento estilo OpenAI. El modelo no es un ajuste fino de GPT-4 o Llama 3; es una arquitectura distinta optimizada para la capacidad de respuesta. Puedes inspeccionar la tarjeta del modelo si deseas verificar sus pesos base. El beneficio clave es la simplicidad: un modelo, un endpoint, un precio.
La API de Hermes está diseñada para ser un reemplazo listo para usar del SDK de OpenAI. Puedes usar las bibliotecas oficiales en Python, Node.js o Go. Simplemente cambia el base_url a https://api.hermesllmapi.com/v1 y proporciona tu clave de API. El ID de modelo a usar es uncensored. Esta compatibilidad se extiende al streaming y a las llamadas a funciones. Si estás utilizando una biblioteca como LangChain o LlamaIndex, es probable que puedas cambiar el proveedor con cambios mínimos de código. Esto es particularmente útil si ya estás construyendo con OpenAI pero quieres probar el comportamiento sin censura sin reescribir tu canalización de datos. La API admite POST /v1/chat/completions y GET /v1/models. No admite embeddings, generación de imágenes ni audio. Si tu aplicación depende de esas funciones, esta API no es un sustituto completo. Sin embargo, para la generación de texto y el uso de herramientas, la compatibilidad es casi perfecta. Puedes cambiar fácilmente de uno a otro para comparar salidas.
Creemos en una facturación transparente y sencilla. No hay suscripciones mensuales ni tarifas ocultas. Prepagas el crédito y los tokens se descuentan a medida que los usas. La tarifa es de $0,25 por millón de tokens de entrada y $1,00 por millón de tokens de salida. Esto es competitivo para un servicio alojado y sin censura. Puedes recargar a partir de $10 usando criptomonedas (USDT o USDC). Si precargas $50, recibes un bono de crédito del 5%. Precargar $100 te da un bono del 10%. Tu crédito no caduca, así que puedes usarlo a tu propio ritmo. Las cuentas nuevas reciben $0,50 en crédito de prueba válido por 7 días, sin necesidad de tarjeta de crédito. Esto te permite probar la API a fondo antes de comprometer fondos. El modelo de prepago asegura que nunca recibas una factura sorpresa. Si te quedas sin crédito, las peticiones se detienen hasta que recargues. Esto es ideal para desarrolladores que quieren controlar sus gastos exactamente.
La API admite una ventana de contexto de 100.000 tokens, incluyendo tanto el prompt como la finalización. Esto te permite procesar documentos largos, bases de código extensas o conversaciones largas en una sola petición. El tamaño del cuerpo de la petición está limitado a 8 MB, lo que acomoda la mayoría de las entradas grandes. Estás limitado a 300 peticiones por minuto por clave de API. Esto es suficiente para la mayoría de los trabajos de desarrollo y producción moderada. Cada cuenta tiene una clave de API, que puedes regenerar en cualquier momento. Regenerar la clave invalida inmediatamente la antigua, así que asegúrate de actualizar tu cliente. El sistema no ofrece ajuste fino ni embeddings. Si necesitas esas funciones, debes usar un servicio diferente. Los límites están diseñados para prevenir el abuso mientras mantienen los costos bajos para los usuarios legítimos. Puedes monitorear tu uso a través del panel, aunque los registros detallados no se proporcionan actualmente. Para la mayoría de las tareas basadas en texto, la ventana de contexto de 100k es más que suficiente para manejar instrucciones complejas.
Tu privacidad es una prioridad. Solo requerimos un correo electrónico y una contraseña para crear una cuenta. No se necesita número de teléfono ni tarjeta de crédito para la prueba. Tus prompts no se utilizan para entrenar el modelo. Esta es una diferencia clave con algunos servicios de nivel gratuito que utilizan tus datos para mejorar. No compartimos tus datos con terceros. El modelo se ejecuta en nuestros propios servidores GPU y gestionamos la infraestructura de principio a fin. Esto significa que no necesitas preocuparte por la salida o el almacenamiento de datos. La API está diseñada para desarrolladores que quieren una interfaz limpia y privada. No ofrecemos SLAs ni certificaciones como SOC2, así que si necesitas garantías de nivel empresarial, esto puede no ser lo adecuado. El servicio es independiente y no está afiliado a ningún proveedor tecnológico importante. Tus datos son tuyos y lo respetamos. Puedes eliminar tu cuenta en cualquier momento para eliminar tus datos.
No, este es un servicio independiente. Hospedamos un modelo de pesos abiertos y proporcionamos un endpoint compatible con OpenAI. No somos los creadores originales de los pesos del modelo ni estamos afiliados a ningún proveedor importante como OpenAI o Together AI. Simplemente proporcionamos la infraestructura para acceder a él.
Significa que el modelo no se niega a responder preguntas sobre temas adultos, ficticios o controversos legales basándose en filtros de seguridad. Generará contenido sexual, groserías o opiniones políticas si se le solicita. La única limitación estricta es que el contenido sexual que involucra a menores siempre está bloqueado. Esto lo hace ideal para escritura creativa y roleplay.
Sí. Puedes usar el SDK oficial de OpenAI configurando <code>base_url</code> a <code>https://api.hermesllmapi.com/v1</code> y el modelo a <code>uncensored</code>. La API admite completados de chat estándar, streaming y llamadas a funciones. Está diseñada para ser un reemplazo listo para usar de los endpoints de OpenAI.
No, tu crédito prepago no caduca. Puedes recargar en cualquier momento y usar los fondos cuando quieras. No hay tarifas mensuales ni renovaciones de suscripción. Esto lo hace rentable para proyectos a largo plazo donde el uso es intermitente.
La ventana de contexto es de 100,000 tokens, lo que incluye tanto el prompt de entrada como la finalización de salida. Esto te permite procesar documentos grandes o conversaciones largas en una sola petición. El tamaño máximo del cuerpo de la petición es de 8 MB.
Crea una cuenta, copia la clave, cambia la URL base. Eso es toda la configuración.