RU ▾
Получить API-ключ

Hermes API: переключите клиентскую библиотеку за три строки

Начните работу с hermes API за несколько минут, используя стандартные SDK OpenAI. Это краткое руководство охватывает конфигурацию, базовые запросы, потоковую передачу и обработку ошибок для вашей интеграции LLM без цензуры.

за 1 млн входных токенов
$0.25
Выходные токены / 1 млн
$1.00
контекстное окно
100,000
пробный баланс
$0.50
запросов в минуту
300

Установите SDK OpenAI

Поскольку наш эндпоинт совместим с OpenAI, вы можете использовать знакомые вам официальные SDK. Этот подход позволяет переключиться с других поставщиков без переписывания логики приложения. Мы поддерживаем стандартный пакет openai для сред Python и Node.js.

Убедитесь, что вы используете последнюю версию SDK для обеспечения совместимости с функциями потоковой передачи и вызова функций. Библиотека клиента автоматически обрабатывает сериализацию JSON и HTTP-транспорт, поэтому вы можете сосредоточиться на параметрах модели, а не на деталях сети.

Настройте базовый URL и ключ

Аутентификация осуществляется с помощью токена Bearer в заголовке Authorization. Вы получаете ключ, зарегистрировавшись по электронной почте и паролю на нашей панели управления. Для пробного периода не требуется банковская карта, и вы можете сгенерировать новый ключ в любое время, чтобы отозвать доступ.

Установите базовый URL на наш выделенный эндпоинт. Это гарантирует, что все запросы будут отправляться в инфраструктуру нашей модели без цензуры, а не в стандартное облако OpenAI. Вы можете найти свой API-ключ на странице «Получить API-ключ» сразу после регистрации.

Отправьте первый запрос

Отправьте стандартный запрос на завершение чата, чтобы проверить подключение. Идентификатор модели всегда uncensored. Эта модель настроена на ответы без отказов в контенте для законного использования взрослыми, что делает ее идеальной для творческого письма, ролевых игр или неограниченных исследований.

  • Используйте POST /v1/chat/completions для генерации текста.
  • Контекстное окно поддерживает до 100 000 токенов для промпта и завершения.
  • Запросы оплачиваются на основе количества входных и выходных токенов.
curl https://api.hermesllmapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Включите потоковую передачу (SSE)

Для улучшения пользовательского опыта включите потоковую передачу, чтобы получать токены по мере их генерации. Это снижает воспринимаемую задержку, особенно для длинных ответов. Сервер возвращает события, отправляемые сервером (SSE), которые ваш клиент может обрабатывать в реальном времени.

Установите параметр stream в значение true в теле запроса. SDK будет выдавать фрагменты по мере их поступления. Это особенно полезно для интерфейсов чата, где вы хотите отображать текст постепенно, а не ждать завершения всего ответа.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Используйте вызов функций

Наш API поддерживает вызов функций, позволяя модели выводить структурированный JSON для выполнения внешних инструментов. Определите свои функции в параметре tools, и модель вернет tool_calls в ответе, если это уместно.

Эта функция работает точно так, как описано в спецификации OpenAI. Вы можете извлечь имя функции и аргументы, выполнить логику на бэкенде и передать результаты обратно в диалог. Она полностью совместима с рабочими процессами вызова инструментов в стандартных SDK OpenAI.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.hermesllmapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Проверьте доступные модели

Обратитесь к эндпоинту моделей, чтобы проверить подключение и увидеть доступные варианты. В настоящее время мы предлагаем одну выделенную модель: uncensored. Эта простота избавляет от сложности маршрутизации моделей или поддержки общей инфраструктуры, обеспечивая предсказуемое поведение.

Вы также можете использовать этот эндпоинт для отладки проблем аутентификации. Если запрос не выполнен, проверьте действительность вашего API-ключа и сетевое подключение. В ответе будет перечислена информация о модели, включая размер контекстного окна и ограничения токенов.

from openai import OpenAI

client = OpenAI(base_url="https://api.hermesllmapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Обработка лимитов запросов и ошибок

Наш API устанавливает лимит в 300 запросов в минуту на ключ. Если вы превысите этот лимит, вы получите ошибку 429. Мы также поддерживаем лимит тела запроса 8 МБ для сложных промптов или больших контекстных окон.

Распространенные ошибки включают 401 (неверный ключ) и 402 (недостаточно средств). Предоплаченный баланс не сгорает, поэтому вы можете пополнить его в удобное время. Бонусы к балансу применяются автоматически для крупных покупок: +5% от $50 и +10% от $100.

Технические характеристики

Все реальные лимиты и возможности API в одном месте — сверьте их до пополнения.

ПараметрЗначение
Формат APIсовместим с OpenAI: любой OpenAI SDK работает — замените base URL и ключ
ID моделиuncensored
ЭндпоинтыPOST /v1/chat/completions · GET /v1/models
АвторизацияAuthorization: Bearer YOUR_KEY
Base URLhttps://api.hermesllmapi.com/v1
Максимум ответадо остатка окна в 100 000 токенов; max_tokens необязателен (отдельного лимита нет)
JSON-режимresponse_format: {"type": "json_object"}
Параметрыtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Вызов функцийда — tools, tool_choice; ответ содержит tool_calls, в том числе в потоке; результат — сообщением role: tool
Контекстное окно100 000 токенов (вход и ответ вместе)
Потоковая передачада — server-sent events, последний фрагмент содержит расход токенов
Параллельные запросыдо 8 одновременно на ключ
Заголовки ответаX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Лимит запросов300 запросов в минуту на ключ
Размер запросадо 8 МБ
Цена$0,25 за 1 млн входных токенов · $1,00 за 1 млн выходных
Бонус+5% от $50, +10% от $100
ПополнениеUSDT (TRC20) или USDC (Base), любая целая сумма от $10 до $500
Пробный баланс$0,50 на 7 дней, без карты · Пробный ключ: 2 параллельных запроса, 60 в минуту; полные лимиты (8 и 300) после первого пополнения
Оплатапредоплаченный баланс по фактическому расходу; ошибки и отказы бесплатны
Срок действияоплаченный баланс не сгорает, без подписки
Ключиодин активный ключ на аккаунт; новый заменяет старый
ВходGoogle или e-mail и пароль
Контентконтент для взрослых разрешён; сексуальный контент с несовершеннолетними запрещён

Коды ошибок

Ошибки приходят в JSON с постоянным type; неудачные и отклонённые запросы не оплачиваются.

КодТипЧто значит
400bad_requestневерный JSON, пустые сообщения, неверный параметр или превышено окно контекста
401missing_key · invalid_key · key_revokedнет ключа, ключ неверный или заменён новым
402no_creditбаланс пуст — пополните, работа продолжится сразу
403content_blockedсексуальный контент с несовершеннолетними — отказ, без оплаты
404not_foundнеизвестный эндпоинт
413request_too_largeтело запроса больше 8 МБ
429rate_limited · concurrencyбольше 300/мин или 8 параллельно — подождите и повторите
503upstream_busyмодель занята — повторите через несколько секунд
01

Вопросы и ответы

Поддерживает ли hermes API генерацию изображений или аудио?

Нет, в настоящее время мы предлагаем API только для текстовых чатов. Мы не поддерживаем эмбеддинги, генерацию изображений, аудио или видео, а также не предлагаем дообучение. Наш фокус — предоставление простой текстовой модели без цензуры для стандартных клиентов, совместимых с OpenAI.

Как модель без цензуры обрабатывает контент для взрослых?

Модель не отказывает в законных темах для взрослых, художественных или спорных вопросах. Однако существует жесткое ограничение: запросы с сексуальным контентом с участием несовершеннолетних всегда блокируются. Это единственное строгое ограничение, применяемое к вашим промптам.

Что произойдет, если у меня закончится баланс?

Ваш API-ключ остается активным, но запросы будут возвращать ошибку 402, указывающую на недостаток средств. Вы можете пополнить аккаунт криптовалютой (USDT или USDC) в любое время. Ваш предоплаченный баланс не сгорает, поэтому вы можете добавлять средства, когда будете готовы продолжить работу.

Ваш ключ — в одной форме от вас

Создайте аккаунт, скопируйте ключ, измените базовый URL. Вот и вся настройка.

Получить API-ключПрочитать документацию