Hermes API:3行でクライアントを切り替え
標準的なOpenAI SDKを使用して、数分でHermes APIを始めることができます。このクイックスタートガイドでは、無検閲LLM統合のための設定、基本リクエスト、ストリーミング、エラー処理について解説します。
- 入力トークン1Mあたり
- $0.25
- 出力トークン / 1M
- $1.00
- トークンコンテキストウィンドウ
- 100,000
- トライアルクレジット
- $0.50
- 1分あたりのリクエスト数
- 300
OpenAI SDKをインストール
エンドポイントはOpenAI互換のため、すでに知っている公式SDKを使用できます。この方法により、アプリケーションロジックを書き換えることなく、他のベンダーから切り替えることができます。PythonおよびNode.js環境に対して標準のopenaiパッケージをサポートしています。
ストリーミングや関数呼び出しの機能との互換性を保証するために、SDKの最新バージョンを使用してください。クライアントライブラリはJSONシリアライズとHTTPトランスポートを自動的に処理するため、ネットワークの詳細ではなくモデルのパラメータに集中できます。
ベースURLとキーを設定
認証はAuthorizationヘッダー内のBearerトークンによって処理されます。ダッシュボードでメールアドレスとパスワードを使用してサインアップすることでキーを取得します。トライアルにはクレジットカードは必要なく、いつでもキーを再生成してアクセスを取り消すことができます。
ベースURLを専用エンドポイントに設定してください。これにより、すべてのリクエストがデフォルトのOpenAIクラウドではなく、無検閲モデルインフラストラクチャに送信されます。サインアップ直後の「APIキーを取得」ページでAPIキーを確認できます。
最初のリクエストを送信
接続性をテストするために標準的なチャット完了リクエストを送信します。モデルIDは常にuncensoredです。このモデルは、法的な成人利用に対してコンテンツ拒否なしで回答するように調整されており、クリエイティブライティング、ロールプレイ、または制限のない研究に最適です。
- テキスト生成には
POST /v1/chat/completionsを使用します。 - コンテキストウィンドウは、プロンプトとcompletionを合わせて最大100,000トークンまでサポートします。
- リクエストは入力および出力トークンのカウントに基づいて課金されます。
curl https://api.hermesllmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
ストリーミング(SSE)を有効化
より良いユーザーエクスペリエンスのために、ストリーミングを有効にしてトークンが生成されるたびに受信してください。これにより、特に長い応答の場合に知覚されるレイテンシが削減されます。サーバーはクライアントがリアルタイムで解析できるサーバー送信イベント(SSE)を返します。
リクエストボディでstreamパラメータをtrueに設定します。SDKは到着したチャンクを順次返します。これは、応答全体が完了するのを待つのではなく、テキストを逐次表示したいチャットインターフェースに特に有用です。
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
ツール/関数呼び出しを使用
APIは関数呼び出しをサポートしており、モデルが外部ツールの実行のために構造化JSONを出力できます。toolsパラメータに関数を定義し、適切であればモデルはレスポンスでtool_callsを返します。
この機能はOpenAI仕様に記載されているとおりに動作します。関数名と引数を解析し、バックエンドロジックを実行し、結果を会話に戻すことができます。標準的なOpenAI SDKのツール呼び出しワークフローと完全に互換性があります。
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.hermesllmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
利用可能なモデルを確認
接続を確認し、利用可能なオプションを確認するには、modelsエンドポイントをクエリしてください。現在、提供しているのは単一の専用モデルuncensoredのみです。このシンプルさは、モデルルーティングや汎用インフラの複雑さを回避し、予測可能な動作を保証します。
このエンドポイントは認証の問題をデバッグするためにも使用できます。リクエストが失敗した場合は、APIキーの有効性とネットワーク接続を確認してください。レスポンスには、コンテキストウィンドウのサイズやトークン制限を含むモデルの詳細がリストされます。
from openai import OpenAI
client = OpenAI(base_url="https://api.hermesllmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
レート制限とエラーを処理
当APIでは、キーあたり1分あたり300リクエストの制限を設けています。これを超えると、429エラーが発生します。また、複雑なプロンプトや大きなコンテキストウィンドウのために、リクエストボディの最大8 MB制限もサポートしています。
一般的なエラーには、401(無効なAPI キー)と402(クレジット不足)があります。前払いクレジットは期限切れにならないため、都合の良いときにチャージしてください。高額な購入にはクレジットボーナスが自動的に適用されます:$50以上で+5%、$100以上で+10%。
技術仕様
購入前に確認できるよう、API の実際の制限と機能をすべてまとめました。
| 項目 | 内容 |
|---|---|
| 形式 | OpenAI 互換:どの OpenAI SDK でも base URL とキーを変えるだけで動作 |
| モデル ID | uncensored |
| エンドポイント | POST /v1/chat/completions · GET /v1/models |
| 認証 | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.hermesllmapi.com/v1 |
| 最大出力 | 100,000 トークンのウィンドウの残りまで。max_tokens は任意(個別の上限なし) |
| JSON モード | response_format: {"type": "json_object"} |
| パラメータ | temperature、top_p、stop、seed、presence_penalty、frequency_penalty |
| 関数呼び出し | 対応 — tools、tool_choice。応答に tool_calls(ストリーミングでも)、結果は role: tool で返送 |
| コンテキスト長 | 100,000 トークン(入力+出力) |
| ストリーミング | 対応 — SSE、最後のチャンクにトークン使用量 |
| 同時実行 | キーごとに同時 8 リクエストまで |
| レスポンスヘッダー | X-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency |
| レート制限 | キーごとに毎分 300 リクエスト |
| リクエストサイズ | 最大 8 MB |
| 料金 | 入力 100 万トークン $0.25 · 出力 100 万トークン $1.00 |
| ボーナス | $50 以上で +5%、$100 以上で +10% |
| チャージ | USDT(TRC20)または USDC(Base)、$10〜$500 の任意の整数額 |
| 無料トライアル | $0.50、7 日間、カード不要 · トライアルキー: 同時2件、毎分60件。初回チャージ後に上限が8件・300件へ拡大 |
| 課金 | 前払いクレジットから実使用量で課金。エラーと拒否は無料 |
| 有効期限 | 購入クレジットは失効なし、サブスクなし |
| キー | アカウントごとに有効なキーは 1 つ。新しいキーで旧キーは無効 |
| ログイン | Google またはメール+パスワード |
| コンテンツ | 成人向けコンテンツ可。未成年者を含む性的コンテンツは拒否 |
エラーコード
エラーは固定の type を持つ JSON で返ります。失敗・拒否されたリクエストは課金されません。
| コード | タイプ | 意味 |
|---|---|---|
400 | bad_request | JSON 不正、メッセージ空、パラメータ誤り、またはコンテキスト超過 |
401 | missing_key · invalid_key · key_revoked | キーなし・誤り・新しいキーに置換済み |
402 | no_credit | 残高ゼロ — チャージすれば即再開 |
403 | content_blocked | 未成年者を含む性的コンテンツ — 拒否、課金なし |
404 | not_found | 不明なエンドポイント |
413 | request_too_large | 本文が 8 MB 超 |
429 | rate_limited · concurrency | 毎分 300 回または同時 8 件を超過 — 待って再試行 |
503 | upstream_busy | モデル混雑 — 数秒後に再試行 |
質問と回答
Hermes APIは画像や音声の生成に対応していますか?
いいえ、現在テキストのみのチャット完了APIを提供しています。埋め込み、画像、音声、動画の生成やファインチューニングはサポートしていません。標準的なOpenAI互換クライアント向けに、シンプルで無検閲のテキストモデルを提供することに注力しています。
無検閲モデルはアダルトコンテンツをどのように扱いますか?
モデルは法的な成人向け、フィクション、または論争的なトピックを拒否しません。ただし、コンテンツに明確な制限があります:未成年者との性的コンテンツを含むリクエストは常にブロックされます。これがプロンプトに適用される唯一の厳格な制限です。
クレジットがなくなったらどうなりますか?
APIキーは有効なままですが、リクエストは資金不足を示す402エラーを返します。いつでも暗号通貨(USDTまたはUSDC)でアカウントにチャージできます。前払いクレジットは期限切れにならないため、準備ができ次第いつでも資金を追加できます。
キーはフォーム 1 つで手に入ります
アカウントを作成し、キーをコピーし、ベースURLを変更します。これがセットアップのすべてです。