API Hermes: Chuyển đổi khách hàng của bạn chỉ với ba dòng mã
Bắt đầu với API Hermes trong vài phút bằng các SDK OpenAI tiêu chuẩn. Hướng dẫn nhanh này bao gồm cấu hình, yêu cầu cơ bản, truyền phát và xử lý lỗi cho tích hợp LLM không kiểm duyệt của bạn.
- trên mỗi 1 triệu token đầu vào
- $0.25
- Token đầu ra / 1 triệu
- $1.00
- cửa sổ ngữ cảnh token
- 100,000
- tín dụng dùng thử miễn phí
- $0.50
- yêu cầu mỗi phút
- 300
Cài đặt SDK OpenAI
Vì endpoint của chúng tôi tương thích với OpenAI, bạn có thể sử dụng các SDK chính thức mà bạn đã quen thuộc. Cách tiếp cận này cho phép bạn chuyển từ các nhà cung cấp khác mà không cần viết lại logic ứng dụng. Chúng tôi hỗ trợ gói openai tiêu chuẩn cho môi trường Python và Node.js.
Đảm bảo bạn đang sử dụng phiên bản SDK mới nhất để đảm bảo tương thích với các tính năng truyền phát và gọi hàm. Thư viện khách hàng tự động xử lý tuần tự hóa JSON và vận chuyển HTTP, vì vậy bạn có thể tập trung vào các tham số mô hình thay vì chi tiết mạng.
Cấu hình Base URL & Khóa
Xác thực được xử lý thông qua token Bearer trong tiêu đề Authorization. Bạn nhận được khóa bằng cách đăng ký với email và mật khẩu trên bảng điều khiển của chúng tôi. Không cần thẻ tín dụng cho bản dùng thử, và bạn có thể tạo lại khóa bất cứ lúc nào để thu hồi quyền truy cập.
Đặt base URL thành endpoint chuyên dụng của chúng tôi. Điều này đảm bảo tất cả các yêu cầu đều được gửi đến cơ sở hạ tầng mô hình không kiểm duyệt của chúng tôi thay vì đám mây OpenAI mặc định. Bạn có thể tìm thấy khóa API của mình trên trang 'Lấy khóa API' ngay sau khi đăng ký.
Gửi yêu cầu đầu tiên của bạn
Gửi một yêu cầu chat completion tiêu chuẩn để kiểm tra kết nối. ID mô hình luôn là uncensored. Mô hình này được tinh chỉnh để trả lời mà không có từ chối nội dung cho mục đích người trưởng thành hợp pháp, rất lý tưởng cho viết sáng tạo, nhập vai hoặc nghiên cứu không giới hạn.
- Sử dụng
POST /v1/chat/completionscho tạo văn bản. - Cửa sổ ngữ cảnh hỗ trợ tối đa 100.000 token cho prompt plus completion.
- Các yêu cầu được tính phí dựa trên số lượng token đầu vào và đầu ra.
curl https://api.hermesllmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Bật truyền phát (SSE)
Để cải thiện trải nghiệm người dùng, hãy bật truyền phát để nhận token khi chúng được tạo. Điều này giảm độ trễ cảm nhận, đặc biệt là đối với các phản hồi dài. Máy chủ trả về các Sự kiện được gửi bởi máy chủ (SSE) mà khách hàng của bạn có thể phân tích cú pháp theo thời gian thực.
Đặt tham số stream thành true trong thân yêu cầu của bạn. SDK sẽ trả về các chunk khi chúng đến. Điều này đặc biệt hữu ích cho các giao diện trò chuyện nơi bạn muốn hiển thị văn bản từng phần thay vì chờ toàn bộ response kết thúc.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Sử dụng gọi hàm
API của chúng tôi hỗ trợ gọi hàm, cho phép mô hình xuất JSON có cấu trúc để thực thi công cụ bên ngoài. Xác định các hàm của bạn trong tham số tools, và mô hình sẽ trả về tool_calls trong phản hồi nếu phù hợp.
Tính năng này hoạt động chính xác như được mô tả trong đặc tả OpenAI. Bạn có thể phân tích cú pháp tên hàm và đối số, thực thi logic backend của mình và đưa kết quả trở lại cuộc trò chuyện. Nó hoàn toàn tương thích với các quy trình gọi công cụ SDK OpenAI tiêu chuẩn.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.hermesllmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Kiểm tra các mô hình có sẵn
Truy vấn endpoint models để xác minh kết nối và xem các tùy chọn có sẵn. Hiện tại, chúng tôi cung cấp một mô hình chuyên dụng duy nhất: uncensored. Sự đơn giản này tránh sự phức tạp của việc định tuyến mô hình hoặc cơ sở hạ tầng chung, đảm bảo hành vi dự đoán được.
Bạn cũng có thể sử dụng endpoint này để gỡ lỗi các vấn đề xác thực. Nếu yêu cầu thất bại, hãy kiểm tra tính hợp lệ của khóa API và kết nối mạng. Phản hồi sẽ liệt kê chi tiết mô hình, bao gồm kích thước cửa sổ ngữ cảnh và giới hạn token.
from openai import OpenAI
client = OpenAI(base_url="https://api.hermesllmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Xử lý giới hạn tốc độ & Lỗi
API của chúng tôi áp dụng giới hạn 300 yêu cầu mỗi phút trên mỗi khóa. Nếu bạn vượt quá giới hạn này, bạn sẽ nhận được lỗi 429. Chúng tôi cũng hỗ trợ giới hạn thân yêu cầu 8 MB cho các prompt phức tạp hoặc cửa sổ ngữ cảnh lớn.
Các lỗi phổ biến bao gồm 401 (khóa không hợp lệ) và 402 (thiếu tín dụng). Tín dụng trả trước không bao giờ hết hạn, vì vậy bạn có thể nạp tiền khi thuận tiện. Tiền thưởng tín dụng được áp dụng tự động cho các khoản mua lớn hơn: +5% từ $50 và +10% từ $100.
Thông số kỹ thuật
Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.
| Mục | Giá trị |
|---|---|
| Định dạng | tương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa |
| ID mô hình | uncensored |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Xác thực | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.hermesllmapi.com/v1 |
| Đầu ra tối đa | tối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng) |
| Chế độ JSON | response_format: {"type": "json_object"} |
| Tham số | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Gọi hàm | có — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool |
| Cửa sổ ngữ cảnh | 100.000 token (đầu vào + đầu ra) |
| Streaming | có — server-sent events; phần cuối chứa lượng token đã dùng |
| Yêu cầu đồng thời | tối đa 8 cùng lúc cho mỗi khóa |
| Header phản hồi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Giới hạn tốc độ | 300 yêu cầu mỗi phút cho mỗi khóa |
| Kích thước yêu cầu | tối đa 8 MB |
| Giá | $0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra |
| Thưởng | +5% từ $50, +10% từ $100 |
| Nạp tiền | USDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500 |
| Dùng thử miễn phí | $0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu |
| Tính phí | tín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí |
| Thời hạn | tín dụng đã trả không hết hạn, không đăng ký định kỳ |
| Khóa | mỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ |
| Đăng nhập | Google hoặc email và mật khẩu |
| Nội dung | cho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên |
Mã lỗi
Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.
| Mã | Loại | Ý nghĩa |
|---|---|---|
400 | bad_request | JSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh |
401 | missing_key · invalid_key · key_revoked | thiếu khóa, sai khóa hoặc khóa đã bị thay |
402 | no_credit | hết tín dụng — nạp tiền là dùng tiếp ngay |
403 | content_blocked | nội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí |
404 | not_found | endpoint không tồn tại |
413 | request_too_large | nội dung lớn hơn 8 MB |
429 | rate_limited · concurrency | vượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại |
503 | upstream_busy | mô hình đang bận — thử lại sau vài giây |
Hỏi đáp
API Hermes có hỗ trợ tạo ảnh hoặc âm thanh không?
Không, hiện chúng tôi chỉ cung cấp API chat-completions chỉ văn bản. Chúng tôi không hỗ trợ embeddings, tạo ảnh, âm thanh hoặc video, cũng như không cung cấp fine-tuning. Trọng tâm của chúng tôi là cung cấp mô hình văn bản không kiểm duyệt đơn giản cho các khách hàng tương thích OpenAI tiêu chuẩn.
Mô hình không kiểm duyệt xử lý nội dung người lớn như thế nào?
Mô hình không từ chối các chủ đề người lớn hợp pháp, hư cấu hoặc gây tranh cãi. Tuy nhiên, có một giới hạn nội dung cứng: các yêu cầu liên quan đến nội dung tình dục với trẻ vị thành niên luôn bị chặn. Đây là hạn chế nghiêm ngặt duy nhất áp dụng cho các prompt của bạn.
Điều gì xảy ra nếu tôi hết tín dụng?
Khóa API của bạn vẫn hoạt động, nhưng các yêu cầu sẽ trả về lỗi 402 cho biết thiếu tiền. Bạn có thể nạp tiền vào tài khoản bằng tiền điện tử (USDT hoặc USDC) bất cứ lúc nào. Tín dụng trả trước của bạn không bao giờ hết hạn, vì vậy bạn có thể thêm tiền bất cứ khi nào bạn sẵn sàng tiếp tục.
Khóa của bạn chỉ cách một biểu mẫu
Tạo tài khoản, sao chép khóa, thay đổi base URL. Đó là toàn bộ quá trình thiết lập.