Hermes API: เปลี่ยนไคลเอนต์ของคุณในสามบรรทัด
เริ่มต้นใช้งาน Hermes API ในไม่กี่นาทีโดยใช้ SDK มาตรฐานของ OpenAI คู่มือเริ่มต้นอย่างรวดเร็วนี้ครอบคลุมการกำหนดค่า คำขอพื้นฐาน การสตรีมมิง และการจัดการข้อผิดพลาดสำหรับการผสาน LLM แบบไม่เซ็นเซอร์ของคุณ
- ต่อ 1M โทเคนอินพุต
- $0.25
- โทเคนเอาต์พุต / 1M
- $1.00
- หน้าต่างบริบทของโทเคน
- 100,000
- เครดิตทดลองใช้
- $0.50
- คำขอต่อนาที
- 300
ติดตั้ง OpenAI SDK
เนื่องจากเอนด์พอยต์ของเราเข้ากันได้กับ OpenAI คุณจึงสามารถใช้ SDK ทางการที่คุณคุ้นเคยอยู่แล้วได้ วิธีนี้ช่วยให้คุณเปลี่ยนจากผู้ให้บริการรายอื่นได้โดยไม่ต้องเขียนตรรกะแอปพลิเคชันใหม่ เราสนับสนุนแพ็กเกจ openai มาตรฐานสำหรับสภาพแวดล้อม Python และ Node.js
ตรวจสอบว่าคุณใช้เวอร์ชันล่าสุดของ SDK เพื่อให้แน่ใจว่าเข้ากันได้กับฟีเจอร์สตรีมมิงและการเรียกใช้ฟังก์ชัน ไลบรารีไคลเอนต์จัดการการแปลงข้อมูล JSON และการขนส่ง HTTP โดยอัตโนมัติ ดังนั้นคุณสามารถมุ่งเน้นไปที่พารามิเตอร์โมเดลแทนรายละเอียดเครือข่าย
กำหนดค่า Base URL และคีย์
การตรวจสอบสิทธิ์ดำเนินการผ่านโทเคน Bearer ในส่วนหัว Authorization คุณได้รับคีย์ของคุณโดยการสมัครสมาชิกด้วยอีเมลและรหัสผ่านบนแดชบอร์ดของเรา ไม่จำเป็นต้องใช้บัตรเครดิตสำหรับการทดลองใช้ และคุณสามารถสร้างคีย์ใหม่ได้ทุกเมื่อเพื่อยกเลิกการเข้าถึง
ตั้งค่า URL พื้นฐานเป็นเอนด์พอยต์เฉพาะของเรา สิ่งนี้ทำให้แน่ใจว่าคำขอทั้งหมดไปยังโครงสร้างพื้นฐานโมเดลที่ไม่เซ็นเซอร์ของเราแทนที่จะเป็นคลาวด์ OpenAI มาตรฐาน คุณสามารถพบคีย์ API ของคุณบนหน้า 'รับคีย์ API' ทันทีหลังจากสมัครสมาชิก
ส่งคำขอแรกของคุณ
ส่งคำขอ chat completion มาตรฐานเพื่อทดสอบการเชื่อมต่อ รหัสโมเดลคือ uncensored เสมอ โมเดลนี้ได้รับการปรับแต่งเพื่อตอบโดยไม่มีการปฏิเสธเนื้อหาสำหรับการใช้งานผู้ใหญ่ตามกฎหมาย ทำให้เหมาะสำหรับการเขียนเชิงสร้างสรรค์ การสวมบทบาท หรือการวิจัยแบบไม่มีข้อจำกัด
- ใช้
POST /v1/chat/completionsสำหรับการสร้างข้อความ - หน้าต่างบริบทรองรับโทเคนได้สูงสุด 100,000 โทเคนสำหรับพรอมต์และการสร้างคำตอบ
- คำขอจะถูกเรียกเก็บตามจำนวนโทเคนอินพุตและเอาต์พุต
curl https://api.hermesllmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
เปิดใช้สตรีมมิง (SSE)
เพื่อประสบการณ์ผู้ใช้ที่ดีขึ้น ให้เปิดใช้สตรีมมิงเพื่อรับโทเคนเมื่อถูกสร้าง ซึ่งช่วยลดความล่าช้าที่ผู้ใช้รู้สึก โดยเฉพาะกับคำตอบที่ยาว เซิร์ฟเวอร์จะส่งเหตุการณ์ที่ส่งโดยเซิร์ฟเวอร์ (SSE) ที่ไคลเอนต์ของคุณสามารถแยกวิเคราะห์แบบเรียลไทม์
ตั้งค่าพารามิเตอร์ stream เป็น true ในบอดี้คำขอของคุณ SDK จะส่งข้อมูลแบบชิ้นส่วนเมื่อมาถึง ซึ่งจะมีประโยชน์มากสำหรับอินเทอร์เฟซแชทที่คุณต้องการแสดงข้อความแบบเพิ่มทีละส่วนแทนที่จะรอให้คำตอบทั้งหมดเสร็จสิ้น
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
ใช้การเรียกใช้เครื่องมือ/ฟังก์ชัน
API ของเรารองรับการเรียกใช้ฟังก์ชัน ทำให้โมเดลสามารถส่งออก JSON ที่มีโครงสร้างสำหรับการดำเนินการเครื่องมือภายนอก กำหนดฟังก์ชันของคุณในพารามิเตอร์ tools และโมเดลจะส่งคืน tool_calls ในการตอบกลับหากเหมาะสม
คุณลักษณะนี้ทำงานเหมือนกับที่ระบุไว้ในสเปคของ OpenAI คุณสามารถแยกวิเคราะห์ชื่อฟังก์ชันและอาร์กิวเมนต์ ดำเนินตรรกะแบ็กเอนด์ของคุณ และป้อนผลลัพธ์กลับเข้าสู่การสนทนา มันเข้ากันได้กับเวิร์กโฟลว์การเรียกใช้ฟังก์ชันของ SDK OpenAI มาตรฐาน
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.hermesllmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
ตรวจสอบโมเดลที่มีอยู่
เรียกใช้เอนด์พอยต์โมเดลเพื่อตรวจสอบการเชื่อมต่อและดูตัวเลือกที่มีอยู่ ปัจจุบันเราเสนอโมเดลเฉพาะเพียงรุ่นเดียว: uncensored ความเรียบง่ายนี้หลีกเลี่ยงความซับซ้อนของการจัดเส้นทางโมเดลหรือโครงสร้างพื้นฐานทั่วไป ซึ่งช่วยให้มั่นใจในพฤติกรรมที่คาดการณ์ได้
คุณยังสามารถใช้เอนด์พอยต์นี้เพื่อแก้ไขปัญหาการตรวจสอบสิทธิ์ได้ หากคำขอล้มเหลว ให้ตรวจสอบความถูกต้องของคีย์ API และการเชื่อมต่อเครือข่าย การตอบกลับจะแสดงรายละเอียดโมเดล รวมถึงขนาดหน้าต่างบริบทและขีดจำกัดโทเคน
from openai import OpenAI
client = OpenAI(base_url="https://api.hermesllmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
จัดการขีดจำกัดอัตราและข้อผิดพลาด
API ของเราจำกัดคำขอ 300 คำขอต่อนาทีต่อคีย์ หากเกินจะรับข้อผิดพลาด 429 รองรับบอดี้คำขอสูงสุด 8 MB สำหรับพรอมต์หรือหน้าต่างบริบทขนาดใหญ่
ข้อผิดพลาดทั่วไปรวมถึง 401 (คีย์ไม่ถูกต้อง) และ 402 (เครดิตไม่เพียงพอ) เครดิตแบบเติมเงินล่วงหน้าไม่หมดอายุ ดังนั้นคุณสามารถเติมเงินได้ตามความสะดวก โบนัสเครดิตจะถูกนำไปใช้โดยอัตโนมัติสำหรับการซื้อขนาดใหญ่: +5% จาก $50 และ +10% จาก $100
ข้อมูลจำเพาะทางเทคนิค
ขีดจำกัดและความสามารถจริงทั้งหมดของ API ในที่เดียว ตรวจสอบก่อนเติมเงิน
| รายการ | ค่า |
|---|---|
| รูปแบบ API | รองรับ OpenAI: ใช้ OpenAI SDK ใดก็ได้ แค่เปลี่ยน base URL และคีย์ |
| ID โมเดล | uncensored |
| เอนด์พอยต์ | POST /v1/chat/completions · GET /v1/models |
| การยืนยันตัวตน | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.hermesllmapi.com/v1 |
| เอาต์พุตสูงสุด | ได้ถึงส่วนที่เหลือของหน้าต่าง 100,000 โทเคน; max_tokens ไม่บังคับ (ไม่มีเพดานแยก) |
| โหมด JSON | response_format: {"type": "json_object"} |
| พารามิเตอร์ | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| การเรียกใช้ฟังก์ชัน | รองรับ — tools, tool_choice คำตอบมี tool_calls รวมถึงตอนสตรีม ส่งผลลัพธ์กลับด้วย role: tool |
| หน้าต่างบริบท | 100,000 โทเคน (อินพุตรวมเอาต์พุต) |
| สตรีมมิง | รองรับ — server-sent events ชิ้นสุดท้ายมีจำนวนโทเคนที่ใช้ |
| คำขอพร้อมกัน | สูงสุด 8 คำขอพร้อมกันต่อคีย์ |
| เฮดเดอร์ของคำตอบ | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| ขีดจำกัดอัตรา | 300 คำขอต่อนาทีต่อคีย์ |
| ขนาดคำขอ | ไม่เกิน 8 MB |
| ราคา | $0.25 ต่อ 1 ล้านโทเคนอินพุต · $1.00 ต่อ 1 ล้านโทเคนเอาต์พุต |
| โบนัส | +5% เมื่อเติมตั้งแต่ $50, +10% ตั้งแต่ $100 |
| เติมเงิน | USDT (TRC20) หรือ USDC (Base) จำนวนเต็มใดก็ได้ตั้งแต่ $10 ถึง $500 |
| เครดิตทดลองใช้ฟรี | $0.50 ใช้ได้ 7 วัน ไม่ต้องใช้บัตร · คีย์ทดลอง: 2 คำขอพร้อมกัน, 60 ครั้งต่อนาที; ขีดจำกัดเต็ม (8 และ 300) หลังเติมเงินครั้งแรก |
| การคิดเงิน | เครดิตแบบเติมเงินล่วงหน้าตามการใช้งานจริง ข้อผิดพลาดและการปฏิเสธไม่คิดเงิน |
| อายุเครดิต | เครดิตที่ซื้อไม่มีวันหมดอายุ ไม่มีการสมัครรายเดือน |
| คีย์ | หนึ่งบัญชีมีคีย์ที่ใช้งานได้หนึ่งคีย์ คีย์ใหม่จะแทนคีย์เดิม |
| เข้าสู่ระบบ | Google หรืออีเมลและรหัสผ่าน |
| เนื้อหา | อนุญาตเนื้อหาสำหรับผู้ใหญ่ ปฏิเสธเนื้อหาทางเพศที่เกี่ยวข้องกับผู้เยาว์ |
รหัสข้อผิดพลาด
ข้อผิดพลาดส่งกลับเป็น JSON พร้อม type ที่คงที่ คำขอที่ล้มเหลวหรือถูกปฏิเสธไม่คิดเงิน
| รหัส | ประเภท | ความหมาย |
|---|---|---|
400 | bad_request | JSON ไม่ถูกต้อง ข้อความว่าง พารามิเตอร์ผิด หรือเกินหน้าต่างบริบท |
401 | missing_key · invalid_key · key_revoked | ไม่มีคีย์ คีย์ผิด หรือคีย์ถูกแทนที่แล้ว |
402 | no_credit | เครดิตหมด เติมเงินแล้วใช้งานต่อได้ทันที |
403 | content_blocked | เนื้อหาทางเพศเกี่ยวกับผู้เยาว์ ถูกปฏิเสธ ไม่คิดเงิน |
404 | not_found | ไม่รู้จักเอนด์พอยต์ |
413 | request_too_large | ขนาดเกิน 8 MB |
429 | rate_limited · concurrency | เกิน 300/นาที หรือ 8 พร้อมกัน รอแล้วลองใหม่ |
503 | upstream_busy | โมเดลไม่ว่าง ลองใหม่ในไม่กี่วินาที |
ถาม-ตอบ
Hermes API รองรับภาพหรือการสร้างเสียงหรือไม่
ไม่ ปัจจุบันเราเสนอ API การสนทนาแบบข้อความเท่านั้น เราไม่รองรับเอบเดดดิ้ง รูปภาพ เสียง หรือการสร้างวิดีโอ และเราไม่เสนอการปรับแต่งพิเศษ จุดเน้นของเราคือการมอบโมเดลข้อความที่ไม่เซ็นเซอร์ที่ตรงไปตรงมาสำหรับไคลเอนต์ที่เข้ากันได้กับ OpenAI มาตรฐาน
โมเดลไม่เซ็นเซอร์จัดการเนื้อหาสำหรับผู้ใหญ่อย่างไร
โมเดลไม่ปฏิเสธหัวข้อผู้ใหญ่ตามกฎหมาย นามสมมติ หรือที่ถกเถกันได้ อย่างไรก็ตาม มีขีดจำกัดเนื้อหาที่เข้มงวด: คำขอที่เกี่ยวข้องกับเนื้อหาทางเพศกับเด็กจะถูกบล็อกเสมอ นี่คือข้อจำกัดเดียวที่เข้มงวดกับพรอมต์ของคุณ
เกิดอะไรขึ้นหากเครดิตหมด
คีย์ API ของคุณยังคงใช้งานอยู่ แต่คำขอจะส่งข้อผิดพลาด 402 บ่งชี้ว่าเงินไม่พอ คุณสามารถเติมเงินบัญชีด้วยคริปโต (USDT หรือ USDC) ได้ตลอดเวลา เครดิตแบบเติมเงินล่วงหน้าของคุณไม่หมดอายุ ดังนั้นคุณสามารถเติมเงินเมื่อใดก็ได้เมื่อคุณพร้อมที่จะดำเนินการต่อ
คีย์ของคุณอยู่ห่างแค่แบบฟอร์มเดียว
สร้างบัญชี คัดลอกคีย์ เปลี่ยน base URL นั่นคือการตั้งค่าทั้งหมด