Your privacy choices

Allow optional cookies for referral attribution, visit analytics, and Google Ads purchase measurement.

Endpoint ที่เข้ากันได้ · การยืนยันตัวตน · Streaming

เอกสารสำหรับนักพัฒนา

เอกสารอ้างอิงเกี่ยวกับ endpoint ที่เข้ากันได้ การยืนยันตัวตน รูปแบบคำขอ การตอบกลับแบบ streaming และการจัดการข้อผิดพลาด

เริ่มต้นอย่างรวดเร็ว

ตั้งค่า endpoint กำหนดค่า API Key เชื่อมต่อ client แล้วส่งคำขอแรก

เลือกเอนด์พอยต์

เลือกรูปแบบเอนด์พอยต์ที่ไคลเอนต์ของคุณต้องการ มีเส้นทางที่เข้ากันได้กับ Chat Completions, Responses และ Messages ให้ใช้งาน

Base URL: https://api.llm-token.cn/v1

เตรียม API Key

ใช้ API Key ที่ใช้งานได้จากสภาพแวดล้อมฝั่งเซิร์ฟเวอร์ หลีกเลี่ยงการเปิดเผยคีย์ในโค้ดฝั่งเบราว์เซอร์

Authorization: Bearer sk-your-api-key

เชื่อมต่อไคลเอนต์

ใช้ SDK ที่เข้ากันได้หรือเรียก REST API โดยตรงด้วย base_url ที่กำหนดเอง

client = OpenAI(base_url='https://api.llm-token.cn/v1')

เริ่มเรียกใช้งาน

ส่งคำขอและรับการตอบกลับจาก AI รองรับการสตรีมเพื่อการตอบสนองที่เร็วขึ้น

POST /v1/chat/completions

การยืนยันตัวตน

ทุกคำขอ API ต้องมี API Key ของคุณในเฮดเดอร์ HTTP Authorization

รูปแบบการยืนยันตัวตน

เพิ่ม API Key ของคุณในเฮดเดอร์ Authorization ในทุกคำขอ

POST/v1/chat/completions

ตัวอย่างคำขอที่มีการยืนยันตัวตน

ตัวอย่างคำขอ
json
curl https://api.llm-token.cn/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer sk-your-api-key" \
  -d '{
    "model": "gpt-4o-mini",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'
ตัวอย่างการตอบกลับ
json
{
  "id": "chatcmpl_123",
  "object": "chat.completion",
  "choices": [{
    "message": {
      "role": "assistant",
      "content": "Hello! How can I help you today?"
    }
  }]
}
Base URL ที่แนะนำ
https://api.llm-token.cn/v1ใช้สำหรับไคลเอนต์ส่วนใหญ่
Base URL สำรอง
https://gpt-agent.ccใช้เฉพาะเมื่อไคลเอนต์ปฏิเสธ /v1 ระหว่างการตรวจสอบ
เอนด์พอยต์ที่เข้ากันได้กับ Chat Completions
/v1/chat/completionsสำหรับไคลเอนต์ที่ต้องการ Chat Completions
เอนด์พอยต์ที่เข้ากันได้กับ Responses
/v1/responsesใช้ก่อนสำหรับไคลเอนต์ที่รองรับ Responses
เอนด์พอยต์ที่เข้ากันได้กับ Messages
/v1/messagesใช้ก่อนสำหรับไคลเอนต์ที่เข้ากันได้กับ Messages

Chat Completions API

endpoint Chat Completions ที่เข้ากันได้กับ OpenAI สำหรับระบบนิเวศโมเดลที่หลากหลาย

python
from openai import OpenAI

# Initialize the client
client = OpenAI(
    api_key="sk-your-api-key",
    base_url="https://api.llm-token.cn/v1"
)

# Send a chat request
response = client.chat.completions.create(
    model="gpt-4o-mini",
    messages=[
        {"role": "system", "content": "You are a concise assistant."},
        {"role": "user", "content": "Introduce yourself in one sentence."}
    ]
)

print(response.choices[0].message.content)

พารามิเตอร์คำขอ

พารามิเตอร์ชนิดจำเป็นคำอธิบาย
modelstringใช่ID ของโมเดล เช่น gpt-4o-mini
messagesarrayใช่อาเรย์ของข้อความแชท
temperaturenumberไม่อุณหภูมิการสุ่มตั้งแต่ 0 ถึง 2 ค่าเริ่มต้น 1
max_tokensintegerไม่จำนวน token สูงสุดที่จะสร้าง
streambooleanไม่เปิดใช้งานการสตรีมเอาต์พุตหรือไม่
top_pnumberไม่ค่าการสุ่มแบบ nucleus ค่าเริ่มต้น 1

ฟิลด์การตอบกลับ

ฟิลด์ชนิดคำอธิบาย
idstringตัวระบุเฉพาะของการตอบกลับ
objectstringประเภทออบเจ็กต์ โดยทั่วไปคือ chat.completion
createdintegerประทับเวลาที่สร้าง
modelstringID ของโมเดลที่ใช้ตอบกลับ
choicesarrayตัวเลือกการตอบกลับที่สร้างขึ้น
usageobjectสถิติการใช้ token

Streaming

เปิดใช้ streaming เพื่อรับ token ที่สร้างขึ้นแบบเรียลไทม์และลดความหน่วงที่ผู้ใช้รู้สึก

ข้อดีของ streaming
  • ลดความหน่วงที่รู้สึกได้ - ผู้ใช้เห็นผลลัพธ์ได้ทันทีโดยไม่ต้องรอการตอบกลับทั้งหมด
  • ประสบการณ์ข้อความยาวที่ดีขึ้น - คำตอบยาว ๆ จะแสดงทีละส่วนคล้ายการพิมพ์สด
  • ต้นทุนเท่าเดิม - streaming คิดราคาเท่ากับการส่งออกแบบซิงโครนัส ต่างกันแค่วิธีส่งข้อมูล
python
from openai import OpenAI

client = OpenAI(
    api_key="sk-your-api-key",
    base_url="https://api.llm-token.cn/v1"
)

# Enable streaming
stream = client.chat.completions.create(
    model="gpt-4o-mini",
    messages=[
        {"role": "system", "content": "You are a concise assistant."},
        {"role": "user", "content": "Introduce yourself in one sentence."}
    ],
    stream=True
)

# Print each streamed token as it arrives
for chunk in stream:
    if chunk.choices[0].delta.content is not None:
        print(chunk.choices[0].delta.content, end="")

print()  # New line

ข้อผิดพลาด

ข้อผิดพลาด API ที่พบบ่อยและขั้นตอนการจัดการที่แนะนำ

สถานะ HTTPชื่อข้อผิดพลาดคำอธิบายการดำเนินการที่แนะนำ
400INVALID_REQUESTรูปแบบคำขอผิดหรือพารามิเตอร์ไม่ถูกต้องตรวจสอบรูปแบบและพารามิเตอร์ของเนื้อหาคำขอ
401UNAUTHORIZEDAPI Key ไม่ถูกต้องหรือหมดอายุตรวจสอบว่า API Key ถูกต้องหรือไม่
429RATE_LIMITเกินขีดจำกัดอัตราคำขอลองใหม่ด้วยกลยุทธ์หน่วงเวลาแบบเอ็กซ์โพเนนเชียล
500INTERNAL_ERRORข้อผิดพลาดภายในของบริการลองใหม่ภายหลัง
503SERVICE_UNAVAILABLEบริการไม่พร้อมใช้งานชั่วคราวลองใหม่ภายหลัง

การจำกัดอัตรา

คำขอ API ถูกจำกัดอัตราเพื่อรักษาเสถียรภาพของบริการ

กฎการจำกัดอัตรา
  • API Key แต่ละตัวมีการจำกัดอัตราคำขอแยกกัน
  • เมื่อได้รับการตอบกลับ 429 โปรดลองใหม่ด้วยกลยุทธ์หน่วงเวลาแบบเอ็กซ์โพเนนเชียล
  • คำขอแบบสตรีมและไม่สตรีมใช้โควตาการจำกัดอัตราเดียวกัน
  • ขีดจำกัดจริงขึ้นอยู่กับการตั้งค่าปัจจุบันของ Key

มีคำถาม? ติดต่อฝ่ายสนับสนุนหรืออ่าน FAQ