Bắt đầu nhanh
Thiết lập endpoint, cấu hình API Key, tích hợp client rồi gửi yêu cầu đầu tiên.
Chọn endpoint
Chọn định dạng endpoint mà client của bạn yêu cầu. Có sẵn các tuyến tương thích với Chat Completions, Responses và Messages.
Base URL: https://api.llm-token.cn/v1Chuẩn bị API Key
Dùng API Key đang hoạt động từ môi trường máy chủ. Tránh để lộ key trong mã phía trình duyệt.
Authorization: Bearer sk-your-api-keyTích hợp client
Dùng SDK tương thích hoặc gọi trực tiếp REST API với base_url tùy chỉnh.
client = OpenAI(base_url='https://api.llm-token.cn/v1')Bắt đầu gọi
Gửi yêu cầu và nhận phản hồi AI. Hỗ trợ truyền phát để phản hồi nhanh hơn.
POST /v1/chat/completionsXác thực
Mọi yêu cầu API đều phải kèm API Key của bạn trong HTTP header Authorization.
Định dạng xác thực
Thêm API Key của bạn vào header Authorization trong mỗi yêu cầu.
/v1/chat/completionsVí dụ yêu cầu có xác thực
curl https://api.llm-token.cn/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer sk-your-api-key" \
-d '{
"model": "gpt-4o-mini",
"messages": [{"role": "user", "content": "Hello!"}]
}'{
"id": "chatcmpl_123",
"object": "chat.completion",
"choices": [{
"message": {
"role": "assistant",
"content": "Hello! How can I help you today?"
}
}]
}https://api.llm-token.cn/v1Dùng cho hầu hết các clienthttps://gpt-agent.ccChỉ dùng nếu client từ chối /v1 khi xác thực/v1/chat/completionsDành cho client yêu cầu Chat Completions/v1/responsesƯu tiên dùng cho client hỗ trợ Responses/v1/messagesƯu tiên dùng cho client tương thích MessagesChat Completions API
Endpoint Chat Completions tương thích OpenAI cho nhiều hệ sinh thái mô hình.
from openai import OpenAI
# Initialize the client
client = OpenAI(
api_key="sk-your-api-key",
base_url="https://api.llm-token.cn/v1"
)
# Send a chat request
response = client.chat.completions.create(
model="gpt-4o-mini",
messages=[
{"role": "system", "content": "You are a concise assistant."},
{"role": "user", "content": "Introduce yourself in one sentence."}
]
)
print(response.choices[0].message.content)Tham số yêu cầu
| Tham số | Kiểu | Bắt buộc | Mô tả |
|---|---|---|---|
model | string | Có | ID mô hình, ví dụ gpt-4o-mini |
messages | array | Có | Mảng tin nhắn trò chuyện |
temperature | number | Không | Nhiệt độ lấy mẫu từ 0 đến 2, mặc định 1 |
max_tokens | integer | Không | Số token tối đa được tạo |
stream | boolean | Không | Có bật truyền phát hay không |
top_p | number | Không | Giá trị lấy mẫu nucleus, mặc định 1 |
Trường phản hồi
| Trường | Kiểu | Mô tả |
|---|---|---|
id | string | Định danh duy nhất của phản hồi |
object | string | Loại đối tượng, thường là chat.completion |
created | integer | Dấu thời gian tạo |
model | string | ID mô hình dùng cho phản hồi |
choices | array | Các lựa chọn phản hồi được tạo |
usage | object | Thống kê sử dụng token |
Streaming
Bật streaming để nhận token được tạo theo thời gian thực và giảm độ trễ cảm nhận.
- Giảm độ trễ cảm nhận - Người dùng thấy nội dung ngay thay vì chờ phản hồi hoàn chỉnh.
- Trải nghiệm văn bản dài tốt hơn - Câu trả lời dài hiện ra dần, giống như đang gõ trực tiếp.
- Chi phí như nhau - Streaming tính phí giống đầu ra đồng bộ; chỉ khác cách truyền tải.
from openai import OpenAI
client = OpenAI(
api_key="sk-your-api-key",
base_url="https://api.llm-token.cn/v1"
)
# Enable streaming
stream = client.chat.completions.create(
model="gpt-4o-mini",
messages=[
{"role": "system", "content": "You are a concise assistant."},
{"role": "user", "content": "Introduce yourself in one sentence."}
],
stream=True
)
# Print each streamed token as it arrives
for chunk in stream:
if chunk.choices[0].delta.content is not None:
print(chunk.choices[0].delta.content, end="")
print() # New lineLỗi
Các lỗi API thường gặp và các bước xử lý được khuyến nghị.
| Mã HTTP | Tên lỗi | Mô tả | Hành động khuyến nghị |
|---|---|---|---|
400 | INVALID_REQUEST | Định dạng yêu cầu sai hoặc tham số không hợp lệ | Kiểm tra định dạng và tham số của thân yêu cầu |
401 | UNAUTHORIZED | API Key không hợp lệ hoặc đã hết hạn | Kiểm tra xem API Key có đúng không |
429 | RATE_LIMIT | Vượt quá giới hạn tần suất yêu cầu | Thử lại với chiến lược lùi theo cấp số nhân |
500 | INTERNAL_ERROR | Lỗi nội bộ của dịch vụ | Thử lại sau |
503 | SERVICE_UNAVAILABLE | Dịch vụ tạm thời không khả dụng | Thử lại sau |
Giới hạn tần suất
Yêu cầu API bị giới hạn tần suất để giữ dịch vụ ổn định.
- Mỗi API Key có giới hạn tần suất yêu cầu riêng
- Khi nhận phản hồi 429, hãy thử lại với chiến lược lùi theo cấp số nhân
- Yêu cầu truyền phát và không truyền phát dùng chung hạn ngạch giới hạn tần suất
- Giới hạn thực tế theo cấu hình hiện tại của Key