Mula pantas
Tetapkan endpoint, konfigurasikan kunci anda, sepadukan client, kemudian hantar permintaan pertama.
Pilih endpoint
Pilih format endpoint yang dijangka oleh klien anda. Laluan serasi Chat Completions, Responses dan Messages tersedia.
Base URL: https://api.llm-token.cn/v1Sediakan API Key
Gunakan API Key aktif dari persekitaran pelayan anda. Elakkan mendedahkan key dalam kod sebelah pelayar.
Authorization: Bearer sk-your-api-keySepadukan klien anda
Gunakan SDK serasi atau panggil REST API secara terus dengan base_url tersuai.
client = OpenAI(base_url='https://api.llm-token.cn/v1')Mula memanggil
Hantar permintaan dan terima respons AI. Penstriman disokong untuk respons yang lebih pantas.
POST /v1/chat/completionsPengesahan
Setiap permintaan API mesti menyertakan API Key anda dalam header HTTP Authorization.
Format pengesahan
Tambahkan API Key anda ke header Authorization dalam setiap permintaan.
/v1/chat/completionsContoh permintaan yang disahkan
curl https://api.llm-token.cn/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer sk-your-api-key" \
-d '{
"model": "gpt-4o-mini",
"messages": [{"role": "user", "content": "Hello!"}]
}'{
"id": "chatcmpl_123",
"object": "chat.completion",
"choices": [{
"message": {
"role": "assistant",
"content": "Hello! How can I help you today?"
}
}]
}https://api.llm-token.cn/v1Gunakan untuk kebanyakan klienhttps://gpt-agent.ccGunakan hanya jika klien anda menolak /v1 semasa pengesahan/v1/chat/completionsUntuk klien yang menjangkakan Chat Completions/v1/responsesGuna dahulu untuk klien yang menyokong Responses/v1/messagesGuna dahulu untuk klien serasi MessagesChat Completions API
Endpoint Chat Completions serasi OpenAI untuk pelbagai ekosistem model.
from openai import OpenAI
# Initialize the client
client = OpenAI(
api_key="sk-your-api-key",
base_url="https://api.llm-token.cn/v1"
)
# Send a chat request
response = client.chat.completions.create(
model="gpt-4o-mini",
messages=[
{"role": "system", "content": "You are a concise assistant."},
{"role": "user", "content": "Introduce yourself in one sentence."}
]
)
print(response.choices[0].message.content)Parameter permintaan
| Parameter | Jenis | Wajib | Penerangan |
|---|---|---|---|
model | string | Ya | ID model, contohnya gpt-4o-mini |
messages | array | Ya | Tatasusunan mesej sembang |
temperature | number | Tidak | Suhu pensampelan dari 0 hingga 2, lalai 1 |
max_tokens | integer | Tidak | Bilangan maksimum token untuk dijana |
stream | boolean | Tidak | Sama ada untuk mengaktifkan output penstriman |
top_p | number | Tidak | Nilai pensampelan nucleus, lalai 1 |
Medan respons
| Medan | Jenis | Penerangan |
|---|---|---|
id | string | Pengecam unik respons |
object | string | Jenis objek, biasanya chat.completion |
created | integer | Cap masa penciptaan |
model | string | ID model yang digunakan untuk respons |
choices | array | Pilihan respons yang dijana |
usage | object | Statistik penggunaan token |
Streaming
Hidupkan streaming untuk menerima token yang dijana secara masa nyata dan mengurangkan latensi yang dirasai.
- Latensi dirasai lebih rendah - Pengguna melihat output serta-merta dan tidak perlu menunggu respons penuh.
- Pengalaman teks panjang lebih baik - Jawapan panjang muncul secara beransur-ansur, seperti taipan langsung.
- Kos sama - Streaming dikenakan harga yang sama seperti output segerak; hanya cara penghantaran berbeza.
from openai import OpenAI
client = OpenAI(
api_key="sk-your-api-key",
base_url="https://api.llm-token.cn/v1"
)
# Enable streaming
stream = client.chat.completions.create(
model="gpt-4o-mini",
messages=[
{"role": "system", "content": "You are a concise assistant."},
{"role": "user", "content": "Introduce yourself in one sentence."}
],
stream=True
)
# Print each streamed token as it arrives
for chunk in stream:
if chunk.choices[0].delta.content is not None:
print(chunk.choices[0].delta.content, end="")
print() # New lineRalat
Ralat API yang lazim dan langkah pengendalian yang disyorkan.
| Status HTTP | Nama ralat | Penerangan | Tindakan disyorkan |
|---|---|---|---|
400 | INVALID_REQUEST | Format permintaan salah atau parameter tidak sah | Semak format dan parameter badan permintaan |
401 | UNAUTHORIZED | API Key tidak sah atau telah tamat tempoh | Sahkan bahawa API Key betul |
429 | RATE_LIMIT | Had kadar permintaan melebihi | Cuba semula dengan strategi backoff eksponen |
500 | INTERNAL_ERROR | Ralat dalaman perkhidmatan | Cuba lagi kemudian |
503 | SERVICE_UNAVAILABLE | Perkhidmatan tidak tersedia buat sementara | Cuba lagi kemudian |
Had kadar
Permintaan API dihadkan kadarnya untuk memastikan perkhidmatan stabil.
- Setiap API Key mempunyai had kadar permintaan tersendiri
- Apabila menerima respons 429, cuba semula dengan strategi backoff eksponen
- Permintaan penstriman dan bukan penstriman berkongsi kuota had kadar yang sama
- Had berkesan mengikut konfigurasi semasa Key