Your privacy choices

Allow optional cookies for referral attribution, visit analytics, and Google Ads purchase measurement.

Endpoint serasi · Pengesahan · Streaming

Dokumentasi pembangun

Dokumentasi rujukan tentang endpoint serasi, pengesahan, format permintaan, respons streaming dan pengendalian ralat.

Mula pantas

Tetapkan endpoint, konfigurasikan kunci anda, sepadukan client, kemudian hantar permintaan pertama.

Pilih endpoint

Pilih format endpoint yang dijangka oleh klien anda. Laluan serasi Chat Completions, Responses dan Messages tersedia.

Base URL: https://api.llm-token.cn/v1

Sediakan API Key

Gunakan API Key aktif dari persekitaran pelayan anda. Elakkan mendedahkan key dalam kod sebelah pelayar.

Authorization: Bearer sk-your-api-key

Sepadukan klien anda

Gunakan SDK serasi atau panggil REST API secara terus dengan base_url tersuai.

client = OpenAI(base_url='https://api.llm-token.cn/v1')

Mula memanggil

Hantar permintaan dan terima respons AI. Penstriman disokong untuk respons yang lebih pantas.

POST /v1/chat/completions

Pengesahan

Setiap permintaan API mesti menyertakan API Key anda dalam header HTTP Authorization.

Format pengesahan

Tambahkan API Key anda ke header Authorization dalam setiap permintaan.

POST/v1/chat/completions

Contoh permintaan yang disahkan

Contoh permintaan
json
curl https://api.llm-token.cn/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer sk-your-api-key" \
  -d '{
    "model": "gpt-4o-mini",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'
Contoh respons
json
{
  "id": "chatcmpl_123",
  "object": "chat.completion",
  "choices": [{
    "message": {
      "role": "assistant",
      "content": "Hello! How can I help you today?"
    }
  }]
}
Base URL disyorkan
https://api.llm-token.cn/v1Gunakan untuk kebanyakan klien
Base URL sandaran
https://gpt-agent.ccGunakan hanya jika klien anda menolak /v1 semasa pengesahan
Endpoint serasi Chat Completions
/v1/chat/completionsUntuk klien yang menjangkakan Chat Completions
Endpoint serasi Responses
/v1/responsesGuna dahulu untuk klien yang menyokong Responses
Endpoint serasi Messages
/v1/messagesGuna dahulu untuk klien serasi Messages

Chat Completions API

Endpoint Chat Completions serasi OpenAI untuk pelbagai ekosistem model.

python
from openai import OpenAI

# Initialize the client
client = OpenAI(
    api_key="sk-your-api-key",
    base_url="https://api.llm-token.cn/v1"
)

# Send a chat request
response = client.chat.completions.create(
    model="gpt-4o-mini",
    messages=[
        {"role": "system", "content": "You are a concise assistant."},
        {"role": "user", "content": "Introduce yourself in one sentence."}
    ]
)

print(response.choices[0].message.content)

Parameter permintaan

ParameterJenisWajibPenerangan
modelstringYaID model, contohnya gpt-4o-mini
messagesarrayYaTatasusunan mesej sembang
temperaturenumberTidakSuhu pensampelan dari 0 hingga 2, lalai 1
max_tokensintegerTidakBilangan maksimum token untuk dijana
streambooleanTidakSama ada untuk mengaktifkan output penstriman
top_pnumberTidakNilai pensampelan nucleus, lalai 1

Medan respons

MedanJenisPenerangan
idstringPengecam unik respons
objectstringJenis objek, biasanya chat.completion
createdintegerCap masa penciptaan
modelstringID model yang digunakan untuk respons
choicesarrayPilihan respons yang dijana
usageobjectStatistik penggunaan token

Streaming

Hidupkan streaming untuk menerima token yang dijana secara masa nyata dan mengurangkan latensi yang dirasai.

Kelebihan streaming
  • Latensi dirasai lebih rendah - Pengguna melihat output serta-merta dan tidak perlu menunggu respons penuh.
  • Pengalaman teks panjang lebih baik - Jawapan panjang muncul secara beransur-ansur, seperti taipan langsung.
  • Kos sama - Streaming dikenakan harga yang sama seperti output segerak; hanya cara penghantaran berbeza.
python
from openai import OpenAI

client = OpenAI(
    api_key="sk-your-api-key",
    base_url="https://api.llm-token.cn/v1"
)

# Enable streaming
stream = client.chat.completions.create(
    model="gpt-4o-mini",
    messages=[
        {"role": "system", "content": "You are a concise assistant."},
        {"role": "user", "content": "Introduce yourself in one sentence."}
    ],
    stream=True
)

# Print each streamed token as it arrives
for chunk in stream:
    if chunk.choices[0].delta.content is not None:
        print(chunk.choices[0].delta.content, end="")

print()  # New line

Ralat

Ralat API yang lazim dan langkah pengendalian yang disyorkan.

Status HTTPNama ralatPeneranganTindakan disyorkan
400INVALID_REQUESTFormat permintaan salah atau parameter tidak sahSemak format dan parameter badan permintaan
401UNAUTHORIZEDAPI Key tidak sah atau telah tamat tempohSahkan bahawa API Key betul
429RATE_LIMITHad kadar permintaan melebihiCuba semula dengan strategi backoff eksponen
500INTERNAL_ERRORRalat dalaman perkhidmatanCuba lagi kemudian
503SERVICE_UNAVAILABLEPerkhidmatan tidak tersedia buat sementaraCuba lagi kemudian

Had kadar

Permintaan API dihadkan kadarnya untuk memastikan perkhidmatan stabil.

Peraturan had kadar
  • Setiap API Key mempunyai had kadar permintaan tersendiri
  • Apabila menerima respons 429, cuba semula dengan strategi backoff eksponen
  • Permintaan penstriman dan bukan penstriman berkongsi kuota had kadar yang sama
  • Had berkesan mengikut konfigurasi semasa Key

Ada soalan? Hubungi sokongan atau baca FAQ.