البدء السريع
اضبط الـ endpoint، وأعد إعداد مفتاحك، وادمج العميل، ثم أرسل الطلب الأول.
اختر نقطة نهاية
اختر تنسيق نقطة النهاية التي يتوقعها عميلك. تتوفر مسارات متوافقة مع Chat Completions وResponses وMessages.
Base URL: https://api.llm-token.cn/v1جهّز مفتاح API
استخدم مفتاح API نشطا من بيئة الخادم لديك. تجنب كشف المفاتيح في كود جانب المتصفح.
Authorization: Bearer sk-your-api-keyادمج عميلك
استخدم SDK متوافقا أو استدعِ REST API مباشرة باستخدام base_url مخصص.
client = OpenAI(base_url='https://api.llm-token.cn/v1')ابدأ الاستدعاء
أرسل الطلبات واستقبل استجابات الذكاء الاصطناعي. البث مدعوم لاستجابة أسرع.
POST /v1/chat/completionsالمصادقة
يجب أن يتضمن كل طلب API مفتاح API الخاص بك في ترويسة HTTP Authorization.
صيغة المصادقة
أضف مفتاح API الخاص بك إلى ترويسة Authorization في كل طلب.
/v1/chat/completionsمثال على طلب مع مصادقة
curl https://api.llm-token.cn/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer sk-your-api-key" \
-d '{
"model": "gpt-4o-mini",
"messages": [{"role": "user", "content": "Hello!"}]
}'{
"id": "chatcmpl_123",
"object": "chat.completion",
"choices": [{
"message": {
"role": "assistant",
"content": "Hello! How can I help you today?"
}
}]
}https://api.llm-token.cn/v1استخدمه لمعظم العملاءhttps://gpt-agent.ccاستخدمه فقط إذا رفض عميلك /v1 أثناء التحقق/v1/chat/completionsللعملاء الذين يتوقعون Chat Completions/v1/responsesاستخدمه أولا للعملاء الذين يدعمون Responses/v1/messagesاستخدمه أولا للعملاء المتوافقين مع MessagesChat Completions API
endpoint للـ Chat Completions متوافق مع OpenAI لمنظومات نماذج متعددة.
from openai import OpenAI
# Initialize the client
client = OpenAI(
api_key="sk-your-api-key",
base_url="https://api.llm-token.cn/v1"
)
# Send a chat request
response = client.chat.completions.create(
model="gpt-4o-mini",
messages=[
{"role": "system", "content": "You are a concise assistant."},
{"role": "user", "content": "Introduce yourself in one sentence."}
]
)
print(response.choices[0].message.content)معاملات الطلب
| المعامل | النوع | مطلوب | الوصف |
|---|---|---|---|
model | string | نعم | معرّف النموذج، مثل gpt-4o-mini |
messages | array | نعم | مصفوفة رسائل المحادثة |
temperature | number | لا | درجة حرارة العينة من 0 إلى 2، الافتراضي 1 |
max_tokens | integer | لا | الحد الأقصى لعدد الرموز (Tokens) المُولَّدة |
stream | boolean | لا | ما إذا كان سيتم تمكين إخراج البث |
top_p | number | لا | قيمة عينة النواة (nucleus)، الافتراضي 1 |
حقول الاستجابة
| الحقل | النوع | الوصف |
|---|---|---|
id | string | معرّف فريد للاستجابة |
object | string | نوع الكائن، عادة chat.completion |
created | integer | الطابع الزمني للإنشاء |
model | string | معرّف النموذج المستخدم للاستجابة |
choices | array | خيارات الاستجابة المُولَّدة |
usage | object | إحصاءات استخدام الرموز (Tokens) |
البث
فعّل البث لاستقبال الرموز (Tokens) المُولّدة في الوقت الفعلي وتقليل زمن الاستجابة المُدرَك.
- زمن استجابة مُدرَك أقل - يرى المستخدم المخرجات فورا بدلا من انتظار الرد الكامل.
- تجربة أفضل للنصوص الطويلة - تظهر الإجابات الطويلة تدريجيا، مثل الكتابة المباشرة.
- التكلفة نفسها - يُسعَّر البث مثل المخرجات المتزامنة؛ يتغير أسلوب النقل فقط.
from openai import OpenAI
client = OpenAI(
api_key="sk-your-api-key",
base_url="https://api.llm-token.cn/v1"
)
# Enable streaming
stream = client.chat.completions.create(
model="gpt-4o-mini",
messages=[
{"role": "system", "content": "You are a concise assistant."},
{"role": "user", "content": "Introduce yourself in one sentence."}
],
stream=True
)
# Print each streamed token as it arrives
for chunk in stream:
if chunk.choices[0].delta.content is not None:
print(chunk.choices[0].delta.content, end="")
print() # New lineالأخطاء
أخطاء API الشائعة وخطوات المعالجة الموصى بها.
| حالة HTTP | اسم الخطأ | الوصف | الإجراء الموصى به |
|---|---|---|---|
400 | INVALID_REQUEST | تنسيق الطلب خاطئ أو المعاملات غير صالحة | تحقق من تنسيق نص الطلب والمعاملات |
401 | UNAUTHORIZED | مفتاح API غير صالح أو منتهي الصلاحية | تأكد من صحة مفتاح API |
429 | RATE_LIMIT | تجاوز حد معدل الطلبات | أعد المحاولة باستخدام استراتيجية التراجع الأسي |
500 | INTERNAL_ERROR | خطأ داخلي في الخدمة | أعد المحاولة لاحقا |
503 | SERVICE_UNAVAILABLE | الخدمة غير متاحة مؤقتا | أعد المحاولة لاحقا |
حدود المعدل
تخضع طلبات API لحدود معدل للحفاظ على استقرار الخدمة.
- لكل مفتاح API حدود معدل طلبات خاصة به
- عند استلام استجابة 429 أعد المحاولة باستخدام استراتيجية التراجع الأسي
- تتشارك الطلبات بالبث وبدون بث نفس حصة حد المعدل
- يعتمد الحد الفعلي على الإعدادات الحالية للمفتاح