Your privacy choices

Allow optional cookies for referral attribution, visit analytics, and Google Ads purchase measurement.

endpoints متوافقة · مصادقة · بث

وثائق المطورين

وثائق مرجعية حول الـ endpoints المتوافقة والمصادقة وصيغة الطلب والردود بالبث ومعالجة الأخطاء.

البدء السريع

اضبط الـ endpoint، وأعد إعداد مفتاحك، وادمج العميل، ثم أرسل الطلب الأول.

اختر نقطة نهاية

اختر تنسيق نقطة النهاية التي يتوقعها عميلك. تتوفر مسارات متوافقة مع Chat Completions وResponses وMessages.

Base URL: https://api.llm-token.cn/v1

جهّز مفتاح API

استخدم مفتاح API نشطا من بيئة الخادم لديك. تجنب كشف المفاتيح في كود جانب المتصفح.

Authorization: Bearer sk-your-api-key

ادمج عميلك

استخدم SDK متوافقا أو استدعِ REST API مباشرة باستخدام base_url مخصص.

client = OpenAI(base_url='https://api.llm-token.cn/v1')

ابدأ الاستدعاء

أرسل الطلبات واستقبل استجابات الذكاء الاصطناعي. البث مدعوم لاستجابة أسرع.

POST /v1/chat/completions

المصادقة

يجب أن يتضمن كل طلب API مفتاح API الخاص بك في ترويسة HTTP Authorization.

صيغة المصادقة

أضف مفتاح API الخاص بك إلى ترويسة Authorization في كل طلب.

POST/v1/chat/completions

مثال على طلب مع مصادقة

مثال على الطلب
json
curl https://api.llm-token.cn/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer sk-your-api-key" \
  -d '{
    "model": "gpt-4o-mini",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'
مثال على الاستجابة
json
{
  "id": "chatcmpl_123",
  "object": "chat.completion",
  "choices": [{
    "message": {
      "role": "assistant",
      "content": "Hello! How can I help you today?"
    }
  }]
}
عنوان Base URL الموصى به
https://api.llm-token.cn/v1استخدمه لمعظم العملاء
عنوان Base URL الاحتياطي
https://gpt-agent.ccاستخدمه فقط إذا رفض عميلك /v1 أثناء التحقق
نقطة نهاية متوافقة مع Chat Completions
/v1/chat/completionsللعملاء الذين يتوقعون Chat Completions
نقطة نهاية متوافقة مع Responses
/v1/responsesاستخدمه أولا للعملاء الذين يدعمون Responses
نقطة نهاية متوافقة مع Messages
/v1/messagesاستخدمه أولا للعملاء المتوافقين مع Messages

Chat Completions API

endpoint للـ Chat Completions متوافق مع OpenAI لمنظومات نماذج متعددة.

python
from openai import OpenAI

# Initialize the client
client = OpenAI(
    api_key="sk-your-api-key",
    base_url="https://api.llm-token.cn/v1"
)

# Send a chat request
response = client.chat.completions.create(
    model="gpt-4o-mini",
    messages=[
        {"role": "system", "content": "You are a concise assistant."},
        {"role": "user", "content": "Introduce yourself in one sentence."}
    ]
)

print(response.choices[0].message.content)

معاملات الطلب

المعاملالنوعمطلوبالوصف
modelstringنعممعرّف النموذج، مثل gpt-4o-mini
messagesarrayنعممصفوفة رسائل المحادثة
temperaturenumberلادرجة حرارة العينة من 0 إلى 2، الافتراضي 1
max_tokensintegerلاالحد الأقصى لعدد الرموز (Tokens) المُولَّدة
streambooleanلاما إذا كان سيتم تمكين إخراج البث
top_pnumberلاقيمة عينة النواة (nucleus)، الافتراضي 1

حقول الاستجابة

الحقلالنوعالوصف
idstringمعرّف فريد للاستجابة
objectstringنوع الكائن، عادة chat.completion
createdintegerالطابع الزمني للإنشاء
modelstringمعرّف النموذج المستخدم للاستجابة
choicesarrayخيارات الاستجابة المُولَّدة
usageobjectإحصاءات استخدام الرموز (Tokens)

البث

فعّل البث لاستقبال الرموز (Tokens) المُولّدة في الوقت الفعلي وتقليل زمن الاستجابة المُدرَك.

مزايا البث
  • زمن استجابة مُدرَك أقل - يرى المستخدم المخرجات فورا بدلا من انتظار الرد الكامل.
  • تجربة أفضل للنصوص الطويلة - تظهر الإجابات الطويلة تدريجيا، مثل الكتابة المباشرة.
  • التكلفة نفسها - يُسعَّر البث مثل المخرجات المتزامنة؛ يتغير أسلوب النقل فقط.
python
from openai import OpenAI

client = OpenAI(
    api_key="sk-your-api-key",
    base_url="https://api.llm-token.cn/v1"
)

# Enable streaming
stream = client.chat.completions.create(
    model="gpt-4o-mini",
    messages=[
        {"role": "system", "content": "You are a concise assistant."},
        {"role": "user", "content": "Introduce yourself in one sentence."}
    ],
    stream=True
)

# Print each streamed token as it arrives
for chunk in stream:
    if chunk.choices[0].delta.content is not None:
        print(chunk.choices[0].delta.content, end="")

print()  # New line

الأخطاء

أخطاء API الشائعة وخطوات المعالجة الموصى بها.

حالة HTTPاسم الخطأالوصفالإجراء الموصى به
400INVALID_REQUESTتنسيق الطلب خاطئ أو المعاملات غير صالحةتحقق من تنسيق نص الطلب والمعاملات
401UNAUTHORIZEDمفتاح API غير صالح أو منتهي الصلاحيةتأكد من صحة مفتاح API
429RATE_LIMITتجاوز حد معدل الطلباتأعد المحاولة باستخدام استراتيجية التراجع الأسي
500INTERNAL_ERRORخطأ داخلي في الخدمةأعد المحاولة لاحقا
503SERVICE_UNAVAILABLEالخدمة غير متاحة مؤقتاأعد المحاولة لاحقا

حدود المعدل

تخضع طلبات API لحدود معدل للحفاظ على استقرار الخدمة.

قواعد حد المعدل
  • لكل مفتاح API حدود معدل طلبات خاصة به
  • عند استلام استجابة 429 أعد المحاولة باستخدام استراتيجية التراجع الأسي
  • تتشارك الطلبات بالبث وبدون بث نفس حصة حد المعدل
  • يعتمد الحد الفعلي على الإعدادات الحالية للمفتاح

هل لديك أسئلة؟ تواصل مع الدعم أو اقرأ الأسئلة الشائعة.