دليل Tencent Hy4 preview API لعام 2026: بنية MoE بحجم 770B وسياق 1M ووكلاء البرمجة

في 29 أغسطس 2026، راجعنا Hy4 preview الذي أطلقته Tencent في اليوم السابق. ولا يكمن التغيير المهم في الانتقال من Hy3 إلى Hy4 فحسب؛ فقد وسّعت Tencent العمود الفقري إلى 770B من المعلمات، ورفعت السياق إلى 1M، وواصلت تقييم النموذج داخل CodeBuddy وWorkBuddy وفي مسارات العمل الهندسية الفعلية.
باختصار في جملة واحدة: Hy4 preview هو نموذج MoE رائد جديد مفتوح المصدر من Tencent Hunyuan للبرمجة والوكلاء وتحليل الأعمال المكتبية وتطوير الألعاب والبحث العلمي؛ واسم النموذج الرسمي المقدَّم محليًا هو hy4-preview، لكن معرّفات النماذج والأسعار والتوفر تختلف باختلاف المنصة.
يعتمد هذا الدليل على إصدار Tencent، ومستودعها الرسمي، وصفحات Tencent Cloud TokenHub، والأوراق البحثية الأولية التي يستشهد بها المستودع. اختبارات المورّد ليست اختبارات مستقلة أجراها هذا الموقع. وعند التحقق، لم يكن كتالوج هذا الموقع المباشر يعرض hy4-preview، لذلك لا يزعم هذا المقال أن مسار البوابة مفتوح بالفعل.
الحقائق الأساسية عن Hy4 preview
| العنصر | المعلومات الرسمية المتحقق منها |
|---|---|
| تاريخ الإصدار | 28 أغسطس 2026 |
| الاسم الرسمي | Tencent Hy4 preview |
| البنية | Mixture-of-Experts (MoE) |
| معلمات العمود الفقري | 770B إجمالًا، و49B نشطة |
| طبقة MTP الأصلية | 10B إجمالًا، و0.7B نشطة |
| عمق العمود الفقري | 78 طبقة |
| توزيع الخبراء | 256 خبيرًا موجّهًا + خبير مشترك واحد؛ تفعيل أعلى 8 خبراء موجّهين لكل رمز |
| الانتباه / المسار المتبقي | Gated DSA + IndexCache؛ أربعة مسارات متبقية من iHC |
| السياق | يذكر المستودع 1M؛ وتذكر Tencent Cloud حدًا أقصى للإدخال قدره 960K وحدًا أقصى للإخراج قدره 64K |
| النموذج الرسمي المقدَّم محليًا | hy4-preview |
| الأوزان المفتوحة | tencent/Hy4-preview، tencent/Hy4-preview-FP8 |
| الترخيص | Apache 2.0 |
| السعر المعلن في Guangzhou على Tencent Cloud | CNY 6 للإدخال، وCNY 18 للإخراج، وCNY 0.3 لقراءة ذاكرة التخزين المؤقت لكل 1M رمز |
آخر تحقق كان في 29 أغسطس 2026. أعد التحقق من وحدة تحكم TokenHub، والمنطقة المستهدفة، والسعر الحالي، وحقول الاستخدام في الاستجابة قبل اعتماد النموذج في الإنتاج.
ما هو Hy4 preview؟ وهل هو إصدار Hy4 النهائي؟
Hy4 preview هو تكرار مبكر من Hy4، وليس إصدارًا نهائيًا مستقبليًا من دون اللاحقة preview. وتوثّق Tencent صراحةً مشكلات معروفة، منها أن النموذج قد يستغرق وقتًا أطول من اللازم في الاستدلال في المهام المعقدة وأنه قد يتحقق من عمله بشكل مفرط.
هذا الحد مهم. فعبارة «نموذج رائد preview» تعني أن النموذج يملك أوزانًا مفتوحة ووصفات للاستدلال وخط أنابيب للضبط الدقيق وواجهات API متاحة. ولا تعني أن سلوكه أو سعره أو مستويات خدمته ثابتة إلى الأبد.
كما تتيح Tencent نموذج Hy4 preview في WorkBuddy وCodeBuddy وYuanbao وima، وتوفر الوصول إلى API عبر Tencent Cloud TokenHub وOpenRouter. وهذا يكفي لإدخاله في تقييم مضبوط، لكن يجب في مسارات العمل الإنتاجية الحساسة تثبيت الإصدارات والحفاظ على مجموعة اختبارات انحدار والإبقاء على نموذج احتياطي.
ما الذي تغيّر في بنية MoE ذات 770B؟
يتكوّن العمود الفقري لـ Hy4 preview من 78 طبقة. تستخدم الطبقة الأولى Dense FFN، بينما تستخدم الطبقات الـ77 الباقية بنية MoE تضم 256 خبيرًا موجّهًا وخبيرًا مشتركًا واحدًا. ويُفعَّل لكل رمز أعلى 8 خبراء موجّهين إضافةً إلى الخبير المشترك.
وتدعم طبقة MTP أصلية فك الترميز التخميني. وتعرض Tencent العمود الفقري على أنه 770B إجمالًا و49B نشطة؛ وإذا أُضيفت طبقة MTP، فستُضاف 10B إجمالًا و0.7B نشطة. عندما تعرض صفحة ما الرقم 770B وتعرض صفحة أخرى رقمًا يقترب من 780B، تحقّق مما إذا كانت طبقة MTP محسوبة ضمن الإجمالي.
يستخدم الانتباه Gated DeepSeek Sparse Attention (Gated DSA)، مع IndexCache لإعادة استخدام الفهارس المتناثرة عبر الطبقات. ويستخدم مسار البقايا أربعة مسارات identity Hyper-Connection (iHC). وتهدف هذه التصاميم مجتمعةً إلى إبقاء الحساب وتدفق المعلومات قابلين للإدارة عند سياق 1M وعلى مقياس MoE كبير.
ويحدد المستودع أيضًا 64 رأس انتباه، وبُعد ضغط للاستعلام قدره 2,048، وبُعد ضغط للمفتاح والقيمة قدره 512، وقيمة Indexer top-k قدرها 2,048. وتفيد هذه القيم في توافق أطر الاستدلال وتخطيط السعة؛ لكنها لا تثبت وحدها نتيجة أي مهمة.
كيف ينبغي فهم نافذة السياق 1M؟
يذكر مستودع Tencent طول سياق قدره 1M. أما صفحة منتج Tencent Cloud فتصف حدود الخدمة المستضافة بأنها 960K كحد أقصى للإدخال و64K كحد أقصى للإخراج. ويمكن أن يتعايش الرقمان لأن نافذة النموذج، والإخراج المحجوز، وموجّه النظام، وهامش الأمان في الخدمة تستخدم حدودًا مختلفة للحساب.
لا تبدأ اختبارات الإنتاج بطلب يقترب من مليون رمز. استخدم مستويات مثل 32K و128K و256K و512K والسياق فائق الطول، وسجّل:
- الزمن حتى الرمز الأول والكمون من البداية إلى النهاية
- رموز الإدخال والإخراج وقراءة ذاكرة التخزين المؤقت
- دقة الاسترجاع بين الملفات
- نجاح استدعاء الأدوات وعدد مرات إعادة المحاولة
- معدل اجتياز المهمة ووقت إعادة العمل البشري
سعة السياق لا تعني الصحة تلقائيًا. فما زالت المستودعات الكبيرة ودفاتر العمل المالية ومجموعات البيانات البحثية تحتاج إلى الاسترجاع وعزل الصلاحيات وروابط الأدلة.
كيف يُفهم أداء Hy4 preview في البرمجة والوكلاء؟
يذكر ملحق benchmark الرسمي من Tencent مكاسب واسعة على Hy3 في هندسة البرمجيات واستخدام الأدوات والمهام ذات السياق الطويل. وفيما يلي قيم مختارة من الجدول الرسمي نفسه:
| التقييم المنشور من Tencent | Hy3 | Hy4 preview |
|---|---|---|
| SWE-bench Multilingual | 75.8 | 82.9 |
| DeepSWE | 28.0 | 64.3 |
| SWE Atlas - Refactoring | 32.9 | 53.3 |
| Terminal-Bench 2.1 | 70.8 | 85.4 |
| Toolathlon-Verified | 56.2 | 74.1 |
| OneMillionBench (with tools) | 51.5 | 65.4 |
هذه نتائج نشرتها Tencent وليست اختبارات مستقلة أجراها هذا الموقع. وتوضح Tencent أن النماذج قُيِّمت عند أعلى إعداد استدلال متاح لها، وأن بعض النتائج المعلَّمة بنجمة شغّلتها Tencent، وأن أدوات الاختبار وميزانيات الرموز وموارد البيئة المعزولة وأخذ العينات المتكرر تؤثر في الدرجات.
ويمنع الجدول نفسه الانتقاء: حصل Hy4 preview على 17.5 في ProgramBench، وهي نتيجة أدنى من Kimi K3 وGPT 5.6 Sol وClaude Opus 5 في مقارنة Tencent. مكسب الجيل الجديد حقيقي، لكن Hy4 لا يتصدر كل اختبار من اختبارات البرمجة.
ماذا يبيّن التقييم الخبير لـ203 مهام؟
أجرت Tencent تقييمًا أعمى شارك فيه 163 خبيرًا داخليًا عبر 203 مهام هندسية فعلية. وكانت النتيجة المنشورة:
- Hy4 preview: متوسط 2.99 من 4
- GLM 5.3: متوسط 2.92 من 4؛ فاز Hy4 في 46.8%، وتعادل في 12.8%، وخسر في 40.4%
- Kimi K3: متوسط 2.94 من 4؛ فاز Hy4 في 51.2%، وتعادل في 7.9%، وخسر في 40.9%
وتهم هذه النتيجة لأن المهام جاءت من أعمال Tencent في هندسة البرمجيات والألعاب والتمويل والأمن، لا من لوحات المتصدرين العامة فقط. لكنها تظل تقييمًا داخليًا من المورّد، وليست benchmark من طرف ثالث يمكن إعادة إنتاجه بالكامل مع مجموعة مهام ومعيار تقييم منشورين.
والطريقة الموثوقة للاعتماد هي بناء مجموعة انحدار من مستودعاتك ووثائقك وأوامر القبول، ثم مقارنة معدل الاجتياز والكمون والتكلفة الإجمالية مع النماذج التي تشغّلها حاليًا.
ما أعباء العمل المناسبة لـ Hy4 preview؟
- وكلاء برمجة طويلو الأمد يخططون ويعدّلون ويصححون الأخطاء ويتحققون من العمل
- أعمال الواجهة الأمامية التي تتطلب جودة الكود والهرمية البصرية والتفاعل معًا
- مسارات عمل مكتبية عابرة للملفات تنتج المستندات وجداول البيانات والعروض التقديمية
- نماذج أولية لألعاب قابلة للعب يتبعها عمل متعدد الأدوار داخل محرك اللعبة
- النمذجة المالية وتحليل البيانات عبر ملفات متعددة
- البحث في الذكاء الاصطناعي والديناميكا الجزيئية وفيزياء المادة المكثفة والرياضيات
- البحث المعتمد على الأدوات ومسارات المعرفة ضمن سياق 1M
وتحتاج عمليات الكتابة في الإنتاج إلى بوابات سياسة أو موافقة بشرية عند التعامل مع Shell وقواعد البيانات والمدفوعات والصلاحيات والرسائل الخارجية. فالنموذج الأقوى لا يلغي مخاطر تفويض الوكيل.
ما السعر الرسمي لـ Hy4 preview؟
تعرض Tencent Cloud TokenHub حاليًا الأسعار المرجعية التالية لمنطقة Guangzhou:
| بند الفوترة | السعر العام |
|---|---|
| الإدخال | CNY 6 / كل 1M رمز |
| الإخراج | CNY 18 / كل 1M رمز |
| قراءة ذاكرة التخزين المؤقت | CNY 0.3 / كل 1M رمز |
هذا سعر اتصال مباشر رسمي خاص بمنطقة وزمن محددين في Tencent Cloud، وليس سعرًا موحدًا للمنصات الخارجية. تستخدم OpenRouter ومزوّدو الاستدلال الآخرون والاستضافة الذاتية اقتصاديات منفصلة؛ ولا يمكن استنتاج مضاعف البوابة من السعر المباشر لـ TokenHub.
عند التحقق في 29 أغسطس 2026، لم تعرض صفحة الأسعار المباشرة لهذا الموقع hy4-preview. وإذا أُضيف لاحقًا، فاستخدم الكتالوج المباشر وسجل الطلبات، لا السعر المباشر لـ Tencent Cloud الوارد في هذا المقال.
لا تخلط بين معرّفات نماذج Hy4 هذه
| مسار الوصول | الاسم / المعرّف الذي يجب استخدامه |
|---|---|
| النموذج المحلي المقدَّم في المستودع الرسمي | hy4-preview |
| OpenRouter | tencent/hy4-preview |
| أوزان BF16 على Hugging Face | tencent/Hy4-preview |
| أوزان FP8 على Hugging Face | tencent/Hy4-preview-FP8 |
لا تترجم بوابة API عادةً اسم مستودع Hugging Face إلى معرّف نموذج مستضاف. انسخ المعرّف الدقيق من المنصة المستهدفة، وتحقق منه باستدعاء قائمة النماذج أو بطلب صغير.
كيف تستضيف Hy4 preview بنفسك وتستدعيه؟
توصي Tencent باستخدام vLLM أو SGLang. وبعد التشغيل، استدعِ النموذج المحلي المقدَّم عبر واجهة OpenAI-compatible Chat Completions:
from openai import OpenAI
client = OpenAI(
base_url="http://127.0.0.1:8000/v1",
api_key="EMPTY",
)
response = client.chat.completions.create(
model="hy4-preview",
messages=[
{"role": "user", "content": "Review this patch and list the highest-risk regressions."}
],
temperature=0.9,
top_p=1.0,
)
print(response.choices[0].message.content)
توصي Tencent بـ temperature=0.9 وtop_p=1.0. ويستخدم النموذج افتراضيًا high reasoning. وعند الحاجة إلى إجابات مباشرة، يستخدم القالب المحلي chat_template_kwargs.reasoning_effort = "no_think" لتعطيل التفكير؛ وقد تعرض المزوّدات المستضافة حقولًا إضافية مختلفة.
تستخدم وصفة vLLM الرسمية التوازي الموزع على ثماني وحدات، وفك الترميز التخميني عبر MTP، وخلفية الانتباه FLASHMLA_SPARSE، ومحلّلي الأدوات والاستدلال hy_v4. لا تلصق الوصفة على أجهزة تختلف في GPU أو برامج التشغيل أو الصورة أو دعم الإطار من دون فحص السعة.
Hy4 preview أم Hy3؟
| البُعد | Hy3 | Hy4 preview |
|---|---|---|
| المقياس الرسمي | 295B إجمالًا / 21B نشطة | 770B إجمالًا / 49B نشطة |
| السياق | 256K | 1M |
| التموضع | وكلاء وإنتاجية بتكلفة فعالة | نموذج رائد جديد للبرمجة والوكلاء والإنتاجية المعقدة |
| النضج | انتقل من preview إلى إصدار رسمي | Hy4 preview مبكر |
| تكلفة الاستضافة الذاتية | أقل | أعلى بكثير |
يبقى Hy3 عمليًا عندما تكون التكلفة وحجم النشر والنضج هي الأولوية. أضف Hy4 preview إلى تقييم مضبوط عندما تحتاج إلى سياق أطول وهندسة طويلة الأمد أو تنفيذ أدوات أقوى، لكن لا تستبدل نموذجًا إنتاجيًا اعتمادًا على عدد المعلمات الإجمالي وحده.
قائمة تحقق لتقييم الإنتاج
- انسخ معرّف النموذج الدقيق من المنصة المستهدفة؛ لا تخمّن حالة الأحرف أو مساحة الاسم.
- ثبّت إصدار النموذج وPrompt والأدوات وجهد الاستدلال والمهلة والحد الأقصى للإخراج.
- ابدأ بمهام للقراءة فقط قبل منح صلاحيات الملفات أو Shell أو قواعد البيانات أو الآثار الخارجية.
- قِس معدل الاجتياز على مستودعات فعلية مع أوامر القبول، لا على الانطباعات الحوارية.
- اختبر مستويات السياق من 32K إلى السياق فائق الطول، وسجّل الكمون واستخدام الذاكرة المؤقتة وإجمالي الفوترة.
- ضع حدًا أقصى للأدوار وميزانيات للرموز وبوابات موافقة للمهام المعقدة.
- تحقّق من استدعاءات الأدوات والمخرجات المهيكلة وربط حقول reasoning على البوابة المستهدفة.
- احتفظ بمجموعة انحدار ومسار احتياطي وإمكانية تراجع سريعة لإصدار preview.
الخلاصات الأساسية
- أُطلق Hy4 preview وأصبح مفتوح المصدر في 28 أغسطس 2026 بوصفه نموذج MoE الرائد الجديد من Tencent Hunyuan.
- يضم العمود الفقري 770B من المعلمات إجمالًا و49B نشطة، إضافةً إلى طبقة MTP أصلية بحجم 10B/0.7B.
- يذكر المستودع سياقًا قدره 1M؛ وتذكر Tencent Cloud حدًا أقصى للإدخال قدره 960K وحدًا أقصى للإخراج قدره 64K.
- تسجل Tencent مكاسب كبيرة على Hy3 في البرمجة واستخدام الأدوات والسياق الطويل، لكن النموذج لا يتصدر كل benchmark.
- إن
hy4-previewوtencent/hy4-previewوtencent/Hy4-preview-FP8معرّفات خاصة بمنصات مختلفة. - لم تكن البوابة مفتوحة في هذا الموقع وقت النشر؛ ويتطلب التوفر والفوترة التحقق من الكتالوج المباشر.
الأسئلة الشائعة
هل أُطلق Hy4 preview رسميًا؟
نعم. أطلقت Tencent Hy4 preview وأتاحته كمصدر مفتوح في 28 أغسطس 2026، مع إمكان الوصول إليه عبر WorkBuddy وCodeBuddy وYuanbao وima وTokenHub وOpenRouter. لكنه ما يزال إصدار preview، وليس الإصدار النهائي من Hy4.
هل Hy4 preview متعدد الوسائط؟
يقدمه مستودع الإطلاق الرسمي من Tencent بوصفه نموذجًا لغويًا للبرمجة والوكلاء والإنتاجية، وتركز مواصفاته العامة على النص والأدوات والسياق الطويل. لا تستنتج دعم إدخال الصور أو الفيديو لمجرد أن عائلة Hunyuan الأوسع تضم نماذج بصرية؛ تحقق من جدول قدرات المزوّد المستهدف.
ما طول سياق Hy4 preview؟
يحدد المستودع سياقًا قدره 1M. وتعرض Tencent Cloud بصورة منفصلة 960K كحد أقصى للإدخال و64K كحد أقصى للإخراج في الخدمة المستضافة.
ما معرّف API الرسمي لـ Hy4 preview؟
اسم النموذج المقدَّم في المستودع الرسمي هو hy4-preview؛ ويستخدم OpenRouter tencent/hy4-preview؛ أما الأوزان المستضافة ذاتيًا فتستخدم tencent/Hy4-preview أو إصدار FP8. وتكون قيمة المعرّف في وحدة تحكم المنصة المستهدفة هي المرجع الأول.
هل يدعم Hy4 preview استدعاء الأدوات؟
تمكّن وصفة vLLM من Tencent محلّل الأدوات hy_v4 والاختيار التلقائي للأدوات، كما تتضمن مجموعة benchmark الرسمية Toolathlon وMCP-Atlas. تحقق من المعلمات المستضافة الدقيقة لدى المزوّد.
كم تبلغ تكلفة Hy4 preview؟
تعرض Tencent Cloud TokenHub حاليًا في Guangzhou سعر CNY 6 للإدخال وCNY 18 للإخراج وCNY 0.3 لقراءة ذاكرة التخزين المؤقت لكل مليون رمز. وقد تتغير الأسعار حسب المنطقة والمنصة والعروض.
هل يمكنني استدعاء Hy4 preview عبر هذه البوابة الآن؟
عند التحقق في 29 أغسطس 2026، لم يعرض الكتالوج المباشر أو مزوّدو الخدمة المفعّلون في هذا الموقع hy4-preview. تحقق من صفحة الأسعار المباشرة لمعرفة أي توفر لاحق.
هل يعمل Hy4 preview مع Claude Code أو وكيل برمجة آخر؟
يستهدف النموذج البرمجة والوكلاء، ويوفر مسار خدمة محليًا متوافقًا مع OpenAI. لكن توافق العميل يعتمد على البروتوكول وشكل استدعاء الأدوات ومخرجات reasoning وطبقة التوافق لدى المزوّد؛ لذلك اختبر طلبًا صغيرًا وانحدارًا للأدوات أولًا.
المصادر الأساسية
- إصدار Tencent الرسمي: Tencent Releases and Open-Sources Tencent Hy4 preview
- GitHub الرسمي لـ Tencent Hunyuan: Hy4-preview
- صفحة منتج وأسعار Tencent Cloud TokenHub
- صفحة منتج Tencent Cloud Hunyuan: حدود Hy4 preview
- ورقة Gated DeepSeek Sparse Attention
- ورقة IndexCache
- أسعار النماذج المباشرة في هذا الموقع: للتحقق من فتح المسار لاحقًا، وليست السعر الرسمي لـ Tencent Cloud