السعر الرسمي
$0.15
لكل مليون رمز إدخال
احسب تكلفة GLM 5.3 Flash على هذا الأساس لا على السعر الترويجي.
المستوى الاقتصادي من Z.ai ضمن عائلة GLM 5: نموذج Mixture-of-Experts بحجم 320B ونشاط 18B، يقبل النص والصور والفيديو، بسياق مليون رمز وأوزان مفتوحة برخصة MIT.
صدر GLM 5.3 Flash في 26 أغسطس 2026، بعد ستة أيام على OpenRouter تحت اسم النموذج المتخفي Ox Alpha.
لا يعمل سوى 8 خبراء من أصل 288 لكل رمز: ذاكرة نموذج بحجم 320B وحوسبة نموذج بحجم 18B.
قدرة الرؤية جاءت من مجموعة التدريب المسبق البالغة 30T رمز، لا من مُرمِّز أُضيف لاحقًا.
تقيس Artificial Analysis 50.2 رمز إخراج في الثانية، أي أقل من وسيط الفئة البالغ 67 رمزًا/ث.
البنية والأوزان والتراخيص وفق بطاقة النموذج على Hugging Face ومستودع zai-org/GLM-5.
بطاقة النموذج
MoE بـ45 طبقة، و8 خبراء من أصل 288.
حوسبة تعادل نموذجًا كثيفًا بحجم 18B.
يحدّها Io Net عند 262,144 وCloudflare عند 1,310,720.
يذكر آخرون حتى 1,179,648.
إدخال متعدد الوسائط وإخراج نصي.
الأوزان والترخيص
استخدام تجاري وإعادة توزيع دون حد أدنى.
تتوفر نسخة -BF16 ومرآة على ModelScope.
لا مستودع مستقل، وGLM-5 تحت Apache-2.0.
مهمة متعددة العقد لا محطة عمل واحدة.
إضافة إلى TokenSpeed وKTransformers وملفات GGUF من المجتمع.
بطاقة النموذج وواجهة endpoints من OpenRouter، أغسطس 2026.
الأسعار / 04
تعلن Z.ai سعر 0.15 دولار للإدخال و0.50 دولار للإخراج لكل مليون رمز. أما 0.075 / 0.25 دولار المتداولة في كل مكان فهي خصم إطلاق مؤقت بنسبة 50%.
السعر الرسمي
$0.15
احسب تكلفة GLM 5.3 Flash على هذا الأساس لا على السعر الترويجي.
السعر الرسمي
$0.50
نسبة حادة تبلغ 1:3.3، لذا ابدأ بتقييد طول الإخراج.
السعر الرسمي
$0.03
خُمس تكلفة الإدخال الجديد، وهو ما يجعل السياق الطويل في المتناول.
قياس مستقل
$0.10
من Artificial Analysis، بمزيج 7:2:1 بين التخزين والإدخال والإخراج.
معايير الأداء / 05
تنشر Z.ai جدولها الخاص وتختار المقارنات بنفسها، لكن الفارق عن GLM 5.2 وأرقام Artificial Analysis تصمد أمام التدقيق.
بحسب Z.ai
يحقق GPT-5.6 Terra نتيجة 87.4، والفجوة تتسع في المهام الصعبة.
بحسب Z.ai
العائلة والمنهج نفسهما بعُشر السعر. وفي AutomationBench: 48.8 مقابل 26.2.
بحسب Z.ai
استدلال على المستندات والصور، ويُذكر أنه يتقدم على Opus 4.8.
Artificial Analysis
57
قياس مستقل، مقابل وسيط يقارب 27 لنماذج الأوزان المفتوحة المشابهة.
القدرات / 06
مصمم لأطر الوكلاء: تحكم في الاستدلال، واستدعاء أدوات، وإخراج منظم، وبث عبر نافذة من مليون رمز.
مفعّل افتراضيًا مع إمكانية تعديل مستوى الجهد.
يدعم الأدوات واختيارها، ويبقى التحقق من كل إجراء مسؤولية تطبيقك.
تحديد صيغة الاستجابة يعيد لك JSON جاهزًا للتحليل.
1.47 ثانية حتى أول رمز تتفوق على الوسيط، أما معدل التدفق فلا.
ألصق لقطة شاشة أو مخططًا أو تسجيلًا للشاشة مع مطالبتك.
سعر الإدخال المخزَّن البالغ 0.03 دولار يبقي الجولات اللاحقة رخيصة.
المقارنة / 07
كلاهما المستوى الاقتصادي في عائلة متقدمة تنشر أوزانها برخصة MIT، ويفترقان في الوسائط والاستدلال ومتطلبات العتاد.
Z.ai
KDA هجينة مع انتباه MLA متناثر بنمط NoPE.
متعدد الوسائط منذ التصميم.
سقف الإخراج يختلف حسب المزوّد.
قبل خصم الإطلاق.
برخصة MIT، لكنها مهمة متعددة العقد.
DeepSeek
بلا استدلال افتراضيًا.
لقطات الشاشة تحتاج إلى تفريغ نصي أولًا.
مساحة أكبر بكثير للاستجابة.
من المصدر مباشرة، وبنسبة 1:2 أكثر توازنًا.
حجم أصغر وتكلفة تشغيل أقل.
كلاهما ضمن قائمة النماذج في glm5.app، فيمكنك تمرير المطالبة نفسها عبر كل منهما.
الجدول الزمني للإصدار / 08
ستة أيام كنموذج متخفٍ مجهول، ثم إطلاق كامل بأوزان مفتوحة.
ظهر `stealth/ox-alpha` على OpenRouter دون الإفصاح عن المزوّد، ومجانًا لكل رمز.
أكبر خمسة مستهلكين كانوا أدوات برمجة وكيلة، وأتاحته OpenCode مجانًا.
أكدت Z.ai صلته بـ Ox Alpha، وصدرت بطاقة النموذج وأوزان MIT والأسعار معًا.
محرك خاص مشتق من SGLang، أُبلغ عن أداء أسرع بنحو 3 أضعاف، والمورّد غير معلن.
`zai-org/GLM-5.3-Flash` إضافة إلى نسخة BF16 ومرآة على ModelScope، دون مستودع على GitHub.
OpenRouter أسبق في الأسعار وHugging Face في التكميم. أما تجارب الاستخدام الفعلي فما زالت على Reddit باسم Ox Alpha.
لمن هذا النموذج / 09
فرق تدفع أسعار النماذج الرائدة لأعمال لم تحتج يومًا إلى ذلك العمق، مع بيان الحالات التي لا يناسبها.
استدعاء الأدوات بعُشر سعر رمز GLM 5.3 يجعل حلقات الوكلاء الطويلة في المتناول.
نافذة من مليون رمز تُبقي قاعدة الشيفرة حاضرة، فتستغني الأسئلة العابرة للملفات عن الاسترجاع.
تخطيطات مكسورة، وتسجيلات لإعادة إنتاج الخلل، ومخططات مرسومة.
قارنه بـ DeepSeek V4 Flash وQwen داخل محادثة glm5.app.
أوزان MIT ودعم vLLM حقيقيان، لكن 328 غيغابايت بصيغة FP8 تستبعد جهازًا واحدًا.
بمعدل نحو 50 رمز إخراج في الثانية، يتأخر عن معظم النماذج في الفئة السعرية نفسها.
ثلاثة مسارات: محادثة مجانية في المتصفح، أو واجهة API من glm5.app، أو تشغيل أوزان MIT على عتادك الخاص.
اختر GLM 5.3 Flash في المحادثة وأرفق لقطات الشاشة. الحسابات الجديدة تحصل على رصيد مجاني.
أرسل طلبات متوافقة مع OpenAI إلى `https://glm5.app/api/v1` باستخدام معرّف النموذج `glm-5.3-flash`.
نزّل `zai-org/GLM-5.3-Flash` وشغّله عبر SGLang أو vLLM، بحجم يقارب 328 غيغابايت بصيغة FP8.
Integration specimen
نقطة نهاية Chat Completions متوافقة مع OpenAI. استخدم معرّف النموذج `glm-5.3-flash` على `https://glm5.app/api/v1`.
افتح وثائق APIcurl https://glm5.app/api/v1/chat/completions \
-H "Authorization: Bearer $GLM5_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.3-flash",
"messages": [{
"role": "user",
"content": "Read this stack trace and name the failing call site."
}],
"stream": true
}'عن Ox Alpha والأسعار ومعايير الأداء والمعاملات وHugging Face وvLLM وDGX Spark وDeepSeek V4 Flash.
نعم — عمل باسم `stealth/ox-alpha` ستة أيام ابتداءً من 20 أغسطس 2026، وتُربط محادثات Ox Alpha المحفوظة بالنموذج الجديد تلقائيًا.
لا — مستويان مختلفان وبفارق سعري يقارب 10 أضعاف. Flash هو النموذج متعدد الوسائط 320B-A18B، أما GLM 5.3 فهو الرائد في النصوص.
تعلن Z.ai 0.15 دولار لكل مليون رمز إدخال، و0.03 دولار للمخزَّن، و0.50 دولار للإخراج. أما 0.075 / 0.25 دولار المتداولة فهي خصم إطلاق مؤقت 50%.
كانت نسخة Ox Alpha التجريبية مجانية، أما الآن فيُحتسب حسب الاستخدام. ومع ذلك يمكنك تجربته مجانًا في محادثة glm5.app.
320B إجمالًا، و18B نشطة لكل رمز، و45 طبقة توجّه 8 خبراء من أصل 288. وتبلغ نقطة التحقق بصيغة FP8 نحو 328 غيغابايت.
الأوزان على Hugging Face ضمن `zai-org/GLM-5.3-Flash` برخصة MIT. ولا يوجد مستودع مخصص على GitHub، فالوصفات موجودة في `zai-org/GLM-5`.
vLLM وSGLang وTokenSpeed وKTransformers مدعومة. لكن 328 غيغابايت لا تتسع في جهاز DGX Spark واحد، ويذكر المجتمع ربط جهازين بدقة 4 بت.
اختر Flash للإدخال البصري أو الاستدلال، وDeepSeek V4 Flash إذا أردت نسبة 1:2 أكثر توازنًا أو إخراجًا بحجم 384K.
معظم التجارب العملية مكتوبة باسم النسخة التجريبية، لذا ابحث في Reddit عن Ox Alpha بدلًا من ذلك.
Start here
مرّر أصعب مهامك عبر GLM 5.3 Flash مجانًا في المتصفح، ثم اربط معرّف النموذج بخط الإنتاج لديك.