GLM 5.3 Flash

المستوى الاقتصادي من Z.ai ضمن عائلة GLM 5: نموذج Mixture-of-Experts بحجم 320B ونشاط 18B، يقبل النص والصور والفيديو، بسياق مليون رمز وأوزان مفتوحة برخصة MIT.

أنشئ باستخدام GLM 5

ما هو GLM 5.3 Flash؟

صدر GLM 5.3 Flash في 26 أغسطس 2026، بعد ستة أيام على OpenRouter تحت اسم النموذج المتخفي Ox Alpha.

01

320B إجمالًا و18B نشطة

لا يعمل سوى 8 خبراء من أصل 288 لكل رمز: ذاكرة نموذج بحجم 320B وحوسبة نموذج بحجم 18B.

02

متعدد الوسائط منذ التصميم

قدرة الرؤية جاءت من مجموعة التدريب المسبق البالغة 30T رمز، لا من مُرمِّز أُضيف لاحقًا.

03

Flash تعني رخيصًا لا سريعًا

تقيس Artificial Analysis 50.2 رمز إخراج في الثانية، أي أقل من وسيط الفئة البالغ 67 رمزًا/ث.

مواصفات GLM 5.3 Flash وحجمه وحالة مصدره المفتوح

البنية والأوزان والتراخيص وفق بطاقة النموذج على Hugging Face ومستودع zai-org/GLM-5.

بطاقة النموذج

البنية

إجمالي المعاملات
320B

MoE بـ45 طبقة، و8 خبراء من أصل 288.

المعاملات النشطة
18B

حوسبة تعادل نموذجًا كثيفًا بحجم 18B.

نافذة السياق
1,048,576 رمزًا

يحدّها Io Net عند 262,144 وCloudflare عند 1,310,720.

أقصى إخراج
131,072 رمزًا

يذكر آخرون حتى 1,179,648.

الوسائط
نص وصورة وفيديو

إدخال متعدد الوسائط وإخراج نصي.

الأوزان والترخيص

الحجم والترخيص

ترخيص الأوزان
MIT

استخدام تجاري وإعادة توزيع دون حد أدنى.

Hugging Face
zai-org/GLM-5.3-Flash

تتوفر نسخة -BF16 ومرآة على ModelScope.

GitHub
zai-org/GLM-5

لا مستودع مستقل، وGLM-5 تحت Apache-2.0.

حجم نقطة التحقق
نحو 328 غيغابايت (FP8)

مهمة متعددة العقد لا محطة عمل واحدة.

أطر التشغيل
SGLang وvLLM

إضافة إلى TokenSpeed وKTransformers وملفات GGUF من المجتمع.

بطاقة النموذج وواجهة endpoints من OpenRouter، أغسطس 2026.

الأسعار / 04

أسعار GLM 5.3 Flash: السعر الرسمي مقابل خصم الإطلاق

تعلن Z.ai سعر 0.15 دولار للإدخال و0.50 دولار للإخراج لكل مليون رمز. أما 0.075 / 0.25 دولار المتداولة في كل مكان فهي خصم إطلاق مؤقت بنسبة 50%.

01

السعر الرسمي

$0.15

لكل مليون رمز إدخال

احسب تكلفة GLM 5.3 Flash على هذا الأساس لا على السعر الترويجي.

02

السعر الرسمي

$0.50

لكل مليون رمز إخراج

نسبة حادة تبلغ 1:3.3، لذا ابدأ بتقييد طول الإخراج.

03

السعر الرسمي

$0.03

لكل مليون رمز إدخال مُخزَّن

خُمس تكلفة الإدخال الجديد، وهو ما يجعل السياق الطويل في المتناول.

04

قياس مستقل

$0.10

السعر المدمج

من Artificial Analysis، بمزيج 7:2:1 بين التخزين والإدخال والإخراج.

فارق يصل إلى الضعف رغم تطابق الأوزان: Z.AI وNovita وGMICloud تمنح خصمًا، وغيرها يتقاضى السعر الرسمي.

معايير الأداء / 05

معايير أداء GLM 5.3 Flash: أرقام الشركة وقياسات مستقلة

تنشر Z.ai جدولها الخاص وتختار المقارنات بنفسها، لكن الفارق عن GLM 5.2 وأرقام Artificial Analysis تصمد أمام التدقيق.

01

بحسب Z.ai

Terminal-Bench 2.1

5.3 Flash84.3
Opus 4.885.0

يحقق GPT-5.6 Terra نتيجة 87.4، والفجوة تتسع في المهام الصعبة.

02

بحسب Z.ai

DeepSWE v1.1

5.3 Flash63.4
GLM 5.246.2

العائلة والمنهج نفسهما بعُشر السعر. وفي AutomationBench: 48.8 مقابل 26.2.

03

بحسب Z.ai

OfficeQA Pro

5.3 Flash62.4

استدلال على المستندات والصور، ويُذكر أنه يتقدم على Opus 4.8.

04

Artificial Analysis

57

Intelligence Index

قياس مستقل، مقابل وسيط يقارب 27 لنماذج الأوزان المفتوحة المشابهة.

أوثق معيار لـ GLM 5.3 Flash هو قائمة مهامك أنت.

القدرات / 06

ما الذي يستطيع GLM 5.3 Flash فعله

مصمم لأطر الوكلاء: تحكم في الاستدلال، واستدعاء أدوات، وإخراج منظم، وبث عبر نافذة من مليون رمز.

01

استدلال بمستوى جهد قابل للضبط

مفعّل افتراضيًا مع إمكانية تعديل مستوى الجهد.

02

استدعاء الدوال

يدعم الأدوات واختيارها، ويبقى التحقق من كل إجراء مسؤولية تطبيقك.

03

إخراج منظم

تحديد صيغة الاستجابة يعيد لك JSON جاهزًا للتحليل.

04

استجابات متدفقة

1.47 ثانية حتى أول رمز تتفوق على الوسيط، أما معدل التدفق فلا.

05

إدخال الصور والفيديو

ألصق لقطة شاشة أو مخططًا أو تسجيلًا للشاشة مع مطالبتك.

06

سياق من مليون رمز

سعر الإدخال المخزَّن البالغ 0.03 دولار يبقي الجولات اللاحقة رخيصة.

المقارنة / 07

GLM 5.3 Flash مقابل DeepSeek V4 Flash

كلاهما المستوى الاقتصادي في عائلة متقدمة تنشر أوزانها برخصة MIT، ويفترقان في الوسائط والاستدلال ومتطلبات العتاد.

Z.ai

GLM 5.3 Flash

البنية
320B / 18B نشطة

KDA هجينة مع انتباه MLA متناثر بنمط NoPE.

الإدخال
نص وصورة وفيديو

متعدد الوسائط منذ التصميم.

السياق / الإخراج
1M / 131K

سقف الإخراج يختلف حسب المزوّد.

السعر الرسمي
$0.15 / $0.50

قبل خصم الإطلاق.

الاستضافة الذاتية
نحو 328 غيغابايت FP8

برخصة MIT، لكنها مهمة متعددة العقد.

DeepSeek

DeepSeek V4 Flash

البنية
284B / نحو 13B نشطة

بلا استدلال افتراضيًا.

الإدخال
نص فقط

لقطات الشاشة تحتاج إلى تفريغ نصي أولًا.

السياق / الإخراج
1M / 384K

مساحة أكبر بكثير للاستجابة.

السعر الرسمي
$0.14 / $0.28

من المصدر مباشرة، وبنسبة 1:2 أكثر توازنًا.

الاستضافة الذاتية
أوزان MIT

حجم أصغر وتكلفة تشغيل أقل.

كلاهما ضمن قائمة النماذج في glm5.app، فيمكنك تمرير المطالبة نفسها عبر كل منهما.

الجدول الزمني للإصدار / 08

الجدول الزمني لـ GLM 5.3 Flash، من Ox Alpha إلى الأوزان المفتوحة

ستة أيام كنموذج متخفٍ مجهول، ثم إطلاق كامل بأوزان مفتوحة.

01

20 أغسطس — ظهور Ox Alpha

ظهر `stealth/ox-alpha` على OpenRouter دون الإفصاح عن المزوّد، ومجانًا لكل رمز.

02

20-26 أغسطس — تدفق أدوات الوكلاء

أكبر خمسة مستهلكين كانوا أدوات برمجة وكيلة، وأتاحته OpenCode مجانًا.

03

26 أغسطس — إطلاق GLM 5.3 Flash

أكدت Z.ai صلته بـ Ox Alpha، وصدرت بطاقة النموذج وأوزان MIT والأسعار معًا.

04

النسخة التجريبية عملت على شرائح صينية

محرك خاص مشتق من SGLang، أُبلغ عن أداء أسرع بنحو 3 أضعاف، والمورّد غير معلن.

05

نُشرت الأوزان على Hugging Face

`zai-org/GLM-5.3-Flash` إضافة إلى نسخة BF16 ومرآة على ModelScope، دون مستودع على GitHub.

06

أين تظهر الأخبار أولًا

OpenRouter أسبق في الأسعار وHugging Face في التكميم. أما تجارب الاستخدام الفعلي فما زالت على Reddit باسم Ox Alpha.

لمن هذا النموذج / 09

من يستخدم GLM 5.3 Flash؟

فرق تدفع أسعار النماذج الرائدة لأعمال لم تحتج يومًا إلى ذلك العمق، مع بيان الحالات التي لا يناسبها.

01

برمجة وكيلة بكميات كبيرة

استدعاء الأدوات بعُشر سعر رمز GLM 5.3 يجعل حلقات الوكلاء الطويلة في المتناول.

02

العمل على حجم المستودع كاملًا

نافذة من مليون رمز تُبقي قاعدة الشيفرة حاضرة، فتستغني الأسئلة العابرة للملفات عن الاسترجاع.

03

تصحيح الأخطاء بصريًا

تخطيطات مكسورة، وتسجيلات لإعادة إنتاج الخلل، ومخططات مرسومة.

04

فرق تقارن Z.ai بمنافسيها

قارنه بـ DeepSeek V4 Flash وQwen داخل محادثة glm5.app.

05

من يستضيفون ذاتيًا ولديهم عنقود خوادم

أوزان MIT ودعم vLLM حقيقيان، لكن 328 غيغابايت بصيغة FP8 تستبعد جهازًا واحدًا.

06

غير مناسب للواجهات الحساسة للتأخير

بمعدل نحو 50 رمز إخراج في الثانية، يتأخر عن معظم النماذج في الفئة السعرية نفسها.

كيفية استخدام GLM 5.3 Flash / 10

كيفية استخدام GLM 5.3 Flash

ثلاثة مسارات: محادثة مجانية في المتصفح، أو واجهة API من glm5.app، أو تشغيل أوزان MIT على عتادك الخاص.

01
01

تحدث مع GLM 5.3 Flash مجانًا

اختر GLM 5.3 Flash في المحادثة وأرفق لقطات الشاشة. الحسابات الجديدة تحصل على رصيد مجاني.

02
02

استدعِ واجهة API في glm5.app

أرسل طلبات متوافقة مع OpenAI إلى `https://glm5.app/api/v1` باستخدام معرّف النموذج `glm-5.3-flash`.

03
03

أو استضف الأوزان بنفسك

نزّل `zai-org/GLM-5.3-Flash` وشغّله عبر SGLang أو vLLM، بحجم يقارب 328 غيغابايت بصيغة FP8.

Integration specimen

ابدأ مع واجهة API الخاصة بـ GLM 5.3 Flash

نقطة نهاية Chat Completions متوافقة مع OpenAI. استخدم معرّف النموذج `glm-5.3-flash` على `https://glm5.app/api/v1`.

افتح وثائق API
Request previewcurl
curl https://glm5.app/api/v1/chat/completions \
  -H "Authorization: Bearer $GLM5_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5.3-flash",
    "messages": [{
      "role": "user",
      "content": "Read this stack trace and name the failing call site."
    }],
    "stream": true
  }'

الأسئلة الشائعة حول GLM 5.3 Flash

عن Ox Alpha والأسعار ومعايير الأداء والمعاملات وHugging Face وvLLM وDGX Spark وDeepSeek V4 Flash.

هل GLM 5.3 Flash هو نفسه نموذج Ox Alpha؟

نعم — عمل باسم `stealth/ox-alpha` ستة أيام ابتداءً من 20 أغسطس 2026، وتُربط محادثات Ox Alpha المحفوظة بالنموذج الجديد تلقائيًا.


هل GLM 5.3 Flash هو نفسه GLM 5.3؟

لا — مستويان مختلفان وبفارق سعري يقارب 10 أضعاف. Flash هو النموذج متعدد الوسائط 320B-A18B، أما GLM 5.3 فهو الرائد في النصوص.


كم يبلغ سعر GLM 5.3 Flash؟

تعلن Z.ai 0.15 دولار لكل مليون رمز إدخال، و0.03 دولار للمخزَّن، و0.50 دولار للإخراج. أما 0.075 / 0.25 دولار المتداولة فهي خصم إطلاق مؤقت 50%.


هل GLM 5.3 Flash مجاني؟

كانت نسخة Ox Alpha التجريبية مجانية، أما الآن فيُحتسب حسب الاستخدام. ومع ذلك يمكنك تجربته مجانًا في محادثة glm5.app.


كم عدد معاملات GLM 5.3 Flash وما حجمه؟

320B إجمالًا، و18B نشطة لكل رمز، و45 طبقة توجّه 8 خبراء من أصل 288. وتبلغ نقطة التحقق بصيغة FP8 نحو 328 غيغابايت.


هل GLM 5.3 Flash متاح على Hugging Face وGitHub؟

الأوزان على Hugging Face ضمن `zai-org/GLM-5.3-Flash` برخصة MIT. ولا يوجد مستودع مخصص على GitHub، فالوصفات موجودة في `zai-org/GLM-5`.


هل يمكنني تشغيل GLM 5.3 Flash على vLLM أو DGX Spark؟

vLLM وSGLang وTokenSpeed وKTransformers مدعومة. لكن 328 غيغابايت لا تتسع في جهاز DGX Spark واحد، ويذكر المجتمع ربط جهازين بدقة 4 بت.


GLM 5.3 Flash أم DeepSeek V4 Flash — أيهما أختار؟

اختر Flash للإدخال البصري أو الاستدلال، وDeepSeek V4 Flash إذا أردت نسبة 1:2 أكثر توازنًا أو إخراجًا بحجم 384K.


ماذا يقول Reddit عن GLM 5.3 Flash؟

معظم التجارب العملية مكتوبة باسم النسخة التجريبية، لذا ابحث في Reddit عن Ox Alpha بدلًا من ذلك.


Start here

ابدأ مع GLM 5.3 Flash اليوم

مرّر أصعب مهامك عبر GLM 5.3 Flash مجانًا في المتصفح، ثم اربط معرّف النموذج بخط الإنتاج لديك.