Kimi
Kimi

Kimi

Moonshot AI

نماذج اللغة الكبيرة

نماذج اللغة الكبيرة

Kimi

Kimi

Kimi K3 هو إطلاق النموذج النادر الذي غيّر كلاً من المعايير والأسواق. إن نتائجها الفعالة قوية حقًا، لكن نظام 2.8T-parameter ليس بعد نشرًا مؤسسيًا سهلاً أو مثبتًا بشكل كامل.

CURRENT MODEL SNAPSHOT

مزود: Moonshot AI
المرساة الحالية: Kimi K3
دورة الحياة: حاضِر
الأوزان: الأوزان المفتوحة المعلنة ليوم 27 يوليو 2026
تمت المراجعة: 20 يوليو 2026

مجردة التدرج الأزرق والأرجواني

Kimi K3 هو النموذج الذي حرك الأسواق قبل إطلاق أوزانه

أصدرت Moonshot AI Kimi K3 في 16 يوليو 2026 كنموذج خليط من الخبراء مكون من 2.8 تريليون معلمة مع رؤية أصلية ونافذة سياق مكونة من مليون رمز مميز. 16 فقط من أصل 896 خبيرًا نشطون لكل رمز مميز؛ Kimi Delta Attention وAttention Residuals هما أفكار معمارية تهدف إلى جعل هذا المقياس عمليًا للمهام الطويلة.

ولم يكن الجزء الرائع مجرد المواصفات الفنية. في 17 يوليو، انخفض سهم Z.ai بنحو 28% وMiniMax بنحو 16%، حيث أعاد المستثمرون تسعير القيمة التنافسية لمطوري الذكاء الاصطناعي الصينيين. كما تراجعت أسهم التكنولوجيا الأمريكية: خسر مؤشر Nasdaq 1.4% وNvidia 2.2%. كان Kimi حافزًا، وليس السبب الوحيد، حيث أثرت أرباح الشركات وأسعار النفط والمخاطر الجيوسياسية أيضًا على يوم التداول، وانتعشت أسهم التكنولوجيا جزئيًا يوم الاثنين التالي.

وكان تفسير السوق لا يزال عقلانيا. إذا تمكن مختبر صيني من الاقتراب من أداء النموذج المغلق، وتسعير API بقوة، ثم إطلاق أوزانه، فإن ندرته وقوته التسعيرية عبر القطاع تبدو أقل أمانًا. وهذه إشارة اقتصادية وليست معيارا.

اعتبارًا من هذه المراجعة في 20 يوليو 2026، من المقرر إصدار الأوزان الكاملة في 27 يوليو وهي ليست متاحة بعد. ولذلك ينبغي وصف K3 بأنه إصدار معلن للوزن المفتوح، وليس نموذجًا مفتوح الوزن يمكن نشره بالفعل.

ما تقوله الاختبارات في الواقع

النتائج المستقلة تبرر الاهتمام، ولكن ليس الأساطير. سجل Artificial Analysis K3 عند 57 على Intelligence Index. في تسخير المهام التجارية، وصل K3 إلى GDPval-AA v2 إيلو عام 1668- أعلى من GPT-5.5 وClaude Opus 4.8 في هذا الاختبار، خلف Claude Fable 5. كما قاد K3 AutomationBench-AA بنسبة 53% وحصلت على المركز الثاني على AA-Briefcase.

تعتبر هذه نتائج مفيدة لعملاء الذكاء الاصطناعي لأنهم يختبرون إكمال المهام، وليس مجرد الإجابة على الأسئلة القصيرة. كما أنها تكشف عن المقايضات:

  • Artificial Analysis يقدر بنحو 0.94 USD لكل مهمة مرجعية مكتملة. وهذا قريب من النماذج المملوكة الرائدة، ولكنه أعلى ماديًا من المنافسين ذوي التكلفة المنخفضة مثل GLM وDeepSeek.

  • تم إنشاء K3 تقريبًا 132 مليون رمز الإخراج عبر الجناح. إن اقتصاديات المهام الأفضل لا تعني بالضرورة عملية موجزة.

  • ارتفعت الدقة من خصم 33% على K2.6 إلى 46% على K3، في حين تفاقم معدل الهلوسة المقاسة من 39% إلى 51%. انتقلت القدرة والموثوقية في اتجاهات مختلفة.

  • تقول مذكرة الإطلاق الخاصة بـ Moonshot أن K3 لا يزال في المرتبة التالية كلود فابل 5 وGPT-5.6 سول إجمالي.

تضيف العروض التوضيحية التي يديرها الموفر أدلة مفيدة: تحسين النواة على مدار 24 ساعة، ومهمة تصميم الشريحة لمدة 48 ساعة، ومترجم MiniTriton، وسير عمل البحث الذي يشمل العديد من الأدوات. تعامل مع هذه الأمور باعتبارها أدلة تصميمية، وليست معايير محايدة. يجب على المشتري إعادة إنتاج هيكل العمل - وليس العرض التوضيحي الذي يقدمه الموفر - في مستودعه الخاص، ومستنداته، وأدواته، وحالات الفشل.

حالة المؤسسة: مثيرة للإعجاب، وحديثة من الناحية التشغيلية

يعد K3 مرشحًا جديًا للأتمتة طويلة المدى، والبرمجة على نطاق المستودعات، والأبحاث متعددة الوسائط. أقوى حجة لها هي الاستخدام المستمر للأداة بجودة متجاورة - وليس رقم المليون رمزي في حد ذاته.

الصورة العملياتية أقل نضجا. أوقفت Moonshot الاشتراكات الجديدة مؤقتًا بعد أن تجاوز الطلب السعة. توصي الشركة 64 أو أكثر من المسرعات للاستضافة الذاتية، وبالتالي فإن الإصدار المستقبلي ذو الوزن المفتوح سيحسن التحكم دون جعل النشر بسيطًا أو رخيصًا. تسعير API المستضاف هو 3 دولارات لكل مليون من رموز الإدخال غير المخزنة مؤقتًا و15 دولارًا لكل مليون من رموز الإخراج، مع إدخال مخبأ بقيمة 0.30 دولارًا.

كيف يمكننا تقييم ذلك

قم بتشغيل عملية تجارية كاملة بأدلة متناقضة، وانتهاء مهلة الأداة، ونتيجة وسيطة سيئة بشكل متعمد، والامتناع المتوقع، ومخطط المخرجات الصعبة. تتبع النتائج المكتملة، والمطالبات غير المدعومة، وتصحيحات المراجعين، ومعدل الاسترداد، وزمن الاستجابة، وإجمالي الرموز المميزة. قارنه مع كل من النموذج المغلق العلوي والمرشح الأرخص ثمناً للوزن المفتوح.

الأدلة المستخدمة

حالة دعم Beam AI

قيد التقييم. يعد هذا مرجعًا لاختيار النموذج، وليس تأكيدًا لتكامل Beam أو نتيجة قياس الأداء أو التوفر الإقليمي أو توصية الإنتاج. تحقق من صحة سطح K3 الدقيق وإصداره في سير العمل المقصود قبل تقديم التزام العميل.

Use case 1

وكيل هندسي على نطاق المستودع

امنح K3 تغييرًا حقيقيًا ومحدودًا يتطلب البحث في المستودع وتنفيذه واختباراته وتوثيقه والاسترداد من استدعاء أداة فاشل. قم بقياس التصحيحات المقبولة، والانحدارات، ومشكلات الأمان، وتصحيحات المراجعين، والرموز المميزة للمخرجات، وما إذا كان الأفق الطويل يتفوق على سير العمل المتحلل.

Use case 2

معيار العمليات طويل الأمد

اختبر سير عمل المكتب الخلفي لعدة ساعات باستخدام المتصفح أو أدوات API ونقاط التفتيش وقابلية الاستئناف والموافقة البشرية. يجعل AutomationBench هذه فرضية واعدة؛ فقط معدل الإكمال، واسترداد الفشل، والتكلفة لكل حالة مقبولة يمكن التحقق من صحتها.

Use case 3

تحليل غرفة الأدلة المتعددة الوسائط

استخدم المستندات والجداول ولقطات الشاشة والصور لإنشاء خريطة مشكلات مرتبطة بالمصدر. أدخل التناقضات والمواد غير ذات الصلة، ثم سجل دعم الاقتباس، والأدلة المفقودة، والاستنتاجات غير المدعومة، وتقليل البيانات، ووقت المراجع.

Use case 4

دراسة نشر الوزن المفتوح

بعد شحن الأوزان، قارن نقطة النهاية المستضافة ببناء معتمد تتم إدارته ذاتيًا. قم بتضمين مصدر المصنوعات، والتكميم، وقدرة التسريع التي تزيد عن 64، والإنتاجية، وطبقة الأمان، والمراقبة، والتصحيح، والتكلفة الإجمالية، والموظفين التشغيليين - وليس فقط جودة النموذج.

النماذج اللغوية الكبيرة الأخرى

إليك قائمة بنماذج اللغة الكبيرة التي يمكن استخدامها مع Beam

ابدأ اليوم

Build AI agents with the right model

See how Beam can orchestrate governed AI workflows across the model family that fits your requirements.

ابدأ اليوم

Build AI agents with the right model

See how Beam can orchestrate governed AI workflows across the model family that fits your requirements.

ابدأ اليوم

Build AI agents with the right model

See how Beam can orchestrate governed AI workflows across the model family that fits your requirements.

الأسئلة الشائعة

الأسئلة الشائعة

Model selection, deployment, governance, and Beam support questions answered.

هل تسبب Kimi K3 في بيع أسهم الذكاء الاصطناعي في يوليو 2026؟

لقد كان حافزًا مهمًا، خاصة بالنسبة لمطوري الذكاء الاصطناعي الصينيين المعرضين بشكل مباشر: انخفض سهم Z.ai بنسبة 28٪ تقريبًا وMiniMax بحوالي 16٪ في 17 يوليو. وعكست عمليات البيع الأوسع في الولايات المتحدة أيضًا الأرباح والنفط والمخاطر الجيوسياسية، وانتعشت أسهم التكنولوجيا جزئيًا يوم الاثنين التالي. الاستنتاج المفيد هو أن K3 تحدى افتراضات المستثمرين حول ندرة النموذج الحدودي وتسعيره - ولم يثبت يوم تداول واحد أنه النموذج الأفضل في العالم.

ما مدى قوة Kimi K3 في المعايير المستقلة؟

حصلت Artificial Analysis على K3 عند 57 على Intelligence Index، و1668 Elo على GDPval-AA v2، و53% على AutomationBench-AA، حيث كانت في المقدمة وقت المراجعة. وجد التقييم نفسه حجمًا كبيرًا للمخرجات ومعدل هلوسة يبلغ 51%، لذا تتعامل الصفحة مع القصة المعيارية على أنها قوية ولكنها ليست غير مؤهلة.

هل Kimi K3 ذو وزن مفتوح اليوم؟

ليس بعد حتى هذه المراجعة في 20 يوليو 2026. أعلنت Moonshot أنه سيتم إصدار الأوزان الكاملة في 27 يوليو. وإلى أن يتم شحن المصنوعات اليدوية وفحصها، يجب وصف K3 كنموذج مستضاف مع إصدار معلن للوزن المفتوح.

هل يمكن لمؤسسة أن تستضيف Kimi K3 ذاتيًا اقتصاديًا؟

ربما، ولكن ليس عرضا. توصي Moonshot بما لا يقل عن 64 مسرعًا، مما يجعل تخطيط السعة، وهندسة الاستدلال، وضوابط السلامة، وإمكانية المراقبة، والتصحيح، والملكية عند الطلب أمرًا أساسيًا في القرار. الأوزان المفتوحة تقلل من الاعتماد على مقدم الخدمة؛ فهي لا تزيل تكلفة البنية التحتية.

هل يدعم Beam Kimi K3 في الإنتاج؟

دعم Beam قيد التقييم حاليًا. لم يتم إرفاق أي تكامل إنتاج معتمد أو معيار Beam بسجل CMS هذا. تحقق من صحة نقطة النهاية أو إصدار الوزن المستقبلي والمنطقة وضوابط البيانات والأدوات وسلوك الفشل ونموذج التشغيل قبل الالتزام بالعميل.