NVIDIA Nemotron
NVIDIA
Nemotron 3 Ultra هو نموذج MoE مفتوح الأوزان يضم 550 مليار معلمة إجمالية و55 ملياراً نشطة، بهندسة هجينة من Mamba وAttention ومصمم للوكلاء طويلي التشغيل. يتميز بإنتاجية وشفافية استثنائيتين، لكنه يتطلب نقطة تحقق NVFP4 بحجم 352 غيغابايت ومسار تشغيل يعتمد بقوة على NVIDIA.
CURRENT MODEL SNAPSHOT
الموفر: NVIDIA
المثبت الحالي: Nemotron 3 Ultra
دورة الحياة: الحالية
الأوزان: الوزن المفتوح مع البيانات المنشورة و وصفات
تمت المراجعة: 21 يوليو 2026

صُمم Nemotron 3 Ultra لتحسين اقتصاديات الوكلاء طويلي التشغيل
أصدرت NVIDIA Nemotron 3 Ultra في 4 يونيو 2026. يحتوي النموذج على 550 مليار معلمة إجمالية مع ما يقرب من 55 مليار نشط لكل رمز مميز، وبنية Mamba-Attention المختلطة من الخبراء، ودعم NVFP4 الأصلي، ونافذة سياق مكونة من مليون رمز مميز. تنشر NVIDIA الأوزان ومعلومات بيانات التدريب والوصفات، مما يجعل العائلة شفافة بشكل غير عادي بالنسبة لنموذج بهذا المقياس.
تم ضبط البنية لتحقيق إنتاجية استدلال مستدامة بدلاً من أقصى قدر من الاهتمام المكثف في كل خطوة. وهذا أمر مهم بالنسبة للوكلاء الذين يقومون بإنشاء آثار كبيرة، أو استدعاء العديد من الأدوات، أو الحفاظ على ذاكرة عمل طويلة. كما أنه يتوافق بشكل وثيق مع مجموعة أجهزة وبرامج NVIDIA، والتي يمكن أن تكون ميزة لملكية NVIDIA الحالية وتبعية لأي شخص آخر.
تبلغ مساحة فحص NVFP4 حوالي 352 جيجابايت. تعمل الأوزان المفتوحة على تحسين التحكم وقابلية التدقيق؛ فهي لا تجعل Ultra عملية نشر صغيرة.
أقوى الأدلة تجمع بين الإنتاجية العالية واختبارات الوكلاء
عند الإصدار، أبلغ التحليل الاصطناعي عن درجة مؤشر الذكاء 47.7 بموجب منهجيته الحالية وإنتاجية أعلى من 400 رمز مميز للإخراج في الثانية على التكوين المستضاف على Blackbox. قد تعرض صفحات النماذج الحالية درجة موحدة مختلفة مع تطور المجموعة، لذلك يجب أن تحافظ التقارير على تاريخ التقييم ومنهجيته.
تقارير NVIDIA 91 على PinchBench، 33 على EnterpriseOps-Gym، 54 على Terminal-Bench 2.0، 82 على IFBench، 1,448 على الناتج المحلي الإجمالي (GDVal-AA)، و56 على ProfBench Search، و95 على RULER بمليون رمز مميز. كما أفادت الشركة أيضًا بمزايا إنتاجية كبيرة مقارنة بنظيراتها المفتوحة المحددة وانخفاض تكلفة المهمة بنسبة 30% تقريبًا في تقييمها.
يدعم اختبار الإصدار المستقل الادعاء القائل بأن Ultra يمكن أن يكون سريعًا للغاية على البنية التحتية المحسنة.
لا تزال جداول قياس أداء الموفر تتطلب أجهزة دقيقة ووقت تشغيل وأخذ عينات وسياق إصدار المقارنة.
يجب أن تتضمن حالة العمل مدى توفر المسرع وهندسة النظام الأساسي، وليس سعر الرمز المميز فقط.
جدوى المؤسسات: شفافية وقوة مقابل بصمة تشغيلية كبيرة
تعتبر Nemotron جذابة لتنسيق الوكيل طويل الأمد، والتشفير، والاستدلال الخاص عالي الإنتاجية - خاصة عندما تكون البنية التحتية والخبرة الخاصة بـ NVIDIA موجودة بالفعل. إنه غير مناسب للفرق التي تريد نقطة تفتيش مدمجة، أو خدمة محايدة للبائع، أو الحد الأدنى من هندسة الاستدلال.
كيف يمكننا تقييمها
تشغيل عملية وكيل متعددة الساعات مع حالات فشل الأدوات ونقاط التفتيش واختبارات القبول الصارمة على الأجهزة المقصودة. قم بقياس النتائج المقبولة، والاسترداد، والرموز المميزة، والإنتاجية، والوقت حتى الرمز المميز الأول، والطاقة، وإشغال المسرع، وجهد المراجع. قارن مسار NVIDIA المُحسّن ببديل واحد قابل للتطبيق، بما في ذلك تكلفة الموظفين والتأمين.
الأدلة المستخدمة
حالة دعم Beam AI
قيد التقييم. لا يوجد معيار Beam أو طوبولوجيا إنتاج معتمدة مرفقة بهذا السجل. تحقق من صحة نقطة التفتيش ووقت التشغيل والبنية الأساسية بشكل دقيق.
Use case 1
وكيل عمليات طويل الأمد
قم بتشغيل عملية تستغرق عدة ساعات باستخدام واجهات برمجة التطبيقات ونقاط التفتيش وقابلية الاستئناف والموافقة والفشل المتعمد. سجل النتائج المكتملة، والاسترداد، والإجراءات غير المدعومة، وإجمالي الرموز المميزة، وإشغال المسرع، ووقت المراجع.
Use case 2
أسطول الترميز عالي الإنتاجية
قياس مهام المستودع المتوازية على مكدس NVIDIA المقصود. تتبع التصحيحات المقبولة، والانحدارات، والإنتاجية، ووقت الانتظار، والطاقة، واستخدام الأجهزة، والتكلفة لكل تغيير مقبول.
Use case 3
بحث خاص يضم مليون رمز مميز
استخدم الأدلة الداخلية الخاضعة للرقابة عبر سياق طويل، ثم اختبر الاسترجاع باستخدام التناقضات المزروعة والتبعيات البعيدة. سجل الاستشهادات، والسهو، والاستنتاجات غير المدعومة، وزمن الوصول، وتكلفة الذاكرة.
Use case 4
تقييم النظام الأساسي ذو النموذج المفتوح
قارن مسار عرض NVIDIA الكامل مع بديل محايد للبائع. قم بتضمين الأوزان، ووقت التشغيل، والتكميم، وقابلية المراقبة، والسلامة، والتصحيح، والتوظيف، وإمدادات الأجهزة، والتراجع، وتكلفة التشغيل لمدة ثلاث سنوات.

النماذج اللغوية الكبيرة الأخرى
إليك قائمة بنماذج اللغة الكبيرة التي يمكن استخدامها مع Beam
الأسئلة الشائعة
الأسئلة الشائعة
Model selection, deployment, governance, and Beam support questions answered.
ما هو Nemotron 3 Ultra؟
إنه معلمة 550B من NVIDIA، 55B-active hybrid Mamba-Attention MoE للاستدلال والوكلاء طويلي الأمد، مع نافذة سياق مكونة من مليون رمز وأوزان مفتوحة ومعلومات بيانات ووصفات.
ما مدى سرعة Nemotron 3 Ultra؟
أبلغ التحليل الاصطناعي عن أكثر من 400 رموز الإخراج في الثانية على تكوين Blackbox الأمثل عند الإصدار. تعتمد الإنتاجية بشكل كبير على الأجهزة ووقت التشغيل والتجميع والتكميم، لذا قم بإعادة إنتاجها على المجموعة المقصودة.
ما مدى قوة معاييرها؟
تعلن NVIDIA عن وكيل قوي ونتائج سياق طويل مثل 91 على PinchBench و95 على RULER في 1 م. أبلغ التحليل الاصطناعي عن مؤشر ذكاء يبلغ 47.7 عند الإصدار بموجب منهجيته الحالية في ذلك الوقت. احتفظ بالتواريخ والإعدادات عند المقارنة.
هل من السهل استضافة Nemotron ذاتيًا؟
إنه ذو وزن مفتوح ولكنه ليس خفيف الوزن. تبلغ مساحة نقطة تفتيش NVFP4 حوالي 352 جيجابايت، ويتطلب الحصول على الإنتاجية الرئيسية قدرة تسريع كبيرة وخبرة استدلالية من NVIDIA.
هل يدعم Beam Nemotron 3 Ultra في الإنتاج؟
دعم Beam قيد التقييم حاليًا. لم يتم إرفاق أي هيكل إنتاج معتمد أو معيار شعاع بهذا السجل.





