العودة إلى منطقة المطورين

NVIDIA النماذج

استكشف جميع النماذج البالغ عددها 4 من NVIDIA مع تفاصيل الأسعار والمزايا والعيوب وتوصيات المطورين.

4
النماذج
$0.050
أقل إدخال
1M
أقصى سياق
3
مستويات الجودة

توصيات سريعة

أفضل قيمة: Nemotron-3-4B ($0.050/1M)
أفضل جودة: Nemotron-3-Ultra

Nemotron-3-Ultra

Flagship

الاستدلال الوكيل، التنسيق، التخطيط المعقد

التسعير الرسمي

متى تستخدم: أعباء العمل الوكيل الحدودية: التخطيط متعدد الخطوات، تنسيق الأدوات، سلاسل الاستدلال المعقدة، ونشر الوكيل الإنتاجي.

أبرز التحديثات

  • 550B MoE مع 55B نشط — نموذج استدلال حدودي مفتوح
  • Mamba-Transformer هجين: 300+ رمز/ثانية، سياق 1M
  • مصمم خصيصًا للتنسيق الوكيل واستدعاء الأدوات
  • وزن مفتوح: انشره مع NeMo أو NIM أو استضافة ذاتية
  • $0.50/1M إدخال — قدرة حدودية بسعر نموذج مفتوح
سعر الإدخال
$0.500
per 1M tokens
سعر الإخراج
$2.00
per 1M tokens
الإدخال المخبأ
$0.130
per 1M tokens
إدخال الدفعة
per 1M tokens
نافذة السياق: 1M
أقصى إخراج: 32,768 tokens
حد المعرفة: 2026-04
الرؤيةاستدعاء الدالةالضبط الدقيقوضع JSONالمستوى المجاني

المزايا

  • 550B إجمالي / 55B نشط — استدلال حدودي مفتوح
  • هندسة هجينة Mamba-Transformer-MoE
  • سياق 1M لمهام الوكيل طويلة الأفق
  • إنتاجية 300+ رمز/ثانية
  • وزن مفتوح مع تخصيص NeMo

العيوب

  • لا يدعم الرؤية
  • 55B معلمات نشطة لا تزال تتطلب حوسبة كبيرة للاستضافة الذاتية
  • نظام بيئي أصغر مقارنة بـ OpenAI/Anthropic

الأداء

سرعة الإخراج~90 tok/s
حد المعدل5,000 RPM

متعدد الوسائط

إدخال الصورةإخراج الصورةإدخال الصوتإخراج الصوت

المعايير

MMLU
88.5%
MT-Bench
9.4
BFCL
78.2%
AgentBench
72.6%

Nemotron-3-Nano-Omni

Lite

العوامل متعددة الوسائط، فهم الفيديو/الصوت/الصورة، النشر على الحافة

التسعير الرسمي

متى تستخدم: العوامل الذكية متعددة الوسائط التي تحتاج إلى فهم الفيديو والصوت والصورة في الوقت الفعلي على الحافة. ذكاء المستندات، دعم العملاء مع مشاركة الشاشة، وتحليل المحتوى السمعي البصري.

أبرز التحديثات

  • أول نموذج متعدد الوسائط من NVIDIA: رؤية + صوت + لغة موحدة
  • 30B-A3B MoE — ينشر على Jetson و DGX Spark
  • إنتاجية 9 أضعاف: نفس الأداء، موارد أقل بكثير
  • استدلال شاشة أصلي بدقة 1080 بكسل للعوامل الرسومية
  • وزن مفتوح: تخصيص مع NeMo للمهام المجالية
سعر الإدخال
$0.100
per 1M tokens
سعر الإخراج
$0.400
per 1M tokens
الإدخال المخبأ
per 1M tokens
إدخال الدفعة
per 1M tokens
نافذة السياق: 262K
أقصى إخراج: 8,192 tokens
حد المعرفة: 2026-04
الرؤيةاستدعاء الدالةالضبط الدقيقوضع JSONالمستوى المجاني

المزايا

  • متعدد الوسائط: فيديو + صوت + صورة + نص في نموذج واحد
  • 30 مليار إجمالي / 3 مليار نشط — يعمل على 25 جيجابايت من ذاكرة الوصول العشوائي
  • إنتاجية 9 أضعاف مقارنة بالنماذج المفتوحة متعددة الوسائط المماثلة
  • وزن مفتوح مع حقوق الاستخدام التجاري
  • استدلال بصري أصلي بدقة 1920×1080

العيوب

  • 3 مليار معلمة نشطة تحد من الاستدلال المعقد
  • 8 آلاف حد أقصى للإخراج
  • نافذة سياق أصغر (256 ألف)

الأداء

سرعة الإخراج~200 tok/s
حد المعدل15,000 RPM

متعدد الوسائط

إدخال الصورةإخراج الصورةإدخال الصوتإخراج الصوت

المعايير

MMLU
71.2%
MMMU
65.8%
OSWorld
42.3%
DocVQA
92.1%

Nemotron-3-8B

Mid-tier

توليد البيانات الاصطناعية، نمذجة المكافآت

التسعير الرسمي

متى تستخدم: توليد بيانات التدريب الاصطناعية، نمذجة المكافآت لـ RLHF، وسير عمل النظام البيئي لـ NVIDIA.

أبرز التحديثات

  • مصمم خصيصًا لتوليد البيانات الاصطناعية — تدريب نماذج أخرى
  • نموذج مكافآت قوي: ترتيب الاستجابات أفضل من حكم GPT-4
  • نشر NVIDIA NIM — استدلال محسّن على وحدات معالجة الرسوميات
  • الضبط الدقيق باستخدام إطار NeMo
  • $0.10/1M إدخال — فعال من حيث التكلفة لتوليد البيانات على نطاق واسع
سعر الإدخال
$0.100
per 1M tokens
سعر الإخراج
$0.400
per 1M tokens
الإدخال المخبأ
per 1M tokens
إدخال الدفعة
per 1M tokens
نافذة السياق: 128K
أقصى إخراج: 4,096 tokens
حد المعرفة: 2025-03
الرؤيةاستدعاء الدالةالضبط الدقيقوضع JSONالمستوى المجاني

المزايا

  • محسّن لتوليد البيانات الاصطناعية
  • قدرات قوية لنمذجة المكافآت
  • تكامل مع نظام NVIDIA البيئي
  • دعم الضبط الدقيق

العيوب

  • حد أقصى للإخراج 4K
  • لا يدعم الرؤية
  • حجم النموذج الأصغر يحد من المهام المعقدة

الأداء

سرعة الإخراج~100 tok/s
حد المعدل10,000 RPM

متعدد الوسائط

إدخال الصورةإخراج الصورةإدخال الصوتإخراج الصوت

المعايير

MMLU
73.8%
MT-Bench
8.2

Nemotron-3-4B

Lite

بيانات اصطناعية خفيفة الوزن، نشر على الحافة

التسعير الرسمي

متى تستخدم: النشر على الحافة، توليد بيانات اصطناعية خفيفة الوزن، ومعالجة دفعية حساسة للتكلفة.

أبرز التحديثات

  • 4B معلمة — ينشر على Jetson ووحدات معالجة الرسوميات الطرفية
  • توليد بيانات اصطناعية بسعر $0.05/1M إدخال
  • NVIDIA NIM: نشر محسَّن في حاويات
  • مفتوح المصدر: أوزان كاملة للتخصيص
سعر الإدخال
$0.050
per 1M tokens
سعر الإخراج
$0.200
per 1M tokens
الإدخال المخبأ
per 1M tokens
إدخال الدفعة
per 1M tokens
نافذة السياق: 128K
أقصى إخراج: 4,096 tokens
حد المعرفة: 2025-03
الرؤيةاستدعاء الدالةالضبط الدقيقوضع JSONالمستوى المجاني

المزايا

  • مدمج 4B — يعمل على وحدات معالجة الرسوميات الطرفية
  • توليد بيانات اصطناعية
  • مُحسَّن لـ NVIDIA NIM
  • أوزان مفتوحة المصدر

العيوب

  • قدرة استدلال محدودة
  • أقصى إخراج 4K
  • لا رؤية

الأداء

سرعة الإخراج~180 tok/s
حد المعدل20,000 RPM

متعدد الوسائط

إدخال الصورةإخراج الصورةإدخال الصوتإخراج الصوت

المعايير

MMLU
66.5%
MT-Bench
7.1

مقارنة جنبًا إلى جنب

النموذجالمستوىالإدخالالإخراجالسياق
Nemotron-3-UltraFlagship$0.500$2.001M
Nemotron-3-Nano-OmniLite$0.100$0.400262K
Nemotron-3-8BMid-tier$0.100$0.400128K
Nemotron-3-4BLite$0.050$0.200128K