[ analysis · 11.03.2026 ]

חברת nvidia שיחררה הערב מודל חדש בסדרת נומרטרון :Nemotron 3 Super

ביקשתי מgrok לסכם עליו אני רק אגיד בזריזות שעל פי הנתונים מאוד מרשים והכי נחמד שאפשר להשתמש בו בחינם

חברת nvidia שיחררה הערב מודל חדש בסדרת נומרטרון :Nemotron 3 Super
חברת nvidia שיחררה הערב מודל חדש בסדרת נומרטרון :Nemotron 3 Super

נוסיף שהוא גם נבנה בצורה מותאמת לסוכנים ובייחוד openclaw

הוא אפילו מנצח בביקורות שם במדד שלהם מהמודלים של קוד פתוח

ועכשיו : לדבר הגרוק 😀

המודל החדש של NVIDIA הוא Nemotron 3 Super – מודל פתוח (open-weights) מסוג hybrid Mamba-Transformer MoE עם 120 מיליארד פרמטרים בסך הכל (רק 12.7 מיליארד פעילים בכל token). הוא יצא היום (11 במרץ 2026) והוא חלק ממשפחת Nemotron 3 (יש גם Nano ו-Ultra).

### מה מיוחד בו? (הדגשים עיקריים)

זה לא סתם "מודל גדול יותר" – הוא מתוכנן מראש להיות הכי יעיל וחכם ל-agentic AI:

- Latent MoE – מפעיל פי 4 יותר "מומחים" (experts) בעלות inference זהה → יותר דיוק בלי עלות נוספת.

- Multi-token prediction – מנבא כמה tokens בבת אחת → דורש פחות זמן יצירה (generation time).

- Hybrid Mamba-Transformer – 4× שיפור בזיכרון ובחישוב (במיוחד ב-context ארוך).

- NVFP4 quantization – אופטימיזציה מלאה ל-GPUs של Blackwell (Blackwell-native).

- Native 1M-token context window – יכול "לבלוע" מיליון tokens בבת אחת (נתונים עצומים, קוד ארוך, שיחות ארוכות).

תוצאה: פי 5 throughput ו-**פי 2 דיוק** בהשוואה לגרסה הקודמת, תוך שהוא נשאר open-source מלא (weights + datasets + recipes).

### מה הוא מסוגל לעשות?

- Multi-agent workflows – מאות agents משתפים פעולה בו זמנית (תכנון, קריאת כלים, אימות, ביצוע).

- Coding agents – כותב, מתקן ומפתח קוד ברמה גבוהה (הכי טוב ב-PinchBench).

- Long-running autonomous agents – רץ שעות/ימים עם context ענק (1M tokens).

- Reasoning modes – 3 מצבים (off / low-effort / regular) – אפשר לבחור כמה "חשיבה" הוא משקיע.

- משימות מורכבות כמו אוטומציית IT, ניתוח נתונים ענק, סוכנים אישיים וכו'.

https://x.com/nvidiaaidev/status/2031774913544016179?s=46