[ analysis · 11.03.2026 ]
חברת nvidia שיחררה הערב מודל חדש בסדרת נומרטרון :Nemotron 3 Super
ביקשתי מgrok לסכם עליו אני רק אגיד בזריזות שעל פי הנתונים מאוד מרשים והכי נחמד שאפשר להשתמש בו בחינם

נוסיף שהוא גם נבנה בצורה מותאמת לסוכנים ובייחוד openclaw
הוא אפילו מנצח בביקורות שם במדד שלהם מהמודלים של קוד פתוח
ועכשיו : לדבר הגרוק 😀
המודל החדש של NVIDIA הוא Nemotron 3 Super – מודל פתוח (open-weights) מסוג hybrid Mamba-Transformer MoE עם 120 מיליארד פרמטרים בסך הכל (רק 12.7 מיליארד פעילים בכל token). הוא יצא היום (11 במרץ 2026) והוא חלק ממשפחת Nemotron 3 (יש גם Nano ו-Ultra).
### מה מיוחד בו? (הדגשים עיקריים)
זה לא סתם "מודל גדול יותר" – הוא מתוכנן מראש להיות הכי יעיל וחכם ל-agentic AI:
- Latent MoE – מפעיל פי 4 יותר "מומחים" (experts) בעלות inference זהה → יותר דיוק בלי עלות נוספת.
- Multi-token prediction – מנבא כמה tokens בבת אחת → דורש פחות זמן יצירה (generation time).
- Hybrid Mamba-Transformer – 4× שיפור בזיכרון ובחישוב (במיוחד ב-context ארוך).
- NVFP4 quantization – אופטימיזציה מלאה ל-GPUs של Blackwell (Blackwell-native).
- Native 1M-token context window – יכול "לבלוע" מיליון tokens בבת אחת (נתונים עצומים, קוד ארוך, שיחות ארוכות).
תוצאה: פי 5 throughput ו-**פי 2 דיוק** בהשוואה לגרסה הקודמת, תוך שהוא נשאר open-source מלא (weights + datasets + recipes).
### מה הוא מסוגל לעשות?
- Multi-agent workflows – מאות agents משתפים פעולה בו זמנית (תכנון, קריאת כלים, אימות, ביצוע).
- Coding agents – כותב, מתקן ומפתח קוד ברמה גבוהה (הכי טוב ב-PinchBench).
- Long-running autonomous agents – רץ שעות/ימים עם context ענק (1M tokens).
- Reasoning modes – 3 מצבים (off / low-effort / regular) – אפשר לבחור כמה "חשיבה" הוא משקיע.
- משימות מורכבות כמו אוטומציית IT, ניתוח נתונים ענק, סוכנים אישיים וכו'.