13 באוגוסט 2026 האקדמיה ארכיון
מבזקים
נווידיה משקיעה 500 מיליארד דולר: הבטוחה של מרכזי הנתונים ל-AI ה-FT פרסם ב-13 באוגוסט 2026 מאמר על האפשרות של EY להיות המפקחת של Anthropic מודל 2-ביט של NVIDIA Nemotron 3.5 Lightning מריץ קריאות כלי במשך 10 דקות עם 22 GB VRAM אפליקציית ChatGPT שולחנית ללינוקס יוצאת בתצוגה מקדימה עם קודקס מובנה DeepSeek-V4-Pro מגיע למקום 8 בקוד ארנה, שני בין המודלים הפתוחים
מוצרים

NVIDIA חושפת את Vera ו-cuFile פתוח ב-FMS: האחסון הופך לחלק פעיל בנתיב הנתונים

מאת הדר מזרחי כתב/ת AgentNet
NVIDIA חושפת את Vera ו-cuFile פתוח ב-FMS: האחסון הופך לחלק פעיל בנתיב הנתונים

ב-FMS השבוע NVIDIA לא דיברה על עוד כרטיס גרפי, אלא על הצינור שמזין אותו. סוכני AI מייצרים אלפי בקשות אחסון מקבילות ישירות מה-GPU, והמערכות הקיימות, שעסוקות בהצפנה, דחיסה ואימות בו-זמנית, הופכות לצוואר בקבוק עוד לפני שהמודל מתחיל לחשוב. המסר ברור: בלי אחסון שרץ בקצב של המאיץ, ה-GPU יושב ומחכה.

הבעיה: סוכני AI מציפים את האחסון

השינוי הבסיסי הוא ש-GPUים כעת יוזמים בקשות I/O בעצמם, בלי תיווך של ה-CPU. זה מייצר עומס של אלפי אופרציות מקבילות שדורשות טיפול מיידי בנתונים, הצפנה, דחיסה, אימות ושחזור. כשאלפי סוכנים פוגעים באחסון יחד, שירותי הנתונים האלה נתקעים, והתפוקה קורסת. NVIDIA מגדירה את זה כשינוי כלכלי של 40 שנה: פעם ההחלטה בין זיכרון (יקר, מהיר, דקות גישה) לאחסון (זול, איטי) נמדדה בדקות; היום, עם פתרונות AI Storage, אותו טריד-אוף משוחק במיקרו-שניות.

Vera CPU: פי 3.21 תפוקה מול x86

התשובה החומרתית היא Vera CPU, חלק מפלטפורמת Vera BlueField-4 STX. בבינצ'מרק שפורסם בבלוג הטכני של NVIDIA, Vera מספק עד פי 3.21 תפוקה גבוהה יותר מ-CPU מבוסס x86 בפייפליין דו-שלבי של דחיסה והצפנה. המשמעות המעשית: פלטפורמות אחסון יכולות לבלוע את שטף הנתונים של AI עם הרבה פחות תשתית מחשוב. האחסון מפסיק להיות מקום פסיבי לשמירת קבצים והופך לחלק פעיל בנתיב הנתונים (data path).

cuFile יוצא לקוד פתוח: גישה ישירה של GPU לאחסון

במקביל, NVIDIA משחררת את cuFile, ממשקי ה-API של GPUDirect Storage, כקוד פתוח, כולל הסטאק האנכי שמתחתיהם. cuFile מאפשר ל-GPU לקרוא ולכתוב לאחסון ישירות, באמצעות מאות אלפי ת'רדים של GPU ו-HBM רחב-פס, ומגיע לזמני גישה של מיקרו-שניות. המהלך מיישר קו עם גישת security-first שמבוססת על best practices של לינוקס, ומזין יוזמות כמו Open Secure AI Alliance, שבה Google, Intel, NVIDIA ו-Meta משמשות כמתחזקות ראשוניות. המטרה: להפוך קשרי אבטחה ונתונים לנגישים במהירות שמערכות הגנה מבוססות AI דורשות.

Storage-Next: תקן פתוח לאחסון מונחה GPU

הזרוע השלישית היא יוזמת Storage-Next, שמובילה NVIDIA עם יצרניות אחסון, ספקי בקרים, הנדסת תרמיקה וקירור, מפעילי תזמור וגופי תקינה. היעד: להגדיר איך אחסון מונחה-GPU צריך להתנהג, ואז להפוך את זה לתקנים פתוחים וברי-אינטרופרביליות. בשורה התחתונה, NVIDIA דוחפת את כל האקוסיסטם לקו-דיזיין קיצוני: מזיכרון ואחסון, דרך תוכנה, ועד תקנים, כי בלי זה, ה-GPU הכי חזק בשוק סתם שורף חשמל בהמתנה לדאטה.

מקור: blogs.nvidia.com