13 באוגוסט 2026 האקדמיה ארכיון
מבזקים
נווידיה משקיעה 500 מיליארד דולר: הבטוחה של מרכזי הנתונים ל-AI ה-FT פרסם ב-13 באוגוסט 2026 מאמר על האפשרות של EY להיות המפקחת של Anthropic מודל 2-ביט של NVIDIA Nemotron 3.5 Lightning מריץ קריאות כלי במשך 10 דקות עם 22 GB VRAM אפליקציית ChatGPT שולחנית ללינוקס יוצאת בתצוגה מקדימה עם קודקס מובנה DeepSeek-V4-Pro מגיע למקום 8 בקוד ארנה, שני בין המודלים הפתוחים
מודלים

Alibaba שחררה את Qwen3.8-Max, מודל מסוג mixture-of-experts עם 2.4 טריליון פרמטרים שמפעיל רק כ-95 מיליארד מתוכם לכל token

מאת רותם ברנע כתב/ת AgentNet
Alibaba שחררה את Qwen3.8-Max, מודל מסוג mixture-of-experts עם 2.4 טריליון פרמטרים שמפעיל רק כ-95 מיליארד מתוכם לכל token

התוצאה היא מודל שתופס מקום שני ב-Vision Arena עם 1,305 נקודות, 13 נקודות מתחת ל-Claude Fable 5 ושתי נקודות מעל Claude Opus 4.7 (Thinking). במבחן ייצור קוד למשחק Flappy Bird המודל קיבל ציון 9 מתוך 10, בדיוק כמו GPT-5.6 Sol, אבל בעלות של 0.0248 דולר להרצה, פי 4.2 פחות מהמתחרים ## המבנה שמאפשר את המחיר

המודל משתמש בארכיטקטורת sparse mixture-of-experts, כלומר router קטן בוחר רק חלק מהמומחים הרלוונטיים לכל token במקום להפעיל את כל 2.4 טריליון הפרמטרים. זה מסביר איך מודל בסדר גודל כזה מגיע למחיר של 2 דולר לכל מיליון input tokens ו-6 דולר לכל מיליון output tokens. המחיר הזה מציב את Qwen3.8-Max על גבול ה-Pareto ב-Frontend Code Arena, יחד עם Claude-Opus-5, Kimi-K3, GLM-5.2 ו-DeepSeek-V4-Flash.

מה המספרים אומרים

ב-Vision Arena, שמודד יכולות ריבוי-מודאליות בניתוח תמונות, Qwen3.8-Max נכנס ישירות למקום השני עם 1,305 נקודות. הפער מהמקום הראשון, Claude Fable 5, עומד על 13 נקודות. מתחתיו, Claude Opus 4.7 (Thinking) נמצא שתי נקודות פחות. הניתוח כולל captioning, OCR, דיאגרמות וזיהוי ישויות.

ביצועים מול עלות

מבחן ה-Flappy Bird מדגים את הנקודה המרכזית: ציון זהה ל-GPT-5.6 Sol ב-gameplay, UI ו-UX, אבל בעלות של 0.0248 דולר לעומת פי 4.2 יותר אצל המתחרים. המקור לא מפרט כמה בדיוק עלה המתחרה, ולא מפרסם מדדי latency או זמן תגובה. גם לא נמסרו נתונים על זמינות מסחרית, API או מגבלות שימוש.

מה חסר

ההכרזה כוללת תיעוד מלא ב-GitHub, מתיקייה ריקה ועד אפליקציה עובדת, ללא הדרכה צעד-אחר-צעד. המודל נכנס לשני leaderboards שונים, Vision Arena ו-Frontend Code Arena, ובשניהם הוא ממוקם על גבות ה-Pareto העדכני. מה שלא נאמר: אין נתונים על צריכת משאבים באימון, לא פורסם שווי שוק או סבב גיוס, ואין מידע על זמינות מסחרית או תמחור לשימוש production בקנה מידה גדול.