עליבאבא משיקה את Qwen3.8-Max עם 2.4 טריליון פרמטרים ותמחור שובר שוק

ענקית הטכנולוגיה הסינית Alibaba שחררה את Qwen3.8-Max, מודל שפה ענק של 2.4 טריליון פרמטרים שמפעיל רק כ-95 מיליארד פרמטרים לכל טוקן בזכות ארכיטקטורת mixture-of-experts דלילה. הנתב הקטן בוחר קומץ מומחים לכל העברה קדימה, מה שמאפשר תמחור אגרסיבי של 2 דולר למיליון טוקני קלט ו-6 דולר למיליון טוקני פלט (כ-7.4 ו-22 שקל בהתאמה), מחיר שמציב אותו על חזית ה-Pareto של עלות-ביצועים ב-Frontend Code Arena לצד Claude Opus 5, Kimi K3, GLM-5.2 ו-DeepSeek-V4-Flash.
מיקום בצמרת הקוד
ב-Frontend Code Arena השיג Qwen3.8-Max ניקוד של 1,668 נקודות, שממקם אותו במקום הרביעי, צמוד ל-Claude Opus 5 (High) עם 1,669 נקודות, ומאחורי Kimi K3 (Max) עם 1,676 ו-Claude Opus 5 (Max) שמוביל עם 1,705. הפער מהפסגה צנוע, והמודל הסיני מוכיח שהוא מסוגל להתחרות ראש בראש עם המודלים היקרים ביותר בשוק המערבי בלי לדרוש תקציבי עתק.
יכולות מולטימודליות ורכיב אוטונומי
ב-Vision Arena, שבוחן חשיבה מולטימודלית על תמונות, כיתוב, OCR, דיאגרמות וזיהוי ישויות, נכנס המודל למקום השני עם 1,305 נקודות. הוא מפגר ב-13 נקודות בלבד אחרי Claude Fable 5, ומקדים ב-2 נקודות את Claude Opus 4.7 (Thinking). מעבר לבנצ'מארקים, Qwen3.8-Max השלים ריצת קוד אוטונומית של יותר מעשרה ימים שבה בנה מאפס את ה-harness המתפתח oh-my-cli, כולל בנייה, בדיקה, אימות ותיקון עצמאיים של המערכת.
מבחן מעשי: פלפי בירד בעשירית המחיר
במבחן צד-אל-צד של יצירת משחק Flappy Bird ב-one-shot, קיבל Qwen3.8-Max ציון 9 מתוך 10 בגיימפליי, UI ו-UX, זהה ל-GPT-5.6 Sol, בעלות של 0.0248 דולר בלבד (כ-9 אגורות). זה בערך פי 4.2 זול מהמתחרים שהשיגו תוצאה דומה. השילוב בין ביצועי קצה לעלות שולית נמוכה הופך את המודל לאופציה מעשית לצוותי פיתוח שצריכים להריץ כמויות גדולות של קוד בלי לשבור את התקציב.