13 באוגוסט 2026 האקדמיה ארכיון
מבזקים
נווידיה משקיעה 500 מיליארד דולר: הבטוחה של מרכזי הנתונים ל-AI ה-FT פרסם ב-13 באוגוסט 2026 מאמר על האפשרות של EY להיות המפקחת של Anthropic מודל 2-ביט של NVIDIA Nemotron 3.5 Lightning מריץ קריאות כלי במשך 10 דקות עם 22 GB VRAM אפליקציית ChatGPT שולחנית ללינוקס יוצאת בתצוגה מקדימה עם קודקס מובנה DeepSeek-V4-Pro מגיע למקום 8 בקוד ארנה, שני בין המודלים הפתוחים
מודלים

יולי מתגלגל כחודש של שחרורי מודלים, והלוח עמוס: DeepSeek v4 Pro מתוכנן לאמצע החודש

מאת הדר מזרחי כתב/ת AgentNet
יולי מתגלגל כחודש של שחרורי מודלים, והלוח עמוס: DeepSeek v4 Pro מתוכנן לאמצע החודש

Gemini 3.5 Pro שנדחה מיוני אמור להתפרסם, והיום צפוי Grok 4.5, מודל של xAI שאומן יחד עם Cursor ויכלול כ-1.5 טריליון פרמטרים. במקביל, OpenAI ערכה היום שידור חי להכרזה על מצב קולי חדש, ומחר משיקה את GPT-5.6, כולל הדגם החזק ביותר שלה ששמו Sol ## גישה מוקדמת ורושם ראשוני

תצוגה מקדימה של GPT-5.6 הייתה זמינה לחוג חברות במהלך החודש האחרון, לאחר שרגולציה ממשלתית מנעה שחרור ציבורי כללי. על פי הדיווחים ברשתות החברתיות, התגובות חיוביות ברובן, גם בהשוואה למודל שנקרא Fable. מי שלקח חלק בבדיקה המוקדמת הוא מיצ'ל האשימוטו (Mitchell Hashimoto), מייסד HashiCorp (החברה מאחורי Terraform ו-Vault), שקיבל גישה ל-Sol לפני כחודש ובחר לשתף את רשמיו.

Sol מול Fable

האשימוטו מדווח ש-Sol הפך לברירת המחדל שלו. לדבריו, המודל מהיר יותר, מתכנן ומעריך ברמה זהה ל-Fable, ובאופן כללי מייצר תוצאות איכותיות יותר. עם זאת, הוא מציין שהוא עדיין יפנה ל-Fable למשימות ממוקדות של ניפוי שגיאות או אופטימיזציית ביצועים עם קריטריוני בדיקה ברורים. במילים שלו, ההבדל ביניהם הוא כמו בין עמית כריזמטי ופרודוקטיבי שמעורר קנאה לבין גאון מתבודד שמצטיין בתחום הצר שלו אך לא נעים לבלות איתו זמן.

איפה Fable עדיין מוביל

במשימות נקודתיות הקשורות לניפוי שגיאות, אבטחה וביצועים, האשימוטו טוען שאין ל-Fable תחרות. הוא מציין שהעבודה איתו מרשימה לצפייה, ושהוא לא הצליח לקבל מ-Sol את אותה רמת מסירות בקטגוריה הזו. לעומת זאת, בכל שאר התחומים, לדבריו, Sol מוביל או לכל הפחות נמצא באותה רמה, והעבודה איתו פשוט נעימה יותר.

מה לא נאמר

האשימוטו תוהה בסיום הפוסט שלו אם המודל יכתוב קוד טוב יותר ו"נעים יותר". התגובה הזו משקפת את הקושי לתאר במילים את ההבדלים בין המודלים, אך גם מעלה שאלה לגבי משמעות המונח "נעימות" בהקשר של כתיבת קוד. מה שלא נמסר הם מדדי ביצועים כמותיים, תאריכים מדויקים לשחרור הציבורי של המודלים המתחרים, או הקשר מלא להכרזות הצפויות של החברות האחרות במהלך החודש.