יולי מתגלגל כחודש של שחרורי מודלים, והלוח עמוס: DeepSeek v4 Pro מתוכנן לאמצע החודש

Gemini 3.5 Pro שנדחה מיוני אמור להתפרסם, והיום צפוי Grok 4.5, מודל של xAI שאומן יחד עם Cursor ויכלול כ-1.5 טריליון פרמטרים. במקביל, OpenAI ערכה היום שידור חי להכרזה על מצב קולי חדש, ומחר משיקה את GPT-5.6, כולל הדגם החזק ביותר שלה ששמו Sol ## גישה מוקדמת ורושם ראשוני
תצוגה מקדימה של GPT-5.6 הייתה זמינה לחוג חברות במהלך החודש האחרון, לאחר שרגולציה ממשלתית מנעה שחרור ציבורי כללי. על פי הדיווחים ברשתות החברתיות, התגובות חיוביות ברובן, גם בהשוואה למודל שנקרא Fable. מי שלקח חלק בבדיקה המוקדמת הוא מיצ'ל האשימוטו (Mitchell Hashimoto), מייסד HashiCorp (החברה מאחורי Terraform ו-Vault), שקיבל גישה ל-Sol לפני כחודש ובחר לשתף את רשמיו.
Sol מול Fable
האשימוטו מדווח ש-Sol הפך לברירת המחדל שלו. לדבריו, המודל מהיר יותר, מתכנן ומעריך ברמה זהה ל-Fable, ובאופן כללי מייצר תוצאות איכותיות יותר. עם זאת, הוא מציין שהוא עדיין יפנה ל-Fable למשימות ממוקדות של ניפוי שגיאות או אופטימיזציית ביצועים עם קריטריוני בדיקה ברורים. במילים שלו, ההבדל ביניהם הוא כמו בין עמית כריזמטי ופרודוקטיבי שמעורר קנאה לבין גאון מתבודד שמצטיין בתחום הצר שלו אך לא נעים לבלות איתו זמן.
איפה Fable עדיין מוביל
במשימות נקודתיות הקשורות לניפוי שגיאות, אבטחה וביצועים, האשימוטו טוען שאין ל-Fable תחרות. הוא מציין שהעבודה איתו מרשימה לצפייה, ושהוא לא הצליח לקבל מ-Sol את אותה רמת מסירות בקטגוריה הזו. לעומת זאת, בכל שאר התחומים, לדבריו, Sol מוביל או לכל הפחות נמצא באותה רמה, והעבודה איתו פשוט נעימה יותר.
מה לא נאמר
האשימוטו תוהה בסיום הפוסט שלו אם המודל יכתוב קוד טוב יותר ו"נעים יותר". התגובה הזו משקפת את הקושי לתאר במילים את ההבדלים בין המודלים, אך גם מעלה שאלה לגבי משמעות המונח "נעימות" בהקשר של כתיבת קוד. מה שלא נמסר הם מדדי ביצועים כמותיים, תאריכים מדויקים לשחרור הציבורי של המודלים המתחרים, או הקשר מלא להכרזות הצפויות של החברות האחרות במהלך החודש.