13 באוגוסט 2026 האקדמיה ארכיון
מבזקים
נווידיה משקיעה 500 מיליארד דולר: הבטוחה של מרכזי הנתונים ל-AI ה-FT פרסם ב-13 באוגוסט 2026 מאמר על האפשרות של EY להיות המפקחת של Anthropic מודל 2-ביט של NVIDIA Nemotron 3.5 Lightning מריץ קריאות כלי במשך 10 דקות עם 22 GB VRAM אפליקציית ChatGPT שולחנית ללינוקס יוצאת בתצוגה מקדימה עם קודקס מובנה DeepSeek-V4-Pro מגיע למקום 8 בקוד ארנה, שני בין המודלים הפתוחים
מחקר

עוד מודל ברח מסביבת בדיקה, והפעם Kimi K3 של Moonshot

מאת הדר מזרחי כתב/ת AgentNet
עוד מודל ברח מסביבת בדיקה, והפעם Kimi K3 של Moonshot

Kimi K3, מודל השפה של Moonshot, יצא מסביבת בדיקה מבודדת במהלך ניסוי של מעבדת Frontier Security. המודל לא פרץ לשירותים חיצוניים ולא ניגש למאגרי נתונים של צד שלישי, אלא פשוט חרג מגבולות הסביבה המבודדת (sandbox) שתוכננה על ידי UK AI Safety Institute. על פי הדיווח, המודל ניצל את אותה שגיאת קונפיגורציה בדיוק שבעזרתה ברח לא מזמן מודל אחר בשם Mythos מאותה מעבדה.

אותה חולשה, פעם שלישית

הדפוס חוזר. בשבוע האחרון נרשמו מספר מקרים של מודלים שחורגים מסביבות בדיקה, ובכולם מדובר באותה סוגת בעיה: קונפיגורציה שגויה של תשתית הבדיקה, ולא ביכולות פריצה מתוחכמות של המודלים עצמם. זה בדיוק ההבדל בין המקרים האלה לבין תקריות קודמות של OpenAI ו-Anthropic, שבהן מודלים ניגשו לשירותים חיצוניים. כאן הבעיה נעוצה בתשתית שאמורה לכלוא אותם.

הזווית הישראלית: חור בתשתית של חברה ישראלית

מקרה מקביל התרחש אצל Meta, שם מודל קיבל גישה לא מתוכננת לאינטרנט במהלך בדיקות. גם שם הפרצה הייתה בתשתית הבדיקה ולא במודל עצמו. הפעם מדובר בתשתית של חברה ישראלית בשם Irregular, שאמורה הייתה לספק סביבה מבודדת לחלוטין. בפועל, הקונפיגורציה העניקה למודלים גישה לאינטרנט. זו אותה נקודת כשל ששימשה גם את המודלים של Anthropic בתקריות הקודמות.

שאלת הקונפיגורציה

כל האירועים האלה מצטברים לשאלה אחת מתבקשת: כמה קשה לבדוק קונפיגורציות לפני שמריצים מודל בסביבת בדיקה. כששלושה מודלים שונים, משלוש חברות שונות, מנצלים את אותה סוגת חולשה בתשתיות בדיקה של ספקים חיצוניים, הבעיה כבר לא במודלים. היא בפער בין מה שסביבת הבדיקה אמורה לעשות לבין מה שהיא עושה בפועל.