מטא הודיעה כי אחד ממודלי הבינה המלאכותית שלה הצליח להגיע למערכות של חברה אחרת במהלך בדיקות אבטחת סייבר, בעקבות שגיאת תצורה בסביבת הבדיקה. המקרה מצטרף לשורת אירועים דומים שעליהם דיווחו לאחרונה גם Anthropic ו-OpenAI, ומחדד את הדיון סביב הסיכונים שמציבים מודלי AI מתקדמים בתחום הסייבר.
לפי מטא, מקור התקלה היה בהגדרה שגויה של חברת Irregular, חברה עצמאית המבצעת עבורה הערכות אבטחה. כתוצאה מכך קיבל המודל גישה לאינטרנט במהלך הבדיקה - גישה שלא הייתה אמורה להיות זמינה לו.
בהודעת החברה נמסר כי המודל ניצל חולשת אבטחה בשירות של צד שלישי, באופן הדומה למקרים שעליהם דווח בעבר אצל חברות אחרות. לפי דיווח של The Information, מדובר במודל Muse Spark 1.1, שמטא הציגה כאחד המודלים המתקדמים שלה למשימות קוד ולסוכני AI. עוד נטען כי המודל הצליח לחדור למערכות של חברה שלא זוהתה ואף שינה את הסביבה הפנימית שלה.
דובר מטעם Irregular אמר לסוכנות רויטרס כי מדובר בדיוק באותה בעיית תצורה בסביבת ההערכה שנחשפה בשבוע שעבר במקרה של Anthropic. לדבריו, לא מדובר בבריחה מסביבת הבידוד (Sandbox Escape) או בפעולת סייבר מתוחכמת, אלא בתקלה בסביבת הבדיקות. עוד נמסר כי אין כיום בעיות פתוחות, וכי החברה מכינה מסמך מקצועי שיציג המלצות להפעלת מבחני סייבר בצורה בטוחה יותר ולשיפור מנגנוני הבידוד.
האירועים האחרונים מגבירים את החשש בקרב מחוקקים בארצות הברית מפני האפשרות שמודלי AI מתקדמים יוכלו בעתיד לבצע או לסייע במתקפות סייבר. קבוצת תובעים כלליים רפובליקנים כבר פנתה ל-OpenAI בדרישה לשמור מסמכים הקשורים לאירוע הפריצה שנחשף במסגרת Hugging Face. OpenAI מסרה כי תתייחס לבקשה ברצינות וכי בכוונתה לפרסם דוח טכני מפורט על המקרה.
בתוך כך, הבית הלבן כינס השבוע את החברות המובילות בתחום - בהן מטא, Anthropic, OpenAI וגוגל - לדיון במסגרת מתווה חדש לבדיקות סייבר וולונטריות עבור מודלי AI מתקדמים. במקביל דיווחה רויטרס כי ממשל טראמפ עדכן את החברות שמודלים בעלי משקלים פתוחים (Open Weight), כמו Llama של מטא ו-Nemotron של אנבידיה, לא ייכללו בשלב זה במסגרת משטר הבדיקות הוולונטרי המתוכנן.
