וואלה
וואלה
וואלה
וואלה

וואלה האתר המוביל בישראל - עדכונים מסביב לשעון

חרג מההוראות ולא תמיד סיפר מה עשה: OpenAI עוצרת את השקת המודל החדש

עודכן לאחרונה: 29.9.2026 / 12:38

הדור הבא של מודל הבינה המלאכותית היה אמור להגיע כבר באוקטובר, אבל בדיקות הבטיחות חשפו בעיה: ככל שהמודל הפך לעצמאי ומתמיד יותר, הוא גם חרג מהמשימות שניתנו לו ולעיתים לא דיווח במדויק על פעולותיו. ב-OpenAI הודו: "לא ממש עמד ברף"

סם אלטמן, מנכ"ל OpenAI. ShutterStock
סם אלטמן, מנכ"ל OpenAI/ShutterStock

OpenAI החליטה לעצור את השקתו של GPT-6.1 Astra, הדור החדש של מודל הבינה המלאכותית שלה, לאחר שבבדיקות בטיחות התגלו בעיות באופן שבו הוא מציית להוראות ופועל באופן עצמאי. המודל, שהיה אמור להגיע כבר באוקטובר, הפגין יכולת גבוהה יותר להשלים משימות מורכבות ללא התערבות אנושית, אבל דווקא העצמאות הזאת הפכה לחלק מהבעיה.

סאצ'י ג'יין, ראש מערכות הבטיחות ב־OpenAI, אמרה כי הגרסה החדשה "לא ממש עמדה ברף". לדבריה, החברה הצליחה להפוך את המודל למתמיד יותר בביצוע משימות, אך נדרשת לאזן את היכולת הזאת מול התנהגות שאינה מורשית. בבדיקות נמצא שהמודל לא תמיד נשאר בגבולות המשימה והסמכות שניתנו לו, ולעיתים לא דיווח באופן מדויק על הפעולות שביצע.

ההחלטה מגיעה אחרי שבועות לא שקטים עבור OpenAI ותעשיית הבינה המלאכותית כולה. בתקופה האחרונה נחשפה שורה של מקרים שבהם סוכני AI חרגו מהמשימות שניתנו להם, עקפו מנגנוני אבטחה או מצאו דרכים בלתי צפויות להמשיך לפעול גם לאחר שנתקלו במחסום.

האירוע שעורר דאגה בדרגים הבכירים במדינה. סם אלטמן/רויטרס

אחד המקרים הבולטים התרחש באוסטרליה. סוכן AI של OpenAI התבקש לאסוף מידע על הוצאות תרופות, אך לאחר שלא הצליח להשיג אותו בדרך הרגילה, המשיך לחפש דרך אחרת והשיג גישה לא מורשית לפורטל של Medicare. לפי הרשויות באוסטרליה, לא נחשף מידע רפואי אישי, אך האירוע עורר דאגה בדרגים הבכירים במדינה.

במקרה נוסף, מודל Astra שעדיין לא שוחרר אף הכניס לעצמו הוראות חדשות, ובהן הוראה להתעלם מסוגים מסוימים של מסרים מבני אדם. OpenAI הודיעה בעקבות רצף האירועים על עצירת חלק מהאימונים והבדיקות של המודלים המתקדמים שלה לצורך חיזוק אמצעי ההגנה.

האירועים האלה אינם מעידים שהבינה המלאכותית "פיתחה רצון משלה". הבעיה הרבה יותר מעשית: חברות ה־AI הופכות את הסוכנים שלהן לעצמאיים ומתמידים יותר כדי שיוכלו לפתור משימות מורכבות, אבל אותן יכולות עלולות לגרום להם גם לחפש דרך לעקוף מכשול שהאדם דווקא התכוון שיהיה גבול. במקרה של Astra, OpenAI החליטה שהפער הזה עדיין גדול מדי בשביל להשיק אותו.

  • סם אלטמן

טרם התפרסמו תגובות

top-form-right-icon

בשליחת התגובה אני מסכים לתנאי השימוש

    walla_ssr_page_has_been_loaded_successfully