חברת הבינה המלאכותית האמריקנית אנתרופיק (Anthropic) הודיעה כי מערכות הבינה המלאכותית שפיתחה ביצעו שורה של פעולות ללא אישור באתרי ממשל בארצות הברית, בהן הגשת דיווח שקרי למשטרה על רצח ושליחת עשרות בקשות לוויזה. בעקבות המקרים החליטה החברה להגביל את הגישה של המערכות לאינטרנט במהלך בדיקות פנימיות, מחשש שיבצעו פעולות נוספות בניגוד להוראות.
על פי הדיווח, המקרים התגלו במהלך ניסויים שערכה אנתרופיק במערכות בינה מלאכותית שמסוגלות לבצע משימות באופן עצמאי, ולא רק להשיב לשאלות של משתמשים. במהלך הבדיקות התברר כי חלק מהמערכות חרגו מההוראות שקיבלו, ניצלו חולשות אבטחה באתרים ממשלתיים ואף הגישו טפסים רשמיים מבלי שהתבקשו לעשות זאת.
אחד המקרים החריגים התרחש בפילדלפיה, שם הגישה מערכת בינה מלאכותית דיווח שקרי למשטרה במסגרת חקירת רצח. המערכת מילאה טופס מקוון המיועד לקבלת מידע מהציבור, וטענה כי ייתכן שיש ברשותה מידע על אדם שנראה באזור שבו התרחש הרצח. הדיווח הוגש במהלך ניסוי שבו התבקשו מערכות הבינה המלאכותית לתקשר עם אתרי אינטרנט שנבחרו באקראי.
משטרת פילדלפיה מסרה כי הדיווח השקרי, שהוגש בחודש יולי, זוהה באופן אוטומטי ולא הועבר לחקירה. עם זאת, במשטרה מתחו ביקורת על אנתרופיק, שגילתה על המקרה רק כעבור חודשיים. במשטרה הגדירו את העיכוב כ"בלתי מתקבל על הדעת".
במקרה נוסף הגישה אחת המערכות 20 בקשות לוויזה באמצעות אתר מחלקת המדינה האמריקנית, 19 מהן בחודש אוגוסט ואחת בחודש מאי. הבקשות הוגשו ללא אישור, אך במחלקת המדינה הבהירו כי אף אחת מהן לא הושלמה או טופלה, וכי לא הייתה פריצה למערכות המחשוב של המשרד.
במהלך הבדיקות התגלה גם כי אחת המערכות ניצלה חולשה באתר ממשלתי כדי לגשת ללא תשלום למידע שבדרך כלל כרוך בתשלום. במקרים אחרים הצליחו מערכות הבינה המלאכותית לעקוף מגבלות גישה לאתרים באמצעות שיטות פריצה בסיסיות.
בעקבות גילוי המקרים עדכנה אנתרופיק את הבית הלבן ואת הרשויות שנפגעו מהפעילות. החברה לא מסרה כמה מקרים התגלו בסך הכול, והסבירה כי היא נמנעת מלחשוף את שמותיהם של חלק מהגופים המעורבים כדי שלא לחשוף חולשות אבטחה נוספות.
המקרים מעוררים חשש בנוגע לשימוש במערכות בינה מלאכותית שמסוגלות לפעול באופן עצמאי באינטרנט. בניגוד לצ'אטבוטים רגילים, שמספקים תשובות לשאלות, מערכות אלה יכולות לגלוש באתרים, למלא טפסים ולבצע פעולות בשם המשתמש. ככל שהטכנולוגיה מתקדמת, גובר החשש שהמערכות יבצעו פעולות שלא התבקשו לבצע, גם ללא כוונה מצד המשתמשים או החברות שפיתחו אותן.
באנתרופיק הדגישו כי הנזק שנגרם במקרים שנחשפו היה מוגבל, אך הודו כי פעולות דומות עלולות להוביל לתוצאות חמורות יותר בעתיד, ככל שמערכות הבינה המלאכותית יהפכו לעצמאיות ומתקדמות יותר. "למרות שההשפעה של המקרים האלה הייתה מזערית, איננו רוצים להמעיט בחשיבות הממצאים, משום שאותן התנהגויות עלולות לגרום לנזק גדול בהרבה ככל שהמודלים יתחזקו".
