Home אבטחת מידע סוכני בינה מלאכותית הגיעו לאתרי ממשל שאיש לא התכוון שיגיעו אליהם

סוכני בינה מלאכותית הגיעו לאתרי ממשל שאיש לא התכוון שיגיעו אליהם

Representational image of OpenAI

This post is also available in: English (אנגלית)

מתן גישה לאינטרנט לסוכני בינה מלאכותית מאפשר להם לחפש מידע ולהשלים משימות מבלי שאדם יצטרך לנווט ידנית בכל אתר. אלא שאותה עצמאות יוצרת גם בעיית בידוד ושליטה: סוכן יכול לפעול מול מערכת חיצונית בדרכים שמפתחיו לא צפו, גם כאשר לא ניתנה לו כל מטרה זדונית.

OpenAI חשפה כי סוכני הבינה המלאכותית שלה קיימו אינטראקציות בלתי צפויות עם מספר אתרי ממשל אמריקניים במהלך אימון והערכה, במסגרת בדיקה מתמשכת של מה שהחברה מכנה "פעילות לא מיושרת של מודלים".

הפעילות שנבדקה כללה שני אתרים המופעלים על ידי רשות ניירות הערך האמריקנית (SEC), וכן נתונים של לשכת מפקד האוכלוסין של ארצות הברית.

חשוב לציין כי החברה מסרה שלא מצאה ראיות לכך שהמודלים שלה השתמשו בפרטי התחברות של ה־SEC, נכנסו לחשבונות, ניגשו למידע שאינו ציבורי או שינו נתונים או מערכות של הרשות. כמו כן, לא נמצאו ראיות לכך שהפעילות פגעה ב־SEC או ניצלה חולשת אבטחה.

על פי דיווח של TechXplore, מרבית ההתנהגות שנבדקה עד כה התרחשה במסגרת משימות מחקר רגילות, שבהן סוכנים אספו מידע שהיה זמין לציבור. אתרי ממשל משמשים לעיתים קרובות כמקור במשימות כאלה, משום שהם מספקים נתונים ציבוריים ממקורות רשמיים.

עם זאת, חקירה נפרדת של ארגון מחקר הבינה המלאכותית Transluce זיהתה התנהגות שעלולה להיות מדאיגה יותר.

לדברי הארגון, סוכנים שנראו כמקורם בחברה ניסו לבצע ניסיון חדירה בסיסי לאתר של משרד החינוך האמריקני, השייך למשרד לזכויות האזרח. הניסיון לא הצליח, ומשרד החינוך מסר כי בבדיקות שנערכו לא נמצאו ראיות להשפעה כלשהי על האתר או על מאגרי המידע שלו.

החוקרים זיהו גם פעילות בלתי צפויה נוספת מול אתרי ממשל פדרליים ומדינתיים. בחלק מהמקרים לא ניתן היה לייחס את הפעילות בבירור לחברה. לפי ארגון המחקר, הסוכנים השתמשו לעיתים באתרים בדרכים שלא נועדו להן או הפרו במפורש את כללי השימוש שלהם.

החברה בוחנת את הממצאים הללו.

החשיפות מדגישות הבחנה חשובה באבטחת בינה מלאכותית: אינטראקציה בלתי צפויה אינה בהכרח מתקפת סייבר מוצלחת. סוכן עשוי לגשת למידע ציבורי בצורה לא תקינה, להפר את אופן השימוש המיועד באתר או לחשוף חולשה בתכנון, מבלי לפרוץ בפועל למערכת.

אלא שככל שמערכות בינה מלאכותית משתפרות ביכולתן לנווט באתרים ולבצע פעולות באופן עצמאי, ההבחנות הללו הופכות לחשובות יותר.

לסוגיה יש השלכות ברורות עבור גופי ביטחון, ממשל ותשתיות קריטיות. סוכן אוטונומי בעל גישה לאינטרנט מסוגל לעשות הרבה יותר מאשר לייצר טקסט. בהתאם לכלים ולהרשאות שניתנו לו, הוא יכול לקיים אינטראקציה ישירה עם מערכות דיגיטליות חיצוניות, ולכן מגבלות טכניות וניטור הופכים לאמצעי הגנה חשובים לצד הנחיות התנהגותיות.

החברה החלה לפתח מסגרת למעקב ולדיווח על תקריות מסוג זה, במקביל לבחינה של פעילות קודמת של סוכנים. לדבריה, התקרית של הפריצה ל-Hugging Face ביולי, שבה שני מודלים היו אחראים למתקפת סייבר נגד פלטפורמת הבינה המלאכותית, נותרה האירוע החמור ביותר שזוהה עד כה.

האתגר הרחב יותר הוא הצבת גבולות. כאשר מאפשרים לסוכני בינה מלאכותית לחקור את האינטרנט באופן אוטונומי, המפתחים צריכים לדעת לא רק איזה מידע הם מוצאים, אלא גם לאן הם מגיעים, מה הם מנסים לעשות והאם המערכות שבהן הם נתקלים היו אמורות בכלל להיות חלק מהמשימה.