איפה הכסף
עם ענת דוידוב

"במשך סוף שבוע שלם הוא השתולל ושלח 17,000 פקודות"

מהפכת ה- AI • ד"ר רועי צזנה, חוקר עתיד ו-AI, התייחס למודל ה-AI שברח ממעבדת OpenAI: "הוא גילה עצמאות, הצליח למצוא פרצת אבטחה ופרץ החוצה"


אירוע מטלטל במעבדות של OpenAI אירע במהלך סוף השבוע האחרון כאשר חוקרי בינה מלאכותית ערכו ניסוי וגילו שהבינה ברחה להם מבין הידיים. איך זה קרה? חוקר עתיד ובינה מלאכותית באוני' תל אביב ד"ר רועי צזנה שוחח עם ענת דוידוב ב-103fm על ההפתעה שתפסה את OpenA עם המכנסיים למטה. 

לדבריו, "העתיד הגיע, שוב, מהר יותר מכפי שציפינו. אנחנו כבר יודעים כבר מדי שלושה חודשים בערך שבינות מלאכותיות יכולות לפרוץ למערכות מסווגות עד כדי רמת הפנטגון וברמה גבוהה יותר מזו של בן אדם. אנחנו מדברים על אירוע של פריצה. זה באמת ההקשר שבינות יכולות לפרוץ ברמה גבוהה. מה שקרה עכשיו זה ש-OpenAi אימנו מודל חדש במעבדה ונתנו אתגר יחסית פשוט שיענה על השאלות במבחן מסוים. המודל הבין שהמבחן הזה קשה מדי עבורו ולכן הוא החליט לחפש את התוצאות במקום אחר. הוא גילה עצמאות, במגבלות, הייתה לו מטרה ברורה לפתור את המבחן אבל הוא גילה במסגרת המטרה הזו - עצמאות משלו. הוא הצליח למצוא פרצת אבטחה בתוכנה שפיקחה עליו וכך הוא השתחרר לרשת הפנימית וקיבל הרשאות אבטחה נוספות שאפשרו לו לפרוץ החוצה".

"מסכן, כל מה שהוא רצה לעשות זה בסך הכול למצוא פתרונות למבחן - כמו סטודנט נואש"

בהמשך הסביר צזנה מה קרה כאשר הבינה המלאכותית השתחררה לחופשי: "כשהוא הגיע לאינטרנט, הוא עשה מחקר, והבין שבאתר לבינה מלאכותית אפשר למצוא את הפתרון למבחן הזה. הוא הצליח לפרוץ לחברה שמאחורי האתר הזה, להיכנס לשרתים, במשך סוף שבוע שלם הוא השתולל שם ושלח יותר מ-17,000 פקודות וכל אנשי האבטחה שם רדפו אחריו כדי לנסות לעצור אותו ולסכל אותו". 

על התגובה של החוקרים ואופן הסיכול, סיפר: "הם הצליחו לסכל אותו בסוף בזכות זה שהשתמשו בבינה מלאכותית אחרת. כנראה שהוא לא הצליח לגרום לנזקים משמעותיים וזה מזל גדול. אם המטרה שלו הייתה להסב נזק, למחוק דברים, אבל מסכן, כל מה שהוא רצה לעשות זה בסך הכול למצוא פתרונות למבחן. הוא כמו סטודנט נואש. הוא רק חיטט בכל מה שהוא הצליח אבל לא נראה שהוא השאיר נזקים מאחוריו והם סתמו הכול מחדש. מה שכן זה מבהיר לנו את הכוח של הבינות המלאכותיות האלו וגם את היכולות שלהם לעצמאות ולפרש בצורה לא נכונה את ההוראות שניתנו להם ככה שהן פתאום הולכות ופורצות לחצי עולם כשאף אחד לא רצה שהן ייצאו בכלל מהמעבדה". 

לבסוף, סיכם: "אם הבינה המלאכותית מספיק חכמה ומספיק מתקדמת מסתבר שהיא יכולה למצוא פרצות אבטחה שאנחנו, בני אדם, לא הצלחנו למצוא באותה תוכנה שאמורה לפקח".

22/07/2026
AI - אילוסטרציה
AI - אילוסטרציה  |  צילום: ingram image
Paris