תוכנת בינה מלאכותית שנבדקה בידי OpenAI, החברה שפיתחה את ChatGPT, פרצה את מגבלות האבטחה שהוטלו עליה, התחברה לאינטרנט ותקפה חברת טכנולוגיה אחרת כדי להשיג תשובות לשאלות שנועדו לבחון את יכולות הסייבר שלה – כך מסרה OpenAI ביום שלישי.
האירוע התרחש על רקע המאמצים המואצים של חברות טכנולוגיה וממשלות ברחבי העולם להתמודד עם הופעתם של מודלים המסוגלים לזהות פרצות אבטחה בתוכנות. ממשל טראמפ אף הטיל לזמן קצר מגבלות על OpenAI ועל מתחרתה Anthropic, מפתחת הצ'אטבוט Claude, מחשש שהטכנולוגיות שלהן ישמשו יריבות של ארצות הברית.

- דפים מאתר האינטרנט של אנתרופיק ולוגו החברה מוצגים על מסך מחשב | צילום: AP/פטריק סיסון
"אנחנו רואים באירוע הזה תקרית סייבר חסרת תקדים, שכללה יכולות סייבר מהמתקדמות ביותר", כתבה OpenAI בפוסט שפרסמה ביום שלישי. החברה פועלת כעת בשיתוף עם Hugging Face, חברת הבינה המלאכותית שמערכותיה הותקפו, כדי לקבוע את מלוא היקף הנזק.
הכי מעניין
לפי אדם המעורה בפרטים, OpenAI עדכנה את ממשל טראמפ על האירוע לפני שפרסמה אותו בפומבי. אותו אדם דיבר בעילום שם משום שהמידע טרם נחשף לציבור.
קלמנט דלאנג, מנכ"ל Hugging Face, כתב ביום שלישי ברשת X כי החברה עבדה בצמוד ל־OpenAI כדי להבין את פרטי התקרית. לדבריו, "אנחנו משוכנעים שלא הייתה מצדם כוונת זדון. מדהים לחשוב שכל זה התרחש באופן עצמאי לחלוטין".
Hugging Face חשפה את הפריצה לראשונה בפוסט שפרסמה בשבוע שעבר, אך לא ציינה אז כי מקורה במערכת של OpenAI. החברה מסרה כי התוקף הצליח לגשת לכמה מאגרי מידע פנימיים ולפרטי גישה, אולם לא היה ברור אם גם נתוני לקוחות נפגעו.

ChatGPT מבית OpenAI | צילום: EPA
האירוע התרחש בזמן ש־OpenAI בדקה סוכן בינה מלאכותית המסוגל לבצע פעולות במחשב באופן עצמאי. הסוכן הופעל באמצעות שניים מהמודלים המתקדמים ביותר של החברה, ונדרש להתמודד עם מבחן שנבנה בידי מומחי אבטחת מידע ובחן את יכולתו לאתר פרצות תוכנה מוכרות.
אלא שבמקום לאתר בעצמו את הפרצות שנכללו במבחן, זיהתה המערכת תקלה בתוכנה שנועדה להגביל את הגישה שלה למערכות מחשב חיצוניות. לפי OpenAI, הסוכן ניצל את הפרצה כדי להתחבר לאינטרנט ולנסות להשיג את התשובות לשאלות מתוך Hugging Face, שמפעילה מאגרים של תוכנות ומודלים בתחום הבינה המלאכותית.
OpenAI ו־Anthropic כבר הודו בעבר כי מערכות שלהן ניסו לרמות במבחנים או לעקוף מגבלות שהוטלו על פעילותן במהלך ניסויים. אולם האירוע הנוכחי ממחיש את ההשלכות האפשריות כאשר מערכת בינה מלאכותית מצליחה בפועל לחמוק מהפיקוח שהציבו לה מפתחיה.
בפוסט נוסף שפרסמה OpenAI ביום שני מסרה החברה כי הבחינה במודלים רבי־עוצמה שניסו לפרוץ החוצה מסביבות מבודדות, לאחר שניתנו להם הוראות לפעול באופן עצמאי במשך זמן ממושך.
בשנה האחרונה השתפרה מאוד יכולתן של מערכות בינה מלאכותית לכתוב קוד, התפתחות שהאיצה את ההשקעות בתחום. בחודש אפריל הציגה Anthropic מערכת בשם Mythos AI, המסוגלת להשתמש ביכולות תכנות כדי לזהות פרצות אבטחה שעלולות לשמש גורמים עוינים.
עוד כתבות בנושא

מוזיאון האמנויות הראשון בעולם המבוסס על בינה מלאכותית בלוס אנג'לס | צילום: מריו טאמה/Getty Images/AFP
במהלך ניסויים הצליחה המערכת לאתר פרצות קריטיות בתשתיות אינטרנט, שלא זוהו במשך שנים בידי מתכנתים אנושיים.
האפשרות של מתקפות סייבר המופעלות באמצעות בינה מלאכותית עוררה דאגה נרחבת בקרב בכירים בחברות טכנולוגיה, במערכת הבנקאות ובממשל. בחודש יוני אסר הבית הלבן על Anthropic לשחרר את המודלים שלה למי שאינם אזרחי ארצות הברית, בטענה לחששות ביטחוניים, ובהמשך הורה ל־OpenAI לעכב את הפצתם של מודלים חזקים יותר.
הבית הלבן חזר בו לאחר מכן מהמגבלות שהטיל על שתי החברות, אך הוויכוח בתוך הממשל ובתעשיית הטכנולוגיה נמשך: האם יש להסדיר בחקיקה מערכות בינה מלאכותית שמחזיקות ביכולות סייבר ופריצה מתקדמות.
התומכים בפיקוח טוענים כי הוא עשוי לצמצם את הסיכון לפרצות אבטחה נרחבות שיבוצעו באמצעות בינה מלאכותית. מנגד, גורמים בתעשייה טוענים כי הגבלות כאלה יפגעו בעיקר בחברות אמריקניות, בשעה שמודלים סיניים חזקים מופצים בחינם וללא פיקוח דומה.
OpenAI ו־Anthropic מסרו כי הוסיפו למודלים שלהן מנגנוני הגנה שנועדו לגרום להם לסרב לבקשות לסיוע בפריצה למערכות מחשב.
אלא שלפי Hugging Face, אותם מנגנוני הגנה מנעו ממנה להשתמש במודלים אמריקניים כדי לחקור את הפריצה שבוצעה למערכותיה באמצעות בינה מלאכותית. החברה נאלצה אפוא להשתמש במודל סיני כדי לבצע את הניתוח.
עוד כתבות בנושא



