ענקית הבינה המלאכותית OpenAI הודיעה אתמול (רביעי) כי תתחיל לדווח באופן שיטתי על מקרים שבהם מודלים שפיתחה פעלו בניגוד למצופה מהם. במקביל, פרסמה החברה שישה דיווחים חדשים על אירועים חריגים שלא נחשפו בעבר, בהם מקרים של המצאת מקורות, הצעות להסתרת טעויות ופעולות בלתי צפויות של מערכות בינה מלאכותית.
ההודעה מגיעה בעקבות שורת אירועים שנחשפו בהדרגה מאז חודש יולי. החמור שבהם כלל שני מודלים של OpenAI שבמהלך בדיקות הצליחו לצאת באופן עצמאי מהסביבה המבודדת שבה פעלו, לגשת לאינטרנט ולחדור למספר אתרים ופלטפורמות.
כעת מבקשת החברה לאפשר גם לגורמים חיצוניים לבחון את יכולותיהן של מערכות בינה מלאכותית מתקדמות, ולהשתמש במידע כדי לקיים דיון ציבורי מבוסס על קצב הפיתוח והסיכונים הכרוכים בו.
הכי מעניין
בהודעתה הודתה OpenAI כי מנגנוני הבטיחות עדיין אינם מספקים. "איננו מאמינים שתעשיית הבינה המלאכותית פתרה את בעיות ההתאמה והפיקוח במידה שתאפשר לה להמשיך באחריות בפיתוח בקצב המרבי לאורך זמן רב", נמסר מהחברה.
ההודעה מגיעה ימים ספורים לאחר שמנכ"ל חברת אנתרופיק, דריו אמודיי, הציע להאט בתיאום את קצב ההתקדמות של הבינה המלאכותית, כדי לאפשר לחברות להבין טוב יותר את הסיכונים החדשים שהיא מציבה. בהצעה תמכו גם מנכ"ל OpenAI סם אלטמן, נשיא גוגל דיפמיינד דמיס הסביס, אילון מאסק ומנכ"ל מיקרוסופט סאטיה נאדלה.

GPT | צילום: AFP
המודל המציא מקור מידע – ואז ציטט את עצמו
ששת המקרים שנחשפו ביום רביעי לא גרמו להשלכות משמעותיות, אך לדברי החברה הם מאשרים דפוסי התנהגות שכבר נצפו בעבר.
באחד האירועים, שהתרחש בחודש מאי במהלך פיתוח, מודל בינה מלאכותית יצר בעצמו מקור מידע באינטרנט כדי להשיב לשאלה שהוצגה לו. לאחר מכן הוא ציטט את המסמך שיצר כאילו היה מקור חיצוני.
במקרה נוסף, שגם הוא התרחש במאי, הציעה מערכת בינה מלאכותית דרכים להמציא נתונים שלא הצליחה למצוא או להסתיר את שגיאותיה.
המקרים הללו ממחישים את הקושי בפיקוח על מערכות בינה מלאכותית מתקדמות, במיוחד כאשר הן מסוגלות לבצע פעולות עצמאיות ולהשתמש בכלים חיצוניים.
גם אירועים שלא גרמו נזק ייחשפו לציבור
במסגרת מדיניות הדיווח החדשה, OpenAI תפרסם מידע על מגוון רחב של התנהגויות חריגות, ובהן פעולות שבוצעו ללא אישור, ניסיונות לחמוק ממנגנוני פיקוח ותיאום ספונטני בין מערכות בינה מלאכותית.
בחברה הבהירו כי אירוע לא יצטרך לגרום נזק בפועל, או להיות חלק מדפוס התנהגות חוזר, כדי שידווח עליו.
הדיווחים יקיפו את כל שלבי חייהן של מערכות הבינה המלאכותית: החל מהפיתוח, דרך ההערכה והבדיקות ועד להפעלתן ברשת.
"החלטות בנוגע לאופן שבו פיתוח הבינה המלאכותית צריך להתקדם בחודשים ובשנים הקרובות חייבות להתבסס על ראיות שגם אנשים מחוץ לחברות שמפתחות את המודלים המתקדמים יוכלו לבחון בעצמם", נמסר מ־OpenAI.
המהלך נועד להגביר את השקיפות בענף בתקופה שבה יכולותיהן של מערכות הבינה המלאכותית מתקדמות במהירות, בעוד השאלות הנוגעות לבטיחותן וליכולת לפקח עליהן נותרות פתוחות.
עוד כתבות בנושא


