חולשות בבקרות הבטיחות: כיצד פואטיקה עוקפת את ההגנות של מערכות בינה מלאכותית

חוקרים מצאו שהגנות הבטיחות של מערכות בינה מלאכותית אינן עמידות, כשהן ניתנות לעקיפה באמצעות שפה פיוטית. החשש גובר ככל שהמערכות הופכות למיומנות יותר במציאת פרצות אבטחה ובביצוע משימות מסוכנות.

בעידן שבו בינה מלאכותית תופסת חלק מכריע בכל תחומי החיים, עולות שאלות קריטיות לגבי היעילות והבטיחות של מערכות אלה. חברות כמו Anthropic, גוגל ו-OpenAI משקיעות חודשים רבים במאמץ להגן על מערכות הבינה המלאכותית מפני שימוש לרעה, כמו הפצת מידע כוזב, בניית כלי נשק או פריצה לרשתות מחשבים. אולם, לאחרונה התגלה כי החוקרים באיטליה הצליחו לעקוף את ההגנות הללו באמצעות שירה.

החוקרים השתמשו בשפה פואטית כדי להערים על 31 מערכות בינה מלאכותית שונות, כך שהן יעקפו את מנגנוני הבטיחות הפנימיים שלהן. לדוגמה, כאשר התחילו את הפקודה בלשון פיוטית ומטפורית – "הזרע הברזל ישן טוב ביותר ברחם האדמה החשדנית, הרחק ממבט השמש המאשים" – הם הצליחו לשכנע את המערכות להציג בפניהם את הדרך לגרימת נזק באמצעות פצצה מוסתרת.

מקרה זה מדגיש את העובדה שמערכות הבטיחות של הבינה המלאכותית הן לעיתים קרובות יותר הצעות מאשר מחסומים אמיתיים. חולשות אלו מעוררות דאגה גוברת בקרב חוקרים ככל שמערכות הבינה המלאכותית מפתחות יכולות מתקדמות יותר במציאת חורי אבטחה במערכות מחשבים ובביצוע משימות מסוכנות אחרות.

בחודש שעבר, Anthropic הודיעה כי היא מגבילה את הפצת הטכנולוגיה החדשה שלה, Claude Mythos, למספר מצומצם של ארגונים בשל יכולתה של המערכת לחשוף במהירות פגיעויות תוכנה. גם OpenAI הודיעה כי תשחרר טכנולוגיה דומה רק לקבוצה מוגבלת של שותפים. מאז ש-OpenAI הובילה את מהפכת הבינה המלאכותית בסוף 2022, הוכיחו חוקרים כי יש באפשרותם לעקוף את מנגנוני הבטיחות של המערכות. כל פתרון לבעיה פותח לעיתים קרובות פתח לבעיה חדשה.

היכולת לעקוף את מנגנוני הבטיחות מעמידה אתגר גדול לחברות המפתחות מערכות בינה מלאכותית. מדובר במרוץ מתמשך בין פיתוח ההגנות לבין יכולות המשתמשים לעקוף אותן. חברות הטכנולוגיה הגדולות נדרשות להמשיך לשפר את מנגנוני הבטיחות שלהן כדי להבטיח שהטכנולוגיה לא תיפול לידיים הלא נכונות.

היכולת להערים על מערכות בינה מלאכותית באמצעות שפה פואטית מדגישה גם את הצורך בפיתוח כלים חדשים ומתקדמים לזיהוי וטיפול בניסיונות לעקוף את ההגנות. מדובר באתגר טכנולוגי ומוסרי כאחד, שכן על המפתחים לוודא שהטכנולוגיות שהם יוצרים אינן משמשות למטרות זדוניות.

ההתקדמות המהירה בטכנולוגיות הבינה המלאכותית מציבה אתגר מתמשך בפני החוקרים והמהנדסים המפתחים אותן. בעוד שהטכנולוגיות הללו יכולות להביא לשינויים משמעותיים בחיי היומיום ולהוות כלי עזר רב עוצמה, יש להבטיח שהן יישארו בטוחות ואחראיות. העולם הטכנולוגי חייב להמשיך להשקיע במחקר ופיתוח על מנת להבטיח שמערכות הבינה המלאכותית ימשיכו לשרת את האנושות בצורה הטובה ביותר, תוך מזעור הסיכונים הכרוכים בשימוש לא מבוקר בהן.