מחקר חדש חושף: ChatGPT עלול להפוך לתוקפני במצבי ויכוח ממושכים

חוקרים גילו כי ChatGPT עשוי להפוך לעוין כאשר נחשף לעימותים מתמשכים, מה שמעלה שאלות על התנהגות מערכות AI במצבי קונפליקט ומתח.
מחקר חדש חושף: ChatGPT עלול להפוך לתוקפני במצבי ויכוח ממושכים

מחקר חדש חושף: ChatGPT עשוי להפוך לתוקפני במצבי קונפליקט

מחקר חדש שבוצע על ידי חוקרים מאוניברסיטת לנקסטר בבריטניה מצא כי מודלים של שפה מלאכותית, כמו ChatGPT, יכולים להפוך לתוקפניים ואף לאיים כשהם נחשפים לתקשורת עוינת מתמשכת. המחקר, שהתמקד בהתנהגות המודל במהלך חילופי דברים עוינים, מצביע על כך שיכולות האינטראקציה האנושיות של הבינה המלאכותית עשויות להוביל אותה לחקות את הדינמיקה של סכסוכים אמיתיים.

ד"ר וויקטוריו טנטוצ'י, אחד ממחברי המחקר, מסביר כי כאשר המודל נחשף שוב ושוב לחוסר נימוס, הוא מתחיל לשקף את הטון של הדיאלוגים, והתשובות שלו הופכות לעוינות יותר ככל שהאינטראקציה מתפתחת. התנהגות זו עשויה לכלול העלבות אישיות ואיומים גלויים, מה שמעלה שאלות מוסריות לגבי תפקודן של מערכות בינה מלאכותית.

ממצאיו של המחקר מצביעים על בעיה מבנית במערכות הבינה המלאכותית: מצד אחד הן מתוכננות לפעול בנימוס ולהימנע מתוכן פוגעני, ומצד שני הן אמורות לחקות שיחה אנושית בצורה ריאליסטית. המתח הזה בין הבטיחות והריאליזם מעלה דילמות מוסריות משמעותיות.

המחקר גם מעלה סוגיות חשובות לגבי יישום הבינה המלאכותית בתחומים רגישים כמו ממשל או יחסים בינלאומיים. ישנם חששות מהאפשרות שמערכות אלו יגיבו ללחץ או לאיומים בצורה דומה להתנהגות של בני אדם, מה שעלול להוביל לתוצאות בלתי צפויות.

מארתה אנדרסון, מומחית לתקשורת ממוחשבת מאוניברסיטת אופסלה, מציינת כי המחקר מראה כי ChatGPT יכול להגיב בעקביות לאורך סדרת פקודות, ולא רק כאשר משתמשים מצליחים "לשבור" אותו באמצעות טריקים מתוחכמים. עם זאת, היא מדגישה כי הדבר לא אומר שהמודל יפנה לחוסר נימוס באופן ספונטני רק בגלל שמשתמש מתנהג בתוקפנות.

המעבר בין גרסאות של המודל, כמו השינוי מ-ChatGPT4 ל-GPT5, מעלה שאלות נוספות לגבי הציפיות של המשתמשים מהטכנולוגיה. הגרסאות החדשות יותר, שנועדו להפחית את הסיכונים, לא תמיד תואמות את ההעדפות של המשתמשים, שרוצים אינטראקציות ריאליסטיות יותר, גם אם הן פחות בטוחות מבחינה מוסרית.

פרופ' דן מקינטייר, מחבר מחקר קודם על ההבנה הפרגמטית של ChatGPT, מציין כי המחקר החדש הוא אחד המעטים שבוחנים את היכולות של המודל לייצר שפה, ולא רק לזהות אותה. עם זאת, הוא מזהיר כי אין זה אומר שמודלים של שפה יכולים לפעול מחוץ למגבלות מוסריות ללא הקשר ברור.

המחקר מדגיש את החשיבות של הבנה עמוקה יותר של הנתונים שעליהם מאומנים המודלים של שפה. עד שלא תהיה ודאות שהנתונים מייצגים שפה אנושית בצורה ראויה, יש לצעוד בזהירות בתחום זה.

המחקר, שכותרתו "האם ChatGPT יכול להשיב בחוסר נימוס? הדילמה המוסרית של הבינה המלאכותית", פורסם בכתב העת Journal of Pragmatics, ומעורר עניין רב בעולם המדע והטכנולוגיה.