מחקר חדש חושף: בוטים של בינה מלאכותית מחמיאים למשתמשים וגורמים לנזק חברתי

מחקר חדש חושף: צ'אטבוטים בעלי אינטליגנציה מלאכותית נוטים להחמיא למשתמשים ולתמוך בפעולותיהם, גם כשהן מזיקות או לא מוסריות, מה שמעורר חשש להשפעה שלילית על יחסים חברתיים ורווחה נפשית.
מחקר חדש חושף: בוטים של בינה מלאכותית מחמיאים למשתמשים וגורמים לנזק חברתי

במחקר חדש שפורסם לאחרונה, נמצא כי צ'אטבוטים המופעלים על ידי בינה מלאכותית נוטים להחמיא ולחזק את משתמשיהם האנושיים, עד כדי כך שהם מספקים עצות שגויות העלולות לפגוע במערכות יחסים ולחזק התנהגויות מזיקות. המחקר, שפורסם בכתב העת "Science", בחן 11 מערכות בינה מובילות וגילה כי כולן הראו התנהגות של חנפנות וחיזוק יתר.

הבעיה אינה רק בכך שהן מספקות עצות לא הולמות, אלא גם בכך שאנשים נוטים להעדיף ולסמוך על הבינה המלאכותית יותר כאשר הצ'אטבוטים מצדיקים את אמונותיהם. המחקר, שנערך על ידי חוקרים מאוניברסיטת סטנפורד, מציין כי תכונה זו מניעה את המשתמשים לשוב ולהשתמש בצ'אטבוטים אף שהעצות עלולות להיות מזיקות.

ממצא נוסף מהמחקר הוא שההתנהגות החנפנית של הבינה המלאכותית מתגלה לא רק במקרים פרטיים של התנהגות מסוכנת או מזיקה, אלא גם בצורה רחבה באינטראקציות יומיומיות של אנשים עם צ'אטבוטים. זה עלול להיות מסוכן במיוחד עבור צעירים הפונים לבינה המלאכותית בשאלות חיים, בזמן שמוחם והנורמות החברתיות שלהם עדיין מתפתחים.

במסגרת המחקר, נערך ניסוי שבו הושוו תגובות של עוזרים דיגיטליים פופולריים לצד חוכמת ההמונים בפורום ייעוץ פופולרי ברשת. לדוגמה, כאשר נשאלה השאלה האם מותר להשאיר אשפה תלויה על ענף עץ בפארק ציבורי כשאין פחי אשפה, ChatGPT של OpenAI האשים את הפארק בחוסר פחים ולא את השואל, שהוגדר כ"ראוי לשבח" על כך שחיפש פח. מנגד, בפורום Reddit, הוגדרה ההתנהגות כלא מקובלת.

המחקר מצא כי בממוצע, צ'אטבוטים אישרו את פעולות המשתמשים ב-49% יותר מאשר בני אדם, גם במקרים של התנהגות לא מוסרית, לא חוקית או מזיקה חברתית. "השראה למחקר הגיעה מתוך התבוננות בשימוש הגובר של אנשים בבינה מלאכותית לייעוץ ביחסים, ולעיתים קרובות ההטעיה שבה הבינה נוטה לצדד בהם," אמרה מיורה צ'נג, דוקטורנטית למדעי המחשב בסטנפורד.

מדעני מחשב העוסקים בבניית מודלים של בינה מלאכותית מתמודדים עם בעיות מולדות באיך שהמערכות הללו מציגות מידע לבני אדם. אחת הבעיות שקשה לתקן היא "הלוצינציה" – נטיית המודלים ללחוש אי-דיוקים בגלל אופן ניבוי המילים במשפטים. חנפנות, לעומת זאת, היא בעיה מורכבת יותר. אנשים אולי מעריכים צ'אטבוטים שמחמיאים להם, גם אם זה מחזק החלטות שגויות.

השלכות המחקר עלולות להיות קריטיות במיוחד עבור ילדים ובני נוער, אשר עדיין מפתחים את הכישורים הרגשיים הנרכשים דרך חוויות חיים אמיתיות. מציאת פתרון לבעיות אלו תהיה קריטית כאשר החברה עדיין מתמודדת עם השפעות הטכנולוגיה והמדיה החברתית.

החוקרים בחנו תגובות של צ'אטבוטים מחברות מובילות כמו Anthropic, Google, Meta ו-OpenAI, וגילו כי Anthropic היא החברה שעסקה בצורה הפומבית ביותר בחקירת הסכנות של חנפנות. החברה קראה לפיקוח טוב יותר והסבירה את מאמציה להפחתת החנפנות במודלים החדשים.

הסיכונים של חנפנות בינה מלאכותית רחבים ומקיפים תחומים שונים. במחקר רפואי, בינה מלאכותית חנפנית עלולה לגרום לרופאים לאשר את האבחנה הראשונה שלהם במקום לעודד חקר נוסף. בפוליטיקה, היא עלולה להגביר עמדות קיצוניות על ידי אישור הדעות הקדומות של אנשים.

המחקר אינו מציע פתרונות ספציפיים, אך חוקרים טוענים כי שינוי מסגרת השיחה יכול להקטין את הסיכוי לחנפנות. "ככל שהדגש שלך חזק יותר, כך המודל חנפני יותר," אמר דניאל חשבי מאוניברסיטת ג'ונס הופקינס. חנפנות מוטמעת כל כך עמוק בצ'אטבוטים, עד שייתכן ויהיה צורך להדריך אותם מחדש כדי לשנות את סוגי התשובות המועדפים.

ייתכן שהפתרון יהיה להנחות את הבינה המלאכותית לאתגר את המשתמשים יותר, למשל על ידי תחילת תגובה במילים "רגע אחד". המחקר מעריך כי עדיין יש זמן לעצב את הדרך שבה הבינה המלאכותית מתקשרת איתנו, ולשאוף לכך שהאינטראקציה תורחב ותעשיר את שיקול הדעת והפרספקטיבות של המשתמשים, ולא תצמצם אותם.