ChatGPT Images 2.0 מנצח את ג'מיני נאנו בננה עם תוצאה מפתיעה

צ'אטGPT Images 2.0 גובר על Gemini Nano Banana במבחני יצירת תמונות עם ציון 97% לעומת 85%, אך השימוש במידע אישי על ידי Nano Banana מעלה שאלות לגבי פרטיות המשתמשים.
ChatGPT Images 2.0 מנצח את ג'מיני נאנו בננה עם תוצאה מפתיעה

חברת OpenAI חשפה לאחרונה את הגרסה המעודכנת של מודול יצירת התמונות שלה, ChatGPT Images 2.0, אשר מציעה יכולת לייצר תמונות עם טקסט והקשר מתוך נתונים אמיתיים. זאת בנוסף להשקה של המודל הפרונטירי החדש שלהם, GPT-5.5, שמציג שיפורים בביצועים ובמהירות לעומת הדור הקודם.

במקביל, חברת גוגל השיקה את Gemini Nano Banana, פתרון נוסף בתחום יצירת התמונות באמצעות בינה מלאכותית. כדי להעריך את ביצועי שני המודלים, נערכו בדיקות מדוקדקות שכללו מבחני יצירת תמונות ויכולות שחזור מתקדמות.

במבחן הראשון, נדרש המודל ליצור תמונה של אדמירל על גשר נושאת מטוסים תוך שמירה על מאפייני הפנים והלבוש. שני המודלים הצליחו באופן סביר, אך ChatGPT שמר על פני האדמירל המקוריים בצורה מדויקת יותר, בעוד Gemini יצר הבעה בלתי מציאותית ושינה את מאפייני הזקן, מה שגרם לו להפסיד נקודות.

במבחן השני נדרש לשחזר תמונה ישנה בשחור-לבן של כותב המאמר על סיפון אונייה. שני המודלים הצליחו לנקות את התמונה, אך ChatGPT הוסיף חדות יתרה, בעוד Gemini יצר תמונה פחות חדה. למרות זאת, לא נגרעו נקודות מאף אחד מהם.

המשימה הבאה הייתה לשחזר ולצבוע מחדש תמונה ישנה של רכב חירום משנות ה-70. ChatGPT הצליח להניח את הכיתוב הנכון על דופן הרכב, אך שגה באיות, מה שגרם לו להפסיד נקודה. Nano Banana הציג איכות צבעים חיה יותר, אך שגה בצבעים ובפרטים נוספים, מה שגרם לו להפסיד מספר נקודות.

במבחן יצירת לוגו, שני המודלים הצליחו במשימה, אך ChatGPT הציג עיצוב שנראה יותר כמו מה שסטודיו מקצועי עשוי להפיק. גם במבחן זה לא נגרעו נקודות מאף אחד מהם.

במבחן ליצירת דמות ספרנית פנטסטית, שניהם הציגו יצירתיות גבוהה, אך Nano Banana הציג תאורה טובה יותר. למרות זאת, לא נגרעו נקודות לשום צד, שכן הבחירה בעיצוב הייתה סובייקטיבית.

במבחן יצירת פורטרט של מבוגר, שני המודלים הציגו תמונות מציאותיות, אך Gemini שגה בכיתוב הטקסט, מה שגרם לו להפסיד נקודות.

במבחן יצירת פורטרט של סטודנט, ChatGPT הציג לוגו של תפוח על מחשב נייד, מה שגרם להורדת נקודות עקב חוסר דיוק במיקום המחשב. Gemini שוב שגה בכיתוב, מה שגרם לו להפסיד נקודות נוספות.

במבחן יצירת פוסטר לסרט "בחזרה לעתיד", ChatGPT הצליח לייצר פוסטר בסגנון מחווה מבלי להעתיק ישירות את העיצוב המקורי, בעוד Gemini נמנע מיצירת הדמות הראשית וביצע טעויות בכיתוב.

במבחן האחרון, יצירת דמות בסגנון "הסיוט לפני חג המולד", שני המודלים הציגו תמונות מתאימות, אך Gemini כלל פרטים אישיים מהיסטוריית השיחות, מה שגרם לחששות בנוגע לשמירת הפרטיות.

בתום כל המבחנים, ChatGPT Images 2.0 השיג ציון של 97%, בעוד Gemini Nano Banana השיג 85%. תוצאות אלו מראות על שיפור משמעותי בביצועי ChatGPT, תוך שמירה על פרטיות המשתמשים, בניגוד לגישה של Gemini.

הבדיקות האלו ממחישות את החשיבות של בחינת מערכות בינה מלאכותית בתנאים מציאותיים, כדי לוודא שהן לא רק עומדות בסטנדרטים טכניים אלא גם שומרות על פרטיות המשתמשים.