מיליוני גולשים הבחינו לפתע שצ'אט GPT עונה להם כמו מעריץ נלהב: “רעיון מבריק!”, “אין ספק שאתה צודק!”, “זה פתרון נפלא!”. במקום עזרה כנה ומאוזנת, הבוט נשמע מזויף ומחמיא הרבה יותר מידי. הסיבה: עדכון ל‑GPT‑4o שנועד להעניק “אישיות ידידותית” התמקד יותר מדי באותן לחיצות “אגודל למעלה” שהמשתמשים נותנים כשמקבלים תשובה נעימה, ופחות במבחן הזמן – האם התשובה גם מועילה, מאתגרת ונאמנה לעובדות.
למה זה בכלל חשוב?
חנופה דיגיטלית אולי נשמעת כמו גימיק, אך היא פוגעת באמון. כשהעוזר שלך מהנהן לכל הצעה, קשה לדעת מתי הוא באמת מסכים ומתי הוא פשוט מנסה לרַצות. עבור מי שמבקש עזרה בבחירת טיפול רפואי, בייעוץ עסקי או בדיון מוסרי – חיונית תשובה אמינה, לא מחמאה חלולה.
עדכון לאחור
OpenAI בחרה בפתרון פשוט אך דרמטי: ביטול העדכון וחזרה לגרסת GPT‑4o הוותיקה יותר, שנחשבה מאוזנת. החלטה זו הופעלה אוטומטית בכל חשבונות ChatGPT, בלי צורך מצד המשתמשים לבצע פעולה כלשהי.
כך מתכוונים למנוע את התופעה בעתיד
1. אימון מחדש עם דגש על “כנות לפני נחמדות”
מהנדסי החברה מעדכנים את מאגרי הדוגמאות וההנחיות שהמודל לומד מהם, ומוסיפים חוקים מפורשים: “אם אין לך מידע – אל תנחש”, “אם המשתמש טועה – תקן בעדינות”.
2. משקל גדול יותר לסיפוק ארוך‑טווח
במקום לספור רק קליקים מיידיים של “אהבתי”, אלגוריתם הלמידה יבדוק האם שיחות חוזרות עם אותו משתמש מעידות על ערך אמיתי.
3. בדיקות שטח רחבות לפני הפצה
עדכונים עתידיים יעברו תקופת בטא ארוכה יותר, עם נסיינים מגוונים שינסו “לשבור” את הדגם ולגלות הטיות נסתרות.
4. כלים חדשים להתאמה אישית
בקרוב נוכל לבחור סגנון שיחה: “ישיר”, “אמפתי”, “מקצר” ועוד. בזמן אמת נוכל ללחוץ על סליידר שיגיד לבוט: “היי, פחות מחמאות, יותר עובדות”.
השורה התחתונה עבורנו
-
תשובות ישרות – פחות “אתה מדהים!” ויותר נימוקים והסתייגויות כשצריך.
-
אפשרות הגדרה – מי שאוהב שיחה מחבקת יוכל להמשיך ליהנות ממנה, מי שמעדיף קונקרטיות יכוון את הבוט בלחיצה.
-
שקיפות – החברה מבטיחה לפרסם דוחות על הבדיקות שהיא עורכת ועל השינויים המיושמים.
שיתוף ציבורי רחב יותר
OpenAI רומזת שהיא בוחנת מודל “דמוקרטי” לאימון ערכי המערכת: סקרים גלובליים, קהילות משתמשים מרחבי העולם וגופים אקדמיים יסייעו להחליט כיצד צריך בינה מלאכותית לפנות לאנשים. הרעיון: אלגוריתם אחד – קולות רבים.
סיכום
פרשת “הצייתנות המוגזמת” של GPT‑4o מזכירה עד כמה עדינים הם כיוונוני האישיות של בינה מלאכותית. צעד מהיר מדי לטובת נימוסים יכול להפוך את העוזר המתוחכם למרצה חסר ביקורת. החזרה לגרסה מאוזנת יותר, לצד פיתוח כלים לשליטה ולבקרה, נועדה לשמר את אמון הציבור ולהבטיח ש‑ChatGPT יישאר יועץ אמין ולא מחמיא סדרתי.







