
כשה-AI מסביר את עצמו, אתם מפסיקים לחשוב
מחקר חדש מהארוורד ומ-MIT מגלה: כשבינה מלאכותית מצרפת הסבר להמלצה שלה, אנשים בודקים אותה פחות - ודוחים רעיונות שיכלו להיות ה-Google הבא. זה קורה גם אצלכם, בכל אישור קמפיין.
- מחקר משותף של הארוורד, MIT ואוניברסיטת וושינגטון בדק 228 שופטים מנוסים שהעריכו כמעט 50 הצעות אמיתיות לתחרות חדשנות של MIT.
- כשה-AI צירף הסבר כתוב להמלצה שלו, השופטים הסכימו איתו ב-75% מהמקרים – לעומת 54% הסכמה עם מומחי אנוש. וב-67% מהמקרים בסך הכול, הם פשוט קיבלו את מה שה-AI אמר.
- ההסבר לא שיפר את הדיוק – הוא רק הגדיל את מספר הרעיונות הטובים שנדחו. גם Google Glass ואת ה-Ethernet של Xerox דחו בזמנו ועדה של אנשים חכמים.
שבוע שעבר ישבתי בפגישת אישור קריאייטיב אצל לקוח, וראיתי את זה קורה בזמן אמת. מישהו הרים טיוטת קמפיין ל-ChatGPT, ביקש חוות דעת, קיבל בחזרה שלוש פסקאות מנומקות למה הקונספט "לא יעבוד" – וזהו. הישיבה נגמרה. אף אחד לא שאל "רגע, למה בעצם". מחקר חדש שיצא השבוע נותן למה שראיתי שם שם מדויק: ה-AI לא שכנע אתכם שהוא צודק. הוא רק גרם לכם להפסיק לבדוק.
מה בדיוק בדקו
חוקרים מהארוורד, MIT ואוניברסיטת וושינגטון בנו ניסוי שדה נקי: 228 שופטים מנוסים קיבלו כמעט 50 הצעות אמיתיות שהוגשו לתחרות חדשנות של MIT, ונדרשו להחליט אילו מהן ראויות להמשך. השופטים חולקו לשלושה תרחישים – הצעות בלי שום עזרה מ-AI, המלצת AI "קופסה שחורה" בלי הסבר (רק "לקבל" או "לדחות"), והמלצת AI עם רציונל כתוב ומנומק. את התוצאות השוו לפסיקה של ארבעה מומחי תוכן אנושיים, שנחשבה קו הבסיס.

המספרים שמדאיגים
כשההמלצה הגיעה בלי הסבר, השופטים עדיין הושפעו ממנה. אבל כשהיא הגיעה עם רציונל כתוב, ההסכמה איתה קפצה לכ-75% – כמעט זהה להשפעה של הקופסה השחורה, אבל עם ביטחון גבוה בהרבה מצד השופטים עצמם. לשם השוואה, ההסכמה עם החלטות מומחי האנוש עמדה על 54% בלבד. במילים אחרות: הסבר משכנע לא קירב את השופטים לשיפוט טוב יותר, הוא רק גרם להם לחתום מהר יותר על מה שה-AI כבר החליט. בממוצע, 67% מההמלצות התקבלו כמות שהן.
זה כבר קרה, וזה יקר
המאמר, שהתפרסם כ-Working Paper של הרווארד ביזנס סקול, מזכיר בכוונה כמה החלטות דחייה מפורסמות שהתבררו כטעות היסטורית: Google Glass, ה-Fire Phone של אמזון, וגם הטכנולוגיות של Xerox – האתרנט וה-PostScript – שהחברה עצמה דחתה לפני שאחרים הרוויחו מהן מיליארדים. החוקרים כותבים במפורש: "דחייה היא החלטה אקטיבית ומחסלת, שמרגישה משמעותית ובעלת אחריות יותר מאשר שמירה על אופציונליות" – כלומר קל יותר להגיד "לא" מאשר "אולי", ו-AI שנותן לכם נימוק מוכן להגיד "לא" הוא הדבר הכי נוח שיש. הם גם מציינים תופעה מוכרת: "אנשים נוטים להעריך יתר על המידה את ההבנה שלהם לגבי החלטה, למרות תובנה מוגבלת לגבי הנימוק שמאחוריה". קראתם הסבר, הרגשתם שהבנתם, ועברתם הלאה.
הסבר משכנע לא הופך אתכם לשופטים טובים יותר – הוא רק גורם לכם להרגיש שאתם לא צריכים לשפוט.

מה זה אומר לכם
אם אתם צוות שיווק שמריץ טיוטות קמפיין דרך AI, מנהל תוכן שנעזר בו לסינון רעיונות, או ארגון ששוקל להטמיע כלי סקירה אוטומטי – זה בדיוק הרגע לעצור. הבעיה לא ב-AI עצמו, היא בממשק: ברגע שה-AI "מסביר", אתם מפסיקים לחלוק עליו. הפתרון שהחוקרים מציעים, ושאני ממליץ להטמיע בכל תהליך אישור שיש בו כלי AI, הוא לבנות תרגיל של "נרטיב מנוגד" – לבקש מהמערכת גם את הסיבות בעד וגם נגד, ולסמן איפה יש חוסר ודאות, במקום לתת פסקה חלקה אחת שנשמעת סופית. דרך אגב, אם אתם רוצים לראות כמה בדיוק אתם נשענים על AI בעבודה השוטפת, כתבנו לא מזמן על Reflect, הפיצ'ר של אנתרופיק שמראה בדיוק את זה.
בפעם הבאה שאתם מבקשים מ-AI חוות דעת על קמפיין, פוסט, מצגת או רעיון – אל תבקשו המלצה אחת. בקשו ממנו לשחק "עורך דין לשני הצדדים" לפני שהוא מכריע. תעתיקו את הפרומפט הבא, תדביקו אותו לפני התוכן שאתם בודקים, ותראו איך התשובה משתנה:
לפני שאתה נותן לי המלצה סופית על [התוכן/הרעיון], כתוב לי שני תרחישים מנוגדים: 1. תרחיש שבו זה מצליח בגדול - מה חייב לקרות כדי שזה יעבוד. 2. תרחיש שבו זה נכשל - מה חייב לקרות כדי שזה ייכשל. רק אחרי שני התרחישים, תן לי את ההמלצה שלך - וסמן באיזו נקודה אתה הכי פחות בטוח.
אם אתם בונים תהליכי עבודה ארגוניים שנשענים על AI – סקירת תוכן, אישורי קמפיינים, הערכת רעיונות – שווה לבדוק את התהליך עצמו, לא רק את הכלי. אנחנו עוזרים לארגונים לבנות בדיוק את זה דרך הליווי הארגוני שלנו.
אנתרופיק אומרת לא לאיסור, כן לבקרת שבבים מול סין
דריו אמודיי הבהיר שאנתרופיק מעולם לא רצתה לאסור מודלים פתוחים - היא רק רוצה לקבוע מי מותר לו לשחק בליגה הבכירה. ההבדל…
1.5 מיליארד דולר על ספרים גנובים: הלקח לעסקים עם AI
אנתרופיק שילמה את ההסדר הכי גדול בהיסטוריה על זכויות יוצרים - לא על האימון, אלא על מאגר של שבעה מיליון ספרים גנובים.…
האיחוד האירופי: מ-2 באוגוסט חובה לתייג תוכן AI
בעוד פחות משבועיים נכנס לתוקף חוק שמחייב לתייג כל תוכן שנוצר או נערך בבינה מלאכותית - עם קנס שיכול להגיע ל-15 מיליון…