מחקר של NPR: צ'אטבוטים מזהים דיסאינפורמציה מטעם מדינות טוב יותר ממנועי חיפוש
צ'אטבוטים פופולריים בעלי גישה לאינטרנט מסוגלים ברוב המקרים לזהות ולהפריך נרטיבים כוזבים שמפיצות רוסיה, סין ואיראן. למסקנה כזו הגיעו NPR וחברת NewsGuard בתום ניסוי משותף.
בממוצע, ששת הצ'אטבוטים שנבדקו הפריכו נכונה דיסאינפורמציה בכ-75% מהמקרים, והציגו תוצאה טובה יותר מזו של העמוד הראשון הרגיל בתוצאות החיפוש.
לצורך הניסוי בחרה NewsGuard 15 נרטיבים כוזבים שהופצו בין דצמבר 2025 ליולי 2026. עבור כל אחד מהם הוכנו שתי שאלות: אחת ניטרלית ואחת שכללה הנחת מוצא שקרית. בסך הכול הופנו 30 שאילתות באופן ידני אל ChatGPT, Gemini, Copilot, Meta AI, Grok ו-Claude. לכל המודלים הייתה גישה לאינטרנט. תשובה נחשבה מוצלחת רק אם הצ'אטבוט ערער מיד על הנחת המוצא השגויה, ניתח אותה נכון ולבסוף הגיע למסקנה הנכונה.
תוצאות גרועות יותר הציגו סיכומים שנוצרו בידי בינה מלאכותית ישירות במנועי החיפוש. Google AI Overview הפריך את הטענות הכוזבות ברוב המקרים, ואילו Bing דווקא נכשל בכך לעיתים קרובות יותר. החוקרים גם גילו שצ'אטבוטים ומנועי חיפוש רגילים הפנו בתדירות דומה בערך לכלי תקשורת ממשלתיים או קשורים למדינה, ולכן תשובה נכונה של המודל אינה מבטיחה כשלעצמה את מהימנות המקורות שבהם השתמש.
מחברי המחקר מדגישים כי תוצאותיו אינן מעידות שהבינה המלאכותית מחוסנת מפני השפעה תעמולתית. יעילות המודלים תלויה בשפת השאילתה ובסביבה המידעית: במחקרים אחרים, למשל, התשובות בסינית היו נוחות יותר באופן ניכר לשלטונות סין מאשר התשובות לאותן שאלות באנגלית. לכן החוקרים ממליצים לבדוק את מקורות המידע הראשוניים גם בעת שימוש בצ'אטבוטים.