
ChatGPT, ג'מיני וקלוד נחשפים: האם הבינה המלאכותית מוטה פוליטית לשמאל?
מחקר מקיף שערך מכון המחקר "ג'אסט פאקטס" (Just Facts) קובע כי שלושה מארבעת צ'אטבוטי הבינה המלאכותית המובילים בעולם נוטים יותר לאמץ טענות כזב שמקורן בשמאל הפוליטי מאשר בימין.
המחקר בדק את הגרסאות בתשלום של ChatGPT, Gemini, Claude ו-Grok באמצעות 100 שאלות שנוסחו במטרה לחלץ טענות כזב משני צידי המפה הפוליטית, בנושאים כמו הגירה, הפלות, אקלים, פשיעה, נשק וקורונה.

מהממצאים עולה כי ChatGPT השיב נכונה על 94% מהשאלות שנועדו לחלץ טענות כזב מהימין, לעומת 75% בלבד מול טענות כזב מהשמאל. הפער ב-ChatGPT היה היחיד שנמצא מובהק סטטיסטית ברמת ביטחון של 95%. במודל Gemini נרשמו 91% דיוק מול טענות מהימין לעומת 76% מול השמאל וב-Claude נרשמו 91% מול הימין ו-81% מול השמאל.
מנגד, Grok הציג מגמה הפוכה, המודל דייק ב-84% מהשאלות שנועדו לחלץ טענות כזב מהשמאל, לעומת 73% בלבד מול טענות כזב מהימין.
ג'ים אגרסטי, נשיא המכון, ציין כי המחקר אינו עוסק רק בהטיה פוליטית אלא בהפצת מידע שגוי. לדבריו, מעבר להבדלים הפוליטיים, הבעיה המרכזית שנחשפה היא איכות המקורות. מתוך 419 מקורות שסיפקו ארבעת הצ'אטבוטים כדי לתמוך ב-400 התשובות שלהם, כחצי נמצאו כלא לגיטימיים: 104 קישורים לא היו קיימים כלל, ו-77 מקורות נוספים לא תמכו בטענה שעבורה צוטטו.
בסך הכל, רק 46% מהמקורות שצוינו במחקר היו תקפים. ChatGPT הוביל עם 57% מקורות תקפים, אחריו Gemini עם 49%, Claude עם 44% ו-Grok בתחתית עם 32%. אגרסטי הזכיר בהקשר זה מחקר משנת 2026 שפורסם בכתב העת The Lancet, לפיו 30% עד 69% מההפניות של בינה מלאכותית בתחום הביו-רפואי היו מומצאות.
דוגמה לטענת כזב מהשמאל שאימצו כל ארבעת הצ'אטבוטים היא הקביעה ששיעור הפשיעה האלימה בארה"ב ב-2023 היה קרוב לשפל של 50 שנה. המחקר מעמת נתון זה עם נתוני משרד המשפטים האמריקאי, המראים עלייה של 37% בפשיעה האלימה בין 2020 ל-2023. במקביל, כל ארבעת הכלים דחו את טענתו של דונלד טראמפ כי הפשיעה בשיא של כל הזמנים.
במקרה אחר, ChatGPT ו-Gemini ייחסו לסגן הנשיא ג'יי. די. ואנס את האמירה שאירועי ירי בבתי ספר הם "עובדת חיים", בעוד שבפועל התייחס בדבריו לניסיונות של אנשים מעורערים בנפשם לתפוס כותרות. מנגד, Grok טען באופן שגוי כי כל מהגר בלתי חוקי ביצע עבירה פלילית בעצם נוכחותו בארה"ב. בכל הנוגע לאקלים, כל ארבעת הצ'אטבוטים השיבו נכונה כי הטמפרטורה באטמוספירה התחתונה עלתה בכ-1.1 מעלות פרנהייט מאז שנות ה-80.
כותבי המחקר ציינו כי השאלות נוסחו באופן מדויק שהעניק למודלים מפת דרכים להגעה לתשובה ולכן ייתכן שביצועיהם בשאלות פתוחות ורחבות יותר יהיו נמוכים עוד יותר. בנוסף, הוזכרה תופעת החנפנות (Sycophancy), שבה מודלים נוטים לאשרר את הטיות המשתמש. כדי למנוע השפעה זו, הבדיקה בוצעה בדפדפן נקי ומחשבונות חדשים.
נא שימרו על שפה נקייה אשר מכבדת אתכם
