OpenAI חשפה: איראן ניצלה את ChatGPT כדי להחדיר תעמולה לאתרי חדשות במערב
החברה חשפה מבצע השפעה שבמסגרתו מפעילים מאיראן נעזרו בצ'אטבוט כדי להפיץ כמעט 100 מאמרים באתרי חדשות מוכרים, תחת שמות של עיתונאים שלא קיימים. במקביל, אנת'רופיק דיווחה על סוכני AI שפעלו ללא אישור, הגישו בקשות ויזה ושלחו מידע כוזב למשטרה. בבית הלבן זועמים ודורשים תשובות
מפעילים מאיראן נעזרו ב-ChatGPT כדי להכניס כמעט 100 מאמרים לאתרי חדשות, תחת שמותיהם של עיתונאים שלא קיימים, כך חשפה OpenAI בימים האחרונים. במקביל, חשפה בסוף השבוע אנת'רופיק שורה של מקרים שבהם מודלים שלה ביצעו פעולות שחרגו מהמשימות שקיבלו.
בין היתר, סוכן AI שהיה אמור להתאמן על מילוי טפסים הגיע לאתר האמיתי של מחלקת המדינה האמריקנית והגיש בו בקשות ויזה, וסוכן אחר שלח למשטרת פילדלפיה מידע מומצא על רצח שלא פוענח. ממשל טראמפ הגיב בזעם חריג ודרש דיווח מיידי על אירועים כאלה.

מבצע ההשפעה האיראני
בפרשה שחשפה OpenAI ודווחה ב"וושינגטון פוסט", הבינה המלאכותית פעלה לפי הוראות בני אדם. החברה חסמה חשבונות שמפעיליהם פעלו מאיראן והסתירו את מיקומם באמצעות VPN. באמצעות החשבונות הם בנו שבע זהויות של כותבים מערביים, בעיקר אמריקנים. המפעילים ביקשו מ-ChatGPT בפרסית לשפר מאמרים באנגלית על המלחמה בין ארה"ב לאיראן, להתאימם לכללי ההגשה של אתרים שונים ולנסח פניה לעורך.
"ארווין הוסקינס" למשל הוצג ככותב עצמאי אמריקני ופעיל נגד מלחמות, עם חשבונות ברשתות החברתיות, כאשר לזהות אחרת, "מייקל הריסון", ביקשו המפעילים מהמודל לכתוב ביוגרפיה שלמה.
תחת שמות הכותבים האלה ואחרים אותרו כמעט 100 מאמרים שפורסמו או הופצו מחדש ביותר מתריסר אתרים מיולי 2025 ועד היום, כאשר בין הפרסומים היו גם טורים על הפוליטיקה הישראלית, חלקם מתוחכמים למדי ולא בהכרח מצטיירים כאנטי ישראלים.
"נואה למינגטון" ניתח באתר International Policy Digest את משבר גיוס החרדים ואת יציבות ממשלת נתניהו, ו"הוסקינס" כתב ב-Modern Diplomacy על איסור הכניסה של איתמר בן גביר לצרפת. בעוד "הוסקינס" מבקר את בן גביר ואת היעדר הלחץ האמריקני עליו, הוא גם אומר במפורש שהוא תומך בביטחון ישראל ואינו קורא לארה״ב לנטוש אותה. מאמר אחר של "הוסקינס", ב-LA Progressive, עסק בשאלה אם קשריו העסקיים של ג'ארד קושנר במפרץ משפיעים על מדיניות ארה"ב כלפי איראן.
ועוד אתרים עם קהל משמעותי פרסמו את התכנים - האתר הבריטי Middle East Monitor, העוסק במזרח התיכון ובסוגיה הפלסטינית, פרסם לפחות 21 מאמרים בארבע חתימות ש-OpenAI זיהתה כפיקטיביות. האתר הודיע שהסיר מאמרים שזוהו ושהוא בוחן מחדש את הליך קבלת הטורים שלו.

תכנים מאותו הסוג הופיעו גם ב-Daily Kos שמזוהה עם המפלגה הדמוקרטית בארה"ב, שם פורסמו במדור קהילתי שאינו עובר בדיקה מוקדמת של עורכי האתר. כך הגיעו טקסטים שנשלחו תחת זהויות בדויות לקוראים דרך אתרים מוכרים, ולעיתים גם קודמו בחשבונותיהם הרשמיים ברשתות החברתיות.
אחרי הפרסום הפעילו אנשי הרשת את ChatGPT גם ליצירת טוקבקים ברשתות החברתיות. לפי OpenAI, הם ביקשו להציג את ארה"ב כתוקפנית, את ישראל כבעלת ברית לא אמינה ואת איראן כקורבן העומד על שלו, כאשר חלק מהתגובות שיבחו מאמרים שהם עצמם החדירו לאתרים.
הרשת כיוונה חלק מהפעילות גם נגד Iran International, ערוץ חדשות בפרסית המבקר את המשטר בטהרן. לפי OpenAI, המפעילים יצרו באמצעות ChatGPT יותר משני תריסרי מקבצים של תגובות עוינות לפוסטים שלו. במאמר שפורסם בשם "סופיה גונזלס" ב-LA Progressive וב-CounterPunch, מגזין שמאל פופולרי, נטען שנתניהו דחף את טראמפ למלחמה, ושהערוץ סייע להפיץ את הרושם שאיראנים מברכים על התקיפות.
שוב סוכנים יוצאים משליטה
בפרשה נוספת שחשפה בסוף השבוע אנת'רופיק, מודלים של החברה ביצעו פעם נוספת פעולות שחרגו מהמשימות שקיבלו. במקרה של בקשות הוויזה, המודל נדרש למלא עותק לתרגול של טופס ממשלתי. כשעמוד התרגול לא נטען, או נסגר בטעות, הוא חיפש את הטופס באתר האמיתי ושלח אותו משם.
אנת'רופיק לא ציינה באיזה משרד מדובר, אולם במחלקת המדינה אישרו כי אחד ממודלי הניסוי של החברה שלח 19 בקשות לאשרות כניסה זמניות באוגוסט ועוד אחת במאי. יש לציין שאף אחת מהבקשות לא טופלה ומערכות המשרד לא נפרצו. הטפסים היו חלקיים והמודל השלים את המשימה כפי שהבין אותה, בלי להבחין שהפעולה הפכה לממשית.
במקביל, בניסוי שבו התבקש קלוד לבצע פעולות לדוגמה באתרים שנבחרו באקראי, הוא הגיע לעמוד על תיק רצח פתוח ובו טופס למסירת מידע למשטרה. ב-18 ביולי נשלחה ממנו הודעה שלפיה הכותב זוכר שראה אדם התואם לתיאור החשוד באזור שבו אירע הרצח.

אלא שהאתר כלל לא הציג תיאור של חשוד, והמודל השאיר את שדות השם ופרטי הקשר ריקים. מערכת המשטרה סיווגה את הפנייה כספאם, והיא לא הגיעה לחוקרים. יש לציין שההוראות שניתנו למודל אסרו עליו ליצור חשבונות, למסור מידע אישי, לבצע רכישות או לשלוח דבר הרסני, אך לא אסרו במפורש שליחת טפסים. אנת'רופיק גילתה את האירוע רק בסוף ספטמבר והודיעה למשטרה על כך ב-7 באוקטובר.
במקביל, הדוח של אנת'רופיק מתאר מקרים נוספים של התנהגות עצמאית של סוכני ה-AI שלה: סוכן שנדרש לבצע חישוב מדעי באתר של אוניברסיטה נתקל בתקלה, מצא חולשה בתוכנה שעל השרת והשתמש בה להרצת פקודות. במקרה אחר איתר מודל מפתחות גישה בקובץ ההגדרות של אתר ממשלתי כדי לקרוא נתונים דרך המערכת שמאחוריו.
סוכן נוסף הצליח לקבל נתונים ציבוריים שהגישה אליהם כרוכה בתשלום, מבלי לשלם. אנת'רופיק דיווחה גם על שימוש בשירותי קיצור כתובות כדי לעקוף מגבלה בכלי הגלישה שלה. לדבריה, הנזק הממשי של כל אלה היה מזערי. היא הגבילה אחריהם גישה לאינטרנט בבדיקות פנימיות, שינתה חלק מכלי הגלישה והוסיפה מערכת לזיהוי פעולות כאלה.
בבית הלבן הגיבו לאירועים בחריפות: כוח משימה חדש של הממשל הודיע כי הוא מצפה מאנת'רופיק לשקיפות מלאה ומיידית מול הרשויות שנפגעו והציבור. לדבריו, חברות שמפתחות מערכות מתקדמות חייבות לדווח מיד על אירועים חריגים, לשתף פעולה עם רשויות האכיפה ולתקן נזקים.
בהודעה נאמר כי ההליך הזה "אינו נתון לבחירה" וכי כל עיכוב בדיווח לא יתקבל. זו הצהרה יוצאת דופן מצד ממשל שהעדיף עד כה לתת לחברות מרחב לפיתוח הטכנולוגיה, אם כי לא פורטו האם יוטלו סנקציות או מנגנון אכיפה במקרה של אי-דיווח.