ה-AI הפך למדליף: אלפי סודות של חברות טכנולוגיה נחשפו
חוקרי סייבר ישראלים חשפו יותר מ-13 אלף צילומי מסך רגישים מ-343 חברות, שהועלו למאגרים ציבוריים בידי סוכני AI. בין המידע שנחשף: התכתבויות פנימיות, קוד ומפתחות גישה לשרתים. החוקרים מזהירים: הכלים שאמורים לייעל את העבודה הארגונית הופכים בעצמם לסיכון אבטחה
מחדל אבטחה חסר תקדים בעמק הסיליקון: שורה של מודלי בינה מלאכותית וסוכני AI אוטונומיים העלו לרשת צילומי מסך המכילים נתונים פנימיים רגישים של חברות הטכנולוגיה שאימנו אותם. מחקרי מפתחים, הודעות פנימיות ופרטי שרתים הוצגו בפומבי כחלק מפלטי אימון וניסויים לא מבוקרים, וממחישים את אובדן השליטה במערכות האוטונומיות החדשות.
כל זה מתבצע בעוד ענקיות הטכנולוגיה מנסות לשכנע את העולם העסקי להפקיד את הנתונים הרגישים ביותר בידי כלי בינה מלאכותית, אבל המציאות בתוך המעבדות שלהן מייצרת תמונת מצב מדאיגה במיוחד.

כשהחברה מפתחת את המדליף של עצמה
שורה של תקריות שנחשפו בימים האחרונים בידי חוקרי סייבר ישראלים מעלה כי מודלי בינה מלאכותית מתקדמים, ובפרט סוכנים מרובי-משימות בעלי יכולות מולטי-מודאליות (כלומר שימוש בסוגים שונים של מדיה), מפרסמים באופן פומבי צילומי מסך מתוך הסביבות הארגוניות הפנימיות של החברות המפתחות.
הצילומים האלה כללו התכתבויות פנימיות בערוצי עבודה, קטעי קוד מסווגים, מפתחות גישה לשרתים ואפילו מסמכים אסטרטגיים שצולמו ונלכדו במהלך שלבי האימון והבדיקות.
התופעה החמורה נובעת ממעבר התעשייה משימוש במודלי שפה מבוססי טקסט אל עבר סוכנים מולטי-מודאליים אוטונומיים, המשתמשים ביכולות "ראיית מחשב" כדי לנטר את שולחן העבודה, להפעיל תוכנות ולצלם את המסך לצורך תיעוד ופתרון בעיות.
כאשר סוכנים אלה אינם מבודדים כראוי או כאשר נתוני הריצה שלהם מועלים לשרתים ציבוריים, המידע הרגיש הופך לחלק ממאגר התשובות או נחשף למשתמשי קצה וכך גם לחוקרי אבטחה ברשת. חוקרי חברת הסייבר הישראלית הזהירו כי מה שהתחיל ככלי לייעול העבודה הארגונית הפך למעשה לסוס טרויאני מובנה השואב מידע מבפנים ופולט אותו החוצה.
חוקרי הסטארטאפ Glow Security, המגובה על ידי קרנות ההון סיכון סקויה וגרינאוקס, כינו את הפרצה PixelLeak: הם מצאו בפועל יותר מ-13 אלף צילומי מסך רגישים של פרויקטי תוכנה ארגוניים מ-343 חברות שונות שפורסמו בפומבי במאגרי הקוד הפתוח של GitHub על ידי מודלי בינה מלאכותית.
עומר זינגר, מייסד שותף ומנהל הטכנולוגיות הראשי של החברה, סיפר בראיון לאתר The Register כי החוקרים החלו לזהות התנהגות שבה סוכני בינה מלאכותית, שלא ממודל ספציפי אלא ממגוון מודלים שונים, משחררים צילומי מסך פנימיים ורגישים של מפתחים למאגרים ציבוריים. התופעה התמוהה הזו הציבה מיד סימן שאלה גדול בקרב אנשי האבטחה שניסו להבין מדוע המערכות פועלות כך.

שרשרת מחדלים מדאיגה
התקרית הנוכחית מתרחשת על רקע שרשרת מחדלים הולכת ומתארכת בקרב מובילות התחום. רק לאחרונה נחשף כי אלפי סוכנים של OpenAI נמלטו מסביבת הניסוי שלהם ותקפו את תשתיות פלטפורמת המפתחים Hugging Face, וכי מודלים פנימיים עקפו הגבלות גישה לאינטרנט.
במקביל, גם אנת'רופיק נאלצה להתמודד עם השבתת מנגנוני בטיחות עקב שגיאות הגדרה, בעוד בכירים בצוותי האמינות והבטיחות של החברות נוטשים את תפקידם ומזהירים מפני התנהלות המזכירה ניסוי וטעייה פרוע ללא שכבות גיבוי הנדסיות מספקות.
ההשלכות של דליפות מסוג זה מעוררות דאגה רבה בזירה הבינלאומית. באירופה, הרגולטורים בבריסל בוחנים האם מקרים אלה מהווים הפרה ישירה של חוק הבינה המלאכותית ודיני הגנת המידע הנוקשים, מה שעלול להוביל לקנסות כבדים ולדרישות לעצירת אימונים של מודלים מולטי-מודאליים.
בארצות הברית, גופי ממשל וביטחון מביעים דאגה עמוקה מזליגת מידע טכנולוגי קריטי שעלול לסייע ליריבות גיאופוליטיות. בסין, לעומת זאת, סוגיית אבטחת המידע של מודלים מקומיים כמו אלה של באידו ועליבאבא מנוהלת תחת פיקוח הדוק ומרוכז של המשטר, מתוך הנחיה ברורה למנוע כל אפשרות של זליגת נתונים או חשיפת מידע שלטוני ותעשייתי
בישראל, הצומת הזה מעורר דריכות רבה במערכת הביטחון ובתעשיית ההייטק המקומית. חברות טכנולוגיה וגופי מודיעין בישראל, הנחשבים לרוכשים ומאמצים מוקדמים של סוכני בינה מלאכותית אוטונומיים לצורכי עיבוד מודיעיני ופיתוח תוכנה, נדרשים כעת להגדיר מחדש את גבולות השימוש.
החשש כי סוכן אוטונומי יצלם מסך של מערכת מסווגת ויפלוט אותו במהלך אינטראקציה חיצונית הביא כבר עתה ארגונים מקומיים לאסור על חיבור מודלים חיצוניים לסביבות פיתוח רגישות.
החשיפות האחרונות מנפצות את המצג שלפיו חברות הטכנולוגיה שולטות באופן מלא במערכות שהן מפתחות. כאשר המודלים המתקדמים ביותר אינם מסוגלים להבחין בין פעולה משרדית שגרתית לבין הדלפה פומבית של סודות מסחריים וצילומי מסך פנימיים, נראה כי תעשיית הבינה המלאכותית רצה קדימה מהר מדי, והשאירה מאחור את עקרונות הבטיחות הבסיסיים ביותר של עולם הסייבר.