המלחמה על השליטה: כשהאקרים לומדים "להנדס" את תודעת המכונה

האקרים בעידן הנוכחי אינם זקוקים עוד לפריצה טכנית מורכבת כדי לשבש אירועים בקנה מידה עולמי, שכן לעיתים די בבלבול מנגנוני הבינה המלאכותית

המלחמה על השליטה: כשהאקרים לומדים "להנדס" את תודעת המכונה

Grok

האקרים בעידן הנוכחי אינם זקוקים עוד לפריצה טכנית למערכות כדי לשבש אירועים בקנה מידה עולמי, שכן לעיתים די בבלבול מנגנוני הבינה המלאכותית המנהלים את האופרציה. 

דמיינו אלפי משתתפים המקבלים הודעה רשמית ואמינה על שינוי בלוחות הזמנים של מערך ההיסעים, כאשר ההודעה מנוסחת היטב ונשלחת ממערכת לגיטימית, אך תוכנה שגוי מיסודו. במצב זה לא התבצעה גניבת סיסמאות או השתלת קוד זדוני, אלא התרחש כשל תפיסתי של המכונה. מערכת הבינה המלאכותית קיבלה קלט שנוסח בתחכום, פירשה אותו באופן מוטה ופעלה בהתאם להנחיות החדשות שקיבלה, מה שמוכיח כי נקודת התורפה החדשה נמצאת בשכבת הלוגיקה והשפה.

דיוויד וורברטון, מנהל F5 Labs, בוחן מקרוב את החשיפה של המערכות המפעילות את משחקי החורף 2026 ומצביע על כך שהסיכון המרכזי נובע מהפיכת הבינה המלאכותית מגורם תומך לגורם מחליט. באירועים מורכבים אלו, המערכות מנהלות שירות לקוחות, תכנון לוגיסטי, תרגום וזיהוי הונאות בזמן אמת. 

כאשר המכונה מקבלת אוטונומיה תפעולית, גם טעות קטנה בפרשנות הקלט עלולה לייצר אפקט מצטבר של שיבוש המוני. התלות הגוברת באוטומציה הופכת את הארגון לפגיע לא רק למתקפות סייבר קלאסיות, אלא לשימוש לרעה ביכולת של המודל להבין הקשר וכוונה.

שיטת התקיפה הבולטת בהקשר זה היא הזרקת הנחיות, המכונה Prompt Injection. במקום לנצל חולשות תוכנה, התוקף מנסח קלט המוביל את המודל לפעול בניגוד למטרתו המקורית. מודלים של שפה גדולים ומערכות מבוססות סוכנים מתוכננים להיות גמישים וקשובים לשפה אנושית, ודווקא תכונה זו מהווה את הפרצה. 

שינוי קטן בניסוח יכול לגרום לחשיפת מידע חסוי או לביצוע פעולות שגויות. במקביל, גם שיטות הפישינג המסורתיות השתדרגו באמצעות בינה מלאכותית, והן מציגות כיום פניות מותאמות תרבותית ושפתית המקשות על עובדים תחת לחץ לזהות את התרמית.

כלי האבטחה המסורתיים, שנועדו להגן על תשתיות ורשתות, אינם ערוכים להתמודד עם מצב שבו מערכת פועלת בדיוק לפי הגדרותיה אך על בסיס הנחות יסוד מוטעות. המערכת אינה נפרצת אלא משוכנעת לבצע פעולה מזיקה. כדי לגשר על הפער, מתפתחות שכבות הגנה של חסמי בטיחות ובדיקות יריב יזומות המנסות להטעות את המערכת מראש. 

עם זאת, מכיוון שהבינה המלאכותית דינמית ומתעדכנת ללא הרף, נדרש תהליך מתמשך של בחינה. עבור מנהלי טכנולוגיה, השאלה המרכזית כיום אינה רק האם המערכת חסינה מחדירה, אלא כיצד היא מגיבה לניסיונות הטעיה מתוחכמים.

דיוויד וורברטון, (David Warburton), מנהל, F5 Labs