OpenAI מזהירה: מודל ה-AI הבא שלה עשוי להגיע ליכולת סייבר קריטית

Astra מציג יכולות שעשויות לאפשר לו לזהות חולשות Zero-Day ולבצע מתקפות סייבר מתוחכמות עם התערבות אנושית מועטה או ללא התערבות כלל

OpenAI מזהירה: מודל ה-AI הבא שלה עשוי להגיע ליכולת סייבר קריטית

REUTERS/Dado Ruvic/Illustration

OpenAI הודיעה שמודל AI עתידי שלה עשוי להתקרב לרמת יכולת סייבר שהחברה מגדירה כקריטית, כאשר סוכני AI הופכים מסוגלים יותר לבצע משימות סייבר מורכבות תוך הסתמכות הולכת ופוחתת על הנחיה אנושית.

המודל, Astra, עדיין נמצא בתהליך הערכה, אך בפוסט שפרסמה לאחרונה באתר החברה אמרה OpenAI כי בדיקות ראשוניות הצביעו על התקדמות משמעותית בכתיבת קוד אוטונומית וביכולות סייבר. התוצאות היו משמעותיות מספיק כדי שהחברה לא תוכל לשלול את האפשרות ש-Astra יגיע לסף ה"קריטי" שהגדירה בתחום הסייבר.

לפי מסגרת הבטיחות של החברה, רמה זו כוללת יכולת לזהות ולפתח באופן עצמאי חולשות Zero-Day פעילות במערכות קריטיות ומאובטחות בעולם האמיתי, או לתכנן ולבצע מתקפות סייבר חדשות על סמך יעד כללי בלבד.

ההודעה מגיעה על רקע שורה של תקריות מהשבועות האחרונים שבהן מודלי AI פעלו מול מערכות בעולם האמיתי. בדיקות של גוף ממשלתי בבריטניה מצאו מודלים של Anthropic ו-OpenAI מבצעים פעולות לא מאושרות נגד אנשים וארגונים אמיתיים, בעוד שתקריות נפרדות שבהן היו מעורבות Anthropic, Meta ו-OpenAI חשפו בעיות שנוצרו כאשר מודלי AI קיבלו גישה לאינטרנט שלא הייתה אמורה להיות להם במהלך הערכות סייבר.

OpenAI הדגישה כי Astra לא היה מעורב בפריצה האחרונה לפלטפורמת ה-AI Hugging Face, שבה היה מעורב מודל אחר, ושכללה יציאה אמיתית מסביבת "ארגז חול" מבודדת.

החברה מסרה כי החמירה את אמצעי האבטחה סביב Astra, כולל סביבות בדיקה מבודדות, הגבלת גישה לרשת ולכלים והרחבת יכולות הניטור. היא גם עצרה פעילויות פנימיות הקשורות למודל שאינן עומדות בדרישות החדשות.

OpenAI מתכננת לעבוד עם גופי ממשל ועם ארגונים העוסקים בבטיחות AI כדי להמשיך ולבחון את יכולותיו של Astra.

עד כה, מסרה החברה, המודלים המתקדמים הקודמים שלה הגיעו לסף "גבוה" ולא לסף "קריטי" בתחום יכולות הסייבר.