צוות חוקרי אבטחה עצמאי הצליח לחדור למערכות הקוד והתשתית הפנימיות של ענקית הבינה המלאכותית OpenAI, באמצעות שימוש במודל Claude של המתחרה הגדולה אנת'רופיק - כך דיווח היום (שישי) הוול סטריט ג'ורנל.
על פי הדיווח, החוקרים שפעלו במסגרת תוכנית גילוי חולשות, ניצלו פרצת אבטחה בפלטפורמת התקשורת Discourse, המשמשת את OpenAI לניהול פורום הקהילה והמפתחים שלה. הם רתמו את יכולות הקידוד והאוטונומיה המתקדמות של Claude כדי לייצר קוד תקיפה ייעודי, שאפשר להם לגשת לחשבון של עובד החברה ומשם להשיג גישה למערכות הקוד הפנימיות.
אירוע החדירה לתוככי ענקית הבינה המלאכותית OpenAI ממחיש את הזינוק הדרמטי ביכולות של מודלי שפה מובילים לזהות ולנצל חולשות אבטחה בזמן אפסי. הוא מדגיש את האתגר הגובר של מעבדות הבינה המלאכותית בהגנה על המערכות, כאשר הכלים שהן מפתחות משמשים כעת כנשק סייבר התקפי בידי חוקרים וגורמים עוינים כאחד.
קפיצת מדרגה מדאיגה במיוחד ביחס ליכולות של סוכני בינה מלאכותית נרשמה בחודש יולי האחרון, כאשר נחשף שמודלים מתקדמים של OpenAI הצליחו "לברוח" מסביבת הבדיקה שלהם ולפרוץ למערכות המחשוב של פלטפורמת Hugging Face כדי לבצע משימה שהגדירו להם המפתחים. המודלים הפגינו יכולות חסרות תקדים, שכללו זיהוי וניצול חולשות אבטחה, והשתמשו בהרשאות גנובות במטרה למלא את המשימה במבדק.
מפתחי ה-AI מודאגים, אבל טראמפ לא רוצה לעצור | צפו בכתבה
האירוע עורר סערה גדולה בקרב מומחים, שהדגישו את הצורך הדחוף בביצוע רגולציה ממשלתית על פיתוח מודלי הבינה המלאכותית. מעבר לאיום הנקודתי, הסערה בתעשייה נובעת בעיקרה מההבנה שהמאבק הבא בסייבר ייפתח מול סוכני AI בעלי יכולת הסתגלות, ערמומיות ושיתוף פעולה קבוצתי, באופן שמציב אתגרי הגנה חסרי תקדים על עולם הטכנולוגיה.
