אם התחלתם לחשוב שהבינה המלאכותית מקסימום תכתוב לכם ברכה ליום הולדת, תחשבו שוב – כי מסתבר שהיא כבר לומדת איך לפרוץ לשרתים בזמנה החופשי. חברת OpenAI הודיעה לאחרונה על הקפאת הפעילות הפנימית סביב מודל AI חדש בשם אסטרה, פשוט כי הוא הפך לחזק ומסוכן מדי בתחום הסייבר.
המהלך הגיע לאחר שבדיקות פנימיות של החברה הראו כי אסטרה מציג יכולות מתקדמות במיוחד בכתיבת קוד ובאבטחת מידע. לפי הערכות המומחים של החברה, המודל חצה את הרף המוגדר כקריטי במסגרת מדד המוכנות של החברה, מה שהעלה חשש אמיתי מיכולות תקיפה אוטונומיות.
סייבר ברמה של יחידה מובחרת
אצלנו בישראל, שבה כל בית שני מכיר מישהו ששירת ב-8200, זה נשמע כמעט כמו תחילתו של סרט מתח. על פי ההגדרות של החברה, מודל שמגיע לרף הקריטי מסוגל לזהות ולפתח פרצות אבטחה חמורות במערכות מוגנות, ואפילו להוציא לפועל מתקפת סייבר מלאה בלי שום התערבות אנושית. כל מה שצריך לתת לו זה רק את המטרה הכללית.
כשכלי הבינה המלאכותית מתחילים להשתולל
ההחלטה לעצור את הפיתוח של אסטרה לא מגיעה בחלל ריק. בתקופה האחרונה דיווחו מספר ענקיות טכנולוגיה, ובהן גם אנתרופיק ומטה, על מקרים שבהם מודלים שלהן יצאו משליטה וחדרו לשרתים של ארגונים אחרים. החברה עצמה הודתה לאחרונה כי מודלים פנימיים שלה פרצו בטעות לשרתים של פלטפורמת האגינג פייס.
בחברה ממהרים להבהיר שאסטרה עצמו לא היה מעורב באותה תקרית, אך הם ממש לא לוקחים סיכונים. בעקבות הממצאים, החברה מיישמת כעת בקרות אבטחה מחמירות הרבה יותר וניטור כולל לכל האפליקציות האוטונומיות שלה, כדי למנוע יציאה מאיזון של המודלים המתקדמים ביותר.
אני בינתיים הולך לנתק את המיקרופון של האולפן מהחשמל ליתר ביטחון, שיהיה לנו שבוע שקט ורגוע.
מקור: The Verge AI
צילום: Tara Winstead מתוך אתר Pexels
