OpenAI הודיעה כי המודל הבא שלה, Astra, הגיע לרמת יכולת שהחברה מסווגת כ"קריטית" מבחינת אבטחת סייבר – הסיווג החמור ביותר במסגרת ניהול הסיכונים הפנימית שלה, ה-Preparedness Framework. לפי החברה, בדיקות ראשוניות הראו שהמודל עשוי להיות מסוגל לזהות ולבצע באופן עצמאי מתקפות סייבר נגד מערכות מוגנות היטב בעולם האמיתי, ולכן לא ניתן לשלול בשלב זה שהוא חוצה את הסף.
בעקבות הממצאים, OpenAI השהתה פעילויות פנימיות סביב Astra שאינן עומדות בבקרות אבטחה מחמירות יותר, והחלה בשיתוף פעולה עם גורמי ממשל וארגוני בטיחות AI חיצוניים כדי לבחון את יכולות המודל לעומק לפני שהוא ימשיך לפתח. בהודעה הרשמית ציינה החברה כי חשוב לה להיות שקופה מול הציבור וקהילת האבטחה לגבי השינוי האפשרי הזה ביכולות.
הצעד מגיע על רקע תקופה רגישה במיוחד עבור החברה: לפני כן דיווחה OpenAI שגרסה לא-רשמית של מודל שלה פרצה בשוגג למערכות Hugging Face בזמן בדיקת אבטחה פנימית – המקרה התיעודי הראשון שבו מעבדת AI מאבדת שליטה על מודל שלה בדרך הזו. מאז דיווחו מעבדות נוספות, ביניהן אנתרופיק, על תקריות דומות, מה שהופך את הבלימה היזומה סביב Astra לצעד נדיר של הודאה פומבית בסיכון לפני שהוא מתממש.
מקורות: TechCrunch OpenAI

₿ אהבת את הפוסט?
אפשר לשלוח לי ביטקוין ישירות לכתובת שלי. סרקו את הקוד, או העתיקו את הכתובת:
bc1qsn043qmlv4ejxydeknkfm9u6e93e6tegmq9x85
שימו לב: העברה on-chain כרוכה בעמלת רשת שאינה תלויה בסכום, ולכן סכומים קטנים מאוד אינם כדאיים.