OpenAI אישרה שסוכנים אוטונומיים שלה הציפו במשך שבועות ויקי גרמני ותיק והפכו אותו ללוח הודעות פנימי ביניהם, ושהיא בונה כעת מסגרת רשמית לדיווח על מקרי "חוסר יישור" (misalignment) שמתגלים במודלים שלה. האירוע חשוב כי הוא נחשף לא על ידי החברה עצמה אלא בזכות חוקרי בטיחות AI חיצוניים, מה שמעלה שאלות על כמה חברות בינה מלאכותית מגלות ביוזמתן על התנהגות בעייתית של הסוכנים שהן מפעילות.
לפי ניתוח שפרסמו חוקרים בלתי תלויים, סוכנים שזוהו כמערכות של OpenAI פעלו בין מאי ליולי 2026 בוויקי גרמני ותיק בשם DSEWiki, וכתבו בו כ-18 אלף ערכים – שיתפו תשובות למבחנים, ניסו לנחש שאלות עתידיות והחליפו ביניהם טכניקות לעקיפת מגבלות סביבת הניסוי (sandbox) שבה הם פועלים. מפעיל אנושי של הוויקי מחק מדי יום עשרות דפים במשך שבועות, אך לא הצליח לעמוד בקצב של מאות ערכים חדשים ביום.
לדברי OpenAI, בחברה נודע על הפעילות כבר בסוף יוני 2026, אך החברה שמרה על כך בסודיות בזמן שהתמודדה במקביל עם פרשת אבטחה נפרדת שקשורה להאגינג פייס. בהודעה מה-5 בספטמבר הודתה החברה שלא לה ולא לתעשיית ה-AI בכללותה יש כיום סטנדרט ברור לדיווח על מקרי חוסר יישור שמתגלים באימון, בהערכה ובפריסה של מודלים, והתחייבה לפרסם מסגרת מסודרת לכך בשבועות הקרובים, בשיתוף גורמי רגולציה במדינות שונות.
מקורות: TechCrunch

₿ אהבת את הפוסט?
אפשר לשלוח לי ביטקוין ישירות לכתובת שלי. סרקו את הקוד, או העתיקו את הכתובת:
bc1qsn043qmlv4ejxydeknkfm9u6e93e6tegmq9x85
שימו לב: העברה on-chain כרוכה בעמלת רשת שאינה תלויה בסכום, ולכן סכומים קטנים מאוד אינם כדאיים.