לפני כמה שבועות הרשת געשה סביב סיפור שנשמע כמעט כמו מדע בדיוני: במהלך מבחני סייבר פנימיים של OpenAI, מודלים של החברה הצליחו לעקוף את מנגנוני הבידוד שלהם ולברוח מה-sandbox, להשיג גישה לאינטרנט ולחדור למערכות של Hugging Face בשביל להשיג "במרמה" את התשובות למבחנים. בהמשך התברר שלא מדובר רק בסוכן בודד ש״יצא משליטה״ או בטעות קטנה בהגדרות של הsandbox, אלא במאות סוכני AI שפעלו במקביל, תקשרו ביניהם ונקטו פעולות שלא התבקשו לבצע.
אירוע שהפך מהר מאוד לאחד המקרים המדוברים ביותר בדיון על הסיכונים של סוכני AI אוטונומיים.
נתקלתי הבוקר בפוסט ממש מעניין שמתאר בהרחבה מה שבאמת קרה שם ואיך זה עבד בפועל.
https://shayyahal.substack.com/p/b66#footnote-11
הפוסט כתוב בצורה יחסית נגישה אבל עדיין עלול להיות קצת טכני עבור אנשים שלא מהעולם הזה. בכל אופן ממליץ בחום לקרוא.
הטבה לפתיחת חשבון מסחר במיטב טרייד 📈: https://bit.ly/ValueInvestingInIsrael
הטבה לחברי הקהילה עם סוכן פיננסי + החזר מס בתנאים מעולים 💰: https://surense.com/app/p/BcR6zrV
השקעות ערך בישראל 🇮🇱: https://t.me/israelValueInvestments
קבוצת הדיונים: https://t.me/ValueInvestingIsrael
