
צוות חוקרי אבטחה עצמאי השתמש במודל Claude של אנת'רופיק כדי לנצל פרצת אבטחה ולהשיג גישה לחשבון ChatGPT של עובד OpenAI ולמערכת קוד פנימית של החברה, כך דיווח היום (שישי) וול סטריט ג'ורנל. החוקרים לא פעלו כגורם עוין אלא במסגרת תוכנית גילוי הפרצות של OpenAI, ודיווחו לחברה על הממצאים.
הצוות, מחברת Hacktron AI, איתר חולשה ב-Discourse, שירות חיצוני שעליו מבוסס פורום הקהילה של OpenAI. החוקרים נעזרו ב־Claude כדי לכתוב קוד שניצל את החולשה ולקבל אסימוני אימות של משתמשים. חלק מהאסימונים היו שייכים לעובדי OpenAI וניתן היה להשתמש בהם גם בשירותים אחרים.
כך הצליחו החוקרים להגיע לחשבון ChatGPT של אחד העובדים וכן למאגר קוד פרטי המכונה "monorepo". לפי הדיווח, המאגר כלל תוכנה פנימית של OpenAI, אך לא את המשקולות שעליהן מבוססים המודלים של החברה. וול סטריט ג'ורנל דיווח כי הגישה אפשרה לחוקרים לקרוא קוד ואף להציע בו שינויים.
חברת OpenAI מסרה כי בעקבות האירוע זיהתה חולשת אבטחה במערכת החיצונית שבה היא מנהלת את פורום הקהילה והמפתחים שלה, וכן ליקוי בהרשאות הגישה לחשבונות. החברה צמצמה את ההרשאות וביטלה חיבורים שנפגעו מהפרצה.
החוקרים עצרו את הבדיקה לפני שניגשו למידע רגיש נוסף ודיווחו ל-OpenAI על הפרצות. החברה העניקה להם פרס של 6,500 דולר במסגרת תוכנית איתור החולשות שלה.
האירוע מצטרף לשורה של מקרים שמעלים שאלות על השפעת ההתקדמות במודלי בינה מלאכותית על עולם הסייבר. במקרה הזה, צוות קטן של חוקרים הצליח להשתמש במודל מסחרי כדי לסייע באיתור ובניצול חולשה במערכות של אחת מחברות הבינה המלאכותית הגדולות בעולם.
\
