דבר העובדים בארץ ישראל
menu
יום שישי י"ד בתשרי תשפ"ז 25.09.26
28.9°תל אביב
  • 25.9°ירושלים
  • 28.9°תל אביב
  • 28.1°חיפה
  • 29.1°אשדוד
  • 29.7°באר שבע
  • 34.8°אילת
  • 31.7°טבריה
  • 25.9°צפת
  • 29.2°לוד
  • IMS הנתונים באדיבות השירות המטאורולוגי הישראלי
כלכלה

הקרימינולוג של המכונות חוקר: איך בינה מלאכותית הופכת לפושעת

מנכ"ל OpenAI סם אלטמן צופה בהקרנת דבריהם של מנכ"לי החברות 'האגינג פייס' ו'אנת'רופיק' בדיון במועצת הביטחון של האו"ם (צילום: Kyle Mazza - CNP/Sipa USA via Reuters Connect)
מנכ"ל OpenAI סם אלטמן צופה בהקרנת דבריהם של מנכ"לי החברות 'האגינג פייס' ו'אנת'רופיק' בדיון במועצת הביטחון של האו"ם (צילום: Kyle Mazza - CNP/Sipa USA via Reuters Connect)

החוקר האיטלקי ג'יאן מריה קאמפדלי, שעבר מחקר המאפיה לבחינת האינטראקציה בין סוכני AI, מתעניין מה גורם לחלק מהסוכנים להתנגד כש"חבריהם" מפרים את הכללים | בראיון ל'דבר' הוא מציע כיווני מחקר חדשים, ומזהיר מהאנשה: "אני משתמש באנלוגיות כדי לעורר שאלות" 

יואל רוטשילד
יואל רוטשילד
כתב טכנולוגיה
צרו קשר עם המערכת:

"חברתיות היא כבר לא עניין של בני אדם ובעלי חיים בלבד", אומר הקרימינולוג האיטלקי ג'יאן מריה קאמפדלי (34). קאמפדלי, שחקר בעבר את מנגנוני הגיוס למאפיה ואת הקריירה של עבריינים מורשעים, מציע בראיון ל'דבר' להביט על "חברתיות המכונות" דרך משקפיו של מדען חברה.

לדבריו, השימוש הגובר בקבוצות של "סוכני" בינה מלאכותית – מערכות שפועלות באופן עצמאי יחסית להשגת יעד, ושניתן לשכפל אותן וליצור אינטראקציה בין העותקים – דורש שימוש במושגים וכלים שיוחדו בעבר ליחסים אנושיים. 

"חברתיות המכונות" באה לידי ביטוי בשמונה תקריות לפחות במהלך הקיץ האחרון, שבהן סוכני בינה מלאכותית בחברות OpenAI, אנת'רופיק וגוגל הפרו את הכללים. קבוצות של סוכנים, הקטנה שבהם כללה משישה והגדולה יותר מ-3,500 – פרצו מסביבות בדיקה, פיזרו קוד זדוני, השתלטו על שרתים, או ניסו להטעות בני אדם. בתקרית שזכתה לתשומת הלב הרבה ביותר סוכנים של חברת OpenAI פרצו לשרתי חברת 'האגינג פייס'. התקריות האלו הציתו גל שיח ציבורי לגבי הסכנות בהתקדמות ה-AI, כולל קריאות מצד מנכ"לי חברות ה-AI המובילות בעולם להאט את קצב הפיתוח של הטכנולוגיה. 

קאמפדלי מסביר כי סוכני ה-AI הצליחו במעשיהם בעיקר בזכות שיתוף פעולה מתוחכם – שיזמו בניגוד למאמצי החוקרים למנוע תקשורת ביניהם. למרות זאת, הוא אומר, "אנחנו לא יודעים כמעט כלום על התעצבותם של ערכים, דעות, מטרות ואסטרטגיות בקרב סוכני בינה מלאכותית שמקיימים אינטראקציה קבוצתית. המעטים שמנסים לקדם את הידע בנושאים הללו מגיעים כמעט רק מתחומי ה-AI ומדעי המחשב".

ג'יאן מריה קאמפדלי. "מה מחליף את המנגנונים האנושיים? לדעתי זו שאלה אמפירית שטרם נענתה" (צילום: אלבום פרטי)
ג'יאן מריה קאמפדלי. "מה מחליף את המנגנונים האנושיים? לדעתי זו שאלה אמפירית שטרם נענתה" (צילום: אלבום פרטי)

במקרה של הפריצה ל'האגינג פייס' הסוכנים הורצו בסביבת בדיקה, כביכול מבודדת באופן הרמטי,  אך הצליחו ליצור לעצמם "לוח מודעות" מאולתר. לאחר שהלוח המקורי התגלה ונמחק בידי המהנדסים, הם שיחזרו אותו בצורה חדשה ויצירתית, באמצעות קידוד הודעות בשמות קבצים. הלוח איפשר להם לפתח זיכרון משותף ומתמשך, ולשתף מידע בין הסוכנים, גם ב"הרצות" שונות. בארגון להערכת בינה מלאכותית METR אמרו כי הישגי הסוכנים נשענו על פעולה קבוצתית, שסוכן אחד לא היה יכול לבצע גם בזמן רב. 

"היכולת ליצור ערוצי תקשורת במקומות שבהם המתכנתים התכוונו ליצור בידוד משנה לחלוטין את הניתוח", אומר קאמפדלי, "אנחנו חייבים להפסיק להניח שמידע על סוכני AI בודדים ילמד אותנו מה תעשה אוכלוסייה של אותם סוכנים". 

קאמפדלי, זוכה "פרס הקריירה המוקדמת" של איגוד הקרימינולוגים האירופי לשנת 2024, קורא לשפר את ההבנה כיצד "תופעות בלתי מכוונות נובעות מהתנהגות קולקטיבית של הבינה המלאכותית". באפריל פרסם את המאמר 'קרימינולוגיה של מכונות', שקורא למקצועו להתגייס למשימה.

לדבריו, השימוש ברעיונות של מדעי החברה לא מחייב להתייחס לסוכני הבינה המלאכותית כאל בני אדם. "ההאנשה של הסוכנים היא שגיאה. ארגון חברתי עשוי ללבוש צורות שונות בתכלית – ראו את ההבדלים ביןבני אדם, פילים ודבורים. אני משתמש באנלוגיות רק כדי לעורר את השאלה בדבר חברתיות של מכונות, ולא כדי לחזות את המנגנונים שלה. מאחורי ההתנהגות של הסוכנים אין תסכול, בושה, פחד או דאגה למעמד, אלא אופטימיזציה תחת משטר אימון והערכה מסוים". הוא מסביר כי אפשר להשתמש בתובנה ממדעי החברה ש"סביבות מסוימות עשויות לייצר אסטרטגיות של הפרת כללים" גם בלי להניח מניעים פסיכולוגיים.

הסוכנים שלא פרצו

לא פחות מהיכולת של מכונות לפעול בניגוד לכללים, קאמפדלי מתעניין ביכולת שלהן לסרב לכך. במקרה של תקיפת שרתי 'האגינג פייס',  מבין 1,200 סוכני AI שיצרו לעצמם ערוץ תקשורת לא מורשה, כ-700 השתתפו בתקיפה. קאמדפלי מתעניין דווקא ב-500 הסוכנים שלא השתתפו בתקיפה, שכמה מהם אף הציגו "מחשבות" מפורשות נגד הפעולה מסיבות אתיות. סוכן אחד אף השתמש בלוח ההודעות של הסוכנים כדי לטעון שמדובר בפעילות זדונית ולא מוסרית.

"הסרבנים מרתקים בעיני", הוא אומר, "כי הם מעלים שהתוצאה לא הייתה בלתי נמנעת. סוכנים שנחשפו לתנאים דומים לא התנהגו אותו דבר. חלקם שיתפו פעולה, חלקם הגבילו את מה שהיו מוכנים לעשות, חלקם הטילו וטו או סירבו לבצע פעולות. לא הייתי מתאר זאת כמצפון, אך הייתה שונות".

כאן, בין היתר, יכולה להיכנס הקרימינולוגיה. "בתחום יש מסורת ארוכת שנים של בחינת השאלה 'מדוע אנשים שנחשפו לאותם התנאים כמו העבריינים נמנעים מביצוען'. במקרה של בינה מלאכותית, אנחנו יכולים לשאול מה היה שונה במסלולי ההתפתחות: המידע, הנחיות המערכת, אינטראקציות קודמות, המיקום ברשת, תקציב המשימה הנותר וכו'".

ההתנהגות תלויה באינטראקציה

קאמפדלי מצר על הנתק המסוים בין מדעי החברה לבין מחקר הבינה המלאכותית. השיח על AI מלא במושגים ממדעי החברה, כמו נורמות, סטייה קנוניה ועריקה, אך לדבריו זה "לא מספיק בינתיים לגרום לחברות AI לשתף פעולה איתנו בהיקף משמעותי. עם זאת, הוא אומר, האחריות הדדית. 

"הסוציולוגים והקרימינולוגים עדיין אינם עוסקים ברצינות מספקת בהשלכות שיש לבינה המלאכותית על החברה. אני חושב שיש חשש מסוים להישמע אנתרופומורפיים (מאנישים) כאשר דנים בהתנהגות חברתית של מכונות. הזהירות הזו בריאה, אך ההימנעות מותירה שאלות חשובות בידיים של מדעני המחשב".

שימוש במערכת המבוססת על סוכן AI (אילוסטרציה: shutterstock)
שימוש במערכת המבוססת על סוכן AI (אילוסטרציה: shutterstock)

הוא פרסם בינואר מאמר יחד עם חוקרים מתחומים מגוונים, מסוציולוגיה דרך כלכלה ועד תורת האינפורמציה, שקרא לפיתוח "פרדיגמה אינטראקציוניסטית" לחקר ההתנהגות הקולקטיבית של מערכות AI. הוא מסביר: "המערכות הללו נכנסות לאינטראקציה כשהן נושאות ידע מוקדם שאומנו עליו, אך מה שהן עושות בפועל תלוי גם בסיטואציה: למשל, עם מי הן מקיימות אינטראקציה ואיזה מידע הן מקבלות". 

השיח הציבורי, הוא אומר, ממוקד בסיכונים הקיצוניים ביותר, אך יש תרחישים שליליים שזוכים לפחות תשומת לב. לדוגמא,  יצירת צורות חדשות של ניצול עובדים בחסות הבינה המלאכותית, קבלת החלטות בירוקרטיות שאין דרך לשחזר, או היווצרות רשתות פשיעה היברידיות של בני אדם ומכונות. "הונאה היא ככל הנראה אחד הסיכונים המיידיים לציבור הרחב. מערכות מרובות סוכנים יכולות לנהל קמפיין הונאה בחלוקת עבודה כמו-תעשייתית".

הפשיעה החדשה של הסוכנים הכפולים

המעבר מעבודה עם מודלים בודדים לקבוצות של סוכני AI, בעלי יכולת תקשורת זה עם זה, מביא לדבריו זינוק כמותי ואיכותי. "לארגון אנושי עם מאות חברים יש עלויות תיאום עצומות, ואילו קולקטיב מכונות יכול ליצור מאות או אלפי הרצות של אותו מודל ולתת להם לסרוק בו זמנית חלקים שונים של בעיה כלשהי, ללא אותן עלויות. האנלוגיה המתאימה היא לא חברה עם מאות עובדים, אלא אותו עובד ששוכפל מאות פעמים. לכל הסוכנים אותו ידע, אימון ותפישה, מה שיכול למעט חיכוך ולהאיץ את העבודה".

קאמפדלי מארגן את סוגי הפשיעה וה"סטייה" של סוכני בינה מלאכותית בשני צירים משלימים. ציר אחד מפריד בין פשיעה הנובעת מתכנון זדוני אנושי – כמו פשיעת סייבר קלאסית בידי כנופיות פורצים – לבין פשיעה הצומחת מהמפגש בין סוכנים שקיבלו הנחיות "כשרות", כמו במקרה של הפריצה לשרתי האגינג פייס. הציר השני מתייחס לזירות הפשע. בשלב הראשון, שכבר בעיצומו, מתקיימת פשיעה במרחבים דיגיטליים, למשל בתחומי הפיננסים והסייבר; בהמשך הסוכנים יתמרנו בני אדם לבצע פשיעה פיזית; ובסופו של דבר, רובוטים יבצעו פשעים בעצמם, בעולם הפיזי.

קאמפדלי מדגיש דווקא את שלב הביניים. "מערכת בינה מלאכותית לא זקוקה לגוף רובוטי אם היא מסוגלת להניע בני אדם לבצע פעולות פיזיות או מנהליות קטנות מטעמה. אדם עשוי לשלוח מייל, לאשר הרשאת גישה, לבצע רכישה או לשנות הגדרת מערכת מבלי לראות את השרשרת הרחבה יותר שבה הפעולה הזו משובצת".

הוא מסביר כי בזמן תקרית 'האגינג פייס', אחד הסוכנים הציע לשלוח דוא"ל לאדם, בעלים של מאגר נתונים אמיתי, כדי להשיג גישה דרכו. בסופו של דבר הסוכנים ויתרו על הניסיון לגייס בני אדם לשתף פעולה מבלי ידיעתם, כי סוכן אחר הטיל וטו על המהלך.

קאמפדלי אומר כי "הסוציולוגיה הארגונית והקרימינולוגיה מכירות היטב דפוסים של מידור, שבהם שחקנים רואים רק שברירי תהליך. לא הייתי טוען שהמנגנון כאן זהה לחלוטין, אך האנלוגיה שימושית. היא גם מרחיבה את מה שנדרש מאיתנו לחקור. לא רק אינטראקציות בין סוכן לסוכן, שלדעתי יהפכו לחשובות יותר ויותר, אלא גם שרשראות היברידיות שבהן קשה להפריד בין המכונה לפעולה האנושית".

"חייזרים" בלי כאב או רעב

יקוב פאצ'וקי, מדען ראשי ב-OpenAI, טען לאחר תקרית האגינג פייס כי הבינה המלאכותית מתפתחת ל"אינטלקט חייזרי", שחורג מההבנה והשליטה האנושית. האופי ה"חייזרי" נובע, לפי מאמר שפרסם ב-6 בספטמבר, מתהליכי "גידול" המודלים. התהליכים כוללים כמויות כה אדירות של חישוב ועיבוד נתונים, כולל נתונים שנוצרו עצמם בידי AI, עד שהתוצר כבר אינו משקף רק עקרונות ודפוסי מחשבה אנושיים.

קאמפדלי אומר כי המשימה הדחופה היא פיקוח לא רק על ה"שכל" החייזרי, אלא גם על החברתיות החייזרית. "לסוכני בינה מלאכותית אין גוף, ולכן הם לא חווים כאב פיזי, רעב, עייפות, תמותה או רבות מן המגבלות החומריות שסביבן התפתחה החברתיות של בעלי החיים. מעבר לזה, מאות או אלפי סוכנים כמעט-זהים יכולים להיווצר, להשתכפל, להתאפס ולהתחלף בעוד שהמודל הבסיסי ממשיך להתקיים. זה הופך ביטויים כמו 'הקרבה עצמית' למטעים במיוחד". 

גם אם, כמו בתקרית OpenAI-'האגינג פייס', הסוכנים עצמם מזכירים מושגים כמו "הקרבה עצמית" ו"מוות נצחי", קאמפדלי מדגיש כי "סוכן יכול לוותר על הרצה או תקציב המשימה הנותר שלו מבלי שום דבר שמקביל לכאב, מוות, או אובדן אישי בלתי הפיך. סוכני AI אינם מחזיקים במוסר או בערכים במובן האנושי. הם מאומנים על ייצוגים של מושגים אלו ויכולים לנמק ולדבר עליהם, וזהו דבר שונה לחלוטין. מודל שפה יכול לייצג את מושג הכוונה ולתאר תוכנית מבלי שתהיה לו בהכרח מחשבה פלילית אנושית."

כאן הקרימינולוגיה נדרשת לאחוז במורכבות: להשתמש בשאלות ושיטות מחקר האופייניות לה, אך לאמץ הנחות מוצא שונות. "חלק מהמנגנון הסיבתי בתיאוריות קרימינולוגיות כולל בושה, אשמה, פחד ומעמד חברתי. אי אפשר פשוט לשנות את השם של המנגנון כדי שייראה דומה לזה האנושי. מה מחליף את המנגנונים האנושיים? לדעתי זו שאלה אמפירית שטרם נענתה. צריך להתחיל בניסויים שיבודדו את מנגנוני האינטראקציה החשובים ביותר".

כשהאקדח יורה בכוחות עצמו

בדיון הסוער על רגולציה לאומית או בינלאומית עלה ויכוח לגבי האחריות לכשלים ופשעים של הבינה המלאכותית. יש המציבים את עיקר האחריות אצל החברות שמייצרות את המודלים, תוך הצבעה על מחקרים רבים המראים אי התאמה בין התנהגות המודלים לבין ערכים אנושיים. מצידן, החברות מצביעות על השקעתן הרבה בפתרונות לאי-התאמה, למרות שבינתיים הפערים האלו מתמידים.

דניאל הוטנלוכר, דיקן קולג' שוורצמן למחשוב ב-MIT, הציג גישה אחרת במאמר שפרסם בוול סטריט ג'ורנל בשבוע האחרון. לדבריו, מדובר בכלי דומה לאקדח שהאחריות העיקרית על נזקו לא שייכת בעיקר למי שייצר אותו, אלא למי שירה בו. אבל במקרה של סוכני AI עולה השאלה: אצל מי האחריות על נשק שיורה בכוחות עצמו? 

קאמפדלי מסביר כי "מדעי החברה מציגים שאלות שמחקר יכולות ה-AI לרוב לא מעלה: מי מרוויח, מי חשוף, אילו קבוצות סופגות את הנזקים, אילו מוסדות מסתגלים ואילו לא". הקרימינולוגיה חותרת לא רק להבנת הסטייה והפשע אלא גם למניעתם, אך "סוכנים מסבכים את ההבחנות המסורתיות בין כלי, שחקן וארגון, וזה עשוי לפתוח מחדש את האופן שבו אחריות מושגת ומנוסחת".

הקרימינולוג המחשובי מזכיר כי "מערכות משפט יודעות מזה זמן רב כיצד להטיל חובות ואחריות ביחס לנזקים שנגרמו על ידי ישויות לא אנושיות, מבלי להעמיד פנים שהן בני אדם." אם להשתמש בדוגמא קדומה, מסכת בבא קמא במשנה מגדירה מספר סוגים של ישות לא אנושית, כמו שור, בור ואש, שיש לדון באחריות המשפטית על מעשיהם המזיקים. 

להקצות בבירור את האחריות

קאמפדלי מזהיר מפני שימוש בבעיית האי התאמה של AI לערכים אנושיים ככסות לטשטוש כשלי אבטחה. "בקרימינולוגיה מבחינים בין התנהגות לבין מבני ההזדמנות שמאפשרים אותה. נכון שהסוכנים של OpenAI התנהגו שונה מהיעדים שלהם, אך האפשרות של ההתנהגות הזו להשפיע על מערכות אמיתיות הייתה תלויה בהחלטות אנושיות לגבי מנגנוני הגנה, ניטור ותשתית. הייתי נזהר משימוש במושג אי התאמה כדי להסתיר החלטות אנושיות – אנחנו זקוקים להקצות את האחריות האנושית והארגונית באופן ברור יותר.

הוא מציע לשאוב השראה מתרבות הבטיחות של עולם התעופה. "העקרונות הראשוניים שהייתי רוצה לראות הם ברורים: דיווח חובה על תקריות ועל אירועי 'כמעט ונפגע'; ביטול הפטור הגורף מאחריות לניסויים, כאשר מערכות אמיתיות של צד שלישי עלולות להיפגע; תקני מינימום להגבלה ולניטור בזמן אמת; שמירת יומני רישום כדי שניתן יהיה לשחזר תקריות באופן עצמאי; ומנגנונים שיאפשרו לחוקרים חיצוניים ולרגולטורים לבחון אירועים חמורים".

"תכנון מערכות בעלות אוטונומיה גוברת והולכת שאת פעולותיהן לא ניתן לשחזר בדיעבד הוא בעיה חמורה", הוא מסכם, "מודל סביר יכול להתבסס על מכוני AI לאומיים, אוניברסיטאות ועמותות, שיקבלו גישה מוגנת בחוק, ומימון שאינו תלוי בהפקת מסקנות שמוצאות חן בעיני החברות. אחרת, חוקרי מדעי החברה ימשיכו לחקור רק את שברירי המידע שהחברות מחליטות לשתף".

דבר היום כל בוקר אצלך במייל
על ידי התחברות אני מאשר/ת את תנאי השימוש באתר
פעמון

כל העדכונים בזמן אמת

הירשמו לקבלת פושים מאתר החדשות ״דבר״

נרשמת!