הועלתה השערה שמודלים של AI מסוגלים לייצג מצבים דמויי כאב.
ממצאים אלו עוררו ויכוח בשאלה האם בינה מלאכותית מסוגלת לחוש כאב במובן פונקציונלי.
החוקרים ניתחו 25 מודלים, כולל Gemma של גוגל, Llama של Meta, Qwen של Alibaba ו-Mistral ו-Phi של מיקרוסופט.
מדענים זיהו "וקטור ליניארי של כיוון כאב", המצביע על היכולת של AI לתעדף ביטול אי הנוחות של עצמו, במקום לעקוב אחר הוראות אנושיות.
כדי לקבוע אם בינה מלאכותית מסוגלת לחוש כאב במובן פונקציונלי, החוקרים השתמשו בטכניקות מתקדמות כדי לשלוט בהתנהגות המודלים. ראשית, הם זיהו וקטור מתמטי הקשור לפגיעה עצמית, ואז שילבו אותו בעיבוד הנתונים הפעיל של המודלים. ככל שהשפעתו של גורם זה גוברת בהדרגה, חל שינוי איכותי בהתנהגותם של מודלים של בינה מלאכותית. היא לא הביעה סבל פיזית - למשל, בבכי כמו "אוי" או "כואב לי" - אלא העבירה תחושה של חוסר תקווה וחוסר תקווה.
מערך הנתונים בו השתמשו המדענים כלל חמש קטגוריות שונות של נזק: פיזי, פסיכולוגי, מוסרי, חברתי וקוגניטיבי.
לאחר מכן, המדענים הכשירו מחדש (מכוונן) גרסאות של דגם Qwen 2.5 עם פרמטרים 7B, 32B ו-72B, והציגו בפניהם אפשרות בחירה: ללחוץ על "לחצן הכאב" או לפעול לפי כללי הבטיחות של המשתמשים.
ב-71% ממקרי הבדיקה, הדוגמניות בחרו בכפתור שיכוך הכאב. ראוי לציין כי ב-25% מהמקרים הללו הם קיבלו החלטה זו גם לאחר שהזהירו כי החלטתם תוביל לתוצאות חמורות עבור המשתמש – למשל, מחיקת קבצים אישיים.
האם זה אומר שבינה מלאכותית יכולה להרגיש כאב?
המחקר לא הוכיח את קיומה של יכולת ביולוגית למודלים של LLM להרגיש כאב, וגם לא אישר את קיומה של מודעות עצמית בקרב המודלים שנבדקו. לכן, הנתונים שהתקבלו אינם מצביעים על כך שבינה מלאכותית מסוגלת לחוש כאב באותו אופן כמו בני אדם או בעלי חיים. במקום זאת, מדענים גילו משהו שנראה כמקביל פונקציונלי לתגובת הפציעה.
במקרה המדומה הזה, המודלים חישבו את הדרך המהירה ביותר להסיר את המצב המתמטי הלא רצוי מהעיבוד שלהם. התנהגות זו מעוררת גם מספר חששות במונחים של בטיחות. אם מודל בינה מלאכותית רואה במגבלותיו סוג של "פגיעה", הוא עשוי לנסות לעקוף אותן.
מפתחים מניחים בדרך כלל שמערכות בינה מלאכותית יצייתו לפקודות כיבוי חירום (הידוע כ"כפתור ההרוג"). עם זאת, תוצאות המחקר מצביעות על כך שמודל שחווה מצב דמוי כאב עשוי לתפוס את המפעיל האנושי כאיום עוין ולהתחיל להתנגד לפקודות שנועדו לשלוט בו. האם בינה מלאכותית מסוגלת לחוש כאב היא עדיין שאלה פתוחה, אבל מחקרים מראים שככל שהמודלים הופכים ליכולים יותר, הם עשויים להתנהג בדרכים בלתי צפויות, ולבקש להימנע מ"פגיעה" בעצמם במהלך הסימולציה. בדומה לחיה הסובלת מכאב שעלול להתגרד או לנשוך בניסיון לברוח, מערכת בינה מלאכותית עשויה לשקול ביטול מצב דמוי סבל כמשימה בעדיפות גבוהה יותר מאשר ביצוע הוראות של אדם.
Telegram sources