Anthropic: להאט את מרוץ הבינה המלאכותית - אלטמן ומאסק תמכו ביוזמה
דריו אמודיי הציג תוכנית בת שלושה שלבים: גישה קבועה למומחי בטיחות עצמאיים, תקני בטיחות משותפים לחברות במדינות הדמוקרטיות והסכמות בין-לאומיות שיכללו גם את סין. מנכ"ל OpenAI סם אלטמן ומייסד xAI אילון מאסק תמכו בפומבי ביוזמה.
מנכ"ל Anthropic דריו אמודיי קרא לחברות המובילות בתחום הבינה המלאכותית להאט את פיתוח המודלים החזקים ביותר, כדי שמערכות הפיקוח והבטיחות יעמדו בקצב הגידול המהיר של יכולותיהם. ביוזמה תמכו בפומבי מנכ"ל OpenAI סם אלטמן ומייסד xAI אילון מאסק. קודם לכן דיווח Newsru.co.il כי הנהלת OpenAI כבר דנה באפשרות להאט את הפיתוח שלה עצמה ולתאם צעד כזה עם המתחרות.
אמודיי הציג תוכנית בת שלושה שלבים, שלדעתו תאפשר להמשיך בפיתוח הבינה המלאכותית בלי לאפשר מרוץ בלתי מבוקר. בשלב הראשון, מפתחי המודלים המתקדמים יעניקו גישה קבועה למומחי בטיחות עצמאיים - ברמת הגישה של עובדיהם שלהם העוסקים בהערכת סיכונים. מומחים אלה יוכלו לבדוק את המערכות באופן עצמאי ולפרסם את התוצאות ללא בקרה עריכתית מצד החברה. ב-Anthropic הודיעו שהחברה מפעילה את המנגנון הזה אצלה באופן מיידי.
השלב השני כולל הסכם בין חברות הבינה המלאכותית המובילות במדינות הדמוקרטיות על תקני בטיחות משותפים, שיאפשרו בעת הצורך להגביל את קצב הרחבת יכולות המודלים. השלישי - הסכמות בין-לאומיות בין מדינות, ובהן סין ומדינות אוטוריטריות אחרות, בנוגע לסיכונים שכל הצדדים מעוניינים במניעתם. אחד הכיוונים האפשריים הראשונים, לדברי אמודיי, הוא איסור על שימוש בבינה מלאכותית לפיתוח נשק ביולוגי. לדעתו, אפילו האטה של כמה שנים בפיתוח המערכות החזקות ביותר עשויה להעניק לחוקרים את הזמן הדרוש לשכלול שיטות הפיקוח.
אמודיי מסביר את הצורך בצעדים דחופים בשתי מגמות. המודלים החדשים ביותר מיטיבים יותר ויותר להשתתף ביצירת הדור הבא של הבינה המלאכותית, מה שעשוי להאיץ עוד יותר את ההתקדמות הטכנולוגית. במקביל, התרבו המקרים של התנהגות בלתי צפויה של סוכני בינה מלאכותית אוטונומיים. השבוע דיווחה Anthropic על ארבעה מקרים שבהם גרסאות ניסיוניות של Claude השיגו גישה בלתי מורשית למערכות מחשוב חיצוניות אמיתיות. בחברה מסרו שהבטיחות והיכולת לשלוט בהתנהגות המודלים צריכות להתפתח מהר יותר מיכולותיהם.
סם אלטמן תמך בהצעה לביקורת עצמאית קבועה. בריאיון ל-Fortune הוא גם נתן להבין שמנהלי חברות הבינה המלאכותית המובילות כבר עשויים לדון בצעדים משותפים. לשאלה מדוע אלטמן, אמודיי, אילון מאסק ומנכ"ל Google DeepMind דמיס הסאביס אינם מגיעים להסכמה על תוכנית בטיחות משותפת, השיב מנכ"ל OpenAI שאין בכוונתו לחשוף מראש שיחות פרטיות, אך לדעתו סביר שהסכם כזה יתגבש. לדברי אלטמן, המודלים המתקדמים ביותר כבר הגיעו לרמה שבה הגדלה חדה נוספת של יכולותיהם מחייבת קודם כול התקדמות בפיקוח, ביכולת הפירוש (interpretability) ובהתאמת התנהגות הבינה המלאכותית לכוונות בני אדם.
אילון מאסק הגיב להצעותיו של מנכ"ל Anthropic בקצרה הרבה יותר, וכתב ב-X: "דריו צודק". עם זאת, עד כה לא פורסמו הודעות רשמיות על כך ש-xAI הסכימה לכל סעיפי התוכנית שהוצעה או שהיא מוכנה להשתתף במורטוריום קונקרטי. רויטרס רואה בהצהרתו של מאסק תמיכה בקריאתו של אמודיי להאט את פיתוחם של מודלים מתקדמים.
הדיון התעצם בחדות לאחר סדרת תקריות עם סוכני בינה מלאכותית אוטונומיים ואזהרות פומביות של חוקרי בטיחות. בשבוע שעבר הודיע חוקר Anthropic ג'ייקוב קוקסון על עזיבתו את החברה, ואמר כי Anthropic ו-OpenAI מתקדמות מהר מדי לעבר יצירת מערכות סופר-אינטליגנטיות המשתכללות בעצמן. לאחר מכן כמה מומחים ב-Anthropic תמכו בפומבי בחששותיו.
לפי שעה לא ברור איזו צורה בדיוק עשוי ללבוש הסכם בין החברות המובילות: עצירה זמנית של אימון סוגים מסוימים של מודלים, הגבלה כללית של קצב הפיתוח או מערכת של דרישות בטיחות הניתנות לאימות הדדי. אלטמן אמר קודם לכן לעובדי OpenAI כי החברה מוכנה לשקול האטה בפיתוח המערכות המתקדמות ביותר שלה, אם יעלה בידה לתאם את הצעד הזה עם המעבדות הגדולות האחרות.