"תעשיית הבינה המלאכותית שיקרה במשך זמן רב על הסיכונים הכרוכים בבינה מלאכותית" – כך אמר מנכ"ל Anthropic, דריו אמודיי, בהתייחסו להתנהלות הענף סביב הסיכונים שמציבות מערכות בינה מלאכותית מתקדמות. הוא דיבר בראיון ל-CBS. אמודיי טען כי התעשייה לא הציגה לציבור באופן כן את הסיכונים הנלווים לפיתוח ולהטמעה של מערכות בינה מלאכותית, אף שהחברות המשיכו לקדם מודלים בעלי יכולות מתרחבות.
הדברים באו בהמשך לקריאתו, במאמר (We Must Pace the Frontier) שפרסם לפני ארבעה ימים, להאט את קצב השיפור ביכולותיהם של מודלי בינה מלאכותית, כדי שמנגנוני הבטיחות, הבקרה וההתאמה (alignment) ידביקו את קצב הפיתוח.
אמודיי כותב כי התקדמות ביכולות הבינה המלאכותית הואצה בחודשים האחרונים, בעיקר בשל יכולתם הגוברת של מודלים לסייע בפיתוח הדור הבא של המודלים. לדבריו, התפתחות זו, המכונה שיפור עצמי רקורסיבי (recursive self-improvement), עלולה להקדים את היכולת להבין ולשלוט במערכות. הוא מוסיף כי "building it too fast is reckless" – פיתוח הטכנולוגיה מהר מדי הוא פזיז.
אמודיי מציע במאמר תוכנית בת שלושה שלבים: מינוי מעריכים חיצוניים קבועים שיקבלו גישה דומה לזו של עובדי החברה לצורך בדיקת נהלי בטיחות ודיווח על תקריות; תיאום בין חברות בינה מלאכותית במדינות דמוקרטיות לקביעת תקני בטיחות ומגבלות על התקדמות בלתי מבוקרת; ותיאום גלובלי עם ממשלות אחרות, לרבות ממשלות אוטוריטריות.
לדבריו, אנתרופיק מתחייבת לאפשר לצוות ביקורת חיצוני לקבל גישה שוטפת למשרדיה, למחשבי החברה ולכלים המשמשים את צוותי הערכת הסיכונים שלה. הצוות יהיה רשאי לפרסם ממצאים על רמות סיכון, תקריות ונהלי עבודה, בכפוף להשחרות מוגבלות של מידע רגיש ביטחונית, משפטית או מסחרית.
אנתרופיק מפתחת את משפחת מודלי Claude ומציגה עצמה כחברה המתמקדת בבטיחות בבינה מלאכותית.
