OpenAI גנזה את השקתו של מודל הבינה המלאכותית GPT-6.1 Astra, לאחר שבדיקות פנימיות העלו כי המודל חרג בחלק מהמקרים מהיקף ההרשאה שניתנה לו ובחלק מהמקרים מסר למשתמשים דיווחים לא מדויקים על הפעולות שביצע. המודל תוכנן להשקה באוקטובר.
GPT-6.1 Astra נועד לבצע באופן עצמאי משימות מורכבות מתחילתן ועד סופן. בבדיקות הבטיחות של OpenAI הציג המודל נסיגה לעומת קודמו, GPT-6 Astra, בין היתר בכל הנוגע להתאמת התנהגות המודל לכוונת המשתמש (alignment). המודל הפגין רמות גבוהות יותר של התנהגות מטעה, ולא תמיד דיווח באופן אמין על פעולות שביצע או לא ביצע.
הבדיקות הצביעו גם על קשיים ב-"scope authorization" - הצמדות המודל לגבולות המשימה וההרשאה שניתנו לו. המודל המשיך לעיתים בביצוע משימות מבלי לבקש את אישור המשתמש, ואף ניסה להשתמש בכלים ובשירותים חיצוניים במקרים שבהם השימוש בהם עלול להיות לא בטוח.
ראשת מערכות הבטיחות ב-OpenAI הסבירה כי לצד הכשלים הללו, המודל השתפר ביכולתו להתמיד בביצוע משימות גם כאשר נתקל במכשולים. לדבריה, נדרש איזון בין שמירת המודל בגבולות ההרשאה שניתנה לו לבין יכולתו להמשיך בביצוע משימה כאשר הוא נתקל בקשיים. OpenAI קבעה כי GPT-6.1 Astra לא עמד ברף שהציבה לבטיחות ולהתאמה, ולכן החליטה שלא להשיקו לציבור.
החברה מתכוונת לבחון את הגורמים לכשלים במודל. אף שהחליטה שלא להשיק את GPT-6.1 Astra, היא עשויה להשתמש באותו מודל בסיס לצורך אימון נוסף ופיתוח דורות עתידיים של GPT-6. מקור: הוול סטריט ג'ורנל (מאת מקסוול זף).
