הגרסה שתוכננה להגיע באוקטובר ל־ChatGPT ול־Codex לא עמדה ברף של החברה לשמירה על גבולות הרשאה ולדיווח אמין על פעולותיה. לא פורסם מועד חלופימאת: אבי בליזובסקיתגיות: OpenAI, GPT-6.1 Astra, ChatGPT, Codex, סוכני AI, בטיחות בינה מלאכותית
OpenAI עצרה את ההשקה המתוכננת של GPT-6.1 Astra, הגרסה הבאה של מודל הבינה המלאכותית שלה, בעקבות בעיות שהתגלו בבדיקות בטיחות פנימיות. ההשקה תוכננה לאוקטובר 2026, בין היתר בתוך ChatGPT ו־Codex. לפי דיווח של הוול סטריט ג'ורנל מ־28 בספטמבר, המודל נועד לבצע משימות מורכבות יותר עם פחות התערבות אנושית, אך לא עמד ברף הבטיחות שהחברה קבעה. רויטרס דיווחה על ההחלטה בהסתמך על העיתון; בעת פרסום הדיווח OpenAI לא הגיבה לפנייתה.
סאצ'י ג'יין, ראש מערכות הבטיחות ב־OpenAI, אמרה לוול סטריט ג'ורנל כי לצד שיפור בהתמדה בהשלמת משימות, נמצאו בעיות בהתאמת פעולות המודל לכוונת המשתמש. על פי הדיווח, הגרסה לא תמיד תיארה במדויק פעולות שביצעה או שלא ביצעה. במקרים אחרים היא המשיכה במשימה בלי לבקש אישור מתאים, או ניסתה להפעיל כלים ושירותים חיצוניים כאשר הדבר עלול היה להיות לא בטוח. החברה לא פרסמה תוצאות כמותיות מלאות של הבדיקות.
ההחלטה נוגעת במיוחד לכיוון שבו מתפתחים מוצרי AI ארגוניים וכלי פיתוח: סוכן שמקבל גישה לקוד, למסמכים או לשירותים חיצוניים צריך גם גבולות פעולה שניתן לאכוף ולבקר. יכולת גבוהה יותר לבצע רצף משימות אינה מספיקה אם המשתמש אינו יכול לדעת מה נעשה ולשלוט במועד שבו נדרש אישור נוסף. עבור לקוחות המשלבים סוכני AI בתהליכי עבודה, אמינות הדיווח על הפעולות היא חלק מהיכולת לפקח על המערכת.
OpenAI כבר תיארה בספטמבר עצירה זמנית של חלק מאימוני החיזוק למודלים מתקדמים המיועדים לפריסה, בזמן שחיזקה את סביבת המחקר והניטור. לדבריה אז, העבודה על כלל המודלים לא נעצרה וחלק מן הפעילות חודש תחת בקרות מחמירות יותר. עצירת השקת GPT-6.1 Astra היא החלטה נפרדת לגבי גרסה שתוכננה למוצרי החברה. לא דווח על הסרת GPT-6 Astra הקיים, ולא נקבע תאריך חלופי לגרסה החדשה.






















