ב־30 שניות
- OpenAI הכריזה על GPT‑6 Astra והחלה בהשקה מוגבלת לפני הרחבה למוצרי ChatGPT, ל־API ולשירותי ענן.
- החברה מציגה שיפור בשימוש במחשב, הנדסת תוכנה, מדע וסייבר, אך גם מזהירה שניטור מהלך ההנמקה הכתוב קשה יותר לעומת הדגם הקודם.
- ארגונים בישראל צריכים לבצע מבחני עברית ועומסי עבודה מקומיים, להגדיר הרשאות מינימליות ולמדוד את העלות הכוללת לפני הפעלה בייצור.
מה חשוב להבין
הנתונים המספריים והזמינות מבוססים על הודעת OpenAI ומוצגים כטענות ספק; עצם ההשקה והקשר הבטיחות אומתו מול Reuters. האישור המערכתי ניתן בידי ד״ר יניב שנהב ב־4 בספטמבר 2026.
מה הושק ומה צפוי להיפתח
OpenAI הודיעה ב־3 בספטמבר על GPT‑6 Astra והחלה בהשקה מדורגת: תחילה לקבוצה מוגבלת של ארגונים, ובהמשך למנויי ChatGPT Plus, Pro, Business ו־Enterprise ולמפתחים דרך API ושירותי ענן. בארגוני Enterprise הגישה אינה פעילה כברירת מחדל ודורשת הפעלה מצד מנהל המערכת.
שם המודל ב־API הוא gpt-6-astra. המחיר הסטנדרטי שפרסמה החברה הוא 10 דולר למיליון טוקני קלט ו־50 דולר למיליון טוקני פלט. אלה נתוני מחיר של הספק; העלות בפועל תלויה באורך ההקשר, במספר ניסיונות, בכלים שהסוכן מפעיל ובבקרות שסביבו.
היכולות גדלות, וגם דרישות הבקרה
OpenAI מציגה שיפור בשימוש במחשב, בתכנות, במדע ובמשימות סייבר. את נתוני הביצועים יש לקרוא כמדדי ספק ולבחון מחדש בעבודה אמיתית. Reuters אימתה את עצם ההשקה ואת העובדה שהיא מגיעה על רקע ביקורת גוברת על בטיחותם של סוכנים בעלי יכולת פעולה.
בהודעת ההשקה מציינת OpenAI כי מהלך ההנמקה הכתוב של Astra קשה יותר לניטור בהשוואה לדגם Sol. המשמעות המעשית אינה שהמודל אינו בטוח, אלא שאי אפשר להסתמך רק על צפייה בהסבר שהוא מציג. הרשאות מצומצמות, לוגים חיצוניים, מגבלות פעולה ואישור אדם לפעולות רגישות נשארים חיוניים.
המבחן הישראלי: עברית, פרטיות ועלות
ארגון ישראלי צריך לבחון משימות בעברית, מסמכים מקומיים, שילוב עם מערכות קיימות ותרחישי כשל. בדיקה טובה כוללת גם מידע רגיש מדומה, בקשות עמומות וניסיון של הסוכן לבצע פעולה מעבר להרשאה שניתנה לו.
אין צורך לעבור מודל רק בגלל כותרת או ציון benchmark. החלטה אחראית משלבת איכות, אבטחה, זמינות, מחיר ותוכנית חזרה למודל חלופי. כאשר הסוכן מחובר לדוא״ל, לקוד או למערכות עסקיות, נקודות האישור האנושי צריכות להיות מוגדרות לפני ההפעלה ולא אחרי תקלה.
המשמעות שמעבר לכותרת
השקת מודל חזק יותר אינה רק שדרוג איכות. ככל שסוכן מסוגל לפעול במחשב, לכתוב קוד ולהשתמש בכלים, גדלה גם החשיבות של הרשאות, גבולות פעולה ותיעוד החלטות. לארגונים בישראל נוסף מבחן מקומי: ביצועים בעברית, התאמה למדיניות פרטיות ועלות תחת שימוש אמיתי.
צעד יישומי אחד
בחרו שלושה תהליכים מייצגים, הריצו אותם במקביל במודל הקיים וב־Astra, ומדדו איכות בעברית, שיעור טעויות, זמן, עלות ופעולות שדורשות אישור אנושי. אל תרחיבו הרשאות לפני שהבדיקה עוברת.
