ב־30 שניות

  • OpenAI פרסמה ב־6 בספטמבר נתונים פנימיים שלפיהם סוכני קוד משתלבים בעבודת החוקרים, מאיצים כתיבת קוד והרצת ניסויים ומקבלים משימות מורכבות יותר.
  • החברה מגדירה “מתמחה מחקר” כמערכת שמבצעת משימה מוגדרת היטב, תחת הכוונה אנושית, גם כשהמשימה הייתה אורכת לחוקר מיומן כמה ימים.
  • הנתונים הם מדידה עצמית של OpenAI: יותר קוד וניסויים אינם בהכרח יותר פריצות דרך, וביותר ממחצית מהמשימות המוצלחות שנמשכו 4–8 שעות נדרשה לפחות התערבות אנושית אחת.
ההקשר של מיכל הדס

מה חשוב להבין

הטענות והמדדים מיוחסים במפורש ל־OpenAI. לא נמצא בעת הפרסום אימות חיצוני מלא לנתוני השימוש הפנימיים, ולכן הכתבה מדגישה את מגבלות המדידה ואינה מציגה את המערכת כחוקר עצמאי.

מה OpenAI טוענת שהשיגה

בפרסום מ־6 בספטמבר 2026 OpenAI כתבה שלפי המדידות שלה היא הגיעה ליעד שהגדירה כ“מתמחה מחקר אוטומטי”. אין מדובר במערכת שבוחרת לבדה את סדר היום המדעי, אלא בסוכן שמקבל מאדם משימה מוגדרת היטב ומבצע עבודה שיכולה להימשך ימים.

החברה מציגה עלייה בשימוש בסוכני קוד, במספר הניסויים ובמורכבות המשימות. היא גם מדגישה שבני אדם עדיין קובעים סדרי עדיפויות, שופטים אילו רעיונות ראויים להמשך ומחליטים אם להרחיב, לעצור או לפרוס מערכת.

הנתון החשוב שממתן את הכותרת

OpenAI עצמה מזהירה שהמדדים מוקדמים וקשים לפרשנות. יותר קוד או יותר ניסויים אינם מבטיחים מחקר טוב יותר, משום שמחשוב, איכות ההערכה, בחירת השאלה ובטיחות יכולים להפוך לצוואר הבקבוק החדש.

לפי הנתונים שפרסמה, ביותר ממחצית מהמשימות המוצלחות שנאמדו כעבודה של 4–8 שעות נדרשה לפחות התערבות אנושית אחת. לכן “מתמחה” הוא תיאור מדויק יותר מ“חוקר עצמאי”, והביצועים טרם אומתו במחקר חיצוני בלתי תלוי.

מה זה אומר לצוותי מחקר ופיתוח בישראל

צוות ישראלי יכול להשתמש בכלי AI לקוד ניסוי, ניתוח תוצאות, איתור תקלות ותיעוד, אך צריך להפריד בין תפוקה לבין תוקף. כל ניסוי זקוק להשערה, מדד הצלחה, עקיבות לגרסאות ובדיקה אנושית של המסקנה.

בהטמעת AI בארגונים מומלץ להתחיל בסביבה מבודדת, להגביל הרשאות ורשת, לשמור יומן פעולות ולהגדיר נקודת עצירה. משימות הכוללות קוד קנייני, מידע אישי או מערכות ייצור דורשות בקרות מחמירות יותר.

למה זה חשוב

המשמעות שמעבר לכותרת

חדשות בינה מלאכותית נוטות למדוד מודלים לפי תשובות קצרות. כאן הסיפור הוא שינוי בתהליך המו״פ עצמו: סוכני AI מבצעים רצפים ארוכים של קידוד, ניסוי וניתוח. עבור AI בישראל, אוניברסיטאות, חברות סייבר וצוותי פיתוח יכולים להרוויח מקיצור מחזורי ניסוי — בתנאי שהאדם ממשיך לקבוע את שאלת המחקר, לאמת את התוצאה ולהחליט אם להתקדם.

מה עושים עכשיו?

צעד יישומי אחד

בחרו משימת מחקר אחת עם תוצאה ניתנת לבדיקה, תעדו זמן אדם, זמן סוכן, מספר התערבויות, עלות חישוב ושגיאות, והשוו לביצוע הידני. הרחיבו שימוש רק כאשר השיפור חוזר על עצמו ואינו פוגע בבקרה או באבטחת המידע.

מקורות ובדיקת עובדות

גילוי AI ושקיפות: כלי AI עשויים לסייע בניטור, תרגום, טיוטה ויצירת איור. המקורות נבדקו והפרסום נערך ואושר בידי ד״ר יניב שנהב; האחריות המערכתית נשארת בידי AI NEWS ישראל.
מיכל הדס, כתבת AI אחראי ולמידה ב־AI NEWS ישראל
על הכותב

מיכל הדס

מרצה ויועצת להטמעת AI, המפתחת חוויות למידה מבוססות גיימיפיקציה ודיגיטל ומחברת בין כלים פרקטיים, אתיקה וניהול סיכונים.

לכל הכתבות של מיכל הדס
מצאתם טעות? שלחו דיווח למערכת