ב־30 שניות

  • OpenAI פרסמה ב-30 בספטמבר דיווח על קמפיין שנועד לחלץ את ההנמקה הפנימית של מודליה. הפעילות שנחשפה החלה ביולי, לפי החברה.
  • החברה מייחסת קבוצת פעילות מרכזית לאנשים הקשורים ל-Moonshot AI, מפתחת Kimi, אך אינה מייחסת את כל הפעילות לגורם יחיד. Moonshot לא הגיבה מיד לפניות CNBC ו-Bloomberg.
  • OpenAI אומרת שלא נפרצו ההצפנה או מאגרי המידע שלה ושלא הושגה גישה ישירה לשיחות משתמשים שמורות. המספרים שפרסמה מתארים ניסיונות חילוץ, ולא בהכרח הצלחות.
הקשר מערכתי

מה חשוב להבין

הכתבה מבוססת על דיווח OpenAI וסיקור חיצוני. היקף הפעילות, החסימה והייחוס הם טענות החברה; אין כאן אימות עצמאי של זהות המפעילים או תוצאות כל ניסיון.

מה התחדש עכשיו, ומה התרחש ביולי

OpenAI פרסמה ב-30 בספטמבר דיווח על פעילות שהיא מכנה זיקוק עוין: שימוש שיטתי ולא מורשה בתוצרי מודל או בהנמקה שלו כדי לסייע לאימון מודל אחר. ההנמקה המוגנת היא התיעוד הפנימי של הדרך שבה המודל עובד על משימה, ולא התשובה הרגילה שמוצגת למשתמש. פרסום הדיווח הוא האירוע החדש; הפעילות המתוארת בו החלה ב-1 ביולי, לפי החברה.

החברה דיווחה על שיא של 16 אלף בקשות מיותר מארבעת אלפים משתמשים ב-24 וב-25 ביולי, ועל פעילות קשורה בקבוצה של יותר מ-15 אלף משתמשים. לדבריה, הקמפיין נחסם במלואו עד 28 ביולי. הערת השוליים במקור חשובה: הנתונים מתארים ניסיונות חילוץ, ולא בהכרח חילוצים מוצלחים. אין להציג אותם כמספר שיחות שנגנבו.

מה OpenAI אומרת על הגישה למידע

לפי OpenAI, המפעילים לא שברו את ההצפנה שלה, לא פרצו למסד נתונים ולא קיבלו גישה ישירה לשיחות משתמשים שמורות. החברה מתארת מניפולציה של אינטראקציות עם המודלים כדי להביא להצגת הנמקה שלא נועדה להיות גלויה. אין בכך הוכחה שכל ניסיון נכשל, אבל גם אין בסיס לכותרת שלפיה נפרצו שיחותיהם של 15 אלף משתמשים.

החברה אומרת שחוקרי אבטחה עצמאיים הביאו לידיעתה חולשות קשורות במעבר בין מודלים ובדחיסת שיחות, ושהיא אישרה את מסלולי התקיפה שדווחו. CNBC, The Verge ו-Bloomberg מדווחים על הודעת החברה; הם אינם מציגים בדיקה עצמאית שמאמתת את היקף הקמפיין, את כל תוצאותיו או את זהות כל מפעיליו.

הייחוס ל-Moonshot אינו מסקנה עצמאית

OpenAI מייחסת קבוצה מרכזית של הפעילות לאנשים הקשורים ל-Moonshot AI, החברה שמפתחת את Kimi. במקביל היא מציינת שלא ברור אם כל המפעילים שנצפו הגיעו מאותו גורם. לכן הניסוח המדויק הוא הערכת ייחוס של OpenAI, ולא קביעה ש-Moonshot ביצעה את כל הפעילות או גנבה נתוני לקוחות.

CNBC ו-Bloomberg מדווחים ש-Moonshot לא הגיבה מיד לבקשת תגובה. היעדר תגובה בזמן פרסום הדיווח אינו הודאה. גם זיקוק מודלים אינו כשלעצמו שם נרדף לגניבה: אפשר להשתמש בתוצרי מודל לאימון אחר כאשר ההרשאות והתנאים מאפשרים זאת. הטענה כאן נוגעת לפעילות ש-OpenAI מתארת כלא מורשית ובניגוד לתנאיה.

הגנות שהחברה מתארת, ובדיקה לצוותים

OpenAI אומרת שהגבילה או חסמה חשבונות, חיזקה בקרות הרשמה ותשתית, והוסיפה ניטור ובדיקות לפלט שעלול לחשוף הנמקה. היא גם מתארת חיזוק הפרדה בין משתמשים, סביבות עבודה, ארגונים ומשפחות מודלים, ושיתוף מידע דרך Frontier Model Forum. אלה צעדים שהחברה מדווחת עליהם, לא אישור שהסיכון נעלם.

החברה מדגישה שהעבודה נמשכת ושפריסות דרך שותפים זקוקות לאותן הגנות כמו שירותיה הישירים. לצוות ארגוני זו נקודת בדיקה: מי מפעיל את השירות בפועל, אילו נתוני שיחה ניתנים להעברה, ואילו בקרות חלות אצל ספק הענן. אין להניח שכל שירות צד שלישי קיבל כבר כל הגנה שעליה הודיעה OpenAI.

לבדיקת תוצרים אפשר להיעזר בנוהל אימות לתשובת AI. למי שמפעיל סוכנים, הכתבה על גבולות ההרשאה ב-OpenShell מציעה הקשר נוסף. זו המלצת מערכת לבדיקה ארגונית, ולא הנחיה לתיקון חולשה או אישור בטיחות של ספק מסוים.

למה זה חשוב

המשמעות שמעבר לכותרת

הדיווח מבחין בין שימוש בתשובה שהמודל מציג לבין חילוץ מידע פנימי שלא נועד להופיע בה. עבור ארגון שמפתח או מפעיל מערכת AI, ההבחנה נוגעת לרישוי, לבקרת גישה ולשמירת מידע שמועבר בין שיחות ושירותים. טענת ספק על חסימת קמפיין אינה בדיקת אבטחה עצמאית של כל מערכת שמשתמשת במודליו.

מה עושים עכשיו?

צעד יישומי אחד

אם אתם מפתחים מערכת שמשתמשת במודלים, בדקו אילו נתוני שיחה נשמרים ומועברים בין משתמשים, ארגונים וספקים. בקשו מהספק הבהרה על ההגנות בשירות המסוים שלכם, במיוחד בפריסה דרך ספק ענן. אין בדיווח הזה ראיה ששיחותיכם נחשפו או הוראה להחליף כלי באופן מיידי.

שאלות נפוצות

האם נפרצו שיחות משתמשים ב-OpenAI?

OpenAI אומרת שלא הושגה גישה ישירה לשיחות משתמשים שמורות ושלא נפרצו ההצפנה או מסדי הנתונים שלה. הדיווח עוסק בניסיונות לחלץ הנמקה מוגנת דרך אינטראקציות עם המודלים.

האם הוכח ש-Moonshot אחראית לכל הקמפיין?

לא. OpenAI מייחסת קבוצה מרכזית לאנשים הקשורים ל-Moonshot, אך אומרת שלא ברור אם כל המפעילים הגיעו מאותו גורם. זו הערכת החברה.

האם 16 אלף בקשות פירושן 16 אלף חילוצים מוצלחים?

לא. OpenAI מציינת שהמספרים מתארים ניסיונות, ולא בהכרח הצלחות.

האם זיקוק מודלים אסור תמיד?

לא. אפשר לבצע זיקוק בהרשאה ובהתאם לתנאים. הטענה בדיווח נוגעת לשימוש שיטתי ולא מורשה בהנמקה מוגנת.

מקורות ובדיקת עובדות

גילוי AI ושקיפות: כלי AI עשויים לסייע בניטור, תרגום, טיוטה ויצירת איור. ברשומת האתר אין לגרסה זו אישור אנושי מתועד; שם הכותב או המערכת מציין ייחוס תוכן ואינו מוצג כחותמת אישור. המקורות מוצגים לעיון ואפשר לדווח על טעות למערכת.
אחריות מקצועית

מיכל הדס

מרצה ויועצת להטמעת AI, המפתחת חוויות למידה מבוססות גיימיפיקציה ודיגיטל ומחברת בין כלים פרקטיים, אתיקה וניהול סיכונים.

לפרופיל של מיכל הדס
מצאתם טעות? שלחו דיווח למערכת