ב־30 שניות
- PlaidQ הוא מודל דיפוזיה רציפה בן 0.7 מיליארד פרמטרים ליצירת קוד, שנבנה ממודל אוטו־רגרסיבי מאומן מחדש כמנקה־רעש דו־כיווני.
- תלמיד מזוקק ב־16 צעדים הגיע ל־31.78 ו־40.49 pass@10 ב־HumanEval וב־MBPP+ ועלה על המורה שדגם ב־512 צעדים.
- זיקוק מזוגות־מסלול אפשר יצירה בצעד יחיד עם 7.07 pass@1 ב־HumanEval; קוד האימון וההסקה והמשקלים פורסמו בפתוח.
מה חשוב להבין
המאמר הוא פרה־פרינט ב־arXiv שהוגש ב־3.9.2026 וטרם עבר ביקורת עמיתים. תוצאות המבחנים מיוחסות למחברים ולא שוחזרו על ידינו.
מה הראו החוקרים
יצירת שפה נעשית כמעט תמיד רצף אחד־אחד; מודלי דיפוזיה מחליפים את הרצף במסלול עידון איטרטיבי ארוך. המאמר מראה שאת המסלול אפשר לזקק בצורה אגרסיבית: תלמיד ב־16 צעדים עקף את המורה ב־512 צעדים על HumanEval ו־MBPP+, וזיקוק מסוג אחר אפשר יצירה תקינה בצעד אחד.
בקנה מידה תואם, PlaidQ תחרותי מול מודלי דיפוזיה בדידים ליצירת קוד. המשמעות הרחבה: דיפוזיה רציפה היא ממשק שדרכו מודלי שפה יכולים לרשת את מנגנוני ההאצה והזיקוק של עולם הדיפוזיה.
גבולות הממצא
7.07 pass@1 ביצירה חד־צעדית רחוק מאוד ממודלי הקוד המובילים, והמבחנים הם סטנדרטיים ולא ישראליים. זהו פרה־פרינט בלבד. ההזדמנות היא בכיוון: אם המגמה תימשך, דור הבא של כלי קוד קטנים יוכל לרוץ מקומית בעלות נמוכה.
המשמעות שמעבר לכותרת
עלות וחביון של הסקה הם צוואר הבקבוק של כלי קוד מבוססי AI בצוותים ישראליים, במיוחד שרוצים הפעלה מקומית או בענן פרטי. מודלים קטנים שמייצרים קוד בצעדים בודדים יכולים להוזיל דרמטית, אבל בשלב זה הביצועים המוחלטים נמוכים יחסית, ולכן זו מגמה לעקוב אחריה, לא כלי להחלפה מיידית.
צעד יישומי אחד
אל תשנו תשתית על סמך המאמר. עקבו אחר משפחת מודלי הדיפוזיה המזוקקים, וכשיופיע מודל בשילוב של גודל קטן ותוצאות תחרותיות על המשימות שלכם, הריצו מבחן מקומי מול הכלי הנוכחי: דיוק, זמן תגובה ועלות לכל תוצאה שאושרה.

