Qeravio
אירוע בינה קנוני

Llama.cpp תומך ב-72 בינה מלאכותית HMX.

העדכון תומך ב-72 head_dim עבור HMX flash-attention, עם שבילי זנב מלאים אפס שאינם כפולים של 64.

19 בספט׳ 20261 טענות מאומתות1 מקורות1 תצפיות
מה קרה

מקור רשמי דיווח כי בינה מלאכותית הוכשרה להריץ את HMX flash-attention עם head_dim שאינו כפול של 64, כגון SigLIP head_dim=72, על ידי עיבוד DK/DV מעוגל ל-64 עם שבילי זנב מלאים אפס.

למה זה חשוב

עדכון רשמי מדווח על התפתחות בנוגע ל-b11043: hexagon: HMX flash-attention head_dim padding (תמיכה DK=DV=72). משמעות הפיתוח תלויה בטווח והראיות שצוינו על ידי המקור.

מה כדאי לבדוק בהמשך

קראו את עדכון המקור הרשמי ולאמת את היקף, הראיות והזמן המפורטים לפני שתפעילו אותו.

ידע מקושר

ישויות שמושפעות מהאירוע

המשך בנושא
שרשרת ראיות

המקורות שמאחורי האירוע