מקור רשמי דיווח על עדכון: b10687: OpenCL: שיפור מסלול matmul בשני דורות של GPU Adreno. OpenCL: שיפור מסלול matmul בשני דורות של GPU Adreno (#27640). OpenCL: הפעלת Adreno xmem F16xF32 GEMM כברירת מחדל עבור X2E. kernel_mul_mm_f16_f32_l4_lm הוא המהיר ביותר של ה-backend על Adreno. על X2-90 הוא מבצע את התבוננות התשומת לב של gpt-oss-20b בערך רבע מהמהירות של GEMM צפוף מותאם q4_0 על אותו מכשיר. זה חשוב לכל דגם שמשקלו לא מומחה נשאר f16. הגרסה המקורית של gpt-oss-20b היא כזו, ו-40.8% מזמן ה-GPU שלה מוקדש לקרנל זה.
אירוע בינה קנוני
הדורות החדשים של Adreno GPU שיפרו ביצועי כפל מטריצות.
התוכניות של ה-GPU Adreno X2-90 gpt-oss-20b פועלות 25% מהר יותר עם הנתיב החדש של OpenCL.
29 באוג׳ 20261 טענות מאומתות1 מקורות1 תצפיות
עדכון רשמי מדווח על התפתחות של b10687: opencl: שימוש בנתיב טוב יותר למכפלה מטריצות בשתי דורות של GPU Adreno. משמעות הפיתוח תלויה בטווח והראיות המובאות על ידי המקור.
קראו את עדכון המקור הרשמי ווידאו את היקפו, הראיות והזמן לפני שתפעילו אותו.
ידע מקושר
ישויות שמושפעות מהאירוע
שרשרת ראיות
המקורות שמאחורי האירוע
הצגה מערכתית
פתיחת הכתבה