מקור רשמי דיווח על שחרור ModelOpt 0.47.0. בין השינויים החדשים: קוונטיזציה של ONNX עם Autotune, שמבצעת בדיקות מיקום בדיוק הזמן הרצוי ומשמירה על INT8/FP8 Q/DQ ממוזג רק אם עומדת בסף ההאצה של TensorRT (1.02x ברירת המחדל); אחרת, היא שמורה את הדגם בדיוק גבוה ללא קוונטיזציה. נוסף תבנית AutoQuantize של Muse Glimmer, שמחפשת פרויקציות של MLP, פרויקציות של תשומת לב עצמית, ו-lm_head על W4A16 NVFP4 ארבע-על-שש, FP8, ו-BF16 עם נפילה חוזרת של 5.5 ביטים יעילים, תוך שמירה על מגדל הראייה ללא קוונטיזציה.
אירוע בינה קנוני
גרסה 0.47.0 של ModelOpt הוסיפה מתכונים של FP8 Vision Encoder למודלים qwen3_vl ו-qwen3_5.
גרסה 0.47.0 של ModelOpt מביאה קוונטיזציה עם Autotune לדגמים ONNX, ומדד את מיקומי הריצה בדיוק הזמן הנדרש.
23 בספט׳ 20261 טענות מאומתות1 מקורות1 תצפיות
עדכון רשמי מדווח על התפתחות בגרסה ModelOpt 0.47.0. החשיבות המעשית תלויה בטווח ובראיות המובאות על ידי המקור.
קראו את עדכון המקור הרשמי ולאמת את היקף, הראיות והזמן המפורטים לפני שתפעילו אותו.
ידע מקושר
ישויות שמושפעות מהאירוע
שרשרת ראיות
המקורות שמאחורי האירוע
הצגה מערכתית
פתיחת הכתבה