Qeravio
אירוע בינה קנוני

גרסה 0.47.0 של ModelOpt הוסיפה מתכונים של FP8 Vision Encoder למודלים qwen3_vl ו-qwen3_5.

גרסה 0.47.0 של ModelOpt מביאה קוונטיזציה עם Autotune לדגמים ONNX, ומדד את מיקומי הריצה בדיוק הזמן הנדרש.

23 בספט׳ 20261 טענות מאומתות1 מקורות1 תצפיות
מה קרה

מקור רשמי דיווח על שחרור ModelOpt 0.47.0. בין השינויים החדשים: קוונטיזציה של ONNX עם Autotune, שמבצעת בדיקות מיקום בדיוק הזמן הרצוי ומשמירה על INT8/FP8 Q/DQ ממוזג רק אם עומדת בסף ההאצה של TensorRT (1.02x ברירת המחדל); אחרת, היא שמורה את הדגם בדיוק גבוה ללא קוונטיזציה. נוסף תבנית AutoQuantize של Muse Glimmer, שמחפשת פרויקציות של MLP, פרויקציות של תשומת לב עצמית, ו-lm_head על W4A16 NVFP4 ארבע-על-שש, FP8, ו-BF16 עם נפילה חוזרת של 5.5 ביטים יעילים, תוך שמירה על מגדל הראייה ללא קוונטיזציה.

למה זה חשוב

עדכון רשמי מדווח על התפתחות בגרסה ModelOpt 0.47.0. החשיבות המעשית תלויה בטווח ובראיות המובאות על ידי המקור.

מה כדאי לבדוק בהמשך

קראו את עדכון המקור הרשמי ולאמת את היקף, הראיות והזמן המפורטים לפני שתפעילו אותו.

ידע מקושר

ישויות שמושפעות מהאירוע

שרשרת ראיות

המקורות שמאחורי האירוע