Llama.cpp מגביל את זיכרון העבודה למניעת טעינת טנסורים גדולים.
העדכון מגביל את גודל הזיכרון העובד כדי למנוע טנסורים גדולים להיטען ל-RAM.
1 מקורות · 1 טענות מאומתותציר זמן מתפתח אחד של עדכונים מאומתים, בלי לשכפל את אותה אמת בין עמודים.
העדכון מגביל את גודל הזיכרון העובד כדי למנוע טנסורים גדולים להיטען ל-RAM.
1 מקורות · 1 טענות מאומתותהוסף שני גרעיני בינה מלאכותית לשיפור ביצועים על פלטפורמות שונות.
1 מקורות · 1 טענות מאומתותעדכון חדש: Llama הוסיף את TENSOR_READ_LAZY לטעינת הדגמים. לפרטים נוספים, עברו למקור.
1 מקורות · 1 טענות מאומתותלמה-סרבר ולמה-קל"י כוללים כעת אפשרויות בדיקה בלבד.
1 מקורות · 1 טענות מאומתותעדכון אחרון תיקן דליפת זיכרון במטאל, פתרון בעיות עם autoreleasepools.
1 מקורות · 1 טענות מאומתותהוסף האפשרות --n-cpu-ffn להעברת משקלי FFN צפופים של N השכבות הראשונות ל-CPU.
1 מקורות · 1 טענות מאומתותצוות משימה בראשות סטניסלב שימצ'יק פשט את מודל הגרף MiniMax-01. הוא תומך macOS Apple Silicon, Ubuntu ו-Windows.
1 מקורות · 1 טענות מאומתותהפקודות החדשות של CLI כוללות אפשרויות וידאו למחשבי macOS, Linux, Windows ואנדרואיד.
1 מקורות · 1 טענות מאומתותצוות משימה של וולקאן עוקב אחר בעיה בגודל הוורפ של וורפטיילים.
1 מקורות · 1 טענות מאומתותהוסף מעקב אחר מזהה טוקן לתא KV ב-למה. תומך ב-macOS, לינוקס, וינדוס ואנדרואיד.
1 מקורות · 1 טענות מאומתות