AI IN

Muse Glimmer של Meta: מודל AI סוכן בקוד פתוח שרץ שלם על מחשב אחד, בלי ענן ובלי מנוי

מטא משחררת בחינם את Muse Glimmer: מודל AI סוכן בגודל 30 מיליארד פרמטרים שרץ שלם על כרטיס מסך צרכני יחיד, בלי ענן ובלי תשלום לפי שימוש. מה זה אומר למפתחים ולעסקים בישראל.

מערכת האתר2 דק׳ קריאה

מטא הרימה היום (10 באוגוסט) מסך חדש בעולם הפתוח: Muse Glimmer, מודל AI סוכן בגודל 30 מיליארד פרמטרים, ירד בחינם עם רישיון Apache 2.0 להורדה ישירה מ-Hugging Face. הבשורה המרכזית: הוא רץ שלם על מחשב אחד, עם כרטיס מסך צרכני יחיד, בלי חיבור לענן ובלי תשלום לפי טוקן.

מה בדיוק קיבלנו

Muse Glimmer הוא מודל "אג'נטי" שתוכנן במיוחד לעבודה שוטפת ורציפה: תזמון יומן, ניהול קבצים, כתיבת קוד, קריאה לכלים חיצוניים (function calling), ואפילו הבנה של תמונות וצילומי מסך בזכות מקודד תפיסה ייעודי. מטא בנתה אותו בתהליך זיקוק (distillation) מתוך המודל הגדול שלה Muse Spark, כך שהוא "יורש" חלק ניכר מיכולות ההיגיון של אח גדול בהרבה, אבל בגודל שנכנס לכיס.

איך דוחסים 30 מיליארד פרמטרים למחשב ביתי

בדיוק מלא, מודל בגודל הזה דורש מעל 55GB זיכרון, הרבה מעבר למה שכרטיס מסך צרכני מציע. מטא דחסה את המשקלים לדיוק של כ-4 ביט, כך שהמודל עצמו יורד לפחות מ-20GB, ומשאיר מקום לזיכרון העבודה (KV cache), למקודד התמונות ולמודל ה"טיוטה" הקטן שמאיץ את קצב הייצור. התוצאה: המודל השלם נכנס בנוחות בתוך מעטפת של 24 או 32GB VRAM; כלומר מחשב נייד או שולחני רגיל עם כרטיס מסך חזק, לא חוות שרתים.

כדי שהתגובות ירגישו זריזות ולא כמו המתנה מול מסך טעינה, מטא הוסיפה טכניקת speculative decoding מבוססת מודל בשם DFlash: מודל טיוטה קטן מנחש בלוקים שלמים של טוקנים, והמודל הראשי רק מאשר או מתקן. לפי מטא, זה מזניק את מהירות הייצור פי 3.1 על RTX 5090, ופי 1.5-1.8 על מחשבי Mac מסדרת M4/M5-Max.

למה זה חשוב דווקא עכשיו לעסקים ולמפתחים בישראל

  • אפס עלות לפי שימוש: אחרי ההורדה, כל שיחה, כל הרצת קוד וכל קריאה לכלי היא בחינם, בלי חיוב API חודשי שמצטבר עם כל בקשה.
  • פרטיות מלאה: נתונים רגישים של לקוחות, קוד קנייני או מסמכים פנימיים לא יוצאים מהמחשב; יתרון משמעותי לעסקים שכפופים לרגולציית מידע.
  • עבודה גם בלי אינטרנט: סוכן שרץ מקומית ממשיך לתפקד גם כשהחיבור לרשת נופל, קריטי לעבודה בשטח או בסביבות עם קישוריות לא יציבה.
  • נקודת כניסה נוחה למפתחים: תמיכה מובנית בכלים מוכרים כמו llama.cpp, MLX ו-Ollama אומרת שמעבר מהורדה לסוכן עובד לוקח דקות, לא ימים.

איך זה עומד מול המתחרים

במבחני הביצועים שמטא פרסמה, Muse Glimmer מתעלה על מודלים מתחרים בקטגוריית הגודל שלו, כולל Gemma4-31B של גוגל ו-Qwen3.6-27B של אליבאבא, במדדי סוכנות, קוד וניתוח רב-שלבי. זו המשך של מגמה שכבר ראינו אצל Gemini ואצל DeepSeek: מודלים "קטנים" שמתקרבים ביכולת למודלי הדגל, בלי לדרוש תשתית ענן יקרה.

איך מתחילים

המשקלים זמינים כבר עכשיו להורדה ב-Hugging Face, ובימים הקרובים צפויה תמיכה נוספת דרך Ollama, LM Studio ו-Unsloth להרצה מקומית, וכן דרך Together AI, Fireworks AI ו-OpenRouter למי שמעדיף גישה מהירה בלי התקנה. אם אתם רק בתחילת הדרך עם כלי AI, כדאי להציץ במדריך למתחילים שלנו, ולעבור על מאגר הכלים באתר כדי להשוות בין האופציות המקומיות לענניות.

לעסקים קטנים ובינוניים ששוקלים לשלב סוכני AI מקומיים בתהליכי העבודה בלי לחשוף מידע לענן חיצוני, אנחנו בונים כרגע שירות ליווי ייעודי בנושא (בקרוב). בינתיים, כל המדריכים שלנו זמינים לעיון חופשי.

שאלות נפוצות

כמה זיכרון וכרטיס מסך נדרשים כדי להריץ את Muse Glimmer?

מטא דחסה את משקלי המודל לדיוק של כ-4 ביט כך שהוא יורד לפחות מ-20GB, והמודל השלם עם זיכרון העבודה, מקודד התמונות ומודל הטיוטה נכנס בנוחות במעטפת של 24 או 32GB VRAM - כלומר מחשב נייד או שולחני עם כרטיס מסך צרכני חזק, ולא חוות שרתים.

מה זו טכניקת DFlash וכיצד היא משפיעה על מהירות המודל?

DFlash היא טכניקת speculative decoding שבה מודל טיוטה קטן מנחש בלוקים שלמים של טוקנים והמודל הראשי רק מאשר או מתקן אותם. לפי מטא, הטכניקה מזניקה את מהירות הייצור פי 3.1 על כרטיס RTX 5090, ופי 1.5-1.8 על מחשבי Mac מסדרת M4/M5-Max.

האם Muse Glimmer עולה כסף לשימוש שוטף?

לא, לאחר ההורדה החד-פעמית מ-Hugging Face תחת רישיון Apache 2.0, כל שיחה, הרצת קוד וקריאה לכלי היא בחינם לגמרי, ללא חיוב API חודשי או תשלום לפי טוקן.

מול אילו מודלים מתחרים נבחן Muse Glimmer, ואיך הוא מתפקד לעומתם?

במבחני הביצועים שפרסמה מטא, Muse Glimmer מתעלה על מודלים מתחרים בקטגוריית הגודל שלו, כולל Gemma4-31B של גוגל ו-Qwen3.6-27B של אליבאבא, במדדי סוכנות, קוד וניתוח רב-שלבי.

עוד חדשות שיעניינו אתכם