ZGCM 1 7B אומן מאפס לחשיבה מתמטית ולחיפוש המסתייע בכלים. הוא תומך בחלון הקשר של 256 אלף טוקנים ובמצבי חשיבה ותשובה ישירה.
פורסם על ידינערך באמצעות GPT-6 Solהתמונות נוצרו באמצעות GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What is ZGCM-1-7B, who released it and under what license, and what makes it a useful open baseline for mathematical reasoning and tool-assi. Article summary: ZGCM-1-7B is a 7.39-billion-parameter dense language model trained from scratch for mathematical reasoning and tool-assisted search. It was released by researchers at Zhongguancun Academy and the Zhongguancun Institute o. Topic tags: general, academic, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, char
ZGCM-1-7B הוא מודל שפה צפוף שאומן מאפס בידי חוקרים מ־Zhongguancun Academy ומ־Zhongguancun Institute of Artificial Intelligence. הוא מיועד לשלב חשיבה מתמטית עם איסוף מידע פעיל באמצעות כלים. העניין בו אינו רק הציון שקיבל במבחנים: הפרויקט פרסם גם חומרים המאפשרים לחוקרים לבחון חלקים מתהליך הפיתוח והאימון. 2
4
למודל 7.39 מיליארד פרמטרים וחלון הקשר מוצהר של 256 אלף טוקנים. זהו Transformer צפוף המפיק טקסט ברצף, והוא תומך הן במצב חשיבה מכוונת והן במצב של תשובה ישירה. כך אפשר להשוות בין אופני תגובה בתוך אותו מודל, בלי להחליף מודל בין הניסויים. 2
4
הארכיטקטורה משלבת שכבות קשב בעלות חלון נע ושערים עם שכבות קשב מלא. אחד מתיאורי המודל מפרט 27 שכבות מהסוג הראשון ו־5 מהסוג השני. לדברי המחברים, בתנאי ההשוואה שלהם התכנון הזה הקטין את השימוש במטמון ה־KV — מידע שנשמר במהלך יצירת הטקסט — פי 6.4, והגדיל את תפוקת העיבוד בחלון של 256 אלף טוקנים פי 3.94 לעומת החלופה בעלת הקשב המלא. אין בכך הבטחה לאותו שיפור בכל מערכת שתפעיל את המודל. 4
10
שיטת האימון המתוארת מתחילה באימון מאפס, ממשיכה באימון ביניים שמאריך את ההקשר בשלבים של 16 אלף, 64 אלף ו־256 אלף טוקנים, ומסתיימת בכוונון מפוקח הכולל גם דוגמאות לעבודה עם כלים. היא משלבת אופטימייזר Muon ב־FP8 ומייצגת רצפי אינטראקציה כמעברים בתהליך החלטה מרקובי. לפי הדיווח, שלבי אימון הביניים מקיפים 600 מיליארד טוקנים. 1
2
10
לצד המודל הסופי פורסמו מערך נתונים ונקודות שמירה משלבי האימון; בדיווחים על הפרויקט מתוארים גם קוד אימון, מתכונים ויומנים. למשל, נקודת השמירה המסומנת כשלב נתוני 16K מתעדת את הקשר האימון שלה ואת מספר הטוקנים המצטבר באימון הביניים. הפרסום הזה מאפשר לבחון יותר מאשר את משקלי המודל הסופי בלבד. 2
3
6
9
הצוות מתאר גם שימוש בסוכני AI בהנחיית החוקרים למשימות פיתוח, ובהן אצירת נתונים ותפעול מערך המחשוב. זהו תיאור של תהליך העבודה, לא ראיה לכך שהסוכנים תכננו או אימתו את המודל באופן עצמאי, וגם לא מדידה של תרומתם לציונים. 2
8
בהערכות המדווחות קיבל ZGCM-1-7B 97.13% ב־MATH-500, 75.00% ב־AIME 2026, 63.09% ב־WebWalkerQA ו־19.43% ב־BrowseComp. הוא לא הוביל בכל השוואה: בטבלאות שפורסמו הוא מפגר אחרי מודל השוואה גם ב־AIME 2024 וב־AIME 2025. המחברים מדווחים בנפרד על הגעה לאותו מדד שגיאה באימון המקדים בזמן קצר בערך פי 4.2 לעומת מערך ההשוואה שלהם, המבוסס על AdamW/BF16. כל אלה תלויים במבחנים, בהגדרות ההערכה ובבסיסי ההשוואה שנבחרו; הם אינם מוכיחים ביצועים זהים בכל תרחיש חיפוש. 7
10
דף המודל מציין רישיון MIT. סימון CC BY 4.0 המופיע במאמר המחקרי נוגע למאמר, ואין לבלבל בינו לבין רישיון המודל. לפני שימוש, כדאי לבדוק את התנאים של כל משאב בנפרד. 2
7
1
דף המודל כולל דוגמה ליצירת טקסט באמצעות Transformers עם המזהה zgcagi/ZGCM-1-7B ועם trust_remote_code=True. האפשרות הזו מאפשרת הרצת קוד מותאם מהמאגר, ולכן יש לבדוק אותו לפני שמפעילים אותה. החומרים שסופקו אינם קובעים דרישת מינימום לכרטיס גרפי או לזיכרון, וגם לא גרסת חבילות מחייבת להרצת המודל הסופי; אין להסיק דרישות כאלה מתיאורי מבחנים או מנקודות שמירה של שלבי אימון. 2
19
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
ZGCM 1 7B אומן מאפס לחשיבה מתמטית ולחיפוש המסתייע בכלים. הוא תומך בחלון הקשר של 256 אלף טוקנים ובמצבי חשיבה ותשובה ישירה.
ZGCM 1 7B אומן מאפס לחשיבה מתמטית ולחיפוש המסתייע בכלים. הוא תומך בחלון הקשר של 256 אלף טוקנים ובמצבי חשיבה ותשובה ישירה. ערכו כנקודת ייחוס מחקרית נובע גם מפרסום נתונים ונקודות שמירה משלבי האימון, לצד תיאור מפורט של שיטת האימון.
הציונים והשיפורים בביצועים הם תוצאות מדווחות בתנאי השוואה מסוימים, ולא הבטחה לביצועים זהים בכל שימוש.