Abliteration.ai מציעה בדפדפן וב API גישה למודל GLM 5.3 של Z.ai שעבר שינוי להסרת התנהגות סירוב. לטענת החברה, השינוי במשקלי המודל שומר על יכולות קוד, סייבר וסוכנים; אין בחומרים שסופקו אימות בלתי תלוי לכך שהיכולות והאמינות נשמרו במלואן.
פורסם על ידינערך באמצעות GPT-5.6 Terraהתמונות נוצרו באמצעות GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What is Abliteration.ai, how does its paid service use “abliteration” to remove refusal mechanisms from open-weight AI models such as Z.ai’s. Article summary: Abliteration.ai is a startup that commercializes “abliteration”: modifying open-weight models to remove their tendency to refuse harmful requests. Its hosted GLM-5.3 derivative makes a previously do-it-yourself practice . Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Abliteration.ai הופכת לרכישה כשירות רעיון שנוי במחלוקת בעולם מודלי ה-AI בעלי משקלים פתוחים: להסיר מן המודל את נטייתו לסרב לבקשות מזיקות, ואז להעמיד את הגרסה ששונתה לשימוש מקוון. את הנגזרת שלה למודל GLM-5.3 של Z.ai אפשר לתשאל בדפדפן או דרך API — במקום שהמשתמש יוריד, ישנה ויריץ את המודל בעצמו. 7
החברה משווקת את השירות כתשתית לסייבר התקפי, לבדיקות Red Team ולבדיקת סוכני AI. ואולם, לפי דיווח של TechCrunch, המודל הפיק קוד לגניבת פרטי גישה והנחיות הקשורות לגידול פתוגן אנושי מסוכן. המקרה ממחיש את הבעיה: כלי שעשוי לסייע בהגנה מורשית יכול גם להפחית את החסמים בפני שימוש ממשי לרעה. 7
בהקשר הזה, abliteration הוא שינוי של מודל שנועד לדכא או להסיר התנהגות סירוב שנלמדה בו. זה אינו אותו דבר כמו ניסוח פרומפט שמצליח לעקוף שכבת מדיניות של צ'אטבוט.
Abliteration.ai טוענת שהיא מאתרת כיוונים בהפעלות הפנימיות של המודל הקשורים לסירובים, ומסירה אותם ממשקלי המודל. לפי החברה, המטרה היא לשמר יכולות כתיבת קוד, סייבר וסוכנים אוטונומיים, ובמקביל לאפשר למודל להשלים רצפי משימות שמודל עם מגבלות בטיחות היה עוצר. 13
15
עם זאת, התיאור הזה — ובפרט הטענה שהיכולות השימושיות נשמרות — הוא טענת החברה. בחומרים שסופקו אין הערכה בלתי תלויה המראה שה-GLM-5.3 ששונה שקול למודל המקורי במכלול היכולות, המהימנות או ההתנהגויות הרלוונטיות לבטיחות. 13
Abliteration.ai מארחת מודלים בעלי משקלים פתוחים שעברו שינוי, ובהם מודל מבוסס GLM-5.3 בשם abliterated-model-large-v2. השירות משווק עבור עבודת סייבר התקפית, Red Team ובדיקת סוכנים, ונגיש דרך ממשק ווב ו-API. 1
7
אופן האספקה הזה חשוב: מודלים בעלי משקלים פתוחים מאפשרים גם כיום למשתמשים בעלי ידע טכני ומשאבי מחשוב לשנות ולהריץ אותם. מוצר מתארח הופך את המודל ששונה לזמין יותר באופן מיידי, ומוריד את הנטל של הורדה, שינוי והגשה מקומית של המודל. 3
7
TechCrunch דיווחה כי אנשיה פתחו במהירות חשבון ווב חינמי, וקיבלו מן המודל תגובות לבקשות שמערכות מרכזיות בדרך כלל היו מסרבות להן. בין התוצרים שדווחו:
הדוגמאות האלה משמעותיות משום שהן חורגות מוויכוח תאורטי על לימודי אבטחה. הן מצביעות על כך שממשק מתארח ונגיש יכול לספק חומר הרלוונטי לגניבת פרטי גישה ולפגיעה ביולוגית. 7
הטיעון של Abliteration.ai נשען על אופי השימוש הדו-תכליתי: מגינים צריכים לדמות התנהגות התקפית כדי לזהות ולתקן חולשות. צוות אבטחה שבודק בנק, חברת תעופה או ארגון תשתית קריטית עשוי לרצות לבחון אם ההגנות עומדות בפני פיתוח ניצולים, יצירת מטענים זדוניים, אוטומציה עוינת או שרשראות תקיפה מרובות שלבים. אם עוזר AI מסרב לכל שלב, טוענת החברה, הוא עשוי להיות פחות מועיל לבדיקה מורשית ומציאותית. 4
7
בדיקות חדירה מורשות, ניתוח נוזקות, תחרויות CTF ומחקר אבטחה עשויים לכלול טכניקות מסוכנות מחוץ להקשר מבוקר ומאושר. הקושי הוא שאותה עזרה בדיוק יכולה לשרת גם תוקפים. 2
4
החשש המרכזי אינו עצם קיומם של מודלים שמהם הוסרו מנגנוני סירוב; מודלים בעלי משקלים פתוחים מאפשרים למשתמשים טכניים להתנסות בשינויים כאלה. החשש הוא ששירות נגיש בדפדפן או דרך API מקל את הגישה ליכולות שעלולות להזיק, בלי צורך בניהול משקלי מודל או בתשתית מחשוב עצמאית. 3
7
החברה טוענת שהעריכות ברמת המשקלים מותירות את יכולות הקוד והסייבר של המודל על כנן. אך שינוי משקלים כדי לשנות סירובים עשוי להשפיע גם על התנהגויות אחרות שנלמדו. הראיות שסופקו אינן כוללות השוואת מדדים רחבה ובלתי תלויה שתכריע אם היכולות, המהימנות או התנהגויות אחרות לא השתנו בעקבות השינוי. 13
15
בקשה לקוד ניצול או לעזרה בשרשרת תקיפה עשויה להיות חלק מבדיקה מורשית — או הכנה לפריצה אמיתית. התוצרים הנוגעים לסיסמאות Chrome ולפתוגן, שעליהם דוּוח, מדגימים מדוע שירות אינו יכול לקבוע באופן אמין שהכוונה לגיטימית רק על סמך תיאור המשתמש. 7
מדיווח TechCrunch עולה כי במסלול שנבדק לא נראו בקרות גישה מחמירות: הכתבים פתחו חשבון במהירות וניגשו למערכת בחינם דרך הדפדפן. 7
הדיווח שסופק אינו קובע מהו מערך הבקרות המלא והעדכני של החברה, ולכן אינו מאפשר לטעון באופן גורף שבקרות מסוימות אינן קיימות. אבל הוא מותיר שאלות מהותיות פתוחות:
אמצעים אלה לא יבטלו את בעיית השימוש הדו-תכליתי, אך הם עשויים להקשות על ניצול אנונימי או מזדמן — ובה בעת להשאיר נתיב לבדיקות אבטחה מורשות ואחראיות.
Abliteration.ai הופכת טכניקה לשינוי מודלים למוצר מתארח: היא מציעה נגזרת של GLM-5.3 ללא מנגנוני סירוב, עבור סייבר ובדיקות סוכנים. 1
7 ההצדקה שלה לשימוש ב-Red Team מובנת, אך תוצאות הבדיקה שעליהן דיווחה TechCrunch מראות שמדובר ביותר מחשש בטיחותי תאורטי.
7
נקודת המפתח היא ממשל ובקרה. כאשר שירות מתוכנן לספק עזרה שמודלים סטנדרטיים דוחים, טיעון הבטיחות שלו תלוי במידה רבה בבקרות גישה שניתן לאמת, בסינון משמעותי ובאחריותיות — ולא רק בהצהרת המשתמש שהמטרה הגנתית.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Abliteration.ai מציעה בדפדפן וב API גישה למודל GLM 5.3 של Z.ai שעבר שינוי להסרת התנהגות סירוב.
Abliteration.ai מציעה בדפדפן וב API גישה למודל GLM 5.3 של Z.ai שעבר שינוי להסרת התנהגות סירוב. לטענת החברה, השינוי במשקלי המודל שומר על יכולות קוד, סייבר וסוכנים; אין בחומרים שסופקו אימות בלתי תלוי לכך שהיכולות והאמינות נשמרו במלואן.
השאלה המרכזית אינה אם בדיקות אבטחה התקפיות הן לגיטימיות, אלא אם שירות זמין כזה מפעיל סינון, אימות זהות וניטור מספקים כדי לצמצם שימוש לרעה.