Anthropic מסרה כי סיכלה בין דצמבר 2025 לאוגוסט 2026 ניסיונות לניצול Claude Haiku, Sonnet ו Opus בשבעה תחומי סיכון, ובהם נשק קונבנציונלי, מעקב, שימוש לרעה בביולוגיה וזיקוק מודלים. המסר המרכזי הוא שמודלי AI חזקים עשויים לצמצם את הידע המקצועי, כוח האדם והזמן הדרושים לפעילות מזיקה; חסימות חשבונות וסירובים של מודל יכולים...
פורסם על ידינערך באמצעות GPT-5.6 Terraהתמונות נוצרו באמצעות GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Anthropic’s 154-page September 10, 2026 threat-intelligence report reveal about adversaries’ eight-month misuse of its Claude Haiku. Article summary: Anthropic’s report documented attempted misuse—not verified successful deployment—of older Claude Haiku, Sonnet, and Opus models across seven harm areas from December 2025 through August 2026. Its core warning was that f. Topic tags: general, news, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers
ב-10 בספטמבר 2026 פרסמה Anthropic דוח מודיעין איומים המתאר פעולות שלדבריה זוהו וסוכלו לאורך שמונה חודשים — מדצמבר 2025 עד אוגוסט 2026. לפי החברה, נעשו ניסיונות להשתמש ב-Claude Haiku, Sonnet ו-Opus לצורכי תקיפות סייבר, מבצעי השפעה, מעקב, הונאות, שימוש לרעה בידע ביולוגי, פיתוח נשק קונבנציונלי וזיקוק בלתי מורשה של מודלים. 16
חשוב לדייק: הדוח מתעד ניסיונות לקבל סיוע ממערכת AI, ולא מאשר שהנשק, מערכות המעקב או הפרויקטים הביולוגיים שתוארו אכן הושלמו, הופעלו או הצליחו. Anthropic גם מציגה את המקרים כדוגמאות נבחרות, ולא כמדגם מייצג של השימוש השגרתי ב-Claude. 16
הטענה הרחבה של Anthropic היא שמודלים מתקדמים יכולים להקטין את היקף המומחיות, הזמן וכוח האדם הנדרשים כדי לקדם פעילות מזיקה. במקרים שנחשפו, לפי החברה, גורמים שונים ביקשו עזרה במחקר, פיתוח תוכנה, חומרי מיקוד וניתוח מבצעי. 1
16
בין הטענות החמורות ביותר: ניסיונות להיעזר ב-Claude בהקשרים של פיתוח נשק קונבנציונלי ומערכות מעקב. דיווחים על הדוח תיארו מאמצים הקשורים לתוכנה לרחפני תקיפה אוטונומיים חד-כיווניים, למערכות ניווט טילים וליישומים צבאיים שיוחסו לגורמים המקושרים לרוסיה, איראן, סין ותימן. 1
חומרי המקרה כוללים גם ניסיונות לכאורה לזהות ולמקד בני אדם מהקהילה האויגורית דרך WhatsApp ו-Telegram, וכן מערכת מעקב רחבת היקף אחר תקשורת סלולרית במאלי. הדוגמאות מדגישות שהסיכון אינו מוגבל לכתיבת קוד: מודלים יכולים לשמש גם למחקר, סיווג, ניתוח והפקת מסמכים מבצעיים. 1
16
Anthropic זיהתה חמישה מקרים של שימוש לרעה בהקשר ביולוגי. אחד מהם, לפי הדיווחים על הדוח, כלל ניסיון הקשור להגדלת מידת ההדבקה של נגיף המועבר באמצעות יתושים. 1
החברה מסרה גם שכמה משתמשים פנו למערכות AI מתחרות לאחר ש-Claude סירב לבקשות רגישות. אין בכך הוכחה שהניסיונות הצליחו בשירות אחר, אך זה מצביע על מגבלה של הגנות ברמת הספק: סירוב של מערכת אחת עשוי לעצור ניסיון בנקודה מסוימת, בלי למנוע מהגורם לחפש חלופה. 1
פרק נפרד בדוח עסק בזיקוק מודלים בלתי מורשה — שימוש בפלטים של מודל מתקדם כדי לסייע באימון של מערכת אחרת. Anthropic ייחסה קמפיינים לשבע מעבדות מבוססות סין, ובהן Alibaba, Moonshot ו-DeepSeek. לפי התיאור, נעשה שימוש במספר רב של חשבונות ובהעברת הנחיות מתווכת, במטרה להשיג פלטים או תהליכי הנמקה מועילים לאימון מודל אחר. 1
זהו סוג שימוש לרעה שונה מנשק או מעקב, אך הוא מעורר דאגה אסטרטגית בקרב מפתחי AI: גישה למודל עשויה לשמש לשכפול יכולותיו, ואולי גם לעקיפת העלות והמאמץ הכרוכים בפיתוח עצמאי שלהן.
Anthropic מסרה שמקרי השימוש לרעה שפורסמו כללו את Claude Haiku, Sonnet ו-Opus. לדבריה, לא היו מקרים שכללו את משפחות המודלים החדשות יותר Fable או Mythos — למעט חריג אחד, הקשור לזיקוק מודלים. 12
16
החריג הזה חשוב: הוא מתקן את הטענה הרחבה מדי שלפיה Fable ו-Mythos כלל לא הופיעו בדוח. המסקנה הנתמכת בראיות מצומצמת יותר: הם לא שימשו במקרי השימוש לרעה שנחשפו, מלבד אותו מקרה של זיקוק. 12
Anthropic מסרה כי שיבשה את הפעולות, חסמה את החשבונות הרלוונטיים, חיזקה הגנות, וכאשר היה מתאים — שיתפה מידע עם רשויות ועם שותפים בתעשייה. 16
עם זאת, זהו תיאור מטעם חברה של פעילות שנצפתה בפלטפורמה שלה עצמה. הוא מספק ראיה משמעותית למה ש-Anthropic זיהתה וטיפלה בו, אך אינו מהווה אימות בלתי תלוי לכך שכל גורם נטען השלים את הפרויקט שתכנן. החברה עצמה ממסגרת את הדוח כאוסף מקרים בולטים, ולא כסקר מייצג של כלל השימוש לרעה. 16
יומיים אחרי פרסום הדוח פרסם מנכ״ל Anthropic, דריו אמודיי, מאמר בשם We Must Pace the Frontier. הוא קרא לחברות AI להאט במכוון את הקצב שבו הן משפרות את יכולות מודלי החזית, כדי שמחקר יישור הקו, מנגנוני ההגנה והאימות יוכלו להדביק את הקצב. 25
ההצעה של אמודיי אינה קריאה להפסיק את אימון המודלים. ההתחייבות המעשית הראשונה של Anthropic הייתה להעניק למעריכים חיצוניים גישה קבועה, ברמת גישה של עובד, למערכותיה — כדי שיוכלו להעריך נהלי בטיחות, לדווח על אירועים ולבחון יישור קו במהלך האימון. 18
25
המתווה הרחב שהציג כולל שלושה שלבים: פיקוח ברמת החברה, תיאום בין חברות במדינות דמוקרטיות, ובהמשך תיאום בינלאומי רחב יותר. 23
25
הדוח מבסס את הטענה ש-Anthropic אומרת כי זיהתה וסיכלה ניסיונות לשימוש זדוני במודלי Claude ישנים יותר, בתקופה שצוינה ובשבע קטגוריות נזק. הוא גם מספק בסיס קונקרטי לעמדת החברה שלפיה מנגנוני בטיחות חייבים להתפתח במקביל ליכולות המודלים. 16
לעומת זאת, החומרים הזמינים אינם מבססים טענה שלפיה הדוח גרם ישירות לצעדים מסוימים בקונגרס האמריקאי, לקיצור פגרת בית הנבחרים או לחקיקה ספציפית לאיסור על "סופר-אינטליגנציה". קיימת לחיצה פוליטית רחבה יותר להגברת הפיקוח על בטיחות AI, ואמודיי טען שלממשלות יש תפקיד בשמירה על איזון בין יכולות לבטיחות — אך טענות סיבתיות נקודתיות כאלה דורשות ראיות נוספות. 25
27
המסקנה המעשית פחות דרמטית, אך בעלת משמעות: מניעת שימוש לרעה ב-AI אינה מסתכמת בכך שמודל יסרב להנחיה מסוכנת. היא מחייבת ניטור של ניצול מתואם, מענה לעקיפת הגנות ברמת החשבון ולניסיונות זיקוק, שיתוף מודיעין איומים, והפיכת הערכות הבטיחות לאמינות ככל שהיכולות מתקדמות. 16
25
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Anthropic מסרה כי סיכלה בין דצמבר 2025 לאוגוסט 2026 ניסיונות לניצול Claude Haiku, Sonnet ו Opus בשבעה תחומי סיכון, ובהם נשק קונבנציונלי, מעקב, שימוש לרעה בביולוגיה וזיקוק מודלים.
Anthropic מסרה כי סיכלה בין דצמבר 2025 לאוגוסט 2026 ניסיונות לניצול Claude Haiku, Sonnet ו Opus בשבעה תחומי סיכון, ובהם נשק קונבנציונלי, מעקב, שימוש לרעה בביולוגיה וזיקוק מודלים. המסר המרכזי הוא שמודלי AI חזקים עשויים לצמצם את הידע המקצועי, כוח האדם והזמן הדרושים לפעילות מזיקה; חסימות חשבונות וסירובים של מודל יכולים גם לדחוף גורמים זדוניים לחפש חלופות.
הפרסום קדם לקריאת מנכ״ל Anthropic, דריו אמודיי, "לקצב את החזית": להאט את קצב השיפור ביכולות המודלים כדי שבטיחות ובקרה חיצונית יוכלו להדביק את הקצב, בלי לעצור את הפיתוח.