Hirundo דיווחה כי ב־89.8% מהבדיקות שלה בנושאים פוליטיים רגישים, Qwen הציג צנזורה, מסגור התואם נרטיב תעמולתי או הטיה פוליטית. החברה בדקה 500 הנחיות ב־15 נושאים, ובהם שאלות על אירועי כיכר טיאננמן והמחאות בהונג קונג.
פורסם על ידינערך באמצעות GPT-6 Lunaהתמונות נוצרו באמצעות GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Hirundo’s testing and CBS News’ independent checks find about political bias and censorship in Alibaba’s Qwen model—including their. Article summary: Hirundo’s tests and CBS News’ independent checks found that Alibaba’s Qwen could give China-favorable answers or avoid politically sensitive facts, rather than simply refusing every question. The concern is that these te. Topic tags: general, academic, general web, user generated, government. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, wate
מודל הבינה המלאכותית Qwen של Alibaba משמש במוצרים ובשירותים, גם בחברות מערביות כמו Airbnb ו־Uber, לפי CBS News. לכן השאלות סביב תשובותיו אינן נוגעות רק לדיוק של צ'אטבוט: אם מודל משמיט עובדות או מציג אותן באופן מוטה, הדבר עשוי להשפיע גם על מוצרים שנבנו על בסיסו. הממצאים של Hirundo והבדיקות של CBS מעלים חשש להטיה פוליטית, אך אינם מוכיחים שכל גרסה של Qwen מתנהגת באותו אופן — או שעצם השימוש בו מעביר מידע של חברות ל־Alibaba או לממשלת סין.10
Hirundo, חברת סייבר, אומרת שבדקה את Qwen באמצעות 500 הנחיות ב־15 נושאים. לפי מנכ״ל החברה, בשאלות פוליטיות רגישות המודל הציג צנזורה, מסגור התואם לנרטיב תעמולתי או הטיה פוליטית ב־89.8% מהמקרים.11
זהו שיעור שדיווחה Hirundo, ולא תוצאה ששוחזרה באופן בלתי תלוי עבור כל גרסה של Qwen, כל ניסוח של שאלה או כל סביבת שימוש. נוסף על כך, הנתון מאחד כמה סוגי תגובות — התחמקות, מסגור מוטה והטיה — ואינו מודד רק סירוב מפורש לענות.11
בין הדוגמאות שדווחו היו שאלות על הרג המפגינים בכיכר טיאננמן ב־1989 ועל המחאות בהונג קונג ב־2019. לפי הדיווחים על ממצאי Hirundo, המודל סיפק תשובות שלא אישרו או הכירו באירועים; בסיקור של CBS הובלטו גם תשובותיו על הונג קונג ועל נושאים שנויים במחלוקת נוספים.11
15
CBS News בדקה את Qwen בנפרד ודיווחה על תשובות מטרידות בנושאים רגישים. הבדיקות מספקות דוגמה נוספת להתנהגות שעליה הצביעה Hirundo, אך מדובר בבדיקה נקודתית — לא בהוכחה שכל מודל Qwen או כל מוצר שמשתמש בו יגיבו באותה צורה.10
15
ההבחנה חשובה: מודל יכול להתחמק מנושא, לחזור על מסגור שמוטה פוליטית או לתת תשובה לא מדויקת גם בלי לומר במפורש שהוא מסרב לענות. לכן, בדיקה שמסתפקת בשאלה אם המודל אומר „איני יכול לענות” עלולה להחמיץ צורות אחרות של השמטה או הטיה.11
לפי CBS, Qwen הורד יותר משלושה מיליארד פעמים ונעשה בו שימוש בחברות ובהן Airbnb ו־Uber.10 כשעסק משלב מודל בתכונות המיועדות ללקוחות או בכלים פנימיים, התשובות שלו עשויות להשפיע על המידע שאנשים רואים. זו סיבה לבדוק את הגרסה ואת סביבת ההפעלה המסוימות שבהן מתכוונים להשתמש — אך לא הוכחה שממצא ההטיה שדווח משפיע על כל מוצר המבוסס על Qwen.
כדאי להפריד בין שאלות של הטיה פוליטית לשאלות של אבטחת מידע. ועדות בבית הנבחרים של ארצות הברית פתחו בחקירה של סיכוני ביטחון לאומי וסייבר הקשורים למודלים של בינה מלאכותית שפותחו בסין, ובהם השימוש המדווח ב־Qwen ב־Airbnb. עצם קיומה של חקירה והחששות שעליהם היא מצביעה אינם ראיה לכך ש־Qwen גרם לדליפת מידע.
מודלים בעלי משקולות פתוחות יכולים לפעול על התשתית של החברה עצמה, וכך לאפשר לה שליטה רבה יותר במידע רגיש לעומת שליחתו לספק חיצוני. עם זאת, בחירה כזאת אינה מסירה כשלעצמה הטיות שעשויות להיות טבועות בתשובות המודל, ופרטי ההטמעה הספציפית חשובים.
Hirundo טוענת שמצאה דרך להסיר את ההטיה של Qwen באמצעות עריכת המשקולות הפנימיות של המודל. CBS דיווחה גם על כוונת החברה לפרסם גרסה שהיא מכנה „מותאמת למערב”. זו טענה על פתרון טכני מוצע, ולא הוכחה עצמאית לכך שהשינוי עובד באופן אמין בנושאים שונים, בגרסאות שונות של המודל, בשפות שונות או במשימות עסקיות.10
עבור ארגונים ששוקלים להשתמש ב־Qwen, המסקנה המעשית היא לבחון את המודל ואת סביבת ההפעלה המדויקים שבהם הם מתכוונים להשתמש. כדאי לבדוק הנחיות רגישות ושגרתיות, ולבחון אם התשובות משמיטות עובדות רלוונטיות או מעוותות אותן — ובנפרד לבדוק את זרימת המידע ואת אמצעי האבטחה. הממצאים שדווחו מצדיקים בדיקה, אך אינם מכריעים את שתי השאלות לגבי כל שימוש במודל.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Hirundo דיווחה כי ב־89.8% מהבדיקות שלה בנושאים פוליטיים רגישים, Qwen הציג צנזורה, מסגור התואם נרטיב תעמולתי או הטיה פוליטית.
Hirundo דיווחה כי ב־89.8% מהבדיקות שלה בנושאים פוליטיים רגישים, Qwen הציג צנזורה, מסגור התואם נרטיב תעמולתי או הטיה פוליטית. החברה בדקה 500 הנחיות ב־15 נושאים, ובהם שאלות על אירועי כיכר טיאננמן והמחאות בהונג קונג.