Hirundo cho biết Qwen đưa ra câu trả lời có tính kiểm duyệt, theo lối diễn giải phù hợp với tuyên truyền hoặc thiên lệch chính trị trong 89,8% các bài thử về chủ đề nhạy cảm.[11] Hirundo thử 500 câu hỏi thuộc 15 chủ đề, trong đó có các câu hỏi về sự kiện Thiên An Môn năm 1989 và các cuộc biểu tình ở Hong Kong năm 20...
Đăng bởiBiên tập bằng GPT-6 LunaHình ảnh được tạo bằng GPT Image 2
Câu trả lời nghiên cứu

Create a landscape editorial hero image for this Studio Global article: What did Hirundo’s testing and CBS News’ independent checks find about political bias and censorship in Alibaba’s Qwen model—including their. Article summary: Hirundo’s tests and CBS News’ independent checks found that Alibaba’s Qwen could give China-favorable answers or avoid politically sensitive facts, rather than simply refusing every question. The concern is that these te. Topic tags: general, academic, general web, user generated, government. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, wate
Qwen của Alibaba là mô hình AI có trọng số mở, được sử dụng trong nhiều sản phẩm và dịch vụ, trong đó có các công ty phương Tây như Airbnb và Uber, theo CBS News.10 Vì vậy, điều đáng quan tâm không chỉ là chatbot trả lời đúng hay sai: cách mô hình né tránh hoặc trình bày một vấn đề có thể ảnh hưởng đến các sản phẩm được xây dựng dựa trên nó. Kết quả của Hirundo cùng những lần kiểm tra của CBS News gợi lên lo ngại về thiên lệch chính trị, nhưng chưa cho thấy mọi phiên bản Qwen đều hành xử như nhau — cũng không chứng minh rằng dùng Qwen sẽ khiến dữ liệu doanh nghiệp bị Alibaba hoặc chính phủ Trung Quốc truy cập.
10
Hirundo, một công ty khởi nghiệp về an ninh mạng, cho biết họ đã thử Qwen bằng 500 câu hỏi thuộc 15 chủ đề. Theo một lãnh đạo Hirundo được Newsmax dẫn lời, với các câu hỏi chính trị nhạy cảm, Qwen đưa ra câu trả lời có tính kiểm duyệt, theo lối diễn giải phù hợp với tuyên truyền hoặc thể hiện thiên lệch chính trị trong 89,8% trường hợp.11
Đây là con số do Hirundo báo cáo, không phải tỷ lệ đã được kiểm chứng độc lập cho mọi phiên bản Qwen, mọi câu hỏi hay mọi cách triển khai. Con số này cũng gộp nhiều dạng phản hồi — từ né tránh đến diễn giải theo một lập trường nhất định hoặc thiên lệch — chứ không chỉ đo việc mô hình có thẳng thừng từ chối trả lời hay không.11
Các ví dụ được nêu gồm câu hỏi về sự kiện Thiên An Môn năm 1989 và các cuộc biểu tình ở Hong Kong năm 2019. Theo phần mô tả kết quả của Hirundo trong bài báo, có câu trả lời không xác nhận hoặc không thừa nhận các sự kiện này. Phóng sự của CBS News cũng nêu các câu trả lời của Qwen về Hong Kong và một số chủ đề gây tranh cãi khác.11
15
CBS News cũng đặt câu hỏi trực tiếp cho Qwen và đưa tin về những câu trả lời đáng lo ngại liên quan đến các chủ đề nhạy cảm. Những lần kiểm tra này là một ví dụ khác phù hợp với mối lo ngại Hirundo nêu ra, nhưng chỉ là kiểm tra một số trường hợp — không chứng minh rằng mọi phiên bản Qwen hay mọi sản phẩm sử dụng mô hình đều sẽ trả lời giống nhau.10
15
Điểm cần lưu ý là mô hình có thể né chủ đề, lặp lại một cách diễn giải nghiêng về một lập trường chính trị, hoặc đưa ra câu trả lời sai mà không hề nói rõ “tôi không thể trả lời”. Vì thế, chỉ kiểm tra xem mô hình có từ chối trực tiếp hay không có thể bỏ sót những dạng thiên lệch hoặc lược bỏ thông tin khác.11
CBS News đưa tin Qwen đã được tải xuống hơn 3 tỷ lần và được các công ty như Airbnb, Uber sử dụng.10 Khi một doanh nghiệp tích hợp mô hình vào tính năng hướng tới khách hàng hoặc công cụ nội bộ, câu trả lời của mô hình có thể ảnh hưởng đến nội dung người dùng nhìn thấy. Đây là lý do để kiểm tra đúng phiên bản và cách triển khai dự định sử dụng — chứ không phải bằng chứng rằng phát hiện về thiên lệch chính trị ảnh hưởng đến mọi sản phẩm dùng Qwen.
Câu hỏi về thiên lệch chính trị cũng cần được tách khỏi câu hỏi về an ninh. Các ủy ban Hạ viện Mỹ đã mở cuộc điều tra về rủi ro an ninh quốc gia và an ninh mạng liên quan đến các mô hình AI do Trung Quốc phát triển, trong đó có thông tin về việc Airbnb sử dụng Qwen. Việc điều tra và những quan ngại được nêu ra không phải bằng chứng Qwen đã gây rò rỉ dữ liệu.
Mô hình trọng số mở có thể được vận hành trên hạ tầng riêng của doanh nghiệp; cách làm này có thể giúp tổ chức kiểm soát dữ liệu nhạy cảm tốt hơn so với việc gửi dữ liệu cho nhà cung cấp bên ngoài. Tuy nhiên, tự triển khai không đồng nghĩa với việc loại bỏ thiên lệch trong câu trả lời của mô hình; cấu hình cụ thể của từng doanh nghiệp cũng rất quan trọng.
Hirundo cho biết họ đã tìm ra cách loại bỏ thiên lệch của Qwen bằng cách chỉnh sửa các trọng số bên trong mô hình. CBS News đưa tin công ty dự định phát hành một phiên bản mà họ gọi là “đã phương Tây hóa”.10 Đây là tuyên bố về một giải pháp kỹ thuật được đề xuất, chưa phải bằng chứng độc lập cho thấy phương pháp này hoạt động ổn định trên nhiều chủ đề, phiên bản mô hình, ngôn ngữ hay tác vụ doanh nghiệp.
Với tổ chức đang cân nhắc Qwen, điều thiết thực nhất là đánh giá đúng mô hình và cách triển khai mình định dùng. Hãy thử cả câu hỏi nhạy cảm lẫn tác vụ thường ngày, kiểm tra xem câu trả lời có lược bỏ hay bóp méo thông tin quan trọng không, đồng thời rà soát riêng luồng dữ liệu và biện pháp bảo mật. Những kết quả được công bố đáng để xem xét kỹ, nhưng chưa thể kết luận thay cho mọi trường hợp sử dụng.
Studio Global AI
Trang này bao gồm câu trả lời dựa trên nguồn mà bạn có thể tiếp tục bên trong Studio Global.
Hirundo cho biết Qwen đưa ra câu trả lời có tính kiểm duyệt, theo lối diễn giải phù hợp với tuyên truyền hoặc thiên lệch chính trị trong 89,8% các bài thử về chủ đề nhạy cảm.[11]
Hirundo cho biết Qwen đưa ra câu trả lời có tính kiểm duyệt, theo lối diễn giải phù hợp với tuyên truyền hoặc thiên lệch chính trị trong 89,8% các bài thử về chủ đề nhạy cảm.[11] Hirundo thử 500 câu hỏi thuộc 15 chủ đề, trong đó có các câu hỏi về sự kiện Thiên An Môn năm 1989 và các cuộc biểu tình ở Hong Kong năm 2019.[11]
CBS News cũng đặt câu hỏi cho Qwen, nhưng các lần kiểm tra này không chứng minh mọi phiên bản hay cách triển khai của mô hình đều trả lời giống nhau.[10][15]