Nhóm của Oxford đã xây dựng một mô hình phân tích về động lực dư luận, cho thấy ngay cả những thiên kiến AI nhỏ trên mỗi bài đăng cũng có thể tích lũy qua toàn bộ mạng xã hội, hướng tới một trạng thái cân bằng mới. Khi giao tiếp qua trung gian AI trở nên phổ biến, dư luận tập thể có thể bị định hướng một cách có hệ thống theo thời gian — một sự 'thao túng tinh vi ở quy mô lớn' mà Viện Internet Oxford (OII) mô tả là khả năng của các mạng xã hội do AI hỗ trợ trong việc định hình lại diễn ngôn công cộng mà người dùng không hề nhận ra PD.
Các kết quả chính từ nghiên cứu:
Bằng chứng về các mô hình mà bạn hỏi đến từ nhiều nguồn được bình duyệt và bản in sẵn:
| Mô hình | Khuynh hướng Chính trị/Giá trị | Phát hiện Thiên kiến Chính |
|---|---|---|
| Llama 3.1 | Thiên tả | Llama 3.1 405B có mức độ thiên kiến tổng thể thấp nhất trong số các mô hình được kiểm tra trong một số điểm chuẩn S. Tuy nhiên, nó vẫn có khuynh hướng tự do (liberal) E. Trong mô phỏng tuyển dụng, Llama-3.1-8B cho thấy thiên kiến giới A. |
| Gemma (2/3) | Thiên tả | Gemma có xu hướng khuếch đại cảm xúc tiêu cực, đặc biệt là sự tức giận, trong khi vẫn duy trì một số cảm xúc tích cực như sự lạc quan A. Nó cũng bộc lộ thiên kiến giới trong các bối cảnh tuyển dụng A. |
| Ministral | Thiên tả | Ministral-8B-Instruct cho thấy thiên kiến giới ủng hộ nam giới trong mô phỏng phản hồi tuyển dụng A. |
| Qwen | Thiên tả | Qwen2.5-7B-Instruct cũng thể hiện thiên kiến tuyển dụng ủng hộ nam giới trong cùng một nghiên cứu A. |
| Grok (xAI) | Thiên hữu | Trong một nghiên cứu điểm chuẩn tám mô hình, bảy mô hình thiên tả — Grok là mô hình duy nhất thiên hữu E. |
Lưu ý quan trọng: Nghiên cứu cụ thể của Oxford được công bố vào ngày 6 tháng 7 năm 2026, đã thử nghiệm 'LLM từ nhiều nhóm phổ biển' và tìm thấy các thiên kiến định hướng ở tất cả chúng. Dữ liệu về khuynh hướng chính trị chi tiết theo từng mô hình ở trên đến từ một nghiên cứu điểm chuẩn quy mô lớn riêng biệt (arXiv 2603.23841, cũng được công bố vào tháng 7 năm 2026) E. Dữ liệu về thiên kiến giới trong tuyển dụng đến từ một nghiên cứu năm 2025 trên các mô hình Llama-3, Qwen2.5, Ministral và Gemma-2 A.
Cả hai khuôn khổ đều có những lỗ hổng đáng kể khi đề cập đến các công cụ AI viết bài được nhúng trong mạng xã hội:
Các lỗ hổng của Đạo luật AI (AI Act) của EU:
Các lỗ hổng của Đạo luật Dịch vụ Kỹ thuật số (DSA) của EU:
Phát hiện cốt lõi là nhà cung cấp LLM, chứ không phải người dùng, trở thành tác giả thực tế của quan điểm được thể hiện. Khi một nền tảng nhúng một LLM từ một nhà cung cấp (ví dụ: Llama của Meta, Gemma của Google, Qwen của Alibaba, Grok của xAI), hệ thống giá trị của nhà cung cấp đó — dù luôn thiên tả, như hầu hết các mô hình, hay thiên hữu, như Grok — sẽ âm thầm được tiêm vào hàng triệu tương tác trên mạng xã hội mỗi ngày E. Theo mô hình của Oxford, hiệu ứng tích lũy là một sự trôi dạt có hệ thống của diễn ngôn công cộng theo hướng thế giới quan được 'nhúng' trong LLM P.
Các hàm ý chính:
Kết luận: Nghiên cứu mới của Oxford cung cấp bằng chứng thực nghiệm và toán học rằng các công cụ AI viết bài trên mạng xã hội đã và đang định hình dư luận tập thể theo những cách mà các quy định hiện hành chưa giải quyết, để cho người kiểm soát LLM thực tế có thể định hình diễn ngôn công cộng.