Một số nhân viên tại UK AI Safety Institute được cho là đã nghỉ ốm hoặc tìm tư vấn tâm lý vì lịch kiểm thử dày đặc, kiệt sức và tinh thần sa sút. Nỗi lo bao gồm việc AI có thể hạ thấp rào cản cho tấn công mạng, lạm dụng sinh học và tiến bộ năng lực nhanh hơn khả năng kiểm soát của con người.
Đăng bởiHình ảnh được tạo bằng GPT Image 2
Câu trả lời nghiên cứu

Create a landscape editorial hero image for this Studio Global article: Why are AI safety researchers at the UK AI Safety Institute and leading labs such as Anthropic, OpenAI, and Google DeepMind taking sick leav. Article summary: The immediate cause is a collision of moral stress and institutional pressure: people tasked with testing frontier models fear that the systems—and the race to deploy them—may enable biological or cyber harm before safeg. Topic tags: general web, ai safety, openai, agents, ai. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
Lý do trước mắt là sự va chạm giữa áp lực đạo đức và áp lực tổ chức. Những người được giao kiểm thử các mô hình AI tiên tiến — tức các hệ thống ở sát giới hạn năng lực hiện có — lo rằng công nghệ có thể bị dùng cho mục đích sinh học hoặc tấn công mạng trước khi biện pháp bảo vệ, cơ chế giám sát và năng lực đánh giá rủi ro theo kịp.
Theo các nguồn được dẫn lại từ Financial Times, một số nhân viên của UK AI Safety Institute (AISI), cơ quan Anh đánh giá độc lập các mô hình AI tiên tiến, đã nghỉ ốm hoặc tìm tư vấn tâm lý. Các nguồn tin mô tả lịch kiểm thử gấp gáp, tinh thần sa sút và kiệt sức. Có thông tin về tâm trạng tương tự ở các phòng thí nghiệm lớn, nhưng bằng chứng công khai hiện chưa cho phép kết luận mức độ phổ biến của tình trạng này trong từng tổ chức. 15
Nỗi lo không chỉ hướng đến một kịch bản xa vời. Các nhà nghiên cứu sợ mô hình AI mạnh có thể làm giảm rào cản kỹ thuật đối với:
Jacob Coxon, người từng làm nghiên cứu tiền huấn luyện tại OpenAI và Anthropic, đã cảnh báo rằng AI có thể mở đường cho các mối đe dọa sinh học và vũ khí mạng ở quy mô nghiêm trọng. 19 Nghiên cứu về tự động hóa hoạt động nghiên cứu và phát triển AI cũng nêu khả năng năng lực AI tăng tốc nhanh, trong khi con người giảm khả năng hiểu và kiểm soát hệ thống.
4
Nhân sự an toàn AI không đứng ngoài quan sát một rủi ro trừu tượng. Họ trực tiếp đánh giá, huấn luyện hoặc góp phần đưa các hệ thống đó vào vận hành. Khi lịch thử nghiệm quá sít sao và cuộc đua thương mại vẫn tiếp diễn, việc phát hiện một lỗ hổng nhưng không có đủ quyền lực để ngăn phát hành có thể tạo ra cảm giác bất lực, kiệt quệ và tổn thương đạo đức.
Coxon đã rời Anthropic và công khai cảnh báo về rủi ro của AI. Trả lời BBC, ông nói những người làm việc trong các phòng thí nghiệm hàng đầu “thực sự sợ hãi” trước tốc độ tiến bộ và hệ quả có thể xảy ra cho nhân loại. 9 Việc một người trong ngành lên tiếng công khai khiến những lo ngại vốn thường diễn ra nội bộ trở nên rõ nét hơn, đồng thời làm tăng áp lực cho những người đang cân nhắc ở lại, phản đối hay nghỉ việc.
14
Dario Amodei của Anthropic, Sam Altman của OpenAI và Demis Hassabis của Google DeepMind nằm trong số các lãnh đạo công nghệ đã ủng hộ, ở những mức độ khác nhau, việc giảm tốc hoặc thận trọng hơn với AI tiên tiến. 2 Nhưng phát biểu không tự nó giải quyết vấn đề niềm tin.
Các nhà phê bình cảnh báo rằng một lệnh “đóng băng AI” do chính các công ty dẫn đầu thiết kế hoặc kiểm soát có thể củng cố quyền lực của các hãng lớn, đồng thời làm suy yếu đối thủ nhỏ hơn. 11 Vì thế, phép thử thực sự không phải là tuyên bố, mà là những bước có thể kiểm chứng: trì hoãn phát hành khi cần thiết, đánh giá độc lập, ngưỡng an toàn có tính bắt buộc, bảo vệ người tố giác và chấp nhận sự giám sát từ bên ngoài.
Các chuyên gia Stanford cho rằng một cuộc giảm tốc rộng khắp về năng lực AI sẽ khó thực hiện. Tuy vậy, họ nhấn mạnh đánh giá độc lập bởi cơ quan nhà nước hoặc bên thứ ba đủ năng lực nên trở thành chuẩn mực trong hệ sinh thái AI. 3
Điều đáng lo không phải là AI đã đạt được khả năng tự cải tiến đệ quy hoàn chỉnh; nghiên cứu hiện cho biết điều đó chưa xảy ra. 6 Mối quan ngại là AI đang có thể tự động hóa từng phần công việc kỹ thuật và nghiên cứu, rút ngắn chu kỳ thử nghiệm–cải tiến.
Một nghiên cứu gần đây cho thấy các tác tử AI có thể hoàn thành phần lớn công việc kỹ thuật trong một số nhiệm vụ nghiên cứu, nhưng vẫn chưa tạo được tiến bộ đáng kể trong nghiên cứu khoa học mở. 5 Dù vậy, ngay cả tự động hóa một phần cũng có thể khiến năng lực tăng nhanh hơn tốc độ mà con người kịp đánh giá, hiểu và quản trị.
4
Đây chưa phải bằng chứng rằng thảm họa tuyệt chủng là sắp xảy ra. Nhưng nó cho thấy một số người ở gần nhất với quá trình phát triển AI tiên tiến đang xem tổ hợp giữa năng lực tăng tốc, rủi ro lưỡng dụng, cạnh tranh thương mại và kiểm soát bên ngoài còn yếu là điều không thể chấp nhận được về mặt tâm lý lẫn đạo đức.
Studio Global AI
Trang này bao gồm câu trả lời dựa trên nguồn mà bạn có thể tiếp tục bên trong Studio Global.
Một số nhân viên tại UK AI Safety Institute được cho là đã nghỉ ốm hoặc tìm tư vấn tâm lý vì lịch kiểm thử dày đặc, kiệt sức và tinh thần sa sút.
Một số nhân viên tại UK AI Safety Institute được cho là đã nghỉ ốm hoặc tìm tư vấn tâm lý vì lịch kiểm thử dày đặc, kiệt sức và tinh thần sa sút. Nỗi lo bao gồm việc AI có thể hạ thấp rào cản cho tấn công mạng, lạm dụng sinh học và tiến bộ năng lực nhanh hơn khả năng kiểm soát của con người.
Cựu nghiên cứu viên Anthropic Jacob Coxon nói nhiều người trong các phòng thí nghiệm AI hàng đầu thực sự sợ hãi trước tốc độ phát triển công nghệ.