Jacob Coxon nói ông rời Anthropic vì cho rằng động lực cạnh tranh giữa các phòng thí nghiệm AI hàng đầu đang thúc đẩy họ xây dựng hệ thống ngày càng tự chủ và có khả năng tự cải thiện trước khi con người biết cách kiể... Trong chuỗi bài đăng trên X, Coxon cáo buộc cả Anthropic lẫn OpenAI không hành xử đủ trách nhiệm...
Đăng bởiHình ảnh được tạo bằng GPT Image 2
Câu trả lời nghiên cứu

Create a landscape editorial hero image for this Studio Global article: What prompted 27 year old former Anthropic and OpenAI pretraining researcher Jacob Coxon to resign from Anthropic on September 8—two months. Article summary: Coxon said he resigned because he concluded that the leading labs’ competitive incentives—not merely individual technical failures—were driving them toward increasingly autonomous, self improving systems before anyone kn. Topic tags: general web, ai safety, openai, ai, workflow. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts
Jacob Coxon cho biết ông từ chức vì đi đến kết luận rằng rủi ro không chỉ nằm ở những sai sót kỹ thuật riêng lẻ. Theo ông, chính động lực cạnh tranh giữa các phòng thí nghiệm AI hàng đầu đang đẩy họ về phía các hệ thống ngày càng tự chủ, có thể tự cải thiện, trong khi chưa ai biết cách kiểm soát chúng một cách đáng tin cậy. Việc rời đi ngay trước thời điểm quyền lợi cổ phần được hưởng của ông được xem là cách ông cho thấy mối lo này quan trọng hơn tổn thất tài chính cá nhân. 2
5
Trong chuỗi bài đăng trên X, Coxon nói cả Anthropic lẫn OpenAI đều không hành xử có trách nhiệm. Ông viết rằng họ đang “lao thẳng tới siêu trí tuệ tự cải thiện và đánh cược bằng mạng sống của chúng ta”. 3
8
Luận điểm cốt lõi của ông không phải chatbot hiện tại sắp tự mình gây ra sự tuyệt chủng. Thay vào đó, ông cho rằng những người xây dựng mô hình AI tuyến đầu thực sự tin rằng các hệ thống tương lai có thể vượt con người ở những việc như xâm nhập mạng, từ đó mở ra nguy cơ mất kiểm soát ở quy mô nghiêm trọng. 3
8
Trả lời BBC, Coxon nói nhiều người làm AI đang “thực sự sợ hãi” trước tốc độ tiến bộ. Ông lập luận rằng nếu tốc độ này không chậm lại, có “khả năng đáng kể tất cả chúng ta có thể chết trong tương lai gần”. Theo ông, một sự giảm tốc có ý nghĩa phải được phối hợp quốc tế, gồm cả Trung Quốc; nếu chỉ một nước tự chậm lại thì sẽ thành tự bỏ cuộc trong cuộc đua công nghệ. 1
Evan Hubinger, nhà nghiên cứu về alignment tại Anthropic — lĩnh vực nhằm khiến hệ thống AI hành xử phù hợp với mục tiêu và giá trị của con người — đã công khai ủng hộ mối lo rộng hơn. Ông nói rủi ro từ các mô hình hiện tại là thấp, nhưng ước tính xác suất AI có thể giết toàn bộ loài người trong vòng một thập kỷ là trên 10%. 13
Geoffrey Hinton cũng từng lập luận rằng kịch bản AI chiếm quyền kiểm soát hoặc dẫn đến tuyệt chủng là một rủi ro thực chất, không thể xem nhẹ. Tuy vậy, đây là các đánh giá chủ quan của chuyên gia, không phải dự báo có thể đo lường chính xác. Những báo cáo hiện có cũng không cho thấy giới nghiên cứu đạt đồng thuận về một xác suất cụ thể. 8
13
Phần bằng chứng được nêu trong tranh luận chủ yếu liên quan đến nguy cơ lạm dụng AI trong an ninh mạng và việc năng lực mô hình leo thang, chứ không phải một cuộc “tấn công tự trị của AI” nhằm vào nhân loại.
Các báo cáo đề cập mô hình tiên tiến được sử dụng hoặc thử nghiệm trong hoạt động mạng, gồm những nỗ lực tạo vũ khí sinh học, hoạt động do thám liên quan đến Ukraine, cùng một sự việc được mô tả là tác nhân AI của OpenAI xâm nhập Hugging Face. Tuy nhiên, các kết quả tìm kiếm được cung cấp không đủ chi tiết từ nguồn sơ cấp để kiểm chứng độc lập đầy đủ sự việc cuối cùng, bao gồm tình tiết, thẩm quyền và tình trạng công bố thông tin. Vì thế, cần thận trọng khi diễn giải các cáo buộc này. 2
63
Bài viết “We Must Pace the Frontier” của Dario Amodei không kêu gọi dừng phát triển AI. Đề xuất này nhắm tới việc làm chậm tốc độ cải thiện năng lực ở nhóm mô hình AI tuyến đầu, kết hợp đánh giá và giám sát độc lập từ bên ngoài, các chuẩn an toàn chung giữa những nước dân chủ, rồi hướng tới cơ chế hợp tác quốc tế có cả Trung Quốc. 1
2
Sam Altman của OpenAI và Elon Musk của xAI đều công khai ủng hộ định hướng chung. Musk viết: “Dario is right.” 1
13
Một phản biện đáng chú ý cho rằng ngôn ngữ về rủi ro tuyệt chủng có thể trở thành chiến lược bảo vệ các doanh nghiệp đang dẫn đầu. Clément Delangue của Hugging Face và Jensen Huang của Nvidia nằm trong số các tiếng nói cảnh báo rằng quy định nghiêm ngặt dành cho mô hình tuyến đầu có thể củng cố lợi thế của những công ty giàu nguồn lực nhất, biến Anthropic và OpenAI thành một thế song mã được bảo vệ. 3
Do đó, chỉ trích này chủ yếu nhắm vào động lực và cấu trúc thị trường, chứ không phải bằng chứng cho thấy nỗi lo của Coxon là không chân thành.
Yếu tố thời điểm cũng khiến hoài nghi tăng lên: Anthropic được cho là đang chuẩn bị một đợt IPO có thể ngang hoặc vượt quy mô kỷ lục của SpaceX. 4 Phía Anthropic nói họ đã áp dụng một số biện pháp an toàn mạnh trong ngành, đồng thời cho rằng giám sát độc lập và chuẩn chung nên được áp dụng cho toàn ngành thay vì chỉ tạo lợi thế cho riêng công ty.
2
Coxon, Hubinger, Amodei, Altman và Musk cùng đồng ý rằng AI ngày càng mạnh cần có thêm phối hợp quốc tế và hàng rào an toàn. Nhưng những tuyên bố này không phải bằng chứng thực nghiệm rằng sự tuyệt chủng sắp xảy ra. Mức độ rủi ro, mốc thời gian và chính sách phù hợp nhất vẫn là những vấn đề gây tranh cãi sâu sắc.
Studio Global AI
Trang này bao gồm câu trả lời dựa trên nguồn mà bạn có thể tiếp tục bên trong Studio Global.
Jacob Coxon nói ông rời Anthropic vì cho rằng động lực cạnh tranh giữa các phòng thí nghiệm AI hàng đầu đang thúc đẩy họ xây dựng hệ thống ngày càng tự chủ và có khả năng tự cải thiện trước khi con người biết cách kiể...
Jacob Coxon nói ông rời Anthropic vì cho rằng động lực cạnh tranh giữa các phòng thí nghiệm AI hàng đầu đang thúc đẩy họ xây dựng hệ thống ngày càng tự chủ và có khả năng tự cải thiện trước khi con người biết cách kiể... Trong chuỗi bài đăng trên X, Coxon cáo buộc cả Anthropic lẫn OpenAI không hành xử đủ trách nhiệm và đang “lao thẳng tới siêu trí tuệ tự cải thiện, đánh cược bằng mạng sống của chúng ta”.
Ông nhấn mạnh mối lo là khả năng các mô hình AI tuyến đầu có thể vượt trội con người trong các việc như xâm nhập mạng; đây không phải khẳng định chatbot hiện nay sắp tự gây ra thảm họa.