ENISA, cơ quan an ninh mạng của EU, đang thử nghiệm Anthropic Mythos 5 và OpenAI GPT 6 Astra; nhưng Viện An ninh AI của Anh được cho là không nhận được Mythos 5.1 trước khi mô hình này phát hành ngày 1/9. Quyền tiếp cận là theo từng mô hình và từng thỏa thuận: việc ENISA có Mythos 5 không tự động tạo ra quyền thử mọ...
Đăng bởiBiên tập bằng GPT-5.6 TerraHình ảnh được tạo bằng GPT Image 2
Câu trả lời nghiên cứu

Create a landscape editorial hero image for this Studio Global article: What does the EU’s access to Anthropic’s Mythos 5 and OpenAI’s GPT-6-Astra for ENISA testing reveal about the UK’s exclusion from pre-releas. Article summary: The episode exposes a practical weakness in the UK’s frontier-AI regime: an internationally respected evaluator cannot guarantee timely access when testing depends on a developer’s consent. The EU’s ENISA access is signi. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Việc Viện An ninh AI của Anh (AI Security Institute, AISI) được cho là không được thử nghiệm Claude Mythos 5.1 trước khi phát hành không hẳn là phán xét về năng lực kỹ thuật của Anh. Nó chủ yếu phơi bày một vấn đề về quyền tiếp cận: cơ quan đánh giá cấp quốc gia khó có thể kiểm tra độc lập, đúng thời điểm một mô hình AI tiền tuyến nếu sự tham gia vẫn phụ thuộc vào sự đồng ý của nhà phát triển.
Cơ quan An ninh mạng Liên minh châu Âu (ENISA) được tiếp cận Anthropic Mythos 5 và OpenAI GPT-6 Astra là bước tiến đáng kể. Tuy nhiên, điều đó không có nghĩa EU có quyền thường trực để thử nghiệm mọi phiên bản kế tiếp, và cũng không có nghĩa ENISA đã được tiếp cận Mythos 5.1. 9
20
Theo người phát ngôn Ủy ban châu Âu, ENISA đã được cấp quyền truy cập Mythos 5 để thử nghiệm, đồng thời cũng được tiếp cận GPT-6 Astra. 9 Trong khi đó, các thông tin được đăng tải cho biết Anthropic không cung cấp Mythos 5.1 cho AISI thử nghiệm trước khi ra mắt — lần đầu được ghi nhận Anthropic giữ một mô hình lớn ngoài quy trình thử nghiệm tiền phát hành của cơ quan này.
20
23
Không nên giản lược sự việc thành câu chuyện “EU thắng, Anh thua”. Quyền tiếp cận của ENISA áp dụng với hai mô hình được nêu tên, theo những thỏa thuận cụ thể. Mythos 5.1 là một đợt phát hành khác, với điều kiện tiếp cận chặt chẽ hơn. Bài học thực tế là việc đánh giá an toàn đang bị phân tầng theo phiên bản mô hình, năng lực, mục đích sử dụng, khu vực pháp lý và tiêu chí lựa chọn đối tác của chính doanh nghiệp phát triển.
Anthropic cho biết Claude Fable 5.1 và Claude Mythos 5.1 dùng cùng mô hình nền tảng, nhưng khác nhau về mức độ bảo vệ an toàn. Fable 5.1 được cung cấp rộng rãi, còn Mythos 5.1 chỉ có trong các chương trình “truy cập đáng tin cậy”, được thiết kế cho công việc về an ninh mạng và khoa học sự sống. 12
Vì thế, đây không đơn thuần là câu chuyện kiểm thử sản phẩm. Một hệ thống phục vụ công việc nhạy cảm về an ninh mạng hoặc khoa học có thể đặt ra yêu cầu về môi trường sử dụng kiểm soát, giám sát nguy cơ lạm dụng, thẩm tra nhân sự và quy trình xử lý liên quan đến an ninh quốc gia. Các báo cáo nói rằng quyền tiếp cận Mythos 5.1 ban đầu chỉ dành cho những tổ chức Mỹ đã qua thẩm định. 18
24
Các bằng chứng hiện có không cho thấy Anthropic loại Anh vì không tin tưởng nước này hoặc AISI. Thiết kế của chương trình giới hạn, yêu cầu an ninh vận hành và quyền kiểm soát thương mại đối với việc tiếp cận đều là những cách giải thích có thể có. Dù vậy, kết quả vẫn đáng chú ý: lịch sử hợp tác và uy tín của một cơ quan đánh giá không bảo đảm quyền tiếp cận kịp thời với mô hình có hệ quả lớn.
EU có nền tảng pháp lý mạnh hơn một cơ chế hoàn toàn tự nguyện. Theo Điều 55 của Đạo luật AI của EU (EU AI Act), nhà cung cấp mô hình AI đa dụng có rủi ro hệ thống phải đánh giá mô hình theo giao thức và công cụ chuẩn hóa; đánh giá, giảm thiểu rủi ro hệ thống; theo dõi và báo cáo sự cố nghiêm trọng; đồng thời bảo đảm mức bảo vệ an ninh mạng phù hợp. 43
37
Đạo luật cũng đặt ra yêu cầu đánh giá trước lần đầu đưa mô hình ra thị trường, bao gồm thử nghiệm đối kháng có ghi chép; khi phù hợp, việc này có thể được thực hiện nội bộ hoặc bởi bên đánh giá độc lập bên ngoài. 35
34
Dẫu vậy, nghĩa vụ của nhà cung cấp không đồng nghĩa ENISA mặc nhiên có quyền nhận trọng số mô hình, quyền truy cập hệ thống không giới hạn, hoặc quyền thử trước khi phát hành đối với mọi mô hình AI tiền tuyến. Thỏa thuận ENISA đang có ý nghĩa chính vì nó dường như được đạt tới từ quá trình làm việc với các công ty, bên cạnh vị thế điều tiết rộng hơn của EU. 4
9
Nói cách khác, quy định có thể tăng khả năng của EU trong việc yêu cầu bằng chứng, quản trị rủi ro và tuân thủ. Nhưng với các mô hình mang năng lực nhạy cảm về an ninh mạng, sinh học hoặc tác tử tự hành, việc kiểm thử vẫn cần hợp tác vận hành an toàn.
Việc Anh bị cho là không được tiếp cận Mythos 5.1 làm nổi bật giới hạn của cơ chế dựa trên sự tự nguyện. Các bài viết về vụ việc ghi nhận những lời kêu gọi trao nền tảng pháp lý và quyền hạn mạnh hơn cho AISI, sau khi Anthropic không cấp quyền truy cập mô hình mới nhất. 23
Cách tiếp cận tự nguyện có thể hiệu quả khi các phòng thí nghiệm AI nhìn thấy giá trị trong hợp tác. Nó cũng có thể nhanh và linh hoạt về kỹ thuật hơn các quy định cứng nhắc. Điểm yếu là tính dự báo: nhà phát triển có thể hạn chế quyền truy cập, thay đổi nhóm đối tác đủ điều kiện, hoặc quyết định một mô hình phải nằm trong kênh an ninh quốc gia chặt chẽ hơn.
Điều này tạo rủi ro chiến lược cho Anh. Nếu các đơn vị đánh giá chỉ nhận được hệ thống AI tiền tuyến sau khi phát hành — hoặc sau khi chính phủ và đối tác được phê duyệt ở nơi khác đã thử nghiệm — Anh có thể chuyển từ vị thế góp phần định hình bằng chứng an toàn sang tiếp nhận bằng chứng do nơi khác tạo ra.
Mục tiêu trước mắt không nhất thiết phải là buộc doanh nghiệp bàn giao trọng số mô hình. Với các mô hình năng lực cao, cách làm đó có thể tự tạo ra rủi ro về an ninh và sở hữu trí tuệ. Một khuôn khổ mạnh hơn có thể tập trung vào quyền tiếp cận có kiểm soát và có thể kiểm toán.
Các biện pháp có thể gồm:
Những đề xuất này nhắm vào điểm yếu cốt lõi mà vụ việc phơi bày: quyền tiếp cận cần được thiết kế sẵn trong hệ thống quản trị, thay vì hoàn toàn dựa vào quan hệ với từng phòng thí nghiệm AI.
Xu hướng có khả năng xảy ra là hệ thống đánh giá nhiều tầng. Các mô hình phục vụ thị trường đại chúng sẽ chịu kiểm thử của nhà cung cấp, nghĩa vụ tài liệu điều tiết và yêu cầu báo cáo sự cố. Năng lực nhạy cảm hơn về an ninh mạng, sinh học và tác tử tự hành sẽ ngày càng được đánh giá trong bối cảnh hạn chế. Những hệ thống rủi ro cao nhất có thể chỉ mở cho một nhóm nhỏ đối tác chính phủ, phòng thí nghiệm và an ninh đã được thẩm định.
Thỏa thuận của ENISA và việc Anh không được thử Mythos 5.1 cho thấy vì sao sự phân biệt này quan trọng. Cạnh tranh hiện nay không còn chỉ là ai xây được mô hình mạnh nhất, mà còn là ai có thể kiểm tra, thử nghiệm và quản trị những phiên bản hệ quả nhất trước khi chúng được triển khai rộng hơn. 9
12
20
Với Anh, năng lực đánh giá kỹ thuật vẫn rất có giá trị, nhưng chỉ riêng điều đó là chưa đủ. Muốn duy trì ảnh hưởng, nước này sẽ cần quyền hạn pháp lý đáng tin cậy trong nước và những cơ chế tiếp cận bền vững, có tính đến yêu cầu an ninh, với các đối tác ở nước ngoài.
Studio Global AI
Trang này bao gồm câu trả lời dựa trên nguồn mà bạn có thể tiếp tục bên trong Studio Global.
ENISA, cơ quan an ninh mạng của EU, đang thử nghiệm Anthropic Mythos 5 và OpenAI GPT 6 Astra; nhưng Viện An ninh AI của Anh được cho là không nhận được Mythos 5.1 trước khi mô hình này phát hành ngày 1/9.
ENISA, cơ quan an ninh mạng của EU, đang thử nghiệm Anthropic Mythos 5 và OpenAI GPT 6 Astra; nhưng Viện An ninh AI của Anh được cho là không nhận được Mythos 5.1 trước khi mô hình này phát hành ngày 1/9. Quyền tiếp cận là theo từng mô hình và từng thỏa thuận: việc ENISA có Mythos 5 không tự động tạo ra quyền thử mọi bản nâng cấp, gồm Mythos 5.1.
Sự việc củng cố lập luận rằng Anh cần thẩm quyền pháp lý rõ ràng hơn để yêu cầu thông tin và đánh giá an toàn trong môi trường kiểm soát, đồng thời tăng hợp tác với EU và các đối tác an ninh.