Đây là một phần quan trọng trong thông điệp của Z.ai: thay vì xem khả năng mạng của AI chủ yếu là rủi ro cần phong tỏa, công ty muốn chứng minh rằng chính những năng lực đó có thể được chuyển hướng sang phía phòng thủ.
Tài liệu của Z.ai cho biết quá trình hậu huấn luyện đã cải thiện đáng kể khả năng phát hiện lỗ hổng và phân tích chuỗi khai thác của GLM-5.3. Đây là những năng lực có ích cho chuyên gia bảo mật, nhưng đồng thời cũng có thể hỗ trợ hoạt động tấn công.
Theo dữ liệu do công ty công bố, GLM-5.3 đạt 84,5% trên CyberGym, một bài kiểm tra khả năng rà soát mã nguồn và phát hiện lỗ hổng; Reuters cho biết mức này nhỉnh hơn con số 83,8% mà Z.ai công bố cho Mythos 5 của Anthropic.
Vấn đề nằm ở chỗ các mô hình có trọng số mở có thể làm giảm ngưỡng kỹ năng cần thiết để tiến hành một số cuộc tấn công mạng. Vì vậy, Z.ai nói rằng họ sẽ áp dụng quy trình đánh giá rủi ro nhiều lớp và tăng cường giám sát thay vì phát hành mọi tính năng một cách không hạn chế.
Cách tiếp cận được đề xuất không phải là cấm toàn bộ các tác vụ liên quan đến mã nguồn hay bảo mật. Các biện pháp bảo vệ nhằm chặn những yêu cầu mạng có rủi ro cao, trong khi vẫn cho phép các công việc thông thường như viết mã, bảo trì phần mềm và kiểm tra bảo mật phòng thủ tiếp tục hoạt động.
Sự phân tách này nhằm duy trì giá trị thực tế của hệ sinh thái mã nguồn mở. Một cơ chế quá nghiêm ngặt có thể khiến nhà phát triển không thể sử dụng AI cho những công việc hợp pháp, trong khi một cơ chế quá lỏng lại làm tăng nguy cơ công cụ bị dùng để tự động hóa tấn công.
Những khả năng tấn công mạng nhạy cảm nhất dự kiến chỉ được cung cấp cho người dùng đã xác minh thông qua chương trình Cybersecurity Trusted Access. Như vậy, Z.ai đang mở rộng quyền tiếp cận các công cụ phòng thủ cho cộng đồng, nhưng vẫn tạo một lớp kiểm soát riêng đối với các chức năng có nguy cơ lạm dụng cao.
GLM-5.3 cũng được triển khai theo từng giai đoạn: các đối tác bảo mật được lựa chọn sẽ đánh giá mô hình trong môi trường kiểm soát trước khi quyền truy cập rộng hơn và API được cung cấp.
Project Glasswing của Anthropic là sáng kiến cung cấp quyền truy cập sớm, có kiểm soát vào AI tiên tiến để bảo vệ các phần mềm quan trọng.
Vì vậy, việc gọi Shield of Open Source là một “Project Glasswing của Trung Quốc” nên được hiểu là một so sánh mang tính diễn giải, không phải sự tương đương chính thức. Hai sáng kiến cùng đặt ưu tiên vào phòng thủ, nhưng Z.ai nhấn mạnh hơn vào mô hình phân phối mã nguồn mở: coi tính minh bạch, kiểm toán cộng đồng và khả năng tiếp cận rộng rãi các công cụ phòng thủ là tài sản an ninh, thay vì chỉ xem chúng như rủi ro.
Nếu thành công, chiến lược của Z.ai có thể giúp định hình một câu chuyện mới về vai trò của Trung Quốc trong an ninh mạng toàn cầu: không chỉ cạnh tranh bằng mô hình AI, mà còn cung cấp hạ tầng và công cụ phòng thủ cho các nhà phát triển trên khắp thế giới.
Tuy nhiên, cần giữ một khoảng cách nhất định giữa tuyên bố của doanh nghiệp và tác động thực tế. Shield of Open Source hiện mới là sáng kiến và định hướng chính sách do Z.ai công bố, chưa phải bằng chứng cho thấy tư thế an ninh mạng của Trung Quốc đã thay đổi. Uy tín của chương trình sẽ phụ thuộc vào việc các biện pháp kiểm soát có còn hiệu quả khi quyền tiếp cận được mở rộng hay không, các cuộc kiểm toán có dẫn đến việc công bố có trách nhiệm và vá lỗi hay không, cũng như liệu các thử nghiệm độc lập có xác nhận được những ranh giới an toàn mà Z.ai đưa ra hay không.