OpenAI bắt đầu triển khai giới hạn GPT 6 Astra từ ngày 3/9, gọi đây là mô hình thông minh và căn chỉnh nhất của hãng, dành cho lập trình, nghiên cứu, sử dụng máy tính và công việc nhiều bước. OpenAI công bố các điểm số 98% trên FrontierMath Tier 4, 99,9% trên ARC AGI 3 và 100% trên ExploitBench; đồng thời xếp Astra...
Đăng bởiBiên tập bằng GPT-5.6 TerraHình ảnh được tạo bằng GPT Image 2
Câu trả lời nghiên cứu

Create a landscape editorial hero image for this Studio Global article: What did OpenAI announce with the September 3 launch of GPT-6 Astra—including its claimed intelligence, alignment, record benchmark results,. Article summary: OpenAI presented GPT‑6 Astra as a major step toward highly autonomous AI: “the world’s most intelligent and aligned model,” with record scores across agentic, scientific, computer-use, and cyber evaluations. These are Op. Topic tags: general, documentation, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fak
OpenAI giới thiệu GPT-6 Astra ngày 3/9 như một mô hình phục vụ các công việc khó, nhiều bước: lập trình, nghiên cứu, thao tác trên máy tính và quy trình chuyên môn. Hãng gọi đây là mô hình thông minh và căn chỉnh nhất từ trước đến nay, nhưng ban đầu chỉ mở cho một nhóm tổ chức giới hạn thay vì phổ biến đại trà ngay lập tức. 2
5
13
Điểm đáng chú ý của đợt ra mắt không chỉ là các con số benchmark. OpenAI cho biết Astra là mô hình đầu tiên của họ đạt ngưỡng năng lực an ninh mạng Critical trong Khung chuẩn bị rủi ro (Preparedness Framework). Vì vậy, các tuyên bố về hiệu năng cần được nhìn song song với cách hãng giới hạn triển khai. 10
12
Theo OpenAI, Astra đạt trình độ hàng đầu ở các tác vụ sử dụng máy tính, duyệt web, kỹ nghệ phần mềm, an ninh mạng, khoa học và công việc chuyên môn. Tài liệu dành cho nhà phát triển mô tả mô hình này phù hợp với suy luận phức tạp, viết mã, dùng máy tính, nghiên cứu và tạo tài liệu. 1
3
13
Ba kết quả đánh giá nổi bật được OpenAI công bố là:
Đây là kết quả đánh giá do OpenAI công bố, chưa phải các phép đo được tái lập độc lập. Điểm benchmark cao có thể cho thấy tiến bộ trên đúng các nhiệm vụ được kiểm tra, nhưng không tự động chứng minh trí tuệ tổng quát, khả năng phán đoán đáng tin cậy ngoài thực tế, hay tính tự chủ an toàn trong mọi môi trường.
OpenAI cho biết Astra là mô hình đầu tiên của họ đạt cấp Critical về năng lực an ninh mạng theo Khung chuẩn bị rủi ro. Theo mô tả của hãng, khi được cấp công cụ và quyền truy cập phù hợp, mô hình có thể tìm các lỗ hổng bảo mật chưa từng được biết đến và phát triển phương thức khai thác mới trên nhiều hệ thống được bảo vệ tốt, mà không cần con người chỉ dẫn từng bước. 10
12
Tuyên bố này có hai giới hạn quan trọng:
OpenAI nói đã bổ sung biện pháp bảo vệ mạnh hơn nhằm ngăn các hành vi mạng gây hại, trong đó có giám sát bổ sung khi triển khai Astra. 5
10 Việc mở quyền truy cập theo giai đoạn, thay vì phát hành rộng rãi ngay, phù hợp với mức rủi ro mà hãng tự nhận diện.
OpenAI cũng gọi Astra là mô hình căn chỉnh nhất của mình, với tuyên bố rằng nó tôn trọng ranh giới tác vụ tốt hơn và giao tiếp minh bạch hơn. 2
13
Cần hiểu thận trọng: trong một đợt phát hành mô hình, “căn chỉnh” phản ánh hiệu năng dưới những phương pháp huấn luyện và bài đánh giá cụ thể. Đó không phải cam kết rằng một tác tử AI luôn hiểu đúng ý định người dùng, luôn giữ đúng mọi ranh giới vận hành, hoặc có thể triển khai mà không cần con người giám sát. Ghi chú phát hành của OpenAI nêu rằng Astra có cơ chế giám sát bổ sung để phát hiện các trường hợp tác tử có thể diễn giải sai chỉ dẫn. 5
Với tổ chức muốn dùng tác tử AI, câu hỏi thực tế không phải là mô hình có được gắn nhãn “căn chỉnh” hay không. Quan trọng hơn là: nó được cấp quyền gì; hành động nào phải có người phê duyệt; hoạt động được ghi log ra sao; và hệ thống có thể bị dừng nhanh đến mức nào khi hành xử bất thường.
Tài liệu được cung cấp đề cập tới các điều chỉnh hoặc lưu ý sau này đối với một số kết quả đánh giá, gồm lo ngại về việc benchmark có thể đã bị mô hình biết trước và khác biệt giữa cấu hình truy cập đặc biệt với cấu hình sản phẩm mặc định. Tài liệu cũng mô tả các thử nghiệm trong đó giám sát chỉ dựa vào chuỗi suy luận (chain-of-thought) kém hiệu quả hơn so với giám sát có đầy đủ ngữ cảnh.
Tuy nhiên, các trích đoạn nguồn chính được cung cấp không đưa ra lịch sử chỉnh sửa đầy đủ, có thể kiểm toán độc lập cho mọi con số đã công bố, cũng không trình bày trọn vẹn phương pháp giám sát nền tảng. Kết luận thận trọng là các điểm benchmark nổi bật và đánh giá an toàn nên được xem là bằng chứng phát hành có thể tiếp tục thay đổi; người dùng nên kiểm tra tài liệu mô hình và tài liệu an toàn mới nhất trước khi dựa vào một điểm số hoặc tuyên bố triển khai cụ thể. 2
3
10
Đợt ra mắt diễn ra sau một sự cố thử nghiệm an ninh trước đó liên quan đến các mô hình OpenAI, mà hãng cho biết đã góp phần định hình cách tiếp cận an toàn cho Astra. Tài liệu phát hành của OpenAI nêu rằng Astra không phải mô hình liên quan đến sự cố và các bài học từ đó đã được đưa vào biện pháp bảo vệ của hãng. 10
Bối cảnh này quan trọng vì các hệ thống tự chủ kết hợp năng lực của mô hình với khả năng hành động qua trình duyệt, công cụ lập trình và phần mềm khác. Chính khả năng thực hiện hành động trên nhiều hệ thống khiến chúng hữu ích hơn, nhưng cũng khiến việc cô lập, cấp quyền tối thiểu và giám sát trở nên thiết yếu.
OpenAI cho biết Astra ban đầu được triển khai cho một nhóm tổ chức giới hạn, và sẽ mở rộng khả dụng sau đó. 5
13
Với nhà phát triển, OpenAI niêm yết GPT-6 Astra ở mức 10 USD cho một triệu token đầu vào và 50 USD cho một triệu token đầu ra. Trang mô hình cũng nêu cửa sổ ngữ cảnh 1,05 triệu token và tối đa 128.000 token đầu ra. 3
Quyền truy cập qua ChatGPT được phân tầng và mở dần riêng. Tài liệu trợ giúp của OpenAI cho biết GPT-6 Pro, dùng nền tảng Astra, đang được triển khai cho các gói Pro 100 USD, Pro 200 USD, Business và Enterprise; các gói Plus sẽ nhận Astra trong ChatGPT Work và Codex khi đợt triển khai tiếp tục. Mức khả dụng có thể khác nhau giữa các sản phẩm ChatGPT và tùy thiết lập không gian làm việc. 6
Việc ra mắt GPT-6 Astra mang hai thông điệp không nên tách rời: OpenAI tuyên bố một bước tiến đáng kể trong công việc tác tử phức tạp, đồng thời xếp năng lực an ninh mạng của mô hình ở mức rủi ro cao nhất mà hãng công bố. 10
13
Các benchmark là bằng chứng về những gì OpenAI nói Astra làm được trong các bài đánh giá của họ. Còn việc mở quyền truy cập theo giai đoạn, tăng giám sát và siết hạn chế về an ninh mạng cho thấy hãng không coi những năng lực này là thông thường. Với các đội ngũ đang cân nhắc sử dụng, ưu tiên nên là triển khai có kiểm soát: công cụ giới hạn phạm vi, cổng phê duyệt rõ ràng cho hành động có hệ quả, môi trường cô lập và nhật ký có thể rà soát — thay vì mặc định rằng điểm benchmark cao sẽ tự động chuyển thành khả năng tự chủ đáng tin cậy.
Studio Global AI
Trang này bao gồm câu trả lời dựa trên nguồn mà bạn có thể tiếp tục bên trong Studio Global.
OpenAI bắt đầu triển khai giới hạn GPT 6 Astra từ ngày 3/9, gọi đây là mô hình thông minh và căn chỉnh nhất của hãng, dành cho lập trình, nghiên cứu, sử dụng máy tính và công việc nhiều bước.
OpenAI bắt đầu triển khai giới hạn GPT 6 Astra từ ngày 3/9, gọi đây là mô hình thông minh và căn chỉnh nhất của hãng, dành cho lập trình, nghiên cứu, sử dụng máy tính và công việc nhiều bước. OpenAI công bố các điểm số 98% trên FrontierMath Tier 4, 99,9% trên ARC AGI 3 và 100% trên ExploitBench; đồng thời xếp Astra ở mức “Critical” về năng lực an ninh mạng.
API được niêm yết giá 10 USD cho một triệu token đầu vào và 50 USD cho một triệu token đầu ra.