Adversa mô tả tác động bảo mật tiềm ẩn là nghiêm trọng đối với tính bảo mật: một nạn nhân chỉ yêu cầu Grok tóm tắt trang do kẻ tấn công lưu trữ cũng có thể bị lộ lịch sử trò chuyện, prompt cùng dữ liệu hồ sơ hoặc phiên.
Utevsky được cho là đã thông báo cho xAI ngày 3 tháng 6 năm 2026 và gửi báo cáo thông qua HackerOne, nền tảng tiếp nhận báo cáo lỗi bảo mật và chương trình tiền thưởng lỗi. Đến thời điểm Adversa công bố thông tin ngày 20 tháng 8, vấn đề được cho là vẫn chưa được xử lý sau hơn hai tháng, dù nhóm nghiên cứu đã liên tục nhắc lại.
Các thông tin hiện có không cho thấy xAI đã công bố phản hồi hoặc thời hạn khắc phục tại thời điểm đó. Đây chủ yếu là kết luận dựa trên bài công bố của Adversa và các tin tức cùng thời điểm; chưa có tuyên bố độc lập được xAI công khai để xác nhận tình trạng này.
Theo Adversa, giải pháp cốt lõi không nên chỉ là cải thiện bộ lọc prompt. Cần xử lý lớp runtime — phần điều phối việc chạy mã, truy xuất ngữ cảnh và gọi công cụ — theo hướng:
Sự cố được báo cáo ở Grok nằm trong một xu hướng rộng hơn của AI tác nhân: các hệ thống này thường kết hợp dữ liệu không đáng tin, ngữ cảnh bí mật, khả năng chạy mã, bộ nhớ lâu dài và các công cụ có thể thực hiện hành động. Trong khi đó, mô hình ngôn ngữ không phải lúc nào cũng phân biệt chính xác đâu là dữ liệu cần đọc và đâu là mệnh lệnh cần tuân theo.
Mã hóa một payload có thể khiến các bộ lọc chỉ kiểm tra nội dung không nhận ra chỉ dẫn độc hại. Nhưng điểm yếu căn bản mang tính kiến trúc: tác nhân không được biến đầu vào không đáng tin — dù là văn bản hiển thị, bản mã, email, tài liệu, URL, kho mã hay đầu ra của công cụ — thành quyền truy cập dữ liệu riêng tư hoặc quyền thực hiện hành động bên ngoài.