Điều đó không chứng minh rằng “Spud” chưa từng là tên nội bộ. Nó chỉ có nghĩa là các tuyên bố công khai về thời điểm phát hành, điểm benchmark hoặc khả năng hiểu ảnh/tài liệu vượt trội của Spud chưa được thiết lập bằng bằng chứng chính thức trong bộ nguồn này.
Bằng chứng chính thức mạnh nhất hiện trỏ về GPT-5.4. Trang model GPT-5.4 của OpenAI mô tả GPT-5.4 là mô hình tuyến đầu cho các công việc chuyên nghiệp phức tạp . Hướng dẫn model mới nhất và danh mục model của OpenAI cũng dẫn người đọc tới GPT-5.4 .
Ngược lại, các nguồn nhắc riêng tới Spud trong bộ tài liệu này là bài viết web phổ thông, Reddit, bài đăng X và video YouTube, không phải trang model, hướng dẫn model, model card hay báo cáo benchmark chính thức của OpenAI . Vì vậy, cách đọc an toàn là: GPT-5.5 Spud hiện nên được xem là tin đồn hoặc một nhãn chưa xác minh cho tới khi OpenAI công bố tài liệu chính thức.
| Tuyên bố | Tình trạng | Nguồn hiện ủng hộ điều gì |
|---|---|---|
| GPT-5.5 “Spud” là model OpenAI công khai, chính thức | Chưa xác minh | Các nguồn chính thức được rà soát ghi nhận GPT-5.4, không phải trang model GPT-5.5 hay Spud . |
| Spud sắp ra mắt hoặc đã được xác nhận | Chưa xác minh | Các nhắc đến Spud trong bộ nguồn này đến từ web phổ thông hoặc nội dung do người dùng đăng trên mạng xã hội/video . |
| OpenAI đã tài liệu hóa quy trình hiểu tài liệu đa phương thức | Đã xác minh với GPT-5.4 | OpenAI có hướng dẫn về thị giác và hiểu tài liệu cho GPT-5.4, cùng hướng dẫn prompt cho ảnh dày đặc hoặc nhạy về vị trí . |
| Spud hiểu ảnh/tài liệu tốt hơn GPT-5.4 | Không được nguồn chính thức ở đây hỗ trợ | Tài liệu chính thức được rà soát hỗ trợ GPT-5.4; không có bằng chứng năng lực hoặc benchmark riêng cho Spud . |
Trang GPT-5.4 chính thức nói GPT-5.4 là mô hình tuyến đầu của OpenAI cho công việc chuyên nghiệp phức tạp . OpenAI cũng có trang cookbook về GPT-5.4 tập trung vào thị giác và hiểu tài liệu . Trong tài liệu được truy xuất, phần hướng dẫn này gắn với các ví dụ như trích xuất có cấu trúc từ một mẫu bảo hiểm viết tay, suy luận không gian trên mặt bằng căn hộ, hiểu biểu đồ và trích xuất hộp giới hạn từ một biểu mẫu cảnh sát .
Các ví dụ đó quan trọng vì xử lý tài liệu thật không chỉ là tóm tắt trôi chảy. Một mô hình có khả năng “grounding” tốt phải liên kết câu trả lời với bằng chứng nhìn thấy được: nhãn trường và giá trị, ô trong bảng, điểm/đường trên biểu đồ, chữ viết tay, bố cục trang và vị trí không gian. Dù vậy, phần GPT-5.4 được rà soát ở đây vẫn là hướng dẫn và minh họa do OpenAI công bố, không phải một báo cáo benchmark độc lập đã kiểm toán cho mọi quy trình tài liệu trong sản xuất .
Hướng dẫn prompt của OpenAI cũng có ý nghĩa thực dụng khi đánh giá. OpenAI khuyến nghị dùng mức chi tiết ảnh original cho ảnh lớn, dày đặc hoặc nhạy về không gian, đặc biệt với tác vụ dùng máy tính, định vị, OCR và độ chính xác khi nhấp . Với biểu mẫu, bản scan, ảnh chụp màn hình và biểu đồ, điều này có nghĩa là quy trình có thể mất độ chính xác nếu ảnh bị thu nhỏ quá mức hoặc bị loại bỏ những chi tiết mà mô hình cần quan sát.
OCR chủ yếu hỏi hệ thống đọc được chữ hay không. Grounding đa phương thức đi xa hơn: hệ thống phải kết nối chữ, bố cục, vị trí, cấu trúc thị giác và suy luận để đưa ra câu trả lời có thể kiểm tra ngược trên trang.
Bối cảnh nghiên cứu cũng ủng hộ cách nhìn rộng hơn này. Đánh giá hiểu tài liệu thường bao gồm hiểu biểu mẫu, phân tích hóa đơn/biên nhận và document VQA, tức trả lời câu hỏi dựa trên tài liệu trực quan . Với tài liệu nhiều trang, VQA có thể đòi hỏi mô hình suy luận qua nhiều trang, điều hướng tài liệu, truy xuất nội dung liên quan và mở đúng trang cần kiểm tra, thay vì chỉ nhìn một ảnh hoặc một phần cắt của trang .
Vì vậy, một ảnh chụp màn hình gây ấn tượng chưa đủ để kết luận. Đánh giá nghiêm túc cần bao phủ đúng loại tài liệu, chất lượng scan, số trang, chữ viết tay, bảng, biểu đồ, chữ nhỏ và các trường hợp dễ lỗi trong quy trình thực tế.
original cho đầu vào lớn, dày đặc hoặc nhạy về không gian như OCR, định vị, độ chính xác khi nhấp và tác vụ dùng máy tính .Tên “Spud” xuất hiện trong các nguồn mang màu sắc tin đồn, nhưng chưa được xác minh là model OpenAI công khai, chính thức trong bộ nguồn được rà soát. Kết luận có thể hành động hiện nay hẹp hơn: hãy đánh giá GPT-5.4 cho các quy trình thị giác và hiểu tài liệu mà OpenAI đã tài liệu hóa, và xem các tuyên bố về khả năng grounding đa phương thức của GPT-5.5 Spud là chưa được chứng minh cho tới khi OpenAI công bố trang model, hướng dẫn model, model card hoặc báo cáo benchmark chính thức .