GPT-6 Astra: gửi tài liệu có biểu đồ chưa chắc đưa hình vào mô hình
OpenAI xử lý PDF khác tài liệu Word và PowerPoint trong API. Nhóm làm báo cáo cần kiểm tra định dạng đầu vào trước khi quy lỗi thiếu thông tin biểu đồ cho khả năng suy luận của GPT-6 Astra.

Một báo cáo có biểu đồ chưa chắc được GPT-6 Astra đọc cả hình khi gửi qua API. Tài liệu OpenAI phân biệt định dạng: với PDF, hệ thống đưa cả chữ trích xuất và ảnh từng trang vào mô hình có thị giác; với DOCX hay PPTX, hệ thống chỉ lấy chữ.
Vì vậy, thiếu chi tiết từ biểu đồ có thể bắt đầu ở bước nhập tệp, trước khi đánh giá khả năng suy luận. OpenAI hướng dẫn đổi tài liệu sang PDF nếu cần giữ thông tin hình và sơ đồ. Đây là điều kiện xử lý đầu vào, không phải cam kết mô hình hiểu đúng mọi biểu đồ.
Trong Responses API, tùy chọn detail điều chỉnh mức xử lý ảnh trang PDF. Với GPT-5.6 trở lên, auto dùng high; low giảm số token hình ảnh, còn chữ trích xuất vẫn được đưa vào. Chat Completions không hỗ trợ tùy chọn detail cho tệp.
Nhóm làm báo cáo cần kiểm tra trang có chú thích nhỏ sau khi chuyển đổi, rồi đối chiếu câu trả lời với tài liệu gốc. Một tệp gửi thành công không chứng minh nội dung trực quan đã được tiếp nhận. PRISM chưa thực hiện phép thử độ chính xác với bộ tài liệu tiếng Việt.
프리즘코리아 편집국 > Linh Nguyễn



