GPT-6 Astra读取附件:百万上下文不等于看见每张图表
中文团队把财报、演示文稿或统计表交给GPT-6 Astra时,模型真正接收到的内容取决于文件格式及所用接口。OpenAI文件输入指南区分PDF的文字与页面图像、办公文档的文字提取,以及电子表格按工作表截取的处理方式。附件上传成功,不能证明所有图表和全部数据都已进入模型。

把一份含图表的报告上传给GPT-6 Astra,并不意味着模型已经看见每一张图。OpenAI现行文件输入指南对不同格式采用不同处理路径:具备视觉能力的模型读取PDF时,会接收提取出的文字及各页图像;其他文档格式主要提取文字。对准备分析中文财报或演示材料的团队而言,文件格式影响的是实际输入,而非仅仅影响上传速度。
指南列举的非PDF文件包括Word文档和PowerPoint演示文稿。这类文件中的嵌入图像和图表不会作为视觉内容自动进入上下文。若任务需要模型查看图形,官方建议先转换为PDF。换言之,要求模型解释某张柱状图之前,应确认图形经过受支持的输入路径送达,不能用附件已接收的状态代替这一检查。
电子表格还有另一道边界。对于表格文件,系统只提取每张工作表的前一千行,并补充生成的摘要及表头信息。这是一项文件处理规则,与模型可以容纳多少上下文令牌是两回事。把大型工作簿放进请求,并不能据此宣称模型已逐行审阅所有记录;涉及完整数据的连接、汇总或复杂计算,指南另建议使用具备计算能力的Hosted Shell。
接口选择也会改变可用方式。Responses接口支持多类文件输入;Chat Completions的文件输入仅支持PDF,而且不能采用文件URL方式。已有程序即使保留相同附件,也不能假定切换接口后所有传递方式都兼容。官方同时规定,单个文件须小于五十兆字节,一次请求中全部文件的总量上限为五十兆字节。
PDF视觉细节还存在选择空间。Responses的文件输入可以设置自动、低或高三种细节档位;指南称GPT-5.6及更新模型的自动档默认采用高细节。降低图像细节不会取消文字提取,但可能影响模型读取小字号或复杂图形时获得的视觉信息。Chat Completions不支持这一文件细节设置,不能直接照搬配置。
这些差别提示开发者把验收重点放在材料是否完整到达。用于测试的文档可同时放入正文、图片中的标签,以及超过表格提取范围的记录,再核对实际任务需要哪一类信息。这是依据输入规则提出的检查方法,并非本报完成的性能实验。官方格式支持也不能保证识别准确率,尤其不能以模型长上下文规格替代对原始材料覆盖范围的核验。
因此,若结论依赖工作表后段的一笔交易,或演示页中没有文字说明的曲线,就需要另行提供相应数据。报告没有提到某项内容,既可能源于分析,也可能只是材料未被提取,两者应分别核实清楚。
프리즘코리아 편집국 > 林知远



