GPT-6 Astraの資料入力、PDFとWordで図表の扱いに違い
GPT-6 Astraに業務資料を渡す際は、ファイル形式とAPIによって図表の取り込み方が変わる。PDFの詳細度や容量上限を公式文書で確認し、日本語の資料を扱う読者が、送信成功と必要情報の読み取りを取り違えないための条件を整理した。

GPT-6 Astraへ日本語の業務資料を渡すとき、ファイルを受け付けたことと、資料中の図表まで読めたことは同じではない。OpenAIのAPI文書は、Responses APIに渡すファイルを形式ごとに異なる方法で処理すると説明する。モデル選びに加え、何が入力に変換されたかの確認が必要になる。
PDFでは、画像を扱えるモデルに本文の抽出テキストと各ページの画像が渡る。一方、WordやPowerPointなどPDF以外の文書は、基本的にテキストだけを抽出する。非PDFの中に埋め込まれた画像やグラフは、そのままモデルの入力に含まれない。図の細部を保ちたい場合、公式文書はPDFへの変換を案内している。
この違いは、説明文を読めるのに図の結論を取り違える状況を調べる手掛かりになる。たとえば図中の矢印や凡例が重要な資料では、本文だけを送る設計で必要な情報が失われていないかを確かめたい。日本語資料であっても、拡張子の違いによる処理条件を、言語の理解力だけの問題に置き換えることはできない。
PDFの画像部分には、詳細度を指定する機能がある。選択肢はauto、low、highで、低い設定は入力トークンを減らし、高い設定は小さな文字や密な図表などの視覚情報に向く。文書によればGPT-5.6以降でautoはhighを使う。設定を変えても、PDFから抽出したテキストは入力に含まれる。
ただし、細かく読ませる設定は正答の保証ではない。資料のどのページを根拠にしたか、表の単位や注記を正しく扱ったかは、別に確認する必要がある。本稿は公式の処理条件を整理したもので、日本語文書の文字認識率や、特定業務での回答精度を実験して測った結果ではない。
ファイル容量にも制限がある。一つのファイルは50MB未満で、同じ要求に含めるファイルの合計上限は50MBだ。モデルが扱える文脈の大きさと、送信できるファイル容量は別の制約になる。画像を含むPDFはテキストとページ画像の両方を使うため、費用を見積もる際も文字数だけで判断しない方がよい。
またChat Completionsのファイル入力はPDFに限られ、Responsesとは対応範囲が異なる。送信経路を変える際は、モデル名の変更だけで移行が済むとは限らない。資料の形式、呼び出すAPI、図表の扱いを一組で記録すれば、読み落としの原因を追いやすくなる。
프리즘코리아 편집국 > 水野遼



