GPT-6 아스트라 이미지 분석, 한글 문서와 작은 글씨는 따로 검증해야
GPT-6 아스트라의 이미지 입력 지원은 사진 속 모든 글자와 도표를 정확히 읽는다는 보장이 아니다. 오픈AI 공식 문서는 한글 등 비라틴 문자, 작은 글자, 회전된 그림과 복잡한 선 표시를 한계로 안내한다. 이미지 크기와 처리 설정도 분석 전에 달라질 수 있어 원본과 결과의 대조가 필요하다.

GPT-6 아스트라로 한국어 문서 사진을 분석하려는 이용자는 공식 이미지 입력 지원과 문자 판독의 정확도를 구분해야 한다. 9월 27일 확인한 오픈AI 모델 문서는 아스트라가 이미지를 입력받고 텍스트를 출력한다고 안내한다. 별도의 이미지·시각 안내는 한글이나 일본어처럼 비라틴 문자가 포함된 이미지에서 성능이 최적이 아닐 수 있다고 명시한다.
작은 글씨도 확인 대상이다. 공식 안내는 이미지 속 글자를 확대해 읽기 쉽게 만들고 가능한 경우 원본 상세 설정을 활용할 수 있다고 설명한다. 반대로 회전되거나 거꾸로 놓인 글씨와 그림은 잘못 해석할 수 있다. 문서 사진을 받았다는 사실만으로 표 안의 작은 숫자까지 정확히 옮겼다고 가정할 수 없는 이유다.
이미지가 분석되는 크기와 과금 단위도 원본 파일과 항상 같지는 않다. 안내가 제시한 아스트라의 높은 상세 설정 예시에서는 2048픽셀 정사각형 이미지가 패치 한도에 따라 1600픽셀로 줄어든다. 반면 1024픽셀 정사각형 예시는 크기를 줄이지 않는다. 이는 명시된 설정의 계산 예시이지 모든 입력에 같은 축소율이 적용된다는 뜻은 아니다.
도표에는 별도의 한계가 있다. 색과 실선·점선 같은 표현이 섞인 그래프를 이해하기 어려울 수 있고, 물체의 개수는 근사치로 제시할 수 있다고 문서는 설명한다. 원래 파일 이름이나 메타데이터도 처리하지 않는다고 안내한다. 따라서 파일명에 적힌 날짜나 출처를 이미지 분석 결과가 확인한 사실로 간주해서는 안 된다.
업무에 적용하려면 원본의 중요한 글자·숫자와 모델의 답변을 직접 대조하는 절차가 필요하다. 특히 읽기 쉬운 형태로 바꾼 이미지와 모델이 실제로 처리한 형태를 혼동하지 않는 것이 핵심이다. 아스트라의 모델 사양과 일반 시각 안내를 함께 읽으면 지원 기능과 문서화된 제한을 나눌 수 있다. 본 기사는 공식 사양의 한계를 정리한 것으로 한국어 인식률이나 특정 서식의 오류율을 측정한 결과는 아니다. 이미지 생성 도구를 호출하는 기능 역시 이 같은 입력 판독의 정확도를 보장하지는 않는다.
프리즘코리아 편집국 > 윤서진



