GPT-6 아스트라 캐시 비용, 저장 한 번과 재사용 횟수를 함께 봐야
GPT-6 아스트라의 캐시 입력 할인은 같은 내용을 다시 활용할 때 발생한다. 새로 캐시를 쓰는 요율은 일반 입력보다 높으며, 대화가 이어져도 앞부분이 달라지면 재사용되지 않을 수 있다. 공식 안내는 실제 캐시 읽기·쓰기량을 측정하고 반복될 구간을 구별하도록 설명한다.

GPT-6 아스트라의 캐시 입력 가격이 낮다는 사실만으로 모든 요청 비용이 줄어드는 것은 아니다. 9월 27일 확인한 오픈AI 모델 문서는 기본 입력 100만 토큰당 10달러, 캐시 입력 1달러, 캐시 쓰기 12.50달러를 표시한다. 먼저 저장할 때와 나중에 재사용할 때 적용하는 요율이 다르다는 뜻이다.
공식 캐시 안내는 GPT-5.6 이후 모델에서 저장 요율을 일반 입력의 1.25배, 읽기 요율을 0.1배로 설명한다. 같은 구간을 한 번 저장하고 한 번 온전히 재사용하면 입력 비용은 일반 처리 한 번의 1.35배가 된다. 두 번 모두 새로 처리하는 2배보다 작지만, 재사용이 없다면 저장의 추가 부담만 남을 수 있다. 이 비교는 같은 입력 구간에 관한 것으로 답변 생성 비용 전체를 뜻하지 않는다.
재사용 조건은 대화가 계속된다는 사실보다 엄격하다. 캐시는 요청의 바뀌지 않은 앞부분을 활용하며, 해당 구간의 내용이나 관련 설정이 바뀌면 그 뒤는 기존 저장 내용과 일치하지 않을 수 있다. 도구의 이름·설명·순서나 출력 형식, 일부 추론 설정도 영향을 줄 수 있다고 문서는 안내한다.
개발자가 저장 끝점을 지정하는 명시적 방식도 제공된다. 이 방식에서 끝점을 하나도 두지 않으면 캐시를 사용하거나 새로 쓰지 않는다. 마지막 끝점 뒤의 내용은 일반 입력 요율로 처리되므로 자주 바뀌어 다시 쓸 가능성이 낮은 부분을 저장에서 제외할 수 있다. 지원 모델에서 자동 끝점 선택과 명시적 지정을 함께 활용하는 방식도 설명돼 있다.
운영팀은 캐시가 켜졌는지만 확인하기보다 실제 읽기량과 쓰기량을 구분해 봐야 한다. 공식 안내는 응답의 사용량 기록에서 캐시 토큰, 저장 토큰, 입력량과 실현 비용을 추적하도록 권한다. 모델 문서의 긴 입력 배율 등 별도 조건도 최종 계산에 반영해야 한다. 본 기사의 배율 비교는 공급자가 공개한 계산 원리를 설명한 것이며 특정 기업의 청구액이나 응답 속도를 실측한 결과는 아니다. 저장 정책의 선택과 실제 업무의 반복 사용 패턴을 함께 검토해야 한다.
프리즘코리아 편집국 > 한민서



