본문 바로가기

IT & AI

GPT-5.6 Sol API 가격 인하, 긴 컨텍스트 할증까지 따져봐야 해요

728x90

GPT-5.6 Sol API 가격 인하, 긴 컨텍스트 할증까지 따져봐야 해요

AI 뉴스 썸네일
AI 뉴스 썸네일

OpenAI가 GPT-5.6 Sol의 API 가격을 낮췄어요. 100만 토큰당 입력은 4달러, 출력은 20달러로 바뀌었어요. 다만 입력이 272K 토큰을 넘으면 요청 전체에 별도 배수가 붙어요. 긴 문서를 한 번에 넣는 서비스라면 기본 단가만 보고 비용을 잡기 어려워요. 1

핵심 요약

구분바뀐 내용실무에서 확인할 점
기본 API 가격입력 100만 토큰당 4달러, 출력 20달러이전보다 입력은 20%, 출력은 33% 낮아졌어요
캐시 입력100만 토큰당 0.40달러반복되는 시스템 지시나 공통 문맥의 캐시 활용도를 봐야 해요
프로모션 기간최소 2026년 11월 21일까지장기 예산은 프로모션 이후 단가 변동도 염두에 둬야 해요
긴 컨텍스트입력이 272K 토큰을 넘으면 요청 전체에 입력 2배, 출력 1.5배 적용일부 초과분이 아니라 전체 요청이 할증 대상이에요
모델 한도컨텍스트 1,050,000 토큰, 최대 출력 128,000 토큰큰 한도를 실제로 쓸 때는 품질과 비용을 함께 측정해야 해요

1. GPT-5.6 Sol 기본 단가는 낮아졌지만 큰 요청은 계산법이 달라요

OpenAI 공식 모델 페이지에 따르면 GPT-5.6 Sol의 새 단가는 100만 토큰당 입력 4달러, 캐시 입력 0.40달러, 출력 20달러예요. 이전 가격과 비교하면 입력은 20%, 출력은 33% 내려갔어요. 이 프로모션 가격은 최소 2026년 11월 21일까지 제공돼요. 2

가격표에서 더 눈여겨볼 부분은 272K 토큰 기준이에요. 입력이 이 선을 넘으면 초과분에만 할증이 붙지 않아요. 해당 요청 전체가 입력 2배와 출력 1.5배 요율을 적용받아요. 여러 저장소의 코드, 긴 회의 기록, 대규모 계약서 묶음을 한 요청에 넣는 제품은 평균 입력 길이를 따로 확인해야 해요.

728x90

캐시 쓰기 비용도 일반 입력 가격의 1.25배로 책정돼요. 캐시 입력 단가만 보면 반복 요청이 매우 저렴해 보일 수 있어요. 하지만 캐시를 새로 쓰는 빈도와 재사용률이 낮으면 기대한 만큼 비용이 줄지 않을 수 있어요. 공통 지시문과 자주 바뀌는 사용자 자료를 분리하면 캐시가 실제로 얼마나 재사용되는지 측정하기 쉬워요.

큰 컨텍스트를 바로 채우기 전에 볼 항목

  • 요청별 입력 토큰의 중앙값과 상위 5% 구간을 나눠 봐야 해요.
  • 272K 토큰을 넘는 요청 비율을 별도로 기록해야 해요.
  • 캐시 쓰기와 캐시 읽기를 구분해 비용을 계산해야 해요.
  • 한 번의 큰 요청과 여러 번의 검색·요약 요청을 같은 작업으로 비교해야 해요.
  • 최대 출력 한도를 높게 잡았을 때 실제 출력 토큰이 얼마나 늘어나는지 확인해야 해요.

모델 기능은 기존 개발 흐름에 폭넓게 맞아요

GPT-5.6 Sol은 텍스트와 이미지 입력, 텍스트 출력을 지원해요. 스트리밍, 함수 호출, 구조화 출력도 쓸 수 있어요. Responses API에서는 웹 검색, 파일 검색, 코드 인터프리터, 호스티드 셸, 패치 적용, 컴퓨터 사용, MCP와 도구 검색 등을 지원해요. 복잡한 코딩이나 리서치 작업을 한 모델 안에서 이어가려는 팀에 필요한 도구가 넓게 묶여 있어요. 2

추론 강도는 `none`, `low`, `medium`, `high`, `xhigh`, `max` 중에서 고를 수 있어요. 기본값은 `medium`이에요. 비용을 비교할 때는 모델 이름만 고정하면 부족해요. 같은 평가 세트에서 추론 강도와 최대 출력 토큰까지 고정해야 결과를 제대로 비교할 수 있어요.

컨텍스트 윈도우는 1,050,000 토큰이고 최대 출력은 128,000 토큰이에요. 큰 입력 한도는 긴 작업을 끊지 않고 처리할 선택지를 줘요. 그렇다고 모든 자료를 한 번에 넣는 방식이 늘 유리한 건 아니에요. 필요한 문서를 먼저 찾는 검색 단계가 있으면 입력 비용을 줄이고 관련 없는 내용이 답변에 섞이는 문제도 줄일 수 있어요.

파인튜닝은 지원하지 않아요. 특정 말투나 업무 규칙을 고정하려는 팀은 지시문, 검색 자료, 도구 호출과 평가 세트를 중심으로 운영해야 해요. 공식 페이지에 적힌 지식 기준일은 2026년 2월 16일이에요. 그 이후 정보가 필요한 작업은 웹 검색이나 내부 데이터 연결을 전제로 설계해야 해요.

왜 중요한가요

이번 가격 조정은 GPT-5.6 Sol을 API로 쓰는 서비스의 기본 비용을 낮춰요. 특히 출력이 긴 코딩 결과, 보고서, 분석 답변을 많이 만드는 제품은 출력 단가 인하의 영향을 직접 받아요. 반복 문맥을 안정적으로 캐시하는 서비스라면 캐시 입력 단가도 비용 절감에 도움이 돼요. 2

반대로 272K 토큰 경계는 비용 구조를 갑자기 바꿔요. 긴 컨텍스트가 필요한 작업과 단순히 자료를 많이 넣는 작업을 구분해야 해요. 저장소 전체를 매번 보내는 코딩 도구라면 변경 파일과 관련 코드만 고르는 단계가 여전히 필요해요. 문서 분석 서비스도 원문 전체를 넣기 전에 검색과 구간 선택을 거치면 할증 구간에 들어가는 요청을 줄일 수 있어요.

모델 비교도 단순한 100만 토큰 가격표로 끝내기 어려워요. 같은 업무를 끝내는 데 필요한 재시도 횟수, 출력 길이, 도구 호출 수가 모델마다 달라질 수 있어요. 실제 업무 20~50건을 고정 평가 세트로 만들고 성공한 작업 한 건당 비용을 비교하면 제품 예산에 가까운 숫자를 얻을 수 있어요.

프로모션 종료일 이후 가격은 공식 페이지에서 다시 확인해야 해요. 계약이나 연간 예산을 잡는 팀은 현재 단가와 보수적인 예비 단가를 따로 두는 편이 안전해요. 당장 절감된 금액을 모두 사용량 확대에 쓰기보다, 긴 요청의 할증 비율과 캐시 재사용률부터 확인하는 게 좋아요.

참고 자료

  1. GPT-5.6 Sol 가격 20% 인하 — GeekNews
  2. GPT-5.6 Sol 모델 및 API 가격 안내 — OpenAI Developers
728x90