드디어 Codex 토큰 사용량 이슈 해결
Sol 사용자 여러분, 안녕하세요!
모든 ChatGPT Work 및 Codex 사용자의 사용량 한도를 초기화했습니다. 이와 함께 GPT-5.6 Sol의 사용량 한도에 관한 간단한 업데이트를 공유드립니다.
지난 몇 주 동안 많은 분이 Sol을 사용할 때 Codex 한도가 예상보다 빠르게 소진된다는 의견을 주셨습니다. 분명히 말씀드리면, 어떤 구독 플랜의 사용량도 축소하지 않았습니다.
그동안 원인을 면밀히 조사했고, 여러 개선 사항을 적용했습니다. 그 결과, 일반적인 Sol 사용 환경에서 사용 가능 시간이 약 18% 늘어날 것으로 예상합니다. 일부 사용자는 오늘부터 이보다 훨씬 큰 개선 효과를 체감할 수 있습니다. 또한 조사 기간에 일시적으로 중단했던 5시간 단위 한도도 내일부터 다시 적용할 예정입니다.
조사 결과는 다음과 같습니다.
GPT-5.6 Sol은 이전보다 더 오랫동안 작업하고, 추가 도구 호출을 수행하며, 여러 도구와 서브에이전트가 참여하는 복잡한 워크플로를 조율하려는 성향이 훨씬 강합니다. 덕분에 어려운 문제를 더 잘 해결하지만, 일부 작업에서는 예상보다 훨씬 많은 사용량이 소모됐습니다.
Sol은 동일한 추론 수준에서도 이전 모델보다 더 많은 연산을 수행합니다. 따라서 Sol의 High 설정은 GPT-5.5의 High 설정보다 더 많은 토큰을 사용할 수 있습니다.
프로그래매틱 도구 호출, 즉 ‘코드 모드’는 Sol이 여러 도구를 병렬로 호출하거나 도구 실행을 기다리는 동안 다른 작업을 계속할 수 있도록 훨씬 높은 유연성을 제공합니다. 하지만 이로 인해 한 번의 요청에서 생성되는 응답 수와 캐시된 입력 토큰이 늘어나면서 예상보다 많은 사용량이 발생하기도 했습니다.
이러한 현상은 Sol이 도구 호출 완료를 기다리거나 많은 웹 검색을 수행할 때 특히 두드러졌습니다. 두 경우의 처리 방식을 개선했으며, 앞으로도 코드 모드의 효율성을 계속 높여 나갈 예정입니다.
사용자별 영향의 편차도 매우 컸습니다. 중앙값 기준으로는 Sol의 토큰 효율성이 상당히 높았지만, 난도가 높은 작업을 수행하는 일부 고급 사용자는 사용량이 훨씬 빠르게 소진됐습니다. 출시 전에는 평균 및 중앙값 사용량에 지나치게 집중한 나머지, 분포의 끝부분에 있는 일부 사례에서 사용량이 크게 증가할 수 있다는 점을 놓쳤습니다.
Sol은 Codex의 역량을 크게 끌어올린 모델입니다. 하지만 성능과 효율성이 항상 같은 속도로 개선되는 것은 아니며, 일부 문제는 실제 사용자가 대규모로 모델을 사용하기 시작한 뒤에야 드러나기도 합니다. 저희가 이를 더 일찍 파악하고, 상황을 더욱 투명하게 설명했어야 합니다.
여러분이 계속해서 가능성의 한계를 넓혀 주시는 만큼, 저희도 효율성을 지속적으로 개선하고 그 과정을 꾸준히 공유하겠습니다.
5시간 단위 한도도 내일부터 다시 적용되니 리셋 티켓 8월1일 남은거 있으면 후다닥 돌려야겠네용
