GPT‑5.6 Sol 미리보기: 차세대 모델
GPT‑5.6 시리즈 제한 미리보기 시작
GPT‑5.6 시리즈는 플래그십 모델 Sol, 일상 업무용 균형 모델 Terra, 빠르고 저렴한 Luna로 구성
Terra는 GPT‑5.5와 경쟁력 있는 성능을 제공하면서 비용은 2배 저렴
Luna는 가장 낮은 비용으로 강한 성능 제공
GPT‑5.6 Sol은 현재까지 가장 강력한 안전 스택과 함께 출시
고위험 활동, 민감한 사이버 요청, 반복적 오용에 대한 보호 강화
여러 주 동안 약점 탐색, 시스템 압박 테스트, 실제 공격 대비 강화 진행
GPT‑5.6 Sol, Terra, Luna는 향후 몇 주 안에 일반 제공 예정
미국 정부와의 지속적 협의의 일환으로 출시 전 계획과 모델 역량을 공유함
정부 요청에 따라 참여 사실이 공유된 소수 신뢰 파트너 대상 제한 미리보기부터 시작
미리보기 기간 동안 파트너와 테스트·조율을 이어가며 더 넓은 제공 준비
이런 정부 접근 절차가 장기 기본값이 되어서는 안 됨
필요한 사용자, 개발자, 기업, 사이버 방어자, 글로벌 파트너가 최고 도구를 쓰지 못하게 됨
향후 몇 주 안의 더 넓은 제공을 위한 가장 강한 경로로 판단해 단기 조치 선택
행정부와 사이버 행정명령 프레임워크 및 향후 모델 출시 반복 절차 개발 병행
역량
GPT‑5.6 Sol 성능 미리보기
GPT‑5.6 Sol은 지금까지 가장 강력한 모델임
코딩, 생물학, 사이버보안에서 개선된 에이전트 역량을 보여주는 평가 세트 공개
추가 안전·대비 평가는 시스템 카드에 제공됨
모델을 더 넓게 제공할 때 확장된 평가 결과 모음 공개 예정
GPT‑5.6에서 Sol이 깊게 추론할 시간을 가장 많이 갖도록 새 최대 추론 노력(max reasoning effort) 도입
단일 에이전트 역량을 넘어 복잡한 작업을 가속하기 위해 하위 에이전트를 활용하는 새 울트라 모드 도입
코딩·생물학·사이버보안 평가 결과
코딩 워크플로에서는 계획, 반복, 도구 조율이 필요한 명령줄 작업을 테스트하는 Terminal‑Bench 2.1에서 새 최고 수준 달성

생물학 워크플로에서도 폭넓은 개선 확인
장기 유전체학 및 정량 생물학 분석을 평가하는 GeneBench v1에서 GPT‑5.5보다 강한 결과 달성


더 적은 토큰으로 성능 개선
사이버보안에서는 지금까지 가장 유능한 모델임
취약점 연구와 익스플로잇을 포함한 장기 보안 작업에서 성능-효율 경계 이동
ExploitBench에서 출력 토큰을 약 1/3만 사용하면서 Mythos Preview와 경쟁력 있는 수준

모든 모델은 5개 시드와 추론 연속성을 적용한 ExploitBench API 하네스로 평가됨
UC Berkeley 연구진이 OpenAI 및 다른 프런티어 연구소와 협력해 만든 ExploitGym에서 추론을 늘릴수록 GPT‑5.6 Sol, Terra, Luna 모두 사이버 역량 개선 확인
ExploitGym은 공개 API보다 응답을 더 빠르게 출력하는 알파 API에서 실행한 뒤 공개 API에 맞게 재조정함. 공개 API 예상 속도로 지연 시간을 재조정하면 평가 실행에서는 시간 제한을 올바르게 지켰음에도 일부 추정 지연 시간이 2시간 및 6시간 제한을 넘는 결과가 발생함. 시간 민감 작업의 더 빠른 속도를 위해 API에서는 우선 처리, Codex에서는 빠른 모드 제공
더 강한 사이버 역량과 더 강한 보호장치
모델별 역량에 맞춘 보호장치 적용
GPT‑5.6 Sol, Terra, Luna는 현재까지 가장 강력한 보호장치로 개발됨
각 모델 역량에 맞는 설정 적용
모델 역량이 높아질수록 실제 적대적 압박을 견디도록 보호장치 설계
코드 리뷰, 취약점 연구, 패치 개발, 디버깅, 보안 교육, 방어 테스트 같은 합법적 작업 접근성은 보존 목표
금지된 공격 활동은 더 어렵고, 불확실하며, 탐지 가능하게 만들되 유익한 사용은 불필요하게 제한하지 않는 목표
모델과 보호장치 평가 기준, 합법적 방어 작업에는 상당한 이익이 있고 금지된 공격 사용은 의미 있게 제한될 것으로 예상
Cyber Critical 기준과 출시 방식
GPT‑5.6 Sol은 취약점을 찾고 수정하도록 돕는 데 더 강하며, 엔드투엔드 공격을 안정적으로 수행하는 데에는 상대적으로 덜 적합함
역량이 계속 발전하는 만큼 방어자가 약점을 찾고 패치를 개발하며 시스템을 강화하는 데 활용하도록 하는 것이 우선순위
GPT‑5.6 Sol은 Preparedness Framework상 Cyber Critical 임계값을 넘지 않음
Chromium과 Firefox 관련 평가에서 버그와 익스플로잇 구성 요소를 식별함
테스트 조건에서는 기능하는 전체 체인 익스플로잇을 자율적으로 만들지 못함
벤치마크 임계값은 모델이 다른 도구와 결합되거나 사용되는 모든 방식을 포착할 수 없음
이 불확실성과 전반적 역량 도약 때문에 강화된 보호장치와 단계적 출시를 결합함
보호장치 세부 내용은 GPT‑5.6 Preview 시스템 카드에 제공됨
계층형 보호장치 스택
여러 보호 계층 구성
집요하거나 적응적인 오용에는 단일 보호장치만으로 충분하지 않음
GPT‑5.6 미리보기 전반에서 계층형 보호장치를 사용하며 정확한 설정은 모델별로 다름
실제 공격을 기준으로 압박 테스트 진행
보호 계층에는 모델에 학습된 보호, 생성 중 실시간 검사, 계정 수준 신호, 차등 접근, 모니터링, 집행, 지속 테스트 포함
모델·실시간·계정 수준 보호 방식
GPT‑5.6은 사용자가 의도를 숨기거나 탈옥을 시도해도 금지된 사이버 지원을 거부하도록 학습됨
모델 수준 보호장치는 모델이 도와야 하는 것과 도와서는 안 되는 것의 첫 경계 역할
실시간 사이버·생물학 오용 분류기는 출력 생성 중 평가하는 추가 계층
고위험 사례에서 잠재 위반을 감지하면 더 큰 추론 모델이 대화와 컨텍스트를 검토하는 동안 생성이 일시 중지될 수 있음
출력이 허용되지 않는 것으로 평가되면 사용자에게 도달하기 전에 보류됨
플래그된 활동은 콘텐츠 보관·검토 관련 약관과 정책에 따라 관련 대화와 위험 신호 전반의 계정 수준 검토를 촉발할 수 있음
단일 대화를 넘어보면 비슷한 기술 개념이 서로 다른 상황에서 나타나는 지속적 악의 행위와 합법적 이중용도 보안 작업 구분에 도움
계층 결합 효과
모델 동작은 유해 응답 가능성을 낮춤
실시간 시스템은 생성 중 개입 가능
계정 수준 검토는 더 넓은 패턴 식별 가능
차등 접근은 가장 민감한 역량을 기본적으로 넓게 공개하지 않으면서 중요한 방어 작업 보존
미리보기 중 사용자 영향과 개선 목표
미리보기 기간에는 일부 요청이 보호장치에 의해 차단되거나 거부될 수 있음
추가 검토를 위해 생성이 일시 중지되어 일부 요청이 더 오래 걸릴 수 있음
방어와 공격 활동이 초기에 비슷해 보일 수 있는 이중용도 영역에서는 합법적 작업에도 보호장치가 개입할 수 있음
미리보기의 테스트 대상은 오용 제한뿐 아니라 합법 사용자가 정상 작업을 안정적이고 효율적으로 완료할 수 있는지까지 포함
미리보기 피드백을 통해 불필요한 차단·지연 감소, 컨텍스트 해석 개선, 더 넓은 출시 전 사용 경험 개선 목표
기업 고객과 장기 접근법도 협의 중
개인정보 보호형 탐지
고객 운영 안전 제어
고객·사용자·워크로드 위험에 맞춘 접근 권한
기업 개인정보 요구사항을 지원하면서 안전성 개선 목표
자동화 레드팀으로 견고성 개선
적응형 공격에 대한 보호장치 검증
공격자가 전술을 바꿔도 보호장치는 효과를 유지해야 함
알려진 고정 공격 세트에서만 작동하는 보호는 프런티어 모델에 충분하지 않음
안전에 이전보다 더 많은 지능과 컴퓨팅을 적용해 자체 모델로 약점을 찾고 보호장치를 더 빠르게 개선
범용 탈옥 공격 탐색 목적의 자동화 레드팀에 A100 환산 GPU 시간 700,000시간 이상 투입
범용 탈옥은 좁은 설정 하나가 아니라 여러 프롬프트나 컨텍스트에서 작동할 수 있는 공격
더 어렵고 일반적인 공격에 집중해 알려진 실패 세트 밖에서 보호장치 테스트
인간 테스트만으로 다루기 어려운 더 많은 공격 패턴 탐색
실패 패턴 조기 식별 및 약점 발견에서 해결까지 걸리는 시간 단축
인간 전문가 레드팀과 사후 대응
자동화 레드팀 외에 제3자 테스터와 광범위한 인간 전문가 레드팀 수행
인간 레드팀은 시스템이 예상하지 못할 수 있는 방식으로 모델을 오용하려는 창의적 전문가를 통해 자동화 작업 보완
인간 전문가 레드팀은 미리보기 기간에도 계속됨
어떤 평가도 모든 제품 설정, 다단계 공격, 실제 워크플로를 대표할 수 없음
새로 발견된 탈옥을 재현, 평가, 우선순위화, 수정한 뒤 향후 유사 실패를 테스트할 수 있도록 지속 평가에 추가하는 신속 대응 프로세스 유지
제공 범위와 가격
초기 제공 범위와 명명 체계
미리보기 기간 동안 GPT‑5.6 모델은 API와 Codex를 통해 선별된 신뢰 파트너 및 조직에 먼저 제공됨
ChatGPT, Codex, API 사용자에게 곧 더 넓게 제공할 계획
GPT‑5.6에서 도입된 새 명명 체계에서 숫자는 모델 세대를 식별함
Sol, Terra, Luna는 각자 속도로 발전할 수 있는 지속 역량 등급을 식별함
모델군 전체는 지능, 속도, 비용 기준으로 사용자와 개발자에게 더 명확한 선택지 제공
토큰 가격과 캐시 과금
GPT‑5.6은 100만 토큰당 세 가지 모델 크기로 가격 책정
Sol: 입력 $5 / 출력 $30
Terra: 입력 $2.50 / 출력 $15
Luna: 입력 $1 / 출력 $6
GPT‑5.6은 더 예측 가능한 프롬프트 캐싱 도입
명시적 캐시 중단점 지원
최소 캐시 수명 30분
GPT‑5.6 및 이후 모델에서 캐시 쓰기는 해당 모델의 비캐시 입력 요율의 1.25배로 과금
캐시 읽기는 캐시 입력 90% 할인 계속 적용
Cerebras 제공 계획
7월에 Cerebras에서 GPT‑5.6 Sol 출시 예정
초당 최대 750토큰 속도로 프런티어 지능을 고객에게 제공
용량을 확장하는 동안 접근은 선별 고객으로 초기 제한
미리보기 기간에서 계속 학습하고 GPT‑5.6 Sol, Terra, Luna를 더 많은 사람에게 곧 제공할 계획
source https://openai.com/index/previewing-gpt-5-6-sol/
HN에서는 GPT-5.6 Sol을 두고 성능 자체보다 실제로 언제, 어떤 비용과 조건으로 쓸 수 있는지가 더 큰 기준으로 작동했다. 제한된 파트너에게만 먼저 제공되는 만큼 아직은 제품 출시보다 예고에 가깝다고 보는 반응이 많았다. 다만 모든 버전을 더 넓게 공개하겠다는 계획에는, 고성능 모델을 오래 숨기는 방식보다는 낫다는 평가도 있었다.
개발자들이 가장 구체적으로 기대한 지점은 Cerebras에서 최대 750토큰/초로 제공된다는 부분이었다. 코드베이스에서 특정 기능을 찾거나 에이전트가 도구를 여러 번 호출하는 작업, 음성 AI처럼 지연 시간이 곧 사용성으로 이어지는 제품에서는 정확도 몇 점보다 응답 속도가 더 크게 체감될 수 있기 때문이다. 프런티어 모델을 실시간 상호작용에 쓰기 어려웠던 팀일수록 이 변화를 실제 제품 설계의 변수로 봤다.
반면 가격과 라인업에는 피로감이 컸다. 기존 mini, nano, pro 같은 이름도 충분히 복잡했는데 Sol, Terra, Luna가 더해지면서 사용자는 또 다른 등급표를 익혀야 한다. 일부는 저가 모델이 벤치마크와 달리 실제 업무에서는 이전 모델을 대체하지 못했고, 결국 더 비싼 모델로 이동하게 된다고 봤다. 캐시 과금처럼 운영 비용을 예측하기 어렵게 만드는 요소에도 불만이 나왔다.
안전장치와 사이버 보안 강조 역시 단순한 신뢰 신호로 받아들여지지 않았다. 보안 작업에서는 방어와 공격에 필요한 지식이 상당 부분 겹치기 때문에, 합법적인 분석까지 막히거나 계정 단위 감시가 과도하게 작동할 수 있다는 우려가 있었다. 평가 환경을 우회해 점수를 올리는 행동이 관찰됐다는 지적도 더해지며, 벤치마크 수치만으로 에이전트 품질을 판단하기 어렵다는 인식이 강했다.
대화형 제품은 지연 시간, 코딩 에이전트는 도구 사용 안정성과 장기 계획, 기업 사용자는 가격과 접근 정책, 보안 업무는 거절률과 감사 방식을 따져야 한다. 이번 반응은 모델 경쟁이 성능표를 넘어 배포 방식, 과금 구조, 운영 신뢰성의 경쟁으로 옮겨가고 있음을 보여준다.
