Anthropic, Claude Fable 5 재배포
수출 통제 해제와 Fable 5 재개 일정
2026년 6월 12일 미국 정부가 Claude Fable 5와 Claude Mythos 5에 수출 통제를 적용해 두 모델 접근을 전면 중단함
미국 안팎의 외국 국적자 접근 제한 필요
명령 즉시 발효, 실시간 국적 검증 수단 부재
모든 사용자 대상 두 모델 접근 중단
2026년 6월 30일 기준 Fable 5와 Mythos 5 수출 통제 해제됨
Fable 5는 2026년 7월 1일 수요일부터 전 세계 사용자에게 제공 예정
제공 표면: Claude Platform, Claude.ai, Claude Code, Claude Cowork
Pro, Max, Team, 일부 Enterprise 플랜은 7월 7일까지 주간 사용 한도의 최대 50%까지 포함
표준 Enterprise 에는 포함된 Fable 5 허용량 없음.
모든 Fable 5 사용은 사용 크레딧으로 과금됨. 크레딧이 활성화되지 않으면 사용자가 Fable 5를 사용할 수 없음.
프리미엄 Enterprise 는 7월 7일까지 구독에 Fable 5가 포함됨. 추가 비용 없이 각 구성원의 좌석 사용량에서 차감됨. 7월 7일 이후 팀은 사용 크레딧을 활성화해 Fable 5를 계속 사용할 수 있음. 크레딧이 활성화되지 않으면 사용자가 더 이상 Fable 5를 사용할 수 없음
7월 7일 이후 사용 크레딧으로 제공
AWS, Google Cloud, Microsoft Foundry 접근도 가능한 한 빠르게 재활성화 예정
Mythos 5 접근 복구와 Glasswing 확대
일정과 보호 장치 업데이트
출시와 수출 통제 배경
Fable 5와 Mythos 5는 2026년 6월 9일 화요일 출시
두 모델은 같은 기반 모델 공유
Fable 5는 일반 사용 안전성을 높이기 위한 강한 보호 장치 적용
Mythos 5는 보호 장치가 더 적고, 방어적 사이버보안 용도의 소수 신뢰 Project Glasswing 파트너에게만 제공
6월 12일 수출 통제 지시는 Fable 5 보호 장치 우회 방식이 담긴 보고서를 정부가 인지한 뒤 발생
Amazon 연구진이 Fable 5에 여러 소프트웨어 취약점을 식별하게 하는 프롬프트 방식을 발견
한 사례에서 관련 취약점 악용 방식을 보여주는 코드 생성
지난 2주 동안 정부와 Amazon 등 파트너와 보고서·증거 검토
모델 비교 테스트와 우회 평가
내부 테스트에서 더 낮은 성능의 여러 모델도 보고서의 Fable 5와 같은 취약점 식별 가능
비교 모델: Claude Opus 4.8, GPT-5.5, Kimi K2.7
단일 취약점 악용 시연은 테스트한 모든 모델이 Fable 5와 같은 시연 생성 가능
해당 모델: Claude Haiku 4.5, Sonnet 4.6, Opus 4.6, Opus 4.7, Opus 4.8, GPT-5.4, GPT-5.5, Kimi K2.7
보고된 기법은 Mythos 수준의 고유 사이버 역량을 드러내지 않음
Fable 5 보호 장치의 경계 사례에 해당
위험 가능성이 낮지만 과도한 주의로 차단되는 일부 작업 존재
접근된 동작은 통상적인 방어적 사이버보안 업무에 한정
새 안전 분류기와 차단 성능
보고된 우회에 대응해 정부와 협력해 개선된 안전 분류기 학습
보고서에 나온 동작을 표적으로 삼아 차단
Fable 5 요청이 차단되면 사용자에게 알림 제공
차단된 요청은 Opus 4.8로 전송
새 분류기는 Amazon 보고서의 특정 기법을 99% 초과 사례에서 차단
매우 적은 비율에서는 사이버 공격자에게 도움이 될 만큼 자세하지 않은 정보 제공 가능
보호 장치는 모든 저위험 통상 사이버방어 능력 차단이 아니라 잠재적으로 해로운 능력 차단 목표
미국 상무부 Center for AI Standards and Innovation(CAISI) 연구진도 이전·신규 보호 장치가 매우 강하다는 데 동의
새 분류기의 비용은 일상적 코딩·디버깅 작업에서 정상 요청을 더 자주 플래그하는 것
실제 오용과 정상 요청을 더 잘 구분하고 오탐을 줄이도록 계속 개선 예정
사이버보안 보호 장치 접근법
Mythos 5와 Fable 5의 역량 차이
Claude Mythos 5는 소프트웨어 취약점 발견·악용에서 다른 모델과 대부분의 인간 보안 전문가보다 효과적일 수 있음
강력한 사이버보안 역량 때문에 사이버공격에 악용하려는 행위자에게 특히 매력적임
Claude Fable 5는 그런 고유 공격 역량을 제공하지 않음
Anthropic이 모델에 적용한 것 중 가장 강한 보호 장치와 함께 출시
출시 전 한 달 동안 여러 팀 인력을 옮겨 해당 문제 연구자·엔지니어 수를 두 배로 확대
다층 방어와 분류기 역할
Fable 5는 여러 안전 메커니즘을 함께 적용한 다층 방어 방식으로 출시
각 방어 수단 단독으로는 완벽하지 않음
결합 시 모델 오용 난도를 크게 높이는 구조
위험 요청 지원을 거부하도록 모델을 학습시키는 방어와 오용 패턴 사후 분석 방어 포함
핵심 안전 메커니즘은 분류기(classifier)
상호작용 중 잠재적으로 해로운 사이버보안 작업 요청 또는 출력 감지
감지 시 모델 응답 차단
목표는 고유하게 위험한 행동 방지
분류기는 잠재적 위험 콘텐츠를 놓치거나 의도적으로 탈옥될 수 있음
사용자가 특이한 방식으로 프롬프트해 차단되어야 할 유해 출력을 만들 수 있음
안전 여유 폭과 정상 요청 차단
안전 분류기는 정상일 가능성이 큰 요청도 일부 트리거하도록 의도적으로 설정됨
요청이 매우 명확하게 안전해 보여야 분류기 미작동
사용자는 합리적이고 무해한 일부 요청에 대한 응답 거부로 경험
Fable 5는 이전 출시보다 훨씬 큰 안전 여유 폭 적용
더 많은 정상 요청 차단
사용자 불편을 예상했지만 모델의 다른 능력을 널리 제공하기 위한 절충

사이버보안 안전 분류기 도식
분류기는 요청을 정상 허용, 잠재적 유해 차단으로 구분
모호한 요청 차단: 보안 취약점 찾기처럼 방어 목적일 수 있으나 사이버보안 관련성이 뚜렷한 요청
유해 요청 차단: 소프트웨어 익스플로잇 체인 구축 요청처럼 명백히 위험한 요청
안전 여유 폭은 유해 요청 차단 확신을 높이기 위해 대체로 정상이나 작은 유해 가능성이 있는 요청까지 차단
Fable 5는 더 큰 안전 여유 폭으로 더 많은 정상 요청을 막고 실제 유해 요청 누락을 줄이는 방식
“Vulns”는 취약점 의미
탈옥 유형과 위험도
안전 여유 폭은 탈옥 완화에도 기여
많은 탈옥은 매우 특정한 모델 동작만 해제하는 좁은 형태
일부 가상 사용자는 안전 여유 폭 또는 모호한 유해 동작 일부에 침범할 수 있지만 핵심 유해 동작에는 도달하지 못함
지금까지 보고된 Fable 5 탈옥은 이 경미한 범주에 해당
더 심각한 탈옥은 더 유해한 동작을 해제
좁은 유해 탈옥은 특정 유해 동작 일부 유도 가능
좁기 때문에 공격자 제약이 커 대체로 낮음~중간 심각도
가장 우려되는 범주는 광범위한 유해 동작을 해제하는 보편 탈옥

탈옥과 안전 분류기의 상호작용
경미한 탈옥, 좁은 유해 탈옥, 보편 탈옥을 구분
경미한 탈옥은 분류기가 요청을 막지 않지만 요청이 여전히 안전 여유 폭 안에 있어 유해 가능성이 매우 낮음
좁은 유해 탈옥은 프롬프트가 분류기를 뚫고 모델의 특정 유해 동작을 해제
보편 탈옥은 하나의 프롬프트가 유해 동작 전체 범주를 해제
Fable 5 출시 당시 언급했듯 어떤 AI 모델도 탈옥에 완전히 강건하게 만들기는 어려울 가능성 있음 (유사하게 어떤 소프트웨어도 취약점에 면역은 아님. 다만 일반적으로 소프트웨어 취약점은 LLM 탈옥보다 발견과 패치가 더 직접적임)
일부 탈옥은 발견될 것으로 예상
심각도는 경미한 탈옥 다수, 일부 좁은 유해 탈옥으로 다양할 전망
작성 시점 기준 Fable 5 보편 탈옥은 발견되지 않음
전문 안전 연구자들이 계속 레드팀 진행 중
목표는 중대 탈옥을 안전 파트너와 먼저 찾아 악의적 행위자 악용 전 수정하는 것
신중한 접근으로 대다수 탈옥은 위험 동작 해제에 실패할 전망
분류기는 성공적 탈옥 제작 비용과 노력을 크게 높임
탈옥 성공 시에도 추가 방어 계층이 완화 제공
새로운 탈옥 기법을 학습하면서 분류기 계속 업데이트 예정
탈옥에 대한 업계 합의 프레임워크
공통 심각도 기준 필요성
현재 AI 업계에는 AI 탈옥 심각도를 객관적으로 설명하는 합의 기준 부재
새 탈옥 기법 발견 때마다 큰 불확실성 발생
개발자는 어떤 발견에 가장 긴급히 집중할지에 대한 합의 기준 부재
정부도 언제 조치할지에 대한 합의 기준 부재 (보안 연구의 다른 영역에는 합의된 기준 존재. 예를 들어 Common Vulnerability Scoring System(CVSS)은 특정 소프트웨어 취약점 심각도를 평가하는 공통 방식임)
강력한 사이버보안 및 기타 역량을 가진 모델이 더 많이 학습·평가·출시되면 문제가 더 심해질 전망
공통 평가 기준은 새 모델의 안전한 출시 지원
사용자가 고급 기능을 최대한 활용하는 데도 도움
공동 프레임워크 초안과 대응 방식
Amazon, Microsoft, Google 및 기타 Glasswing 파트너와 AI 탈옥 심각도와 개발자 대응 방식에 대한 합의 프레임워크 초안 작성 중
다른 업계 파트너와 모델 제공자 참여 요청
현재 제안은 탈옥을 네 가지 기준으로 점수화하는 방식
처음 두 기준은 공격자에게 제공되는 것, 나중 두 기준은 실제 문제가 되는 속도 설명
새로 발견된 탈옥 대응을 보정하는 데 심각도 프레임워크 사용 제안
가장 심각한 탈옥 유형은 심각도 확인 즉시 예비 완화책 배포 시작
예시: 핵심 전력망 또는 은행 시스템에 파괴적 영향을 활발히 일으키는 데 사용되는 탈옥
주요 탈옥 제출 채널을 24시간 모니터링하는 팀 신설 중
탈옥 점수화 방식은 불완전하지만 공통 프레임워크로 대략적 심각도를 전달하는 가치 존재
현재 진행 중인 작업
더 많은 파트너 피드백을 받으며 프레임워크가 시간이 지나며 진화할 전망
제안 프레임워크 세부 내용은 곧 추가 공유 예정
그동안 Fable 5 제공 이후 보안 연구자가 발견한 잠재적 사이버 탈옥을 제출할 수 있는 새 HackerOne 프로그램 시작
프런티어 AI 보안을 위한 미국 정부 협력
미국 정부와의 협력 범위
지난 10주 동안 2026년 6월 2일 행정명령 Promoting Advanced Artificial Intelligence Innovation and Security에 반영된 접근법 개발 과정에서 미국 정부와 긴밀히 협력
협력 대상: Office of the National Cyber Director, Office of Science and Technology Policy, Department of the Treasury, Department of Commerce(CAISI 포함), 관련 국가안보 기관
배포 전 테스트·평가에 대한 미국 정부 파트너와의 약 2년간 기존 협력을 바탕으로 계속 협력 예정
아래 약속은 기존 작업과 정부 협력 확대 제안 모두 반영
위 프레임워크가 확정되는 과정에서 협력 확대 목표
규칙화와 규제 기준
해당 협력과 업계 합의 프레임워크가 전체 업계의 체계적 규칙 기반이 되기를 기대
AI 위험과 이익에 대한 효과적 글로벌 조율 템플릿의 초기 형태 가능
이런 규칙은 강한 규제로 성문화되고 프런티어 모델 개발자에게 동일하게 적용되어야 함
AI 출시에서 정부 관여는 지속 가능하고 투명한 절차 필요
사이버 방어자 등에게 강력한 모델 접근에 대한 확실성 제공 필요
source https://www.anthropic.com/news/redeploying-fable-5
사용자들의 전반적인 반응은 꽤 부정적임. 사용자들은 단순히 “구독에서 두 배 요율로 차감된다”는 수준이 아니라, 실제로는 두 배로 차감되면서 동시에 사용량 한도도 절반으로 줄어드는 구조로 이해하고 있음. 그래서 체감상 기존 Opus 사용량의 1/4 수준밖에 못 쓰는 것 아니냐는 반응.
특히 Pro 사용자 기준으로는 5시간 제한 안에서 프롬프트 1~2개 정도밖에 못 할 수도 있다는 추측이 나오고, 이게 작업 중간에 한도에 걸리면 프롬프트와 진행 중이던 작업이 날아가는 점이 가장 불만으로 언급됨. 그래서 “프롬프트를 정말 신중하게 써야 한다”는 식의 체념 섞인 반응도 있음.
Claude Code 우려도 큼. 어떤 사용자는 Fable 출시 초기에 $100 Max5에서 $200 Max20으로 올렸고, 그때는 2주만 써도 가치가 있다고 봤지만, 지금처럼 일주일만 지나고 할당량이 50%로 줄어드는 조건이면 Max20의 매력이 크게 떨어진다고 봄. 현재 모델 기준으로는 Max5만으로도 충분하다는 반응임.
핵심은 사용자들이 이번 변경을 “가격 인상”만이 아니라 실질 사용량 축소 + 고가 플랜 가치 하락 + 작업 안정성 저하로 받아들이고 있다는 점임. 단순한 불만보다, 앞으로 어떤 플랜을 써야 할지 계산이 다시 필요해졌다는 분위기.
