Anthropic 공식 채널의 새 소식을 AI가 분석·정리한 글입니다. 정확한 내용과 맥락은 반드시 하단 원문에서 확인해 주세요.
Claude Fable 5 재배포
🤖 AI 분석 (Claude)
Anthropic은 6월 12일 미국 정부의 수출통제로 인해 중단했던 Claude Fable 5와 Mythos 5에 대한 접근을 6월 30일 해제했다고 발표했다. Fable 5는 7월 1일부터 Claude Platform, Claude.ai, Claude Code, Claude Cowork를 통해 전 세계 사용자에게 제공되며, Pro, Max, Team, 선별된 Enterprise 요금제 사용자는 7월 7일까지 주간 사용량 한도의 최대 50%까지 무료로 이용할 수 있다.
아마존 연구팀이 Fable 5의 안전장치를 우회하는 방법을 발견한 사건 이후, Anthropic은 정부 및 파트너사들과 함께 모델을 검토했다. 테스트 결과 Claude Opus 4.8, GPT-5.5, Kimi K2.7을 포함한 많은 저능력 모델들도 동일한 취약점을 식별할 수 있었으며, 악용 방법 시연도 모든 테스트 모델에서 가능했다. Anthropic은 개선된 안전 분류기를 훈련하여 보고된 우회 기법을 99% 이상 차단하도록 했다.
Anthropic은 업계 파트너들과 함께 AI 탈옥의 심각도를 평가하기 위한 합의된 프레임워크 초안을 작성하고 있으며, HackerOne 프로그램을 통해 보안 연구자들로부터 발견 사항을 제출받을 계획이다. 정부와의 지속적인 협력을 통해 모든 프론티어 모델 개발사에 동등하게 적용되는 체계적 규제 수립을 목표로 하고 있다.
왜 중요한가
Fable 5 재배포로 사용자들이 고성능 AI 모델에 다시 접근할 수 있게 되었다. 정부와 협력하여 더 안전한 모델을 만들었으며, 이는 강력한 기능과 안전성 사이의 균형을 어떻게 맞춰야 하는지 보여준다.
이전과 다른 점
Fable 5는 이전의 안전장치 대비 훨씬 큰 '안전 여유(safety margin)'를 적용하여 더 많은 정상적 요청도 차단하는 대신 악용 가능성을 크게 줄였다. 새로운 안전 분류기는 특정 우회 기법을 99% 이상 차단하도록 개선되었다.
실제로 써보려면
7월 1일부터 Claude Platform, Claude.ai, Claude Code, Claude Cowork에서 Fable 5를 사용할 수 있다. Pro, Max, Team, 선별된 Enterprise 요금제 사용자는 7월 7일까지 주간 사용량 한도의 최대 50%까지 무료로 이용 가능하며, 7월 8일부터는 사용량 크레딧으로 이용할 수 있다.
⚠️ AI가 원문을 바탕으로 생성한 분석입니다. 사실 확인은 아래 원문에서 해 주세요.
Anthropic is redeploying Claude Fable 5 starting July 1 following the lifting of export controls, with updated cybersecurity safeguards and a new industry jailbreak framework.
출처: https://www.anthropic.com/news/redeploying-fable-5