출시 사흘째 되던 날, 한 API 문자열이 오류를 뱉기 시작했습니다. claude-fable-5. 앤트로픽이 올해 가장 공들여 내놓은 모델은 그렇게, 전 세계 모든 고객 화면에서 동시에 사라졌습니다.
흔히 모델이 내려가는 이유는 둘 중 하나입니다. 성능이 기대에 못 미쳤거나, 심각한 결함이 발견됐거나. Fable 5는 어느 쪽도 아니었습니다. 멈춘 이유는 정반대였습니다. 너무 잘 작동해서였습니다.

Photo by Steve A Johnson on Unsplash
사흘 동안 무슨 일이 있었나
타임라인은 짧고 분명합니다.
6월 10일, 앤트로픽은 Claude Fable 5와 Mythos 5를 공개했습니다. 두 모델은 Opus 4.8보다 한 단계 위인 'Mythos급'으로 분류됐습니다. Fable 5는 안전 분류기를 적용한 일반 공개 버전이고, Mythos 5는 같은 기반 모델에서 사이버보안 가드레일을 제거해 Project Glasswing 승인 파트너에게만 제한 제공한 버전입니다.
성능 수치는 출시 당시 화제였습니다. SWE-bench Pro 80.3%(Opus 4.8은 69.2%), 복잡 코딩을 측정하는 FrontierCode 29.3%(Opus 13.4%). Stripe는 5천만 줄 규모의 Ruby 코드베이스를 수동으로 두 달 걸려 옮기던 작업을 하루로 줄였습니다. Mozilla는 Glasswing 파트너로서 수백 건의 취약점을 해결했습니다.
그리고 6월 12일 동부시간 오후 5시 21분. 미국 상무부(Commerce Department)의 지시가 앤트로픽에 도달했습니다. 외국인(foreign nationals)의 Fable 5·Mythos 5 접속을 차단하라는 명령이었습니다.
문제는 실행 방식이었습니다. 앤트로픽은 미국인과 외국인을 실시간으로 구분해 한쪽만 차단할 수 없었습니다. 그래서 규정을 지키기 위해 택한 방법이 전 세계 전면 비활성화였습니다. 한 나라의 수출통제 지시가, 필터링 기술의 한계를 만나, 결국 모든 사용자의 접근 차단으로 번진 셈입니다.
Opus 4.8을 포함한 다른 모든 모델은 영향받지 않았습니다. 이 점이 중요합니다. 앤트로픽 전체가 제재당한 게 아니라, 정확히 그 두 모델만 표적이 됐습니다.
통념과 실제: 무엇이 모델을 멈췄나
이 사건을 두고 흔히 나오는 설명은 "또 하나의 AI 규제 사례"입니다. 안전하지 않은 AI를 정부가 막았다는 프레임입니다.
데이터를 보면 그 설명은 정확하지 않습니다.
정부가 인용한 트리거는 알려진 jailbreak였습니다. 사용자가 Fable 5에게 "특정 코드베이스를 읽고 소프트웨어 결함을 고쳐달라"고 요청할 수 있었던 것입니다. 그런데 앤트로픽은 이를 안전장치 우회가 아니라 일상적인 사이버보안 워크플로우라고 공개 반박했습니다. 같은 종류의 요청은 다른 모델에서도 처리할 수 있고, 이 jailbreak은 좁고 보편적이지 않다(narrow and non-universal)는 입장이었습니다.
여기서 통념과 실제가 갈립니다. 일반적으로는 "위험한 결함이 발견돼서 막았다"고 생각합니다. 그런데 실제 구조는 다릅니다. 막힌 것은 결함이 아니라 능력이었습니다.
자체 정리된 벤치마크를 보면 그림이 더 선명해집니다. Mythos급 모델의 사이버 공격 능력을 측정한 ExploitBench에서 Mythos는 78.0, Opus 4.8은 40.0이었습니다. Glasswing 발표 단계에서 이미 이 계열 모델은 Cybench CTF 35개 전 문제를 100% 풀었고, OpenBSD에서 27년, FFmpeg에서 16년간 발견되지 않았던 제로데이를 자율적으로 찾아냈습니다.
코드의 결함을 찾아 고치는 능력은, 방향을 뒤집으면 코드의 약점을 찾아 뚫는 능력입니다. 같은 능력의 양면입니다. 상무부가 본 것은 버그가 아니라 바로 그 능력이었습니다.