Anthropic, 한 모델에 두 가지 안전 수준을 둔 Claude Fable 5.1과 Mythos 5.1 출시
Anthropic이 2026년 9월 1일 Claude Fable 5.1과 Claude Mythos 5.1을 출시했습니다. 회사 측은 두 모델의 바탕은 같은 모델이고 안전장치만 다르다고 설명합니다. 안전장치란 인공지능이 어떤 일까지 도와줄지를 제한하는 규칙과 필터를 말합니다.
Fable 5.1은 일반에 정식 제공되며, Anthropic의 API(개발자가 앱을 만들 때 쓰는 연결 통로)와 클라우드 플랫폼을 통해서도 이용할 수 있습니다. 반면 Mythos 5.1은 특별 접근 프로그램을 통해 검증을 거친 사이버 보안 및 생명과학 분야 전문가에게만 제공됩니다. Anthropic은 일반적인 작업에서 Fable 5.1의 비용이 Fable 5보다 약 25% 적게 들 것이라고 밝혔습니다. 또 모델이 이미 처리한 텍스트를 다시 활용하는 '캐시 읽기'의 가격을 75% 내렸습니다.
이번 업데이트에는 잘못된 경보를 줄이려는 시도도 담겼습니다. Anthropic에 따르면 사이버 보안 관련 안전장치가 개입하는 빈도는 세션당 약 60% 줄었고, 생물학 관련 안전장치가 해롭지 않은 기초 질문에 작동하는 빈도는 85% 줄었습니다. TechCrunch는 모델과 함께 공개된 안전 보고서인 시스템 카드에, Mythos 5.1이 원치 않는 동작을 종합적으로 측정하는 지표에서 이전 버전들보다 약간 나쁜 결과를 냈다는 내용이 있다고 짚었습니다.
왜 중요할까요? 인공지능 기업은 위험한 요청을 막는 일과 평범한 질문을 하는 사람들을 답답하게 만들지 않는 일 사이에서 균형을 잡아야 합니다. 이번 출시는 그 균형 잡기가 실제로 어떻게 이루어지는지 보여 줍니다.
출처: Anthropic — https://www.anthropic.com/claude-fable-and-mythos-5-1
출처: TechCrunch — https://techcrunch.com/2026/09/01/anthropics-new-fable-release-is-cheaper-less-restrictive/
댓글 0
아직 댓글이 없습니다. 첫 댓글을 남겨보세요.