생물학 관련 폴백(Fallback) 85% 감소시킨 Fable 5 업데이트

Fable 5는 생물학 관련 질문을 처리할 때 성능이 낮은 모델로 자동 전환되는 폴백(Fallback, 시스템이 요청을 처리하지 못해 하위 모델로 넘기는 현상) 발생률을 약 85% 줄였다. 이번 업데이트는 무해한 요청을 위험한 것으로 오판해 차단하던 제약을 완화하여, 일상적인 생물학적 궁금증을 해결하려는 사용자가 낮은 수준의 답변을 받는 빈도를 줄였다.

폴백이 발생하면 시스템은 사용자의 요청을 Opus 5로 리라우팅(Re-routing, 경로를 변경하여 전달함)한다. Opus 5는 Fable 5보다 생물학적 능력이 낮아 악의적인 사용자가 유해한 정보를 얻을 가능성을 제한하는 안전장치 역할을 하지만, 일반 사용자에게는 답변의 질이 떨어지는 결과로 나타난다. 이번 업데이트로 검사 결과 해석이나 증상 이해 같은 일상적 건강 질문, 교육 목적의 생물학 학습, 의료 전문가의 임상 작업 지원 범위가 넓어졌다.

생물학적 위험 감지 시스템의 오판을 줄임으로써 전체 제품군에서도 폴백 수치가 하락했다. 서비스 접점별 전체 폴백 감소치는 Claude.ai 약 67%, Cowork 55%, Claude Code 17%, Claude Platform 7%로 집계되었다. 웹 기반 서비스인 Claude.ai에서 가장 큰 폭의 개선이 이루어졌다.

Anthropic은 합성 생물학이나 게놈 편집 기술이 새로운 생물학적 위협으로 이어질 수 있다는 미국 정보 공동체의 2026년 연례 위협 평가 내용을 반영해 안전장치를 유지한다. 국가 단위의 공격적 생물·화학 무기 프로그램이 프론티어 AI 모델의 능력을 통해 가속화될 위험이 있기 때문이다. 이에 따라 무해한 사용 사례의 접근성은 높이되, 정교한 공격자가 의도를 숨겨 위험한 작업을 수행하려는 시도는 계속해서 차단한다.

세이프티 분류기(Safety Classifier)의 헌법 재작성과 재학습

Fable 5는 이중 용도 위험이 있는 전문 생물학 연구 및 약물 개발 쿼리를 여전히 차단한다. 이 제어는 세이프티 분류기가 담당한다. 세이프티 분류기는 Fable 5가 보호 대상인 생물학 작업을 수행하거나 유해한 출력을 생성하는지 감지하는 소형 자동 AI 시스템이다. 메인 모델의 앞단에서 입력과 출력을 실시간으로 감시하며 위험 요소를 걸러내는 필터 역할을 수행한다.

분류기의 작동 기준은 '분류기 헌법'이 결정한다. 분류기 헌법은 모델이 허용 콘텐츠와 차단 콘텐츠를 구분하도록 돕는 규칙 집합이다. 앤스로픽은 무해한 사용 사례를 상세하게 구분해 오탐지를 줄이기 위해 이 헌법을 전면 재작성했다. 이 과정에서 내외부 전문가 그룹의 피드백을 받아 실제 연구 현장에서 필요한 허용 범위와 잠재적 위험 경계를 검토하고 세부 조항을 수정했다.

수정된 헌법을 기반으로 새로운 데이터를 개발하고 모델을 재학습시켰다. 재학습된 분류기는 유해하거나 이중 용도로 악용될 수 있는 생물학 콘텐츠는 엄격하게 차단하면서도 무해한 사용 사례는 더 넓게 허용한다. 단순히 특정 단어를 찾는 방식에서 벗어나 헌법에 정의된 규칙과 학습 데이터를 통해 맥락을 판별함으로써, 안전성을 유지하면서 답변 가능 범위를 넓혔다.

그럼에도 불구하고 요청의 위험도가 매우 낮음에도 분류기가 이를 위험 영역으로 판단해 차단하는 오탐지(False positive)는 여전히 발생한다. 현재 시스템은 분류기가 판단하기 모호한 요청은 안전을 위해 차단하는 보수적 방식을 취하고 있으며, 이는 잠재적 위험을 제거하기 위한 조치로 향후 정교화할 계획이다.

이중 용도(Dual-use) 위험에 따른 전문 연구 영역 차단 유지

Fable 5는 바이러스학(Virology), 독성학(Toxicology), 분자 설계(Molecular design)와 관련된 요청을 엄격히 차단한다. 이 제약으로 인해 현재 Fable 5는 전문적인 생물학 연구나 신약 개발 작업에 투입할 수 없다. 이는 생물학자들에게 프론티어 수준의 접근 권한을 부여하면서도 책임 있는 방식을 유지하기 위한 조치다.

차단 근거는 이중 용도(Dual-use) 위험에 있다. 이는 유익한 목적과 유해한 목적 모두에 사용될 수 있는 기술을 의미하며, 구현 단계에서 두 용도 사이의 경계를 구분하기 어렵다. 내부 역량 평가 결과, Fable 5는 일부 복잡한 생물학 작업에서 전문가 수준을 능가하며, 다른 공개 모델이나 자료에서는 찾을 수 없는 수준의 전문 지식을 제공하는 업리프트(Uplift, 기존 수준을 뛰어넘는 성능 향상)를 제공하는 것으로 확인됐다. 이러한 기능이 생물 무기 개발 등 파괴적인 목적으로 악용될 위험을 차단하기 위해 제한을 둔 것이다.

초기 출시 단계에서는 매우 광범위한 생물학 분류기를 적용해 거의 모든 생물학 관련 쿼리를 차단했다. 이는 안전 장치 개발 완료까지 출시를 미루는 대신, 전면 차단을 통해 일반 사용자들에게 모델을 빠르게 제공하기 위한 선택이었다. 이 과정에서 무해한 질문까지 차단되는 오탐지 사례가 빈번해 정당한 생물학 사용자들의 불편이 발생했다. 현재는 검증된 연구자에게만 기능을 여는 신뢰할 수 있는 접근 경로(Trusted access pathways)를 구축해 전문 기능을 단계적으로 개방하고 있다.

이처럼 안전성과 유용성을 동시에 확보하려는 시도는 실무 환경에서의 구체적인 활용 기준으로 이어진다.

의료·바이오 실무자의 Fable 5 도입 판단 기준

현재 Mariano-Florentino (Tino) Cuéllar가 첫 Chief Global Affairs Officer로 합류하여 전문 기능 개방을 위한 정책적 기반을 마련하고 있다. 이에 따라 실무자는 작업의 성격이 임상 지원인지 전문 연구인지에 따라 모델 선택을 달리해야 한다.

임상 현장의 보조 업무, 일상적인 건강 질문, 검사 결과 해석 및 증상 이해와 같은 교육적 맥락에서는 Fable 5를 활용할 수 있다. 반면 고도의 전문성이 요구되는 실험 설계나 약물 연구, 특히 바이러스학·독성학·분자 설계와 같은 전문 연구 영역은 서비스 내 안내되는 신뢰 경로를 통해서만 접근 가능하다.