Claude의 가장 강력한 Fable 5.1이 출시되어 목록에 8개 항목이 포함되어 있으며 가격은 최대 45% 인하되었으며 증류 방지 메커니즘이 온라인에 있습니다.

📅 2026-09-02

요약:

Fable 5.1과 Mythos 5.1 출시! 8개 공개 벤치마크 테스트에서 모두 1위를 차지했으며 가격은 최대 45%까지 인하됐다. 특히 과학 연구 및 코딩 분야에서는 Fable 5와 그 이웃인 GPT-5.6 Sol을 확실히 뒤처졌습니다. 보다 직관적인 관점에서 볼 때, 이제 중간 및 낮은 추론 수준으로 Fable 5.1을 실행하면 성능은 기본적으로 매우 높거나 심지어 가장 높은 추론 수준을 가진 이전 버전의 Mythos 5와 동일합니다. 이 물결에서 "Fable"은 "Mythos"를 죽였습니다.

가격 측면에서 Fable 5.1은 캐시 읽기 가격을 토큰 백만 개당 미화 0.25달러로 75% 낮췄습니다.

입력 및 출력 가격은 각각 토큰 백만 개당 10달러와 50달러로 Fable 5와 일치합니다.

한 가지 가격만 인하된 것으로 보이지만 에이전트 작업에서는 캐시 읽기가 비용의 대부분을 차지하기 때문에 실제 영향은 상대적으로 큽니다.

Anthropic이 제공한 데이터에 따르면 일반적인 워크로드 비용은 Fable 5보다 약 25% 낮습니다. 고도로 지능적인 작업인 경우 최대 45%까지 절약할 수 있습니다.

공식 출시 동영상에는 다음과 같은 내용이 있습니다.

이전에 Claude에게 어떤 작업을 요청했더라도 Fable 5.1은 더 많은 작업을 수행하고 가장 어려운 부분을 더 잘 수행할 수 있습니다.

다단계 작업을 처리하는 데 능숙하기 때문에 이렇게 합니다.

이런 종류의 작업에서는 2단계에서 작은 오류가 발생하면 40단계에서 전체가 무너지는데, Fable 5.1은 전 과정에 걸쳐 안정적인 출력을 제공할 수 있습니다.

해결할 수 없는 문제가 발생하면 어떤 해결 방법을 시도했는지, 어디에서 막혔는지 알려줍니다.

연구원 Flix Rieseberg는 또한 글쓰기 측면에서 Fable 5.1에서는 굵은 글꼴 사용을 줄이고 제목, 목록 또는 인용 부호를 더 적게 사용하며 스타일 단서를 더 잘 따른다고 구체적으로 언급했습니다.

그나저나 스타일 팁을 오픈소스로 제공할 수 있나요?

여전히 Fable 5.1은 모든 사용자에게 공개되어 있으며 Mythos 5.1은 Trusted Access Program을 통해 검증된 사이버 보안 및 생명 과학 조직에서만 사용할 수 있습니다.

실용 과학 연구: 단백질 설계, 금성 지도 생성, GPU 가속

앤트로픽은 런닝 스코어 외에도 Fable 5.1과 Mythos 5.1의 실제 결과를 과학 연구 분야에서도 선보였습니다.

단백질 설계 측면에서 Anthropic은 Mythos 5.1을 사용하여 오픈 소스 단백질 설계 및 접기 도구를 사용하여 고친화도 결합 단백질을 설계하고 실험 검증을 위해 계획을 외부 기관 2곳에 보냈습니다.

세 가지 표적에 걸쳐 Mythos 5.1 디자인의 결합 친화력은 Adaptyv Bio 단백질 디자인 경쟁에서 최고의 솔루션보다 10배 더 높았습니다. 12개 타겟 모두에서 적중률은 50%에 가까웠으며, 이는 현재 단백질 설계 분야의 일반적인 적중률이 10~15%인 것과 비교됩니다.

고친화성 결합 단백질은 많은 일반적인 약물 개발 과정의 첫 번째 단계이며 약물이 더 낮은 용량에서도 효과를 발휘할 수 있는지 여부를 직접적으로 결정합니다.

천문학에서 Fable 5.1은 30여년 전 NASA의 마젤란 우주선이 촬영한 레이더 이미지를 기반으로 신경망을 훈련시켜 금성 표면의 1/3에 대한 새로운 고해상도 지형 지도를 생성했습니다.

이전에 사용 가능한 지형 지도는 해상도가 10~20km로 금성의 5분의 1만 포함했습니다. Fable 5.1은 해상도를 2~3km로 높이고, 높이 정확도는 기존보다 25% 높아졌다. 이 지도는 CC 라이선스에 따라 오픈 소스로 공개되었으며 향후 관측을 위한 주요 지질학적 특징을 식별하는 데 도움이 되는 다가오는 NASA VERITAS 및 ESA EnVision 임무의 참조 자료로 사용될 것입니다.

계산 생물학 측면에서 Mythos 5.1은 맞춤형 GPU 커널을 작성하고 중간 결과를 캐싱하여 7개의 오픈 소스 딥 러닝 모델의 실행 속도를 최대 2.5배 향상시켰으며 출력은 완전히 일관되었습니다.

실제 연구에서 생물학자들은 이러한 모델을 수천 번 실행하여 각 인간 유전자 근처에서 가능한 모든 돌연변이를 테스트해야 할 수도 있습니다. 최적화된 모델은 GPU 비용을 30%~60%까지 줄일 수 있습니다.

이런 종류의 최적화는 일반적으로 성능 엔지니어링 팀이 완료하는 데 몇 주가 걸리며 많은 학술 연구실에서는 이를 감당할 여력이 없습니다. 그러나 Mythos 5.1은 단 며칠 만에 이를 완료했으며 오픈 소스 코드에만 의존했습니다.

Anthropic은 가까운 시일 내에 이러한 최적화 기능을 오픈소스로 제공할 계획입니다.

증류 방지 메커니즘이 온라인 상태입니다

Fable 5.1 출시와 함께 몇 가지 특별 규정 및 API 변경 사항이 있습니다.

먼저 안전에 대해 간략하게 이야기하겠습니다.

Fable 5.1의 네트워크 보안 오탐률은 Fable 5보다 60% 낮습니다. 이제 소프트웨어 취약점을 발견하는 데 사용할 수 있지만 악용 개발은 여전히 ​​금지되어 있습니다. 침투 테스트, 익스플로잇 생성, 바이너리 기반 취약점 검색 등과 같은 이중 목적 작업은 여전히 ​​Opus 시리즈 모델로 리디렉션됩니다.

기본 생물학 및 의학 질문에 대한 오탐률은 85% 감소했지만 생명 과학 연구 및 개발과 관련된 쿼리는 여전히 Opus 모델 처리로 라우팅되며 전문가는 Mythos 5.1의 생명 과학 검증 프로그램(LSVP)을 통해 액세스 권한을 얻어야 합니다.

그럼 새로 추가된 증류 방지 메커니즘에 대해 이야기해 보겠습니다.

오늘부터 새로 등록된 API 계정은 사고 사슬 기록을 유지하면서 여러 라운드의 대화에서 Claude 컨텍스트를 수동으로 편집할 수 없습니다.

이전에 공개적으로 녹음된 일반적인 기술이 있습니다. 여러 차례의 대화에서 클로드의 이전 맥락을 수동으로 조작하되 의도적으로 사고 사슬 기록을 유지하는 것입니다. 이를 통해 모델은 새로운, 적대적일 수 있는 명령 집합 아래에서 다른 명령 집합에 따라 생성된 추론을 재생할 수 있습니다.

이 도로는 현재 차단되었습니다.

접근 방식은 각 사고 체인 블록에 서명을 추가하는 것입니다.

사용자가 후속 요청에서 어시스턴트의 응답을 다시 API로 보내면 시스템은 이 서명을 사용하여 현재 모델에 이 블록을 읽을 권한이 있는지 확인하고 이 블록 이전의 전체 대화(시스템 프롬프트 단어, 도구 목록 및 모든 기록 메시지 포함)가 원래 생성되었을 때와 정확히 동일한지 확인하는 두 가지 작업을 수행합니다.

대화 내용을 터치할 때마다 서명 확인이 실패합니다.

실패 후 수행할 작업은 개발자가 설정한 prefix_mismatch_behavior 매개변수에 따라 다릅니다. 기본값은 "error"이며, 400 상태 코드를 직접 반환하고 요청이 거부됩니다. "drop_block"으로 설정되면 시스템은 블록과 그 뒤의 모든 사고 체인을 자동으로 삭제하고 요청 자체는 평소대로 실행됩니다.

버려진 부분은 계산되지 않으며(사람이 좀 이상하네요) 응답의 input_transformations 배열에 나열됩니다.

어떤 작업이 인증 실패를 유발하나요?

문서에는 이전 사용자/보조자/시스템 메시지 편집, 재배열 또는 삭제, 최상위 시스템 프롬프트 단어 변경, 도구 목록에 대한 추가, 삭제 또는 이름 바꾸기, 대화 기록에서 생각 체인 블록 제거하지만 후속 블록 유지, 요청 간에 다른 콘텐츠를 반환한 이미지 또는 문서 URL 참조 등의 세부 목록이 제공됩니다.

위의 사항 중 하나라도 발생하면 이후의 모든 사고 체인 블록이 무효화됩니다.

반대로 일부 작업은 안전합니다.

대화 끝에 새 메시지 추가, 기록 시작 부분에서 사고 체인 블록 제거, max_tokens와 같은 요청 매개변수 변경, 캐시 제어 태그 증가 또는 감소, 서버 측 압축 또는 컨텍스트 편집은 확인 실패를 유발하지 않습니다.

체인 검증 디자인도 있습니다. 각 사고 체인 블록은 이전 블록의 정보를 기록하여 교차 체인을 형성합니다. 체인의 선두 부분에서는 블록을 제거할 수 있지만, 중간 부분에서 블록을 제거하면 그 뒤의 모든 블록은 무효가 되며, 중단된 시점부터 체인 전체가 무효가 됩니다.

개발자가 막히는 것을 방지하기 위해 Anthropic은 기록을 건드리지 않고도 동일한 효과를 얻을 수 있는 일련의 대안도 제공합니다.

중간에 지침을 변경해야 합니까? 최상위 프롬프트 단어를 직접 변경하는 대신 대화 중간 시스템 메시지를 사용하십시오.

각 라운드마다 임시 알림을 추가해야 합니까? "먼저 삽입한 후 삭제"하는 기존 방법을 대체하려면 Clear_at 매개변수와 함께 라운드 수준 시스템 메시지를 사용하세요.

중간에 도구를 추가하거나 제거해야 합니까? 도구 목록을 직접 편집하는 대신 tool_addition 및 tool_removal 블록을 사용하십시오.

맥락을 잘라야 하나요? 대략적인 클라이언트 측 잘림을 서버 측 압축 및 상황별 편집으로 대체합니다.

Claude Code, claude.ai, Claude Managed Agents 또는 Claude Agent SDK와 같은 공식 제품을 사용하는 경우 아무것도 변경할 필요가 없습니다. 대화 접두어가 변조되지 않도록 자동으로 확인했습니다.

하지만 메시지 API를 직접 호출하는 개발자라면 Anthropic의 제안은 메시지 배열을 추가 전용으로 엄격하게 사용한 다음 prefix_mismatch_behavior를 "drop_block" 모드로 설정하여 완전한 다단계 세션 테스트를 실행하여 로그에 prefix_bound_mismatch 항목이 있는지 확인하는 것입니다.

최종 문서에서는 문제가 발생하기 쉬운 시나리오도 구체적으로 언급합니다.

도구나 프레임워크를 유지 관리하고 사용자가 자신의 API 키를 사용하여 이를 호출하는 경우 새로 등록된 사용자는 이 확인을 더 일찍 실행하게 됩니다. 개발자 자체 키는 8월 31일 이전에 등록되었을 가능성이 높기 때문에 아직 시행되지는 않았습니다.

이 경우에는 prefix_mismatch_behavior를 사전에 설정하고 사전에 테스트해 보는 것이 좋습니다. 알아내기 전에 사용자가 충돌할 때까지 기다리지 마십시오.

한 가지 더

이렇게 A회사에서 큰 소란이 일어나면 옆집 OpenAI도 도저히 가만히 있을 수 없을 것입니다.

그러나 그들의 새 모델인 Astra는 아직 실제로 준비가 되지 않았기 때문에 먼저 상징적인 미리보기를 해야 합니다.

Fable 5.1과 OpenAI Astra 출시를 계기로 Ilya도 좀처럼 나서서 네트워크 보안 강화를 요구했습니다.

관련 태그

관련 글

댓글

0/500
Captcha (click to refresh)
댓글 없음