Anthropic의 Opus 5는 2026년 7월 24일 출시와 함께 직관에 반하는 제안을 내놓았다. 더 작고 저렴한 모델이면서도 여러 벤치마크에서 더 큰 형제를 실제로 능가한다는 것이다. 일반적으로 모델 출시가 그렇게 진행되지는 않으며, 바로 그렇기 때문에 개발자들이 주목하고 있다.
Summary
핵심 요약
- Anthropic는 2026년 7월 24일 Opus 5를 출시했으며, 이는 5월 28일에 Opus 4.8이 제공되기 시작한 지 불과 두 달 만이다.
- Opus 5는 Fable 5보다 더 작고 저렴하지만 여러 벤치마크에서 이를 능가하며, 백만 개 입력 토큰당 5달러, 백만 개 출력 토큰당 25달러로 책정되었다.
- Opus 5에서는 안전성 분류기가 Fable 5에 비해 85% 덜 자주 작동하며, 이 모델에는 Fable과 Mythos에 적용되는 30일 데이터 보존 정책이 적용되지 않는다.
- Automatic Fallbacks라는 새로운 베타 기능은 안전성 분류기가 트리거될 때 API 요청을 덜 강력한 모델로 라우팅하여, 오류 메시지 대신 기능적인 응답을 제공한다.
- 경량 Haiku 모델만 아직 5 시리즈로의 업그레이드를 기다리고 있다.
Anthropic, Opus 5 출시로 이전 모델들을 개선하다
Opus 5는 빽빽한 출시 일정 속에 자리 잡는다. Mythos 5, Fable 5, Sonnet 5는 모두 6월에 출시되었고, Opus 4.8은 5월 28일부터 제공되기 시작했으므로, 이번 출시는 두 달 만의 전환이다. Haiku만이 유일한 미업그레이드 모델로 남아 있는 가운데, Anthropic는 사실상 한 시즌 안에 전체 모델 라인업을 새로 고친 셈이다.
핵심 성능 및 비용상의 이점
Ars Technica의 보도에서 가장 눈에 띄는 수치는 무시하기 어렵다. 백만 개 입력 토큰당 5달러, 백만 개 출력 토큰당 25달러라는 가격은 Opus 4.8과 비슷하지만 Fable보다 저렴하다. Anthropic의 벤치마크 차트에 따르면 Opus 5는 코딩 작업에서 Fable과 거의 같은 수준이거나 약간 앞서는 성능을 보이며, Ars Technica에 따르면 대부분의 작업 범주에서 Opus 4.8과 OpenAI의 경쟁 모델인 GPT-5.6-Sol을 앞지른다.
이러한 구도는 현재 기업들이 어떻게 생각하고 있는지를 이해하는 데 중요하다. Ars Technica가 지적했듯이, 엔지니어링 매니저들 사이에서 지배적인 논의는 순수한 능력보다는 비용에 관한 것이다. Opus 5는 이러한 압박에 대한 Anthropic의 답변이다. 선행 모델과 비교해 토큰 비용을 추가로 들이지 않고도 더 높은 성능을 제공하며, 가격은 Fable보다 훨씬 낮다.
그럼에도 Ars Technica는 이를 돌파구라기보다는 점진적인 단계로 묘사하며, 능력 도약보다는 효율성 개선에 가까운 릴리스라고 평가한다. 벤치마크는 진전을 보여주지만, 이전 버전들이 등장했을 때 에이전트형 코딩을 재정의했던 수준의 도약은 아니다. 그러나 대부분의 실용적인 사용 사례에서는 가격 대비 성능 비율이 그러한 구분보다 더 중요할 수 있다.
Opus 5의 향상된 기능과 완화된 제한
숫자를 넘어, Opus 5는 개발자를 얼마나 제약하는지에 있어 의미 있는 변화를 담고 있다. Anthropic는 이 모델을 “자신의 작업을 검증하고 성공할 때까지 신중하게 반복하는 능력이 훨씬 강해졌다”고 설명하며, 불완전한 프롬프트에 응답해 모델이 자체 컴퓨터 비전 파이프라인을 작성한 벤치마크 테스트를 그러한 자기 수정 루프의 구체적인 예로 제시했다.
Fable 및 Mythos와 비교한 데이터 보존 정책의 차이
실질적으로 중요한 차이 중 하나는 데이터 처리 방식에 관한 것이다. Opus 5에는 Fable과 Mythos에 적용되는 30일 데이터 보존 정책이 적용되지 않는다. 이 요구 사항은 Fable 출시 이후 프라이버시에 민감한 사용자와 엔터프라이즈 고객들 사이에서 우려를 불러일으켰다. Opus 5의 예외 조치는 이를 선행 모델과 정렬시키며, 이미 도입 결정에 영향을 미치고 있던 컴플라이언스 마찰 지점을 제거한다.
또한 Opus 5에 전반적으로 제한이 더 적은 이유를 이해하는 것도 중요하다. Ars Technica의 보도에 따르면 이는 의도적인 학습 결정의 결과다. Anthropic는 Opus 5에 대해 사이버 보안 작업에 관한 최첨단 학습을 의도적으로 피했다. 이는 취약점 악용 측면에서 Opus 5가 Fable과 Mythos보다 상당히 뒤처진다는 의미이며, 위험 프로파일이 더 낮기 때문에 필요한 가드레일도 적다. 완화된 제한은 부분적으로, 더 낮은 위협 상한을 염두에 두고 구축된 모델의 결과다.
안전 기능과 사이버 보안 보호 장치
제한이 줄었다고 해서 제한이 사라진 것은 아니다. Anthropic는 특정 사이버 보안 사용 사례 하나에 대해 명확한 경계를 그었다. 소프트웨어 바이너리를 취약점 탐지를 위해 스캔하는 것은 금지된다. 반면, 동일한 목적의 소스 코드 스캔은 허용되는데, 이는 후자가 방어적 보안 작업과 더 일치한다고 보기 때문이다.
안전성 분류기의 작동 감소
보다 넓은 신호는 수치로 표현된다. Anthropic는 Opus 5에서 AI 안전성 분류기가 Fable 5에 비해 85% 덜 자주 작동할 것으로 예상한다. 이는 극적인 감소이며, 가장 위험한 작업에 대해 의도적으로 능력 상한을 둔 모델에 회사가 부여한 더 가벼운 위험 발자국을 직접적으로 반영한다.
프로덕션 애플리케이션을 구축하는 개발자에게 이 감소는 실제 워크플로에 영향을 미친다. 분류기 개입이 줄어들면 깨진 파이프라인이 줄고, 이를 우회하기 위한 엣지 케이스 엔지니어링이 줄며, 대규모에서 API 동작이 더 예측 가능해진다. 85%라는 수치는 단순한 안전성 지표가 아니라, 사실상 신뢰성 지표이기도 하다.
API 사용자 경험을 향상시키는 새로운 기능
분류기 작동 빈도가 훨씬 줄어들었음에도, Anthropic는 그것이 실제로 작동할 때 무엇이 일어나는지를 개선하고자 했다. 그 해답이 바로 Automatic Fallbacks라는 새로운 베타 기능이다.
Automatic Fallbacks의 소개와 기능
프롬프트가 안전성 분류기를 트리거할 때 오류를 반환하는 대신, Automatic Fallbacks는 요청을 자동으로 덜 강력한 모델로 재라우팅하고 기능적인 응답을 제공한다. API 사용자는 이 기능에 옵트인할 수 있으며, 활성화되면 경험은 완전한 중단에서 점진적인 성능 저하로 전환된다.
이는 프로덕션 환경에서 일관된 API 출력을 신뢰하는 개발자에게 의미 있는 삶의 질 향상을 가져온다. 분류기 트리거에 대한 오류 메시지는 다운스트림 실패를 유발하며, 이를 처리하기 위한 커스텀 로직이 필요하다. 기능적인 폴백 응답은 이러한 엔지니어링 부담을 제거한다. 이는 더 넓은 철학도 시사한다. Anthropic는 가드레일 자체를 낮추기보다는, 워크플로를 덜 방해하는 안전 가드레일을 지향하고 있다.
경쟁이 치열해지는 가운데 — Ars Technica는 중국의 오픈 웨이트 모델 Kimi K3가 백만 개 출력 토큰당 15달러에 유사한 성능을 제공한다고 지적했다 — Anthropic가 마찰과 비용을 계속 줄여야 하는 압박은 현실적이다. Opus 5는 두 가지 모두를 해결하지만, 단일 모델이 비용 우위를 유지할 수 있는 시간 창은 빠르게 좁아지고 있다. 더 지속 가능한 승부수는 Automatic Fallbacks와 같은 도구일 수 있다. 토큰 가격이 어디에 안착하든, 전체 플랫폼을 더 끈끈하게 만드는 기능들이다.
FAQ
Opus 5는 성능과 비용 측면에서 Fable 5와 어떻게 비교되나요?
Opus 5는 Fable 5보다 더 작고 저렴하며 제한도 적으면서, 여러 벤치마크에서 이를 능가한다. 백만 개 입력 토큰당 5달러, 백만 개 출력 토큰당 25달러로 책정되어 대부분의 사용 사례에서 Fable보다 더 경제적이다.
Opus 5는 어떤 안전 조치를 구현하나요?
Opus 5는 Fable 5에 적용되는 것보다 85% 덜 자주 작동하는 안전성 분류기를 사용한다. 또한 소프트웨어 바이너리의 취약점 스캔에는 모델을 사용할 수 없도록 막는 반면, 방어적 보안 목적의 소스 코드 스캔은 허용한다.
Opus 5의 Automatic Fallbacks 기능이란 무엇인가요?
Automatic Fallbacks는 API 사용자가 옵트인할 수 있는 베타 기능이다. 프롬프트가 안전성 분류기를 트리거하면, 시스템은 요청을 자동으로 덜 강력한 모델로 라우팅하고 오류 메시지 대신 기능적인 응답을 반환한다.
Opus 5에도 Fable과 같은 30일 데이터 보존 정책이 적용되나요?
아니다. Opus 5에는 Fable과 Mythos 모델에 적용되는 30일 데이터 보존 정책이 적용되지 않으며, 이는 프라이버시에 민감한 사용자와 엔터프라이즈 고객에게 우려 사항이었던 부분이다.
{“@context”:”https://schema.org”,”@type”:”FAQPage”,”mainEntity”:[{“@type”:”Question”,”name”:”Opus 5는 성능과 비용 측면에서 Fable 5와 어떻게 비교되나요?”,”acceptedAnswer”:{“@type”:”Answer”,”text”:”Opus 5는 Fable 5보다 더 작고 저렴하며 제한도 적으면서, 여러 벤치마크에서 이를 능가한다. 백만 개 입력 토큰당 5달러, 백만 개 출력 토큰당 25달러로 책정되어 대부분의 사용 사례에서 Fable보다 더 경제적이다.”}},{“@type”:”Question”,”name”:”Opus 5는 어떤 안전 조치를 구현하나요?”,”acceptedAnswer”:{“@type”:”Answer”,”text”:”Opus 5는 Fable 5에 적용되는 것보다 85% 덜 자주 작동하는 안전성 분류기를 사용한다. 또한 소프트웨어 바이너리의 취약점 스캔에는 모델을 사용할 수 없도록 막는 반면, 방어적 보안 목적의 소스 코드 스캔은 허용한다.”}},{“@type”:”Question”,”name”:”Opus 5의 Automatic Fallbacks 기능이란 무엇인가요?”,”acceptedAnswer”:{“@type”:”Answer”,”text”:”Automatic Fallbacks는 API 사용자가 옵트인할 수 있는 베타 기능이다. 프롬프트가 안전성 분류기를 트리거하면, 시스템은 요청을 자동으로 덜 강력한 모델로 라우팅하고 오류 메시지 대신 기능적인 응답을 반환한다.”}},{“@type”:”Question”,”name”:”Opus 5에도 Fable과 같은 30일 데이터 보존 정책이 적용되나요?”,”acceptedAnswer”:{“@type”:”Answer”,”text”:”아니다. Opus 5에는 Fable과 Mythos 모델에 적용되는 30일 데이터 보존 정책이 적용되지 않으며, 이는 프라이버시에 민감한 사용자와 엔터프라이즈 고객에게 우려 사항이었던 부분이다.”}}]}
본 기사는 인공지능의 도움을 받아 제작되었으며, 편집팀의 검수를 거쳤습니다.

