Anthropic은 코딩, 연구, 비즈니스 작업 및 기타 복잡한 작업을 위한 최신 최첨단 AI 모델인 Claude Opus 5를 출시했습니다. 회사는 동일한 API 가격을 유지하면서 Claude Opus 4.8에 비해 성능이 크게 향상되었다고 말합니다. Anthropic은 또한 일부 코딩 및 컴퓨터 사용 테스트에서 Claude Fable 5에 가깝지만 작업당 비용은 훨씬 저렴하다고 주장합니다.
Opus 5는 Claude의 앱과 API에서 사용할 수 있습니다. 이제 Claude Max 가입자의 기본 모델이자 Claude Pro에 포함된 가장 강력한 옵션입니다.
Claude Opus 5는 Fable 5와 얼마나 가깝습니까?
실제 소프트웨어 개발 작업에서 코딩 에이전트를 테스트하는 CursorBench 3.2에서 Opus 5는 최대 노력으로 Fable 5 최고 점수의 0.5% 이내로 완료되었습니다. Anthropic은 작업당 비용을 절반으로 줄여 이러한 결과를 달성했다고 말합니다.


Opus 5는 또한 OSWorld 2.0에서 Fable 5의 최고 결과를 1/3이 조금 넘는 비용으로 능가했습니다. 벤치마크는 AI 에이전트가 컴퓨터를 얼마나 잘 작동하고 앱과 파일 전반에 걸쳐 작업을 완료할 수 있는지를 측정합니다.
Pro 및 표준 Team 구독자의 경우 Opus 5는 Fable 5가 7월 20일에 종량제 크레딧을 도입하면서 생긴 공백을 메우는 데 도움이 될 수 있습니다.
Opus 4.8보다 얼마나 좋아졌나요?
Anthropic은 어려운 소프트웨어 엔지니어링 작업에서 AI 에이전트를 테스트하는 Frontier-Bench에서 Opus 5가 Opus 4.8의 점수를 두 배 이상 높였다고 말합니다. 또한 더 낮은 평균 비용으로 이러한 작업을 완료했습니다.

회사는 Opus 5가 작업을 확인하고, 버그의 원인을 찾고, 빠른 수정 후 중지하는 대신 어려운 작업을 계속하는 데 더 좋다고 말합니다. 한 예에서는 기존 커뮤니티 패치에서 누락된 극단적인 사례를 발견했습니다.
이러한 결과는 Anthropic의 자체 테스트에서 나온 것이므로 일상적인 작업 부하에 따라 성능이 달라질 수 있습니다. Claude Opus 5의 비용은 입력 토큰 백만 달러당 5달러, 출력 토큰 백만 달러당 25달러이며 Opus 4.8과 동일합니다.
이 주제에 대해 더 알고 싶다면 아래를 참고하세요