AI 비교AI 찾기AI 뉴스AI 활용
회사 소개
개인정보처리방침이용약관FAQ문의하기문의하기
에이아이비 주식회사사업자정보
© 2026 AIB Inc.

Anthropic, 차세대 Claude Opus 5 모델 공개

Anthropic, 차세대 Claude Opus 5 모델 공개

Artificial Analysis·2026년 7월 25일 (토)
  • •Claude Opus 5가 61점을 기록하며 Artificial Analysis Intelligence Index에서 최고 점수를 달성했다.
  • •이 모델은 GDPval-AA v2에서 1861 Elo, AA-Briefcase에서 1720 Elo를 기록하며 Fable 5를 크게 앞섰다.
  • •작업당 비용을 $2.03으로 낮추면서도 우수한 에이전트형 코딩 및 추론 성능을 제공한다.
  • •Claude Opus 5가 61점을 기록하며 Artificial Analysis Intelligence Index에서 최고 점수를 달성했다.
  • •이 모델은 GDPval-AA v2에서 1861 Elo, AA-Briefcase에서 1720 Elo를 기록하며 Fable 5를 크게 앞섰다.
  • •작업당 비용을 $2.03으로 낮추면서도 우수한 에이전트형 코딩 및 추론 성능을 제공한다.
  • •Claude Opus 5가 61점을 기록하며 Artificial Analysis Intelligence Index에서 최고 점수를 달성했다.
  • •이 모델은 GDPval-AA v2에서 1861 Elo, AA-Briefcase에서 1720 Elo를 기록하며 Fable 5를 크게 앞섰다.
  • •작업당 비용을 $2.03으로 낮추면서도 우수한 에이전트형 코딩 및 추론 성능을 제공한다.
  • •Claude Opus 5가 61점을 기록하며 Artificial Analysis Intelligence Index에서 최고 점수를 달성했다.
  • •이 모델은 GDPval-AA v2에서 1861 Elo, AA-Briefcase에서 1720 Elo를 기록하며 Fable 5를 크게 앞섰다.
  • •작업당 비용을 $2.03으로 낮추면서도 우수한 에이전트형 코딩 및 추론 성능을 제공한다.

Anthropic은 2026년 7월 24일 Claude Opus 5를 공개하며, 61점의 기록으로 Artificial Analysis Intelligence Index의 선두 자리를 차지했다. 이 모델은 경쟁 모델인 Claude Fable 5(60점), GPT-5.6 Sol(59점), Kimi K3(57점), Claude Opus 4.8(56점)을 상회한다. 또한 GDPval-AA v2 벤치마크에서 1861 Elo, AA-Briefcase에서 1720 Elo를 기록해, Fable 5 대비 각각 100점과 146점 이상의 성능 향상을 보였다. 평가에는 AI 모델을 외부 도구와 연결하는 오픈소스 에이전트 하네스인 Stirrup이 활용되었다.

Claude Opus 5(xhigh)는 에이전트형 코딩 과제인 Artificial Analysis Coding Index를 주도하며, 특히 SWE-Atlas-QnA에서 최고 점수를 확보했다. 모델은 Intelligence Index 과제당 평균 $2.03의 비용으로 수준 높은 추론을 제공하는데, 이는 Fable 5의 $2.75 대비 경제적이다. 다만 Sonnet 5(max)의 $1.53보다는 비용이 높다. 해당 모델은 이전 버전과 동일하게 100만 토큰의 컨텍스트 윈도우를 지원하며 총 5단계의 노력 설정(low to max)이 가능하다.

특화 벤치마크 분야에서는 Humanity’s Last Exam에서 53%를 획득해 Fable 5와 대등한 성적을 거뒀다. 물리학 평가인 CritPt에서도 Fable 5와 유사한 성능을 보였으나 GPT-5.6 Pro 및 Terra 모델에는 미치지 못했다. AA-Omniscience에서는 Opus 4.8 대비 사실 정확도를 7포인트 개선했으나, 불확실한 상황에서 답변을 자주 시도함에 따라 할루시네이션 비율은 14포인트 증가한 50%를 기록했다. 가격은 입출력 토큰당 각각 $5/$25이며, 캐시 쓰기 비용은 $6.25, 캐시 적중 시 90% 할인이 적용된다.

Anthropic은 2026년 7월 24일 Claude Opus 5를 공개하며, 61점의 기록으로 Artificial Analysis Intelligence Index의 선두 자리를 차지했다. 이 모델은 경쟁 모델인 Claude Fable 5(60점), GPT-5.6 Sol(59점), Kimi K3(57점), Claude Opus 4.8(56점)을 상회한다. 또한 GDPval-AA v2 벤치마크에서 1861 Elo, AA-Briefcase에서 1720 Elo를 기록해, Fable 5 대비 각각 100점과 146점 이상의 성능 향상을 보였다. 평가에는 AI 모델을 외부 도구와 연결하는 오픈소스 에이전트 하네스인 Stirrup이 활용되었다.

Claude Opus 5(xhigh)는 에이전트형 코딩 과제인 Artificial Analysis Coding Index를 주도하며, 특히 SWE-Atlas-QnA에서 최고 점수를 확보했다. 모델은 Intelligence Index 과제당 평균 $2.03의 비용으로 수준 높은 추론을 제공하는데, 이는 Fable 5의 $2.75 대비 경제적이다. 다만 Sonnet 5(max)의 $1.53보다는 비용이 높다. 해당 모델은 이전 버전과 동일하게 100만 토큰의 컨텍스트 윈도우를 지원하며 총 5단계의 노력 설정(low to max)이 가능하다.

특화 벤치마크 분야에서는 Humanity’s Last Exam에서 53%를 획득해 Fable 5와 대등한 성적을 거뒀다. 물리학 평가인 CritPt에서도 Fable 5와 유사한 성능을 보였으나 GPT-5.6 Pro 및 Terra 모델에는 미치지 못했다. AA-Omniscience에서는 Opus 4.8 대비 사실 정확도를 7포인트 개선했으나, 불확실한 상황에서 답변을 자주 시도함에 따라 할루시네이션 비율은 14포인트 증가한 50%를 기록했다. 가격은 입출력 토큰당 각각 $5/$25이며, 캐시 쓰기 비용은 $6.25, 캐시 적중 시 90% 할인이 적용된다.

원문 보기 (영어)·2026년 7월 24일
#anthropic#claude#opus 5#benchmark#intelligence index