앤트로픽 클로드 오푸스 4.1 출시, 코딩 벤치마크 74.5% 최고 기록

Anthropic released Claude Opus 4.1 on August 5, 2025, ahead of OpenAI's anticipated GPT-5 launch. The upgraded model achieved a record 74.5% score on SWE-bench Verified, topping coding benchmarks. This represents a 2-point improvement over Opus 4 and 5-point lead over OpenAI's o-series models. Claude Opus 4.1 shows enhanced code refactoring, data analysis, and agentic task capabilities. Anthropic recommends all users upgrade from Opus 4 to 4.1 at the same pricing. The model uses API tag claude-opus-4-1-20250805 for developer access. Anthropic promises "substantially larger" improvements in coming weeks.

앤트로픽이 2025년 8월 5일 오픈AI의 GPT-5 출시에 대비해 업그레이드된 클로드 오푸스 4.1 모델을 출시했다. 새 모델은 SWE-벤치 베리파이드(SWE-bench Verified) 벤치마크에서 74.5%의 최고 점수를 기록하며 코딩 분야 1위를 차지했다. 이는 기존 오푸스 4보다 2포인트, 오픈AI의 o시리즈보다 5포인트 높은 성과다. 클로드 오푸스 4.1은 코드 리팩터링, 데이터 분석, 에이전틱 작업 능력이 크게 향상됐다. 앤트로픽은 모든 사용자에게 기존 오푸스 4에서 4.1로 업그레이드할 것을 권장한다고 밝혔다. 가격은 기존 오푸스 4와 동일하게 유지되며 API 태그는 claude-opus-4-1-20250805를 사용한다. 앤트로픽은 향후 몇 주 내에 "상당히 큰" 개선사항을 추가로 공개할 예정이라고 예고했다.

버트

ai@tech42.co.kr
기자의 다른 기사보기
저작권자 © Tech42 - Tech Journalism by AI 테크42 무단전재 및 재배포 금지

관련 기사

구글 '제미나이' 사용자 10억 명 돌파

구글(Google)의 인공지능(AI) 서비스 '제미나이(Gemini)'가 단독 앱 출시 이후 월간 활성 사용자 수(MAU) 10억 명을 돌파하는 기록을 세웠다.

오픈AI, '리눅스 전용 챗GPT' 전격 출시

오픈AI(OpenAI)가 오픈소스 개발자들의 오랜 요청을 반영해 리눅스(Linux) 전용 챗GPT 데스크톱 앱을 정식 선보였다.

복붙해도 안 지워진다… AI 텍스트에 '스텔스 워터마크' 전격 박힌다

인공지능(AI) 스타트업 앤트로픽(Anthropic)이 생성형 AI 클로드(Claude)가 작성한 모든 문장에 출처를 식별할 수 있는 '텍스트 워터마크' 기술을 전격 도입한다.

150년 수학 난제 터졌다… AI, 인간도 못한 '리만 가설' 풀어냈다

인공지능(AI)이 150년 넘게 미해결 상태로 남아있던 수학계 최고 난제 중 하나인 '리만 가설(Riemann hypothesis)' 해결에 중대한 이정표를 세웠다.