Anthropic가 Claude Sonnet 5.5를 출시했으며, 프로그래밍 성적이 Opus 5.5를 초과했습니다
Anthropic은 이번 주 월요일에 Claude Sonnet 5.5를 발표했습니다. 이는 올해 6월에 출시된 Sonnet 5의 업그레이드 버전입니다. 공식적으로 이 중급 모델은 이전 세대보다 30% 이상 속도가 향상되었으며, 명확한 범위의 일상적인 작업, 결함 수정, 문서, 슬라이드 및 표 작성에서 가장 뛰어난 성능을 보이고, 날카로운 디자인 능력을 갖추고 있습니다. 가격은 입력 토큰 100만 개당 2달러, 출력 토큰 100만 개당 10달러로 유지되며, 이는 Opus 5.5의 절반이며, 각 작업에서 소모되는 토큰은 Sonnet 5보다 거의 3분의 1 감소했습니다.
Terminal-Bench 4 테스트에서 Sonnet 5.5는 70.6%의 점수를 기록하여 Opus 5.5의 66.4%보다 높고, Sonnet 5는 10.3%에 불과했습니다. 독립 테스트 기관인 Artificial Analysis의 결과도 그 우위를 보여주며, 각각 63.6%와 59.6%를 기록했으며, OpenAI의 GPT-6 Astra는 59.1%입니다. 44개 직업의 실제 작업 성과를 평가한 GDPval-AA에서 Sonnet 5.5는 1844점을 기록했으며, Opus 5.5의 1846점과 거의 비슷하고, GPT-6 Sol은 1487점입니다.






