Anthropic выпустила Claude Sonnet 5.5, результаты программирования превысили Opus 5.5
Anthropic выпустила Claude Sonnet 5.5 в этот понедельник, как обновленную версию Sonnet 5, выпущенного в июне этого года. Официально заявлено, что скорость работы этой средней модели увеличилась более чем на 30% по сравнению с предыдущим поколением, она демонстрирует наилучшие результаты в четко определенных повседневных задачах, исправлении ошибок, а также в создании документов, презентаций и таблиц, обладая при этом острым дизайнерским мышлением. Цены остаются на уровне 2 долларов за миллион входных токенов и 10 долларов за миллион выходных токенов, что составляет половину от Opus 5.5, при этом расход токенов на каждую задачу уменьшился почти на треть по сравнению с Sonnet 5.
В тестах Terminal-Bench 4 Sonnet 5.5 набрала 70.6%, что выше, чем 66.4% у Opus 5.5 и всего 10.3% у Sonnet 5. Результаты независимого тестового агентства Artificial Analysis также показывают ее преимущество, составив 63.6% и 59.6%, в то время как GPT-6 Astra от OpenAI составила 59.1%. В оценке реальной рабочей производительности 44 профессий на GDPval-AA Sonnet 5.5 получила 1844 балла, что практически сопоставимо с 1846 баллами у Opus 5.5, в то время как GPT-6 Sol набрала 1487 баллов.






