Только что вышел Claude Haiku 5.5! Цена упала на 90%

Только что Anthropic выпустила Claude Haiku 5.5, цена которого составляет всего 1/10 от предыдущего поколения Haiku 4.5 и 1/20 от Sonnet 5.5, а также равна цене OpenAI GPT-6 Luna.

По официальным тестам Luna уступила ему по всем шести показателям, в нескольких категориях она даже близко подошла к Sonnet.
Операционная система OSWorld поднялась с 15.7% до 72.4%, до Sonnet 5.5 не хватает всего 11.5 процентных пунктов.
Тестирование программирования Terminal-Bench 4.0, в предыдущем поколении набрала 0 баллов, в этот раз получила 39.2%.
GDPval-AA для интеллектуальной работы набрала 1620 баллов, что более чем в два раза превышает результат предыдущего поколения.
"Последний экзамен для человечества" HLE без инструментов поднялся с 10.2% до 45.9%.

Сколько можно сэкономить
Цена составляет 0.10 долларов за миллион токенов на ввод и 0.50 долларов на вывод, это цена для подсказок до 100,000 токенов, свыше 100,000 цена составляет 0.50 долларов за ввод и 2.50 долларов за вывод.
Чтение кэша стоит 0.01 долларов за миллион токенов, при пакетной обработке действует скидка 50%.

По официальным расчетам, выполнение аналогичных задач в среднем экономит около 75% по сравнению с Haiku 4.5, с тем же бюджетом можно выполнить в четыре раза больше вызовов.
Не удалось сэкономить 90%, потому что запросы свыше 100,000 токенов дешевле только на половину, но в предыдущем поколении около 90% запросов были в пределах 100,000, кроме того, новый токенизатор увеличивает количество токенов на 30% для одного и того же текста.
По сравнению с GPT-6 Luna, цены на ввод, вывод и кэш для обеих компаний в пределах 100,000 токенов абсолютно одинаковы.
При работе с длинным контекстом Luna дешевле, она начинает повышать цены только при достижении 270,000 токенов, и даже тогда цена составит 0.20 долларов за ввод и 0.75 долларов за вывод.
Кэш для Sonnet 5.5 также с сегодняшнего дня снижен вдвое, с 0.20 долларов до 0.10 долларов за миллион токенов, по официальным расчетам большинство задач для агентов могут стать дешевле на 20%.
Подписка Max и Team с этой недели будет предоставлять API-кредиты каждый месяц, Max 5x предоставляет 100 долларов, Max 20x предоставляет 200 долларов, Team максимум 500 долларов, общий доступ для всей команды, можно использовать любую модель на платформе Claude.
Результаты лучше, чем у Luna, но в сложном программировании все еще отстает от Sonnet
Это поколение Haiku значительно улучшило свои результаты по сравнению с предыдущим.

Операционная система OSWorld поднялась с 15.7% до 72.4%, до Sonnet 5.5 не хватает всего 11.5 процентных пунктов.
Тестирование программирования Terminal-Bench 4.0, в предыдущем поколении не набрала ни одного балла, в этот раз получила 39.2%.
GDPval-AA для интеллектуальной работы набрала 1620 баллов, что более чем в два раза превышает результат предыдущего поколения.
"Последний экзамен для человечества" HLE без инструментов поднялся с 10.2% до 45.9%.
Операции с компьютером — это самая значительная область прогресса, у Luna с такой же ценой только 48.9%, Haiku 5.5 опережает ее на 23.5 процентных пункта.
С учетом затрат результаты еще более впечатляющие, она на уровне Medium уже превысила результаты Luna на максимуме, при этом затраты были меньше.

В области интеллектуальной работы GDPval-AA Haiku 5.5 с 1620 баллами обошла Luna с 1437 баллами, до Sonnet 5.5 с 1840 баллами еще далеко, но даже на стандартном уровне Medium она набрала 1277 баллов.
В тесте на долгосрочные проекты AA-Briefcase она поднялась с 614 баллов до 1578 баллов, в то время как Luna набрала 1336 баллов.

В области логического вывода и анализа изображений, когда HLE использует инструменты поиска и кода, Haiku 5.5 набрала 57.4%, Sonnet 5.5 — 64.5%. В тесте на чтение профессиональных графиков Chartography она поднялась с 6.4% до 46.4%, Luna — 29.1%, Sonnet 5.5 — 61.6%.

Наибольшее отставание от Sonnet наблюдается в программировании, на Terminal-Bench 4.0 ее 39.2% более чем в два раза превышает Luna (16.4%), но Sonnet 5.5 — 70.6%.
На FrontierCode ее 46.4% также обошли Luna с 42.4%, до лучшего результата Sonnet 5.5 с 52.1% не хватает почти 6 процентных пунктов.
Официально также заявлено, что сложное программирование агентов лучше доверить Sonnet 5.5 и Opus 5.5.
Для чего подходит
Официально Haiku 5.5 позиционируется как модель для больших объемов, быстрой работы и экономии, например, для написания резюме, сжатия контекста, поиска в базе данных и классификации.
Это также самая быстрая модель Claude на данный момент, она лишь немного медленнее Opus в быстром режиме (который стоит очень дорого!), подходит для работы в реальном времени и операций в браузере.
Официально также предоставлены отзывы от ряда звездных AI-приложений.
Asana сообщила, что задержка выполнения задач снизилась более чем на 30% по сравнению с их текущими моделями, Box измерила, что ее задержка составляет всего около половины от Haiku 4.5.

Еще одно основное применение — использование в качестве подагента для Opus или Sonnet, где большая модель разбивает задачи и принимает решения, а Haiku выполняет их.
Cognition использует Devin Fusion, чтобы сделать Opus 5.5 основной моделью, а Haiku 5.5 — вспомогательной, FrontierCode стабильно держится на уровне 66.2 баллов, затраты и задержка снизились.

Финансовая AI-компания Rogo использует большую модель для создания PPT, Haiku 5.5 анализирует 10-K отчеты для извлечения данных о доходах по подразделениям.

Учетная запись разработчика Claude предоставила демонстрацию, задача заключалась в том, чтобы из множества домашних предметов спроектировать подставку для яиц, цель — не разбиться при падении с 32 метров.

Opus 5.5 справился за 3 минуты 37 секунд, попробовал 25 вариантов, потратил 0.47 долларов, а с 10 подагентами Haiku 5.5 это заняло всего 58 секунд, было протестировано 86 вариантов, потрачено 0.14 долларов.
Руководство по использованию Haiku 5.5
Haiku 5.5 уже доступен на клиенте Claude, Claude Code и платформах AWS, Google Cloud, Microsoft Azure, Cursor, OpenRouter и других, ID модели — claude-haiku-5-5, контекст — 1 миллион токенов, максимум за один раз — 128,000 токенов.

Это первая модель Haiku, которая может регулировать уровень мышления, от Low до Max всего пять уровней, по умолчанию API установлен на Medium.
Python и TypeScript SDK также добавили операции с компьютером и браузером, в настоящее время находятся в бета-версии.
При миграции с Haiku 4.5 аналогичное количество текстовых токенов увеличится примерно на 30%, max_tokens и затраты нужно будет пересчитать.
budgettokens заменены на адаптивные уровни мышления и Effort, temperature, topp, top_k нужно удалить, предзаполненные ответы больше не работают, требования к формату изменены на структурированный вывод.
Операции с компьютером нужно заменить на новый набор инструментов computertoolset20260801, приоритетный уровень пока не поддерживается.
Если это слишком сложно, можно выполнить одну команду в Claude Code:
Пусть он сам изменит.
Конечно, для неразработчиков вы уже можете прямо в клиенте общаться с Haiku 5.5!

Не беспокойте Fable, Opus, Sonnet с простыми вопросами, Haiku 5.5 даже при низкой интенсивности вывода может точно мгновенно давать ответы, идеально заменяя поисковые системы.

Попробуйте прямо сейчас!
Ссылки:
https://www.anthropic.com/claude-haiku-5-5
Популярные статьи











