Только что вышла Claude Haiku 5.5! Цена упала на 90%
chaincatcher
Компания Anthropic выпустила Claude Haiku 5.5. Цена составляет 1/10 от предыдущего поколения Haiku 4.5, 1/20 от Sonnet 5.5 и совпадает с ценой GPT-6 Luna от OpenAI.

В официальной таблице бенчмарков Luna проиграла ей во всех шести категориях, а по нескольким категориям она вплотную приблизилась к Sonnet.
OSWorld для управления компьютером подскочил с 15,7% у предыдущего поколения до 72,4%, отставая от Sonnet 5.5 всего на 11,5 процентного пункта.
Terminal-Bench 4.0 для программирования в терминале вырос с нуля у предыдущего поколения до 39,2%.
GDPval-AA для работы со знаниями набрал 1620 баллов, что более чем вдвое превышает результат предыдущего поколения.
«Humanity's Last Exam» (HLE) без инструментов вырос с 10,2% до 45,9%.

Сколько можно сэкономить
Цена составляет $0,10 за миллион входных токенов и $0,50 за миллион выходных токенов — это цена для запросов до 100 000 токенов; свыше 100 000 расчёт идёт по $0,50 за входные токены и $2,50 за выходные токены.
Чтение кэша стоит $0,01 за миллион токенов, а для пакетной обработки действует дополнительная скидка 50%.

По официальным расчётам, те же задачи в среднем примерно на 75% дешевле, чем у Haiku 4.5, что позволяет при том же бюджете выполнять примерно в четыре раза больший объём вызовов.
Экономия не составляет 90%, потому что запросы свыше 100 000 токенов стоят половину цены, но, к счастью, около 90% запросов у предыдущего поколения Haiku были короче 100 000 токенов. Кроме того, новый токенизатор увеличит количество токенов для того же текста примерно на 30%.
По сравнению с GPT-6 Luna цены на входные токены, выходные токены и чтение кэша для запросов до 100 000 токенов у обеих моделей полностью совпадают.
При работе с длинными контекстами Luna дешевле: она повышает цены только около 270 000 токенов, и даже тогда взимает $0,20 за входные токены и $0,75 за выходные токены.
Чтение кэша у Sonnet 5.5 с сегодняшнего дня также подешевело вдвое — с $0,20 до $0,10 за миллион токенов, и, по официальным расчётам, большинство задач агентов могут стать дешевле примерно на 20%.
Подписки Max и Team с этой недели начнут ежемесячно предоставлять API-кредиты: Max 5x — $100, Max 20x — $200, Team — до $500 на всю команду, которые можно использовать на любой модели платформы Claude.
Haiku 5.5 набрала больше баллов, чем Luna, но всё ещё отстаёт от Sonnet в сложном программировании
Это поколение Haiku добилось значительного прогресса по сравнению с предыдущим.

OSWorld для управления компьютером подскочил с 15,7% у предыдущего поколения до 72,4%, отставая от Sonnet 5.5 всего на 11,5 процентного пункта.
Terminal-Bench 4.0 для программирования в терминале вырос с нуля у предыдущего поколения до 39,2%.
GDPval-AA для работы со знаниями набрал 1620 баллов, что более чем вдвое превышает результат предыдущего поколения.
«Humanity's Last Exam» (HLE) без инструментов вырос с 10,2% до 45,9%.
Управление компьютером — область с самым значительным улучшением на этот раз: Luna при той же цене набрала 48,9%, а Haiku 5.5 превзошла её на 23,5 процентного пункта.
С учётом затрат разница ещё более разительная: она превысила максимальный балл Luna при установке режима Medium, оставаясь при этом дешевле.

В работе со знаниями Haiku 5.5 с результатом 1620 превзошла Luna с 1437, всё ещё немного отставая от Sonnet 5.5 с 1840, но даже при стандартной настройке Medium она набрала 1277.
В оценке долгосрочных проектов AA-Briefcase результат вырос с 614 баллов у предыдущего поколения до 1578 баллов, тогда как Luna набрала 1336.

В рассуждениях и чтении изображений, когда HLE использует поиск и инструменты для работы с кодом, Haiku 5.5 набрала 57,4%, а Sonnet 5.5 — 64,5%. В чтении профессиональных диаграмм Chartography выросла с 6,4% у предыдущего поколения до 46,4%, тогда как Luna набрала 29,1%, а Sonnet 5.5 — 61,6%.

Самый большой разрыв с Sonnet — в программировании: на Terminal-Bench 4.0 у Haiku 5.5 39,2% более чем вдвое превышают результат Luna (16,4%), но Sonnet 5.5 набрала 70,6%.
На FrontierCode она набрала 46,4%, превзойдя Luna с 42,4%, но всё ещё отставая почти на 6 пунктов от лучшего результата Sonnet 5.5 в 52,1%.
Официально также заявлено, что сложное агентное программирование по-прежнему лучше доверять Sonnet 5.5 и Opus 5.5.
Для чего подходит Haiku 5.5
Официальное позиционирование Haiku 5.5 — масштабные, быстрые и экономичные задачи, такие как написание кратких изложений, сжатие контекста, запросы к базам данных и классификация.
Это также самая быстрая модель Claude на данный момент, лишь немного медленнее Opus в быстром режиме (который очень дорог!), что делает её подходящей для обслуживания клиентов в реальном времени и работы в браузере.
Официально также приведены отзывы ряда ведущих компаний, разрабатывающих ИИ-приложения, полученные в ходе внутреннего тестирования.
Asana обнаружила, что задержки при выполнении задач сократились более чем на 30% по сравнению с текущей моделью Asana, а Box измерил задержку примерно вдвое ниже, чем у Haiku 4.5.

Ещё одно основное применение — роль субагента для Opus или Sonnet, когда большая модель разбивает задачи и принимает решения, а Haiku их выполняет.
Devin Fusion от Cognition использует Opus 5.5 как основную модель и Haiku 5.5 как ассистента, удерживая высший балл 66,2 при снижении затрат и задержек.

Финансовая ИИ-компания Rogo использует большую модель для создания презентаций, а Haiku 5.5 углубляется в отчёты 10-K, чтобы извлекать данные о выручке по сегментам.

Аккаунт разработчиков Claude предоставил демонстрацию: задача — спроектировать держатель для яйца из набора бытовых предметов, чтобы сбросить его с 32 метров без повреждений.

Opus 5.5 завершила за 3 минуты 37 секунд, перебрав 25 решений и потратив $0,47, а с 10 субагентами Haiku 5.5 это заняло всего 58 секунд, было опробовано 86 решений, и стоило $0,14.
Руководство пользователя Haiku 5.5
Haiku 5.5 уже доступна в клиенте Claude, Claude Code и на таких платформах, как AWS, Google Cloud, Microsoft Azure, Cursor, OpenRouter и других. Идентификатор модели — claude-haiku-5-5, контекст — 1 миллион токенов, максимальный вывод — 128 000 токенов за запрос.

Это первая Haiku с настраиваемым уровнем размышлений — пять уровней от Low до Max, а API по умолчанию использует Medium.
В SDK для Python и TypeScript также добавлены операции с компьютером и браузером, сейчас они находятся в статусе Beta.
При миграции с Haiku 4.5 количество токенов для того же текста увеличится примерно на 30%, и потребуется пересчитать max_tokens и оценку затрат.
budgettokens заменены адаптивным мышлением и уровнями Effort, а temperature, topp и top_k необходимо удалить; предзаполненные ответы больше не поддерживаются, а требования к формату изменены на структурированный вывод.
Для операций с компьютером необходимо переключиться на новый набор инструментов computertoolset20260801, а Priority Tier пока не поддерживается.
Если это кажется хлопотным, можно выполнить команду в Claude Code:
Пусть это изменит себя само.
Конечно, не разработчики теперь могут напрямую общаться с Haiku 5.5 в клиенте!

Для простых вопросов не нужно беспокоить Fable, Opus или Sonnet. Haiku 5.5 может давать точные ответы даже при низкой интенсивности рассуждений, отлично заменяя поисковые системы.

Идите и попробуйте!
Ссылки:
https://www.anthropic.com/claude-haiku-5-5
Данный контент предназначен исключительно для информационных и образовательных целей и не является инвестиционным советом, связанным с BTCC. BTCC прилагает все усилия, но не может гарантировать правдивость, точность или оригинальность вышеприведенного контента.