09.10.2026

Anthropic выпустила Claude Haiku 5.5: маленькая модель с контекстом 1M, адаптивным мышлением и ценой $0,10 за млн входных токенов

Anthropic выпустила Claude Haiku 5.5: маленькая модель с контекстом 1M, адаптивным мышлением и ценой $0,10 за млн входных токенов

Haiku 5.5 — первая модель класса Haiku с настраиваемой настройкой усилий («effort»). Адаптивное мышление включено по умолчанию, а параметр усилий по умолчанию установлен на среднее значение. Модель доступна для развёртывания как размещённый API и общедоступна на Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry и Claude Platform on AWS.

Она принимает текст и изображения, выводит текст и имеет дату обрезки знаний в июне 2026 года. Пакетные задания поддерживают до 300 000 выходных токенов в бета-версии.

Важно отметить две ключевые вещи: нестандартные значения температуры, top_p или top_k возвращают ошибку 400. Новый токенизатор также считает один и тот же текст примерно на 30% больше токенов, чем Haiku 4.5. Руководство по миграции охватывает оба момента.

Цена: структура из двух уровней

Цены разделяются на отметке 100K входных токенов. До 100K вход стоит $0,10, а вывод — $0,50 за миллион. Чтение из кэша стоит $0,01, а запись в 5-минутный кэш — $0,125. Выше 100K ставки растут: $0,50 за вход и $2,50 за вывод.

Haiku 4.5 стоила $1 за вход и $5 за вывод. Anthropic говорит, что около 90% запросов Haiku 4.5 оставались в пределах 100K токенов. С учётом токенизатора она оценивает, что Haiku 5.5 в среднем примерно на 75% дешевле. Пакетная обработка снимает ещё 50%.

GPT-6 Luna указывает идентичные цены на короткий контекст. Её более высокий уровень начинается только выше 272K входных токенов — $0,20 и $0,75. Для промпта на 150K токенов Luna дешевле по прайс-листу.

Бенчмарки

Все цифры ниже сообщены Anthropic: OSWorld 2.1 (офлайн-подмножество): 72,4% против 48,9% у GPT-6 Luna и 15,7% у Haiku 4.5. Terminal-Bench 4.0: 39,2% против 16,4% у Luna и 0,0% у Haiku 4.5. FrontierCode 1.1 (Main): 46,4% против 42,4% у Luna. Humanity’s Last Exam: 45,9% без инструментов и 57,4% с инструментами. GDPval-AA v2.1: 1620 против 1437 у Luna и 735 у Haiku 4.5.

Sonnet 5.5 по-прежнему лидирует в каждой строке, включая 70,6% на Terminal-Bench 4.0. Anthropic сама рекомендует Sonnet 5.5 и Opus 5.5 для сложного агентного программирования.

Лучшие сценарии использования

Три нагрузки подходят Haiku 5.5 лучше всего. Первая — работа субагента под Opus 5.5 или Sonnet 5.5: в Rogo субагент Haiku 5.5 извлекает строку дохода из 10-K, пока более крупная модель собирает презентацию. Вторая — высокообъёмный ответ на вопросы и саммаризация документов: AlphaSense тестировала его на функции с примерно 8 млн вызовов в неделю. Третья — чувствительная к скорости работа, такая как живая поддержка клиентов и использование браузера.

Ключевые выводы

  • $0,10 за вход и $0,50 за вывод на 1 млн токенов для промптов до 100K токенов.
  • Контекст 1M, вывод 128K, адаптивное мышление с настройкой усилий (по умолчанию среднее).
  • 72,4% на OSWorld 2.1 против 15,7% у Haiku 4.5 (сообщено Anthropic).
  • Та же цена короткого контекста, что и у GPT-6 Luna; Luna дешевле выше 100K токенов.
  • Позиционирована как субагент под Opus 5.5 и Sonnet 5.5, а не лидер программирования.

Подписывайтесь на наш канал Дзен и группу ВК

MarkTechPost

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *