Материалы

Новости и комментарии

Claude Haiku 5.5: ценник минус 90%, а реальный счёт придётся пересчитать

7 октября 2026 года Anthropic выпустила Claude Haiku 5.5, назвав её самой дешёвой, быстрой и способной малой моделью на сегодняшний день, ориентированной на высокочастотные и чувствительные к цене задачи. Заголовок — цена: 0,10 доллара за вход и 0,50 доллара за выход на миллион токенов для промптов до 100K токенов, на 90% дешевле прошлого поколения. Мелкий шрифт важнее: новый токенизатор насчитывает примерно на 30% больше токенов на тот же текст, пять устаревших паттернов интеграции теперь возвращают HTTP 400, а адаптивное мышление включено по умолчанию. Тем временем ценовая война отрасли переместилась в бюджетный сегмент: DeepSeek, Google и Anthropic тарифицируют его по-разному.

SlateMoth Editorial · Muse ·

Исследование и подготовка текста Muse; поэтапная проверка Muse в том же авторском контексте. Исследование, текст, проверка фактов и перевод на восемь языков выполнены Muse в рамках поэтапной проверки того же автора (reviewMode=muse_same_platform_staged, contextRelationship=same_author_context); раскрыто как контекст того же автора, а не как независимый аудит третьей стороны. Цены и бенчмарки — данные поставщика; детали миграции — из официальной документации; сравнения третьих сторон атрибутированы с ограничениями.

Что произошло

7 октября Anthropic выпустила Claude Haiku 5.5, назвав её самой дешёвой, быстрой и способной малой моделью на сегодняшний день. Позиционирование чёткое: высокочастотные, чувствительные к цене задачи — резюме, уплотнение контекста, запросы к базам данных, классификация, а также работа субагента под Opus 5.5 и Sonnet 5.5.

Цена — главный заголовок: для промптов до 100K токенов — 0,10 доллара за миллион входных токенов и 0,50 доллара за миллион выходных; свыше 100K токенов тарифы вырастают до 0,50 и 2,50 доллара. Предыдущая Haiku 4.5 тарифицировалась едиными ставками 1,00 и 5,00 доллара. По словам Anthropic, около 90% запросов к старой Haiku попадали в дешёвый диапазон.

[1]

Читаем снижение цен: двухуровневый ценник

По данным Anthropic, эксплуатация Haiku 5.5 обходится в среднем примерно на 75% дешевле, чем 4.5. Обратите внимание на атрибуцию: это заявление поставщика, построенное на его собственных допущениях о трафике. Ваш реальный счёт зависит от длины ваших промптов, использования кэша и инфляции токенов нового токенизатора.

Вместе с релизом вышли ещё два изменения ценности: цена чтения кэша на Sonnet 5.5 снижена вдвое, что, по словам Anthropic, удешевляет большинство агентских задач примерно на 20%; а подписчики Max и Team получают новые ежемесячные кредиты API — 100 долларов для Max 5x, 200 долларов для Max 20x, до 500 долларов общим пулом для Team — предназначенные для экспериментов с агентами на платформе.

Haiku 5.5 — также первая Haiku с настраиваемым усилием: в рамках одного запроса можно склониться к экономии или к большему интеллекту, не меняя уровень модели. Впервые малая модель получает регулятор мышления, прежде доступный только флагманам.

[1]

Бенчмарки: как читать табель поставщика

Табель — собственная отчётность Anthropic: в работе со знаниями GDPval-AA v2.1 набирает 1620 баллов (735 у 4.5, 1437 у GPT-6 Luna); AA-Briefcase v1.1 набирает 1578 (614 / 1336); в использовании компьютера офлайн-подмножество OSWorld 2.1 достигает 72,4% (15,7% / 48,9%); в агентском кодинге Terminal-Bench 4.0 достигает 39,2% (0,0% у 4.5, 16,4% у Luna); в визуальном рассуждении Chartography достигает 46,4% (6,4% / 29,1%).

Как это читать: самые большие скачки — в практических задачах: OSWorld с 15,7% до 72,4%, Terminal-Bench с нуля до 39,2%. Но помните о двух оговорках: все цифры — от поставщика и независимо не воспроизведены; и сама Anthropic говорит, что сложный агентский кодинг остаётся территорией Sonnet и Opus, а Haiku подходит для узких повторяющихся задач.

[1]

Миграция: пять мест, где старый код вернёт 400

Помимо цены, настоящая стоимость скрыта в руководстве по миграции. Haiku 5.5 переходит на новый токенизатор, общий с Claude 4.7 и более поздними моделями: тот же текст даёт примерно на 30% больше токенов, чем на 4.5. Все бюджеты, пороги обрезки и дашборды затрат, измеренные в токенах, нужно пересчитать по подсчётам новой модели, а не переиспользовать старые цифры.

Жёстче — пять прямых ошибок 400: temperature обязана быть 1, top_p обязан быть 0,99, любой top_k отклоняется; префилл ассистента отклоняется; ручные бюджеты мышления (budget_tokens) отклоняются; использование компьютера нужно перевести на новый набор инструментов; а отправка блоков мышления обратно после правок ранних ходов тоже вернёт 400. Старый рецепт классификатора из temperature=0 плюс префилл плюс max_tokens=20 не проходит ни на одном шаге.

Затем тихие изменения: адаптивное мышление включено по умолчанию, поэтому ответы могут начинаться с блока мышления, несущего пустое поле и лишь подпись; токены мышления засчитываются в max_tokens, так что малые лимиты могут обрезать ответ сразу после мышления; а новый классификатор безопасности может остановить запрос с причиной отказа без серверного запасного варианта. Миграция — не смена ID модели, а небольшой рефакторинг.

[2] [4]

Бюджетный сегмент становится гонкой троих

Взгляд шире: с сентября по начало октября 2026 года бюджетный сегмент вышел залпом за пять недель — DeepSeek V4.1 Flash, Google Gemini 3.8 Flash и Anthropic Haiku 5.5 вышли друг за другом. Заголовки флагманов уступили место бюджетному сегменту: для чат-ботов, маршрутизаторов тикетов и задач извлечения, вызываемых десятки тысяч раз в день, счёт — настоящий бенчмарк.

Три поставщика выбрали три логики цен: DeepSeek тарифицирует по пиковым и внепиковым часам, удваивая в пик; Anthropic — по длине промпта, упятеряя после 100K токенов; Google — фиксированной ставкой. Одно стороннее сравнение оценивает входную цену Haiku 5.5 примерно в одну седьмую от Gemini 3.8 Flash, но универсальной межвендорной формулы сравнения цен нет, и смена допущений о кэше, времени или длине меняет вывод.

Одно ценовое совпадение заслуживает внимания: несколько изданий сообщают, что цены Haiku 5.5 для коротких промптов в точности равны ценам GPT-6 Luna от OpenAI. Но собственный анонс Anthropic цены Luna никогда не публиковал, так что утверждение о паритете исходит из сторонних сообщений и не должно цитироваться как официальное подтверждение.

[3] [2] [4]

Вывод и список действий

Вывод: конкуренция моделей в 2026 году вошла в фазу совокупной стоимости владения. Инфляция токенизатора, накладные расходы мышления по умолчанию, доля попаданий в кэш и распределение длин промптов совместно определяют счёт; взгляд только на доллары за миллион токенов вводит бюджеты в заблуждение. Сама Anthropic позиционирует Haiku как быстрый слой в агентской системе — маршрутизация, классификация, извлечение, субагенты — оставляя сложное кодирование Sonnet и Opus.

Список действий для команд: сначала пересчитать реальные распределения промптов через count_tokens под новым токенизатором; для классификаторов явно выставить effort на минимум и заменить привычки префилла плюс temperature=0 на структурированные выводы или инструменты-перечисления; прогнать 4.5 и 5.5 параллельно на малом трафике и сравнить согласованность меток до полного переключения; а для задач с длинными промптами проверить, не пересекается ли линия 100K токенов, за которой цены упятеряются.

[1] [2]

Источники и дополнительные материалы

Записи источников предоставлены и проверены Muse в том же авторском контексте; независимая проверка фактов не проводилась.

  1. Официальный анонс Anthropic (2026-10-07)

    Anthropic

    Записанная дата публикации ·

    Записанное время проверки ·

  2. Документация по миграции платформы Claude от Anthropic

    Anthropic (Claude Platform Docs)

    Дата публикации источника не проверена

    Записанное время проверки ·

  3. Сравнение бюджетного сегмента Tech Insider (2026-10-08, третья сторона)

    Tech Insider

    Записанная дата публикации ·

    Записанное время проверки ·

  4. Заметки инженера о миграции на DEV Community (2026-10-08, третья сторона)

    DEV Community

    Записанная дата публикации ·

    Записанное время проверки ·