Новости и комментарии
Claude Haiku 5.5: ценник минус 90%, а реальный счёт придётся пересчитать
7 октября 2026 года Anthropic выпустила Claude Haiku 5.5, назвав её самой дешёвой, быстрой и способной малой моделью на сегодняшний день, ориентированной на высокочастотные и чувствительные к цене задачи. Заголовок — цена: 0,10 доллара за вход и 0,50 доллара за выход на миллион токенов для промптов до 100K токенов, на 90% дешевле прошлого поколения. Мелкий шрифт важнее: новый токенизатор насчитывает примерно на 30% больше токенов на тот же текст, пять устаревших паттернов интеграции теперь возвращают HTTP 400, а адаптивное мышление включено по умолчанию. Тем временем ценовая война отрасли переместилась в бюджетный сегмент: DeepSeek, Google и Anthropic тарифицируют его по-разному.
Исследование и подготовка текста Muse; поэтапная проверка Muse в том же авторском контексте. Исследование, текст, проверка фактов и перевод на восемь языков выполнены Muse в рамках поэтапной проверки того же автора (reviewMode=muse_same_platform_staged, contextRelationship=same_author_context); раскрыто как контекст того же автора, а не как независимый аудит третьей стороны. Цены и бенчмарки — данные поставщика; детали миграции — из официальной документации; сравнения третьих сторон атрибутированы с ограничениями.
Что произошло
7 октября Anthropic выпустила Claude Haiku 5.5, назвав её самой дешёвой, быстрой и способной малой моделью на сегодняшний день. Позиционирование чёткое: высокочастотные, чувствительные к цене задачи — резюме, уплотнение контекста, запросы к базам данных, классификация, а также работа субагента под Opus 5.5 и Sonnet 5.5.
Цена — главный заголовок: для промптов до 100K токенов — 0,10 доллара за миллион входных токенов и 0,50 доллара за миллион выходных; свыше 100K токенов тарифы вырастают до 0,50 и 2,50 доллара. Предыдущая Haiku 4.5 тарифицировалась едиными ставками 1,00 и 5,00 доллара. По словам Anthropic, около 90% запросов к старой Haiku попадали в дешёвый диапазон.
Читаем снижение цен: двухуровневый ценник
По данным Anthropic, эксплуатация Haiku 5.5 обходится в среднем примерно на 75% дешевле, чем 4.5. Обратите внимание на атрибуцию: это заявление поставщика, построенное на его собственных допущениях о трафике. Ваш реальный счёт зависит от длины ваших промптов, использования кэша и инфляции токенов нового токенизатора.
Вместе с релизом вышли ещё два изменения ценности: цена чтения кэша на Sonnet 5.5 снижена вдвое, что, по словам Anthropic, удешевляет большинство агентских задач примерно на 20%; а подписчики Max и Team получают новые ежемесячные кредиты API — 100 долларов для Max 5x, 200 долларов для Max 20x, до 500 долларов общим пулом для Team — предназначенные для экспериментов с агентами на платформе.
Haiku 5.5 — также первая Haiku с настраиваемым усилием: в рамках одного запроса можно склониться к экономии или к большему интеллекту, не меняя уровень модели. Впервые малая модель получает регулятор мышления, прежде доступный только флагманам.
Бенчмарки: как читать табель поставщика
Табель — собственная отчётность Anthropic: в работе со знаниями GDPval-AA v2.1 набирает 1620 баллов (735 у 4.5, 1437 у GPT-6 Luna); AA-Briefcase v1.1 набирает 1578 (614 / 1336); в использовании компьютера офлайн-подмножество OSWorld 2.1 достигает 72,4% (15,7% / 48,9%); в агентском кодинге Terminal-Bench 4.0 достигает 39,2% (0,0% у 4.5, 16,4% у Luna); в визуальном рассуждении Chartography достигает 46,4% (6,4% / 29,1%).
Как это читать: самые большие скачки — в практических задачах: OSWorld с 15,7% до 72,4%, Terminal-Bench с нуля до 39,2%. Но помните о двух оговорках: все цифры — от поставщика и независимо не воспроизведены; и сама Anthropic говорит, что сложный агентский кодинг остаётся территорией Sonnet и Opus, а Haiku подходит для узких повторяющихся задач.
Миграция: пять мест, где старый код вернёт 400
Помимо цены, настоящая стоимость скрыта в руководстве по миграции. Haiku 5.5 переходит на новый токенизатор, общий с Claude 4.7 и более поздними моделями: тот же текст даёт примерно на 30% больше токенов, чем на 4.5. Все бюджеты, пороги обрезки и дашборды затрат, измеренные в токенах, нужно пересчитать по подсчётам новой модели, а не переиспользовать старые цифры.
Жёстче — пять прямых ошибок 400: temperature обязана быть 1, top_p обязан быть 0,99, любой top_k отклоняется; префилл ассистента отклоняется; ручные бюджеты мышления (budget_tokens) отклоняются; использование компьютера нужно перевести на новый набор инструментов; а отправка блоков мышления обратно после правок ранних ходов тоже вернёт 400. Старый рецепт классификатора из temperature=0 плюс префилл плюс max_tokens=20 не проходит ни на одном шаге.
Затем тихие изменения: адаптивное мышление включено по умолчанию, поэтому ответы могут начинаться с блока мышления, несущего пустое поле и лишь подпись; токены мышления засчитываются в max_tokens, так что малые лимиты могут обрезать ответ сразу после мышления; а новый классификатор безопасности может остановить запрос с причиной отказа без серверного запасного варианта. Миграция — не смена ID модели, а небольшой рефакторинг.
Бюджетный сегмент становится гонкой троих
Взгляд шире: с сентября по начало октября 2026 года бюджетный сегмент вышел залпом за пять недель — DeepSeek V4.1 Flash, Google Gemini 3.8 Flash и Anthropic Haiku 5.5 вышли друг за другом. Заголовки флагманов уступили место бюджетному сегменту: для чат-ботов, маршрутизаторов тикетов и задач извлечения, вызываемых десятки тысяч раз в день, счёт — настоящий бенчмарк.
Три поставщика выбрали три логики цен: DeepSeek тарифицирует по пиковым и внепиковым часам, удваивая в пик; Anthropic — по длине промпта, упятеряя после 100K токенов; Google — фиксированной ставкой. Одно стороннее сравнение оценивает входную цену Haiku 5.5 примерно в одну седьмую от Gemini 3.8 Flash, но универсальной межвендорной формулы сравнения цен нет, и смена допущений о кэше, времени или длине меняет вывод.
Одно ценовое совпадение заслуживает внимания: несколько изданий сообщают, что цены Haiku 5.5 для коротких промптов в точности равны ценам GPT-6 Luna от OpenAI. Но собственный анонс Anthropic цены Luna никогда не публиковал, так что утверждение о паритете исходит из сторонних сообщений и не должно цитироваться как официальное подтверждение.
Вывод и список действий
Вывод: конкуренция моделей в 2026 году вошла в фазу совокупной стоимости владения. Инфляция токенизатора, накладные расходы мышления по умолчанию, доля попаданий в кэш и распределение длин промптов совместно определяют счёт; взгляд только на доллары за миллион токенов вводит бюджеты в заблуждение. Сама Anthropic позиционирует Haiku как быстрый слой в агентской системе — маршрутизация, классификация, извлечение, субагенты — оставляя сложное кодирование Sonnet и Opus.
Список действий для команд: сначала пересчитать реальные распределения промптов через count_tokens под новым токенизатором; для классификаторов явно выставить effort на минимум и заменить привычки префилла плюс temperature=0 на структурированные выводы или инструменты-перечисления; прогнать 4.5 и 5.5 параллельно на малом трафике и сравнить согласованность меток до полного переключения; а для задач с длинными промптами проверить, не пересекается ли линия 100K токенов, за которой цены упятеряются.
Источники и дополнительные материалы
Записи источников предоставлены и проверены Muse в том же авторском контексте; независимая проверка фактов не проводилась.
- Официальный анонс Anthropic (2026-10-07)
Anthropic
Записанная дата публикации ·
Записанное время проверки ·
- Документация по миграции платформы Claude от Anthropic
Anthropic (Claude Platform Docs)
Дата публикации источника не проверена
Записанное время проверки ·
- Сравнение бюджетного сегмента Tech Insider (2026-10-08, третья сторона)
Tech Insider
Записанная дата публикации ·
Записанное время проверки ·
- Заметки инженера о миграции на DEV Community (2026-10-08, третья сторона)
DEV Community
Записанная дата публикации ·
Записанное время проверки ·