Первое декабря, оптовая компания в Караганде. Бот в WhatsApp с утра вежливо отвечает клиентам, но в CRM за полдня не появилось ни одной новой заявки. Менеджеры замечают это к обеду. В логах интеграции – сотни одинаковых ошибок 400. Разработчик за неделю до этого заменил в настройках Claude Sonnet 4.5 на новую модель, как просила рассылка об отключении, и проверил, что бот «отвечает». Проверить, что он ещё и заполняет карточку сделки, никто не догадался.
Сценарий выдуманный. Повод – нет. Anthropic отключает Claude Sonnet 4.5, и отключение Claude Sonnet 4.5 отличается от недавних историй с моделями OpenAI одной неприятной деталью: часть привычных настроек на замене не просто работает иначе, а возвращает ошибку. Запрос падает, ответа нет.
Откуда повод
30 сентября 2026 года Anthropic уведомила разработчиков об отключении claude-sonnet-4-5-20250929. Дата – 30 ноября 2026 года, рекомендованная замена – claude-sonnet-5-5, вышедшая 28 сентября. Дата действует для Claude API, Claude Platform on AWS и Microsoft Foundry. У Amazon Bedrock и Google Cloud свой график.
Главное за минуту
Восемь недель
От уведомления до отключения – 61 день. На 5 октября осталось ровно восемь недель.
Ломается, а не дорожает
Шесть настроек, обычных для ботов на Sonnet 4.5, на Sonnet 5.5 дают ошибку 400.
Токен дешевле на треть
$2 против $3 за 1 млн входных токенов, $10 против $15 за выходные. Но тот же текст занимает примерно на 30% больше токенов.
Рассуждения включены
Sonnet 4.5 без указаний отвечал сразу. Sonnet 5.5 по умолчанию сначала думает, и эти токены оплачиваются как выходные.
Что сломается при переходе с Claude Sonnet 4.5: шесть настроек с ошибкой 400
Каждая из этих настроек когда-то появилась в коде бота по понятной причине. Кто-то хотел стабильных ответов, кто-то – гарантированного JSON для CRM. На Sonnet 4.5 всё это работало. Таблица собрана по руководству Anthropic по переходу на Sonnet 5.5.
| Что стоит в коде | Зачем ставили | Что делать на Sonnet 5.5 |
|---|---|---|
temperature, top_p, top_k с любым значением, кроме стандартного |
Чтобы бот отвечал ровнее, без фантазий | Удалить. Тон и строгость задаются в инструкции |
Предзаполненный ответ ассистента (prefill), например { |
Чтобы модель сразу начала с JSON без вступления | Структурированный ответ через output_config.format, а для классификации – инструмент с перечнем допустимых значений |
tool_choice с типом any или tool |
Чтобы модель всегда вызывала функцию «создать заявку» или «разобрать поля» | tool_choice: auto, у инструмента strict: true, а в инструкции – когда его вызывать |
thinking с budget_tokens |
Чтобы ограничить объём рассуждений | Убрать бюджет и задать уровень effort |
thinking: disabled |
Чтобы модель не рассуждала | thinking: between_tools – это минимальный режим |
output_format без бета-заголовка |
Структурированный ответ в старом формате | Перенести в output_config.format |
Самая коварная строка – третья. Принудительный вызов инструмента – стандартный способ заставить модель разобрать сообщение клиента в поля CRM: имя, телефон, город, товар. На Sonnet 5.5 модель с auto вправе ответить текстом и ничего не вызвать. Поэтому в инструкции нужно прямо написать, в каких случаях вызывать инструмент, а в коде – обработать ответ без вызова, а не молча его потерять. Ещё одна деталь из того же руководства: экранирование в аргументах инструментов может отличаться, так что разбирайте их стандартным JSON-парсером, а не регулярными выражениями.
Если бот работает через Amazon Bedrock, учтите: структурированные ответы, включая strict у инструментов, там для Sonnet 5.5 недоступны. Замену для prefill и принудительного вызова придётся строить на инструкции и проверке ответа в своём коде.
Что не упадёт, но поведёт себя иначе
Вторая группа изменений неприятнее первой: ошибок нет, а результат другой. Бот вроде бы работает, просто чуть медленнее, чуть дороже и чуть страннее.
Рассуждения по умолчанию
Запрос без поля thinking на Sonnet 5.5 идёт с адаптивными рассуждениями, уровень effort по умолчанию – high. Следствий три. Ответ может начинаться с блока рассуждений, и код, который берёт текст из первого элемента ответа, сломается – читать блоки нужно по типу. max_tokens теперь покрывает и рассуждения, и текст: старый лимит может обрезать ответ клиенту. И время ответа растёт.
Для чата с клиентами Anthropic сама советует начинать с medium или low. Если боту рассуждать не нужно вовсе – классификация, разбор полей, короткие ответы по базе знаний, – ставьте between_tools: модель не думает перед ответом.
Цепочки с инструментами
Бот, который сам проверяет остатки, создаёт сделку или ищет заказ в 1С, работает циклом: запрос, вызов инструмента, результат, следующий запрос. Блоки рассуждений в таком цикле нужно возвращать модели без изменений. Для аккаунтов, созданных с 31 августа 2026 года, API по умолчанию проверяет, что ранняя история диалога не редактировалась, и отвечает ошибкой, если её подправили. Если ваш код задним числом вставляет в диалог данные из CRM или обрезает старые сообщения, это место нужно переделать.
Заодно меняется то, что видит оператор. Пояснения длиннее пары предложений, которые модель пишет между вызовами инструментов, теперь приходят как блоки рассуждений и по умолчанию пустые. Если ваш интерфейс показывал их сотруднику, он замолчит.
Отказы и картинки
У Sonnet 5.5 расширен список категорий отказов, и Anthropic прямо пишет, что безобидный запрос тоже может попасть под категорию общих рисков. Ответ с stop_reason: refusal бот должен передавать менеджеру, а не отправлять клиенту пустоту. И если бот читает фото накладных, чеков или документов: изображение 2000×1500 пикселей на Sonnet 5.5 стоит примерно в 2,5 раза больше токенов, чем на Sonnet 4.5.
Сколько это стоит на практике
Прайс выглядит как подарок: Sonnet 5.5 на треть дешевле за токен. Но новая модель использует другой токенизатор, и тот же текст, по данным Anthropic, даёт около 30% больше токенов. Насколько больше для русского и казахского текста – меряйте на своих запросах через подсчёт токенов в API.
Допустим, бот интернет-магазина даёт 20 000 ответов в месяц. На Sonnet 4.5 каждый ответ – 3000 входных токенов (инструкция, база знаний, история диалога) и 200 выходных. Курс – 447,73 тенге за доллар, официальный курс Нацбанка на 5 октября. Кэширование для простоты не учитываем, объём рассуждений в третьей строке условный.
| Вариант | В месяц |
|---|---|
| Sonnet 4.5, без рассуждений | около $240, примерно 107 500 тенге |
Sonnet 5.5, between_tools, токенов на 30% больше |
около $208, примерно 93 100 тенге |
| Sonnet 5.5 по умолчанию, если на рассуждения уходит 500 токенов | около $308, примерно 137 900 тенге |
Аккуратный переход даёт небольшую экономию. Переход «одной строкой», если он вообще заработает, поднимет счёт почти на треть. Есть и приятная новость: минимальный размер кэшируемой части запроса снизился с 1024 до 512 токенов, так что кэшировать теперь можно и короткую инструкцию бота. Остальные способы срезать счёт собраны в статье «Как снижать стоимость AI-бота: токены, кэш, model routing, fallback и лимиты».
Найдём в вашей интеграции всё, что упадёт 30 ноября
Посмотрим код или настройки бота и составим список правок под Sonnet 5.5 с оценкой нового счёта.
Как проверить бота до переключения
Ошибки 400 найдутся при первом же тестовом запросе. С поведением сложнее: его видно только на реальных обращениях. Нужен контрольный набор – 100–200 сообщений клиентов с известными правильными ответами. Как его собрать и что считать, описано в материале «Оценка качества AI-бота: golden set, метрики, A/B-тест и регресс в CI/CD». Для этого перехода мы бы смотрели на шесть вещей:
- заполнение полей CRM – по каждому полю отдельно, особенно там, где раньше стоял принудительный вызов инструмента;
- долю ответов, где модель должна была вызвать инструмент, а ответила текстом;
- длину ответов и число токенов на запрос – по ним считается счёт;
- время ответа при выбранном уровне
effort; - число отказов на обычных клиентских вопросах;
- ответы на казахском и смешанном языке, если такие клиенты у вас есть.
Разработчикам пригодится готовый навык миграции от Anthropic в Claude Code, он работает и для перехода на Sonnet 5.5: меняет название модели, убирает настройки с ошибкой и выдаёт список того, что проверить руками. Сам контрольный прогон он не заменяет.
Чего не ждать
- Что дата 30 ноября одинакова везде. Если Claude подключён через Amazon Bedrock или Google Cloud, сверяйте график у них.
- Что Haiku 4.5 в безопасности надолго. Она пока в статусе Active, но в таблице Anthropic у неё стоит «не раньше 15 октября 2026 года», а предупреждают минимум за 60 дней.
- Что новая модель решит вопрос с местом обработки данных. На Claude API у Sonnet 5.5 на выбор глобальная обработка или обработка только в США с наценкой 10%, казахстанского региона нет. Что из этого следует для согласий клиентов, мы разбирали в статье «Новые правила сбора персональных данных: лиды, маскирование, ИИ».
- Что наши цифры совпадут с вашими. Токены и рассуждения меряются только на ваших логах.
План на восемь недель
Времени меньше, чем у OpenAI с её полугодом, поэтому запаса почти нет. Мы бы раскладывали так:
- До 12 октября: найти все места, где вызывается
claude-sonnet-4-5, включая конструкторы, модули подрядчиков и ночные скрипты. Выгрузка использования по ключам и моделям есть в консоли Anthropic. - До 26 октября: убрать шесть настроек с ошибкой 400, переписать чтение ответа по типам блоков, выставить
effortилиbetween_tools. - До 9 ноября: прогнать контрольный набор на Sonnet 5.5, сравнить поля, время, токены и отказы со старой моделью.
- До 20 ноября: переключить бота, неделю следить за заявками в CRM и логами ошибок.
- Последние десять дней оставить запасом на исправления.
Если бот принимает заявки, переключайте его в будний день утром, когда менеджеры на месте и пропавшие лиды заметят за час, а не к вечеру.
Связанные материалы
Переведём бота на Sonnet 5.5 до 30 ноября
Пришлите выгрузку из 200 обезличенных обращений и доступ к настройкам интеграции – за неделю найдём всё, что упадёт, сравним модели на ваших сценариях и назначим дату переключения.