Вышла llm-anthropic 0.26 — надстройка, через которую программы обращаются к моделям Anthropic. Сам по себе релиз технический, но в нём видно, что изменилось в Claude 5: моделей стало три вместо одной, у них появился доступ к внешним инструментам, а «глубину размышления» теперь можно регулировать. Разбираем, что из этого меняет качество ответов, которые вы получаете.
Три модели вместо одной
Anthropic разделила Claude 5 на Fable-5, Sonnet-5 и Opus-5. Отличаются они не «умом вообще», а тем, как подходят к задаче.
Fable-5 всегда рассуждает перед ответом. Sonnet-5 и Opus-5 позволяют фазу размышления отключить, если нужна скорость.
Отсюда практический выбор. Рассуждение стоит времени и денег, но окупается там, где ошибка дорога: разбор договора, расчёт, сложное объяснение. На вопросах вроде «переформулируй абзац» оно только замедляет. Раньше это решала за вас одна модель, теперь решаете вы — и в этом смысл разделения.
Модель, которая ходит наружу
В релизе появилась поддержка серверных инструментов: WebSearch — поиск в интернете, WebFetch — получение содержимого конкретной страницы, CodeExecution — запуск кода, AnthropicMCP — подключение внешних сервисов по протоколу.
Каждый из них закрывает известную слабость. Модель без поиска знает мир на момент обучения и про свежее говорит наугад. Модель без запуска кода считает по памяти, а значит, ошибается в арифметике. С инструментами она перестаёт угадывать и начинает проверять.
Для вас это выражается в одном практическом признаке: ассистент, который умеет искать, отвечает на вопросы о недавних событиях, а тот, который не умеет, уверенно выдумывает. Про модели с похожей адресацией инструментов мы писали в разборе Ling-3.0-flash.
Размышление стало настройкой
Третье изменение — управление «глубиной размышления» через понятные уровни: низкий, средний, высокий. По умолчанию Claude 5 думает перед ответом, но для части моделей это отключается.
Заодно рассуждения отделили от ответа: их можно показывать, а можно прятать, чтобы не загромождать переписку.
Полезны обе возможности. Видимые рассуждения — способ поймать ошибку: неверный вывод выглядит убедительно, а вот подмена условия в середине рассуждения заметна. Скрытые — обычный режим для повседневных задач, где важен только результат.
Что это значит, если вы пользуетесь чатом
Настраивать ничего не нужно — эти изменения приходят в приложения сами, вместе с обновлениями. Но пользоваться ими стоит осознанно:
- задавая вопрос про недавние события, проверьте, ищет ли ассистент в интернете, — иначе ответ будет из памяти;
- для важных задач включайте режим с рассуждением и просматривайте ход мысли, а не только вывод;
- для мелких задач отключайте — быстрее и дешевле.
Что это значит, если вы собираете своего агента
Здесь появляется реальный выбор архитектуры: какой моделью закрыть массовые запросы, какой — сложные, где включить размышление, а где отключить ради скорости. Раньше настройка сводилась к одной модели, теперь это осмысленное распределение задач.
Начните с малого: разделите свои запросы на «важно и сложно» и «быстро и рутинно», а дальше подберите режим под каждую группу. Как подключить это к агенту, разобрано в полном гиде по OpenClaw, свежие изменения — в разделе новостей и материале про OpenClaw 2026.7.2. Отдельно стоит помнить: чем больше внешних инструментов у агента, тем внимательнее нужно смотреть на данные, к которым он получает доступ — про это материал об изоляции личных чатов.
Источник: llm-anthropic 0.26, Simon Willison, 4 августа 2026.
Что ещё вышло в этой волне релизов: Grok 4.6 и снижение цен на GPT-5.6.