reymer.ai
Новости
/
Данные
/
Инструменты
/
Знания
reymer.ai

Медиапортал об автономном бизнесе, AI-трансформации и автономизации.

hello@reymer.ai

Новости

  • Все новости
  • AI-дайджесты

Инструменты

  • Каталог
  • Коллекции
  • Сравнения
  • Промпты
  • Поиск для агентов

Данные

  • AI-рынки
  • Value Chain
  • Цены API
  • Калькулятор
  • AI Intelligence: инсайдеры и фонды

Знания

  • Вся база знаний
  • Карта профессий и AI
  • AI-агенты для бизнеса
  • AI для профессий
  • Gartner MQ анализы
  • Оценка автономизации
  • Глоссарий
  • Кейсы внедрения ИИ
  • FAQ

Справочники

  • Автономный бизнес
  • Claude Code Tips
  • Вайб-кодинг
  • MCP Protocol
  • AI-кодинг агенты
  • Agent Frameworks
  • Deep Thinking Prompts
  • Гид по AI-агентам
  • OpenClaw vs NanoClaw
  • Конституция Claude

Курсы

  • Все курсы
  • Основы AI
  • Промпт-инжиниринг
  • Claude 101
  • Claude Code
  • Claude Agent Skills
  • Perplexity Pro 101
  • OpenClaw 101
  • NanoClaw 101
  • PicoClaw 101

© 2026 reymer.ai · СТАТУС СИСТЕМЫ: РАБОТАЕТ

О проектеПолитика конфиденциальности
Главная/База знаний/Claude Fable 5.1
Anthropicclaude-fable-5-1

Claude Fable 5.1: что нового и как промптить

Русская адаптация официальной документации Anthropic. Сначала разбираем, что изменилось относительно Fable 5: три ломающих изменения, пять дополнений и новая цена на чтение кэша. Дальше - 16 готовых промптов на русском под каждое поведенческое отличие.

Время чтения: 20 минОбновлено: сентябрь 2026По материалам документации Anthropic

Содержание

01Что нового02Три ломающих изменения03Пять дополнений04Спецификации и цены05Отличия в поведении06Уровни effort07Обновления прогресса08Группировка вызовов инструментов09История только на дозапись10Плотность прозы11Оформление в чате12Цитирование источников13Доводить задачу до конца14Что сохранять при сжатии15Не расширять объём и тесты16Поиск на низком effort17Ложные срабатывания защит18Точечные правки файлов19Длинные ответы на xhigh и max20Субагенты21Зрение: кадрирование и увеличение22Чек-лист миграции

Что нового в Claude Fable 5.1

Claude Fable 5.1 продолжает Fable 5 по тем же ценам на вход и выход, но с чтением кэша вчетверо дешевле, и заметно сильнее в длительном агентном кодировании, многошаговых исследованиях и работе с документами, таблицами и презентациями. Claude Mythos 5.1 - та же модель с теми же возможностями, доступная только участникам программы Project Glasswing.

Важная оговорка от самой Anthropic: для большинства задач начинать рекомендуется с Claude Opus 5. Fable 5.1 берут под требовательные рассуждения и работу с длинным горизонтом либо тогда, когда собственные проверки качества на Opus 5 при высоком effort всё ещё не дотягивают.

Коротко: если вы уже вызываете Fable 5, три изменения ломающие - принудительный вызов инструментов возвращает ошибку, ранние модели не читают блоки размышлений 5.1, правка ранних ходов обнуляет блоки размышлений. Пять изменений добавляющие: effort на каждое сообщение, системные сообщения на один ход, читаемые обновления прогресса, более дешёвое чтение кэша и происхождение контента. Ваши промпты от Fable 5 при этом переписывать не нужно.

МодельID в Claude APIДоступность
Claude Fable 5.1claude-fable-5-1Всем клиентам, в Claude API и на партнёрских площадках
Claude Mythos 5.1claude-mythos-5-1Только участникам Project Glasswing

Три ломающих изменения

Эти три пункта надо проверить в коде до миграции. Всё остальное в 5.1 либо добавляется, либо настраивается промптом.

Принудительный вызов инструментов больше не работает

ошибка 400

tool_choice со значением {"type": "any"} или {"type": "tool", "name": "..."} возвращает 400 invalid_request_error. Значения auto (по умолчанию) и none не изменились, та же проверка действует и на подсчёте токенов. Причина: мышление у модели включено всегда, а принудительный вызов его бы пропустил - модель писала бы рассуждения прямо в аргументы инструмента, и качество аргументов падало бы. Чтобы получить валидный по схеме JSON, оставьте auto и включите strict: true или перенесите схему в структурированный вывод. Чтобы модель точно вызвала инструмент, просто скажите в промпте, когда он применяется: явные указания про инструменты Fable 5.1 выполняет надёжно.

Ранние модели не читают блоки размышлений 5.1

односторонняя совместимость

Каждый блок размышлений помнит, какая модель его создала, и переносится только в одну сторону: Fable 5.1 читает блоки более ранних моделей, а ни одна ранняя модель не читает блоки 5.1. Разговор, переехавший на Fable 5.1 с Opus 5, Fable 5 или чего-то ещё более раннего, сохраняет рассуждения. Разговор, уехавший с 5.1 на любую из этих моделей, теряет их на тех ходах, которые идут там. Нечитаемый блок API выбрасывает до того, как модель его увидит; выброшенные блоки не попадают в input_tokens и не тарифицируются. С бета-заголовком thinking-binding-controls-2026-08-01 факт выброса виден в массиве input_transformations, без него он молчаливый.

Правка ранних ходов обнуляет блоки размышлений

история только на дозапись

Изменение чего угодно, что стоит перед блоком размышлений Fable 5.1 - системного промпта, списка инструментов или более раннего сообщения, - приводит к ошибке на следующем запросе. Проверка включена для аккаунтов, созданных 31 августа 2026 года и позже; для более старых аккаунтов API фиксирует расхождение, но реагирует только если запрос выставил prefix_mismatch_behavior. Mythos 5.1 эту проверку не делает. Claude Code, claude.ai, управляемые агенты Claude и Claude Agent SDK сохраняют префикс за вас; если ваш код сам собирает массив messages, проверять надо до миграции.

Что обнуляет блоки размышлений

  • Правка, перестановка или удаление раннего хода при сохранении поздних
  • Вставка в ранний ход текста, который на следующем запросе убирается (напоминание, строка статуса)
  • Пересборка системного промпта или списка инструментов между запросами одного разговора
  • Картинка или документ по ссылке, которая на следующем запросе отдаёт другие байты (проверка идёт по байтам, а не по ссылке, так что подписанная ссылка с ротацией на тот же файл - нормально)

Что безопасно

  • Удаление ведущей серии блоков размышлений, начиная с самых старых
  • Серверное сжатие и серверное редактирование контекста
  • Перемещение меток cache_control
  • Смена effort между запросами

Удаление блока размышлений откуда угодно, кроме начала серии, обнуляет все блоки после него.

Пять дополнений

Смена effort посреди разговора

бета

Уровень effort можно менять по ходу разговора, не сбрасывая кэш промпта: поднять на трудном шаге и опустить на рутинных. Бета-заголовок mid-conversation-output-config-2026-07-01. Поддерживают Fable 5.1, Mythos 5.1 и Opus 5.

Системные сообщения на один ход

бета

Сообщение с role: "system" и clear_at: "next_user_message" имеет авторитет системного промпта на текущем ходу, а после появления следующего сообщения пользователя перестаёт отображаться. Само сообщение остаётся в messages, вы шлёте его обратно дословно, ничего раньше в разговоре не меняется: кэш продолжает совпадать, блоки размышлений остаются действительными, а погашенное сообщение не стоит входных токенов. Бета-заголовок mid-conversation-system-clear-at-2026-08-21.

Читаемые обновления прогресса

бета

Короткие заметки между вызовами инструментов приходят отдельными блоками thinking. При значении display по умолчанию (omitted) они пустые, и длинный агентный ход выглядит для пользователя как тишина. Новое значение display: "updates" возвращает эти заметки текстом, оставляя сами рассуждения скрытыми. Бета-заголовок thinking-display-updates-2026-08-18. Значение summarized тоже их отдаёт, вперемешку с пересказанными рассуждениями.

Чтение кэша дешевле вчетверо

цены

Чтение кэша (попадания и обновления) стоит 0,025 от базовой ставки входа против 0,1 у остальных моделей Claude. Длинные агентные сессии, которые снова и снова перечитывают закэшированный префикс, платят четверть прежней цены. Запись кэша и минимальная длина кэшируемого промпта в 512 токенов не изменились. Побочный вывод: раннее сжатие контекста ради экономии может уже не быть правильным разменом, стоит попробовать сжимать позже.

Происхождение контента

водяные знаки

Текст, созданный Fable 5.1 и Mythos 5.1, несёт статистический водяной знак Anthropic на всех платформах, где доступна модель. Изображения и видео поддерживаемых форматов, которые Claude создаёт через инструмент исполнения кода, несут подписанные Content Credentials C2PA при получении через Files API. Водяной знак не меняет смысл, качество и читаемость, не добавляет токенов и скрытых символов, не содержит сведений о вас и не требует правок в запросах.

Спецификации и цены

Контекст и вывод

Окно контекста на миллион токенов (и по умолчанию, и максимум) по стандартной цене за токен на всём окне, до 128 тысяч токенов вывода.

Мышление

Адаптивное мышление включено всегда, глубина управляется параметром effort. Отключить его нельзя: и thinking с budget_tokens, и thinking disabled возвращают 400.

Токенизатор

Тот же, что у Fable 5 (появился с Opus 4.7). По сравнению с моделями старше Opus 4.7 один и тот же текст даёт примерно на 30 процентов больше токенов - это надо учитывать в расчёте бюджета.

Отказы и запасные модели

Отклонённый запрос возвращает HTTP 200 со stop_reason refusal и объектом stop_details, где названа сработавшая область политики. Разрешённые запасные модели для Fable 5.1 - Opus 4.8 и Opus 5. Отказ, пришедший до вывода, не тарифицируется, а возврат за переключение компенсирует стоимость кэша при смене модели.

СтатьяЦена за миллион токеновОтносительно Fable 5
Вход10 долларов за миллион токеновкак у Fable 5
Запись кэша, 5 минут12,5 долларакак у Fable 5
Запись кэша, 1 час20 долларовкак у Fable 5
Чтение кэша0,25 долларавчетверо дешевле, 0,025 от базовой ставки
Выход50 долларовкак у Fable 5
Пакетная обработка5 и 25 доллароввход и выход

Где доступна

Claude API - всем клиентам, как claude-fable-5-1. AWS: Claude в Amazon Bedrock, как anthropic.claude-fable-5-1, и Claude Platform на AWS, как claude-fable-5-1. Google Cloud: Claude на Google Cloud, как claude-fable-5-1. Microsoft Foundry: Claude на инфраструктуре Anthropic.

У обеих моделей 30-дневное хранение данных, и они недоступны в режиме нулевого хранения без явного разрешения Anthropic.

Где прибавилось качества

Агентное кодирование в длинных сессиях

Многофайловые функции, крупные рефакторинги и миграции, отладка и code review в сессиях, которые идут часами.

Документы, таблицы и презентации

Доведение разбора от первого вопроса до готового документа, таблицы с живыми формулами или презентации, собранной с чистого листа.

Исследование и поиск

Выше точность на многошаговых веб-исследованиях и на глубоких изысканиях, которые идут по следам собственных находок.

Зрение

Чтение плотных диаграмм, отчётности и таблиц, вложенных в PDF, в том числе с инструментами кадрирования и увеличения.

Работа с длинным контекстом

Рассуждение и связывание деталей на всём окне в миллион токенов.

Управление компьютером

Надёжнее водит браузер и настольные приложения, лучше восстанавливается после неудавшихся шагов.

Разрыв шире на высоких уровнях effort. Многоязычность осталась на уровне Fable 5.

Отличия в поведении: симптом и что делать

Существующие промпты для Fable 5 работают на 5.1 без изменений. Но семь вещей модель делает иначе прямо из коробки, и каждая лечится строчкой в промпте. Найдите свой симптом и переходите к нужному разделу.

Что вы наблюдаетеЧем лечится
В агентной петле один вызов инструмента за ход там, где Fable 5 делал несколько сразуОдна строка-подсказка про группировку независимых вызовов
Между вызовами инструментов почти нет текста, пользователь видит тишину на минутыВключить display: updates и попросить вступление, заметки по ходу и финальный итог
На низком effort модель отвечает по памяти вместо поискаПоднять effort на нужных ходах или добавить подсказку про проверку названий
Проза плотнее, чем нужно: длинные предложения, мало абзацных разрывовИнструкция, описывающая антипаттерн - манерную прозу
В чате меньше структуры, чем требует содержаниеУбрать старые запреты на оформление, заменить правилом, когда оформление уместно
В пересказах документов куски источника идут без пометки, что это цитатаОдин полный образцовый ответ в системном промпте
Мелкая правка, а файл переписан целикомИнструкция про экономию токенов на правках
Ход заканчивается до того, как работа сделана, или модель спрашивает разрешение на уже заказанноеДва блока в системный промпт: автономность и границы объёма работ

Уровни effort: прогоните перебор заново

Effort остаётся главным рычагом размена между интеллектом, задержкой и стоимостью. Начинайте с high - это значение по умолчанию, затем прогоняйте остальные уровни (low, medium, xhigh, max) на своих проверках качества.

Перебор надо повторить, даже если вы уже делали его на Fable 5: названия уровней не соответствуют одинаковому объёму размышлений у разных моделей. На medium результат примерно совпадает с Fable 5, но дешевле, так что спускайтесь на medium или low везде, где ваши проверки показывают, что качество держится. На low модель часто конкурентна с Opus и Sonnet по стоимости задачи при более высоком результате - имеет смысл включать её в сравнение везде, где вы иначе взяли бы модель поменьше с более высоким effort.

Два поведения завязаны на конкретные уровни. На low модель реже вызывает поиск и извлечение - смотрите раздел про поиск. На xhigh и max она может думать дольше перед тем, как писать длинный результат - смотрите раздел про длинные ответы.

Просите сообщения о прогрессе

По умолчанию Fable 5.1 пишет меньше текста для пользователя во время длинных ходов с инструментами, чем Fable 5. Чем выше effort и длиннее цепочка вызовов, тем заметнее. Пользователь видит, как агент замолкает на минуты, или получает финальное сообщение, описывающее только последний шаг вместо всей задачи.

Сначала проверьте, доходят ли обновления вообще. Короткие заметки модели между вызовами инструментов - что она нашла и что делает дальше - приходят блоками thinking, а при значении thinking.display по умолчанию (omitted) эти блоки пустые. Выставьте display: "updates" (бета, заголовок thinking-display-updates-2026-08-18) и выводите каждый непустой блок thinking как строку статуса, либо возьмите "summarized", чтобы получать их вместе с пересказанными рассуждениями.

Второе: вычистите из промпта указания, подавляющие пояснения по ходу. Ранние модели рвались комментировать работу, и в системные промпты попадали строки вроде "держите все находки до финального ответа". Такие строки надо убрать до того, как добавлять что-то новое.

Промпт: вступление, заметки по ходу и финальный итог

Добавьте в системный промпт, если нужно больше пояснений - например, при парном программировании.

Перед началом одной строкой скажите, что собираетесь сделать; короткие заметки по ходу работы помогают пользователю следить за происходящим. Завершите кратким итогом, который понятен сам по себе - что нашли, что сделали и что дальше, - чтобы читателю, который видит только последнее сообщение, была ясна вся картина.

Промпт: вывод инструмента пользователю не виден

Если ваш интерфейс сворачивает или прячет вывод инструментов, скажите об этом модели, иначе она будет запускать команды, чтобы показать пользователю то, что он никогда не увидит. Доставлять лучше системным сообщением на один ход.

Вывод этой команды видите только вы - в терминале пользователя показано в лучшем случае несколько строк. Если пользователю нужно что-то из этого прочитать, перенесите это в свой ответ.

Группируйте независимые вызовы инструментов

Обычно Fable 5.1 выдаёт параллельные вызовы как положено: если в запросе названо несколько вещей, которые надо получить, она запрашивает их разом. Исключение - петли кодирования и управления компьютером, где следующие независимые вызовы вытекают из задачи, но прямо не названы: собственные кодинг-агенты, связки из терминала и редактора, компьютерное использование. Там модель может выдавать по одному вызову за ход.

На качество ответа это не влияет, но каждый лишний ход стоит токенов, круга по сети и времени. Лечится одним предложением в конце текущего запроса.

Сначала про себя перечислите, что вам понадобится дальше; затем запросите в одном ответе всё, что не зависит от результата другого запроса.

Куда именно это класть

Каждый раз, отправляя результаты инструментов обратно, добавляйте свежую копию подсказки после сообщения пользователя - системным сообщением на один ход: запись с role "system" и clear_at "next_user_message" в массиве messages. Как только появляется более позднее сообщение пользователя, API гасит прежние копии, и модель читает только самую свежую. Это бета, нужен заголовок mid-conversation-system-clear-at-2026-08-21. Без беты кладите то же предложение текстовым блоком после блоков tool_result внутри того же сообщения пользователя.

Добавляйте новую копию каждый ход, а прежние оставляйте на месте байт в байт. Они остаются в массиве, но погашенные модель не видит, и входных токенов они не стоят. Удалять или переписывать их нельзя: это правка ранних ходов, которая сбрасывает кэш промпта и обнуляет блоки размышлений после них.

Ведите историю только на дозапись

Добавляйте каждый ход ассистента в историю ровно в том виде, в каком его вернул API, вместе с блоками размышлений, и не правьте ранние ходы между запросами. Для аккаунтов, созданных 31 августа 2026 года и позже, блоки размышлений Fable 5.1 действительны только в том разговоре, который их породил: запрос, который проигрывает блок после изменения префикса (системного промпта, списка инструментов или любого более раннего сообщения), возвращает 400 либо роняет затронутые блоки, если выставить prefix_mismatch_behavior: "drop_block" (бета, заголовок thinking-binding-controls-2026-08-01). Ожидается, что будущие модели будут проверять это для всех аккаунтов, так что схему стоит принять сейчас, даже если у вас проверка пока не включена.

Правки истории, на которых спотыкается проверка, - ровно те же, что сбрасывают кэш промпта: вставка и удаление напоминаний на каждый ход, сжатие старых ходов прямо в истории, смена системного промпта посреди сессии. Разовые напоминания шлите системными сообщениями на один ход, инструкции и инструменты меняйте системным сообщением посреди разговора, а не переписыванием system и tools, а обрезку доверьте серверному сжатию или серверному редактированию контекста.

Если вы сжимаете контекст на своей стороне, самая простая схема - заменить всю историю одним сообщением со сводкой плюс новый ход пользователя и не проигрывать больше ничего: блоки размышлений не переносятся, значит ничего и не ломается, а модель думает заново уже над сжатым разговором.

Чтобы найти правки, которые ваша обвязка уже делает, прогоните сессию с prefix_mismatch_behavior: "drop_block" и пишите в лог input_transformations. Либо снимите точные запросы за несколько обычных ходов и убедитесь, что соседние запросы совпадают байт в байт вплоть до дописанных ходов.

Плотность прозы

Пишет Fable 5.1 в целом лучше предыдущих моделей Claude: меньше дежурных оборотов и меньше необъяснённого жаргона. Но местами проза выходит плотнее, чем у Fable 5: предложения длиннее, абзацных разрывов меньше. Помогает инструкция, которая описывает антипаттерн - манерную прозу. Кладите её в сообщение пользователя (предпочтительно) или в системный промпт.

Промпт: против манерной прозы

Манерная проза подменяет прямое высказывание метафорой и украшением. Вместо "параметр, который стоит менять" манерный автор напишет "рычаг, который стоит повернуть". Вместо "этот довод по-прежнему важен" - "этот довод отрабатывает своё место". Такие обороты существуют, чтобы показать автора, а не передать мысль, и читатель это чувствует. Именно поэтому манерная проза раздражает: она заставляет читателя работать больше ради самолюбования автора. Она ещё и неточна: метафоры тянут за собой смыслы, которые автор не выбирал и не контролирует. Лечится это просто - говорите то, что имеете в виду. Если есть прямое слово, используйте его.

Короткая версия

Обычно тоже срабатывает.

Уберите всю манерную прозу.

Оформление в чате

Ранние модели злоупотребляли маркерами и жирным, и во множестве промптов до сих пор живут запреты на оформление, написанные, чтобы это сдержать. Fable 5.1 кренится в другую сторону: жирное выделение использует реже и реже тянется к заголовкам, спискам и кавычкам. Если в вашем промпте есть такие запреты, уберите их или замените правилом, которое говорит, когда конкретное оформление уместно.

Промпт: когда оформление уместно

Используйте списки и маркеры, когда вас об этом просят или когда содержание достаточно многосоставное, чтобы они помогали ясности. Если человек прямо просит минимум оформления, всегда отвечайте без маркеров, заголовков, списков и жирного выделения, как он и просил. В разговорном, личном или эмоциональном обмене держитесь простой прозы.

Цитирование найденных источников

Пересказывая документы, Fable 5.1 чаще Fable 5 воспроизводит куски исходного текста, не помечая их как цитату. Лечится одним полным образцовым ответом в системном промпте: запрос пользователя, ответ и предложение о том, почему этот ответ правильный. Строки вида [web_search: ...] замените именем своего инструмента, чтобы модель читала их как шаблон вызова, а не как текст, который надо выдать буквально.

Образец для системного промпта

<example> <user>посмотри, как "Речной вестник" и "Приморский курьер" освещали закрытие Портового моста, и сравни их подачу</user> <response> [web_search: закрытие Портового моста Речной вестник] [web_search: закрытие Портового моста Приморский курьер] Оба издания сходятся в фактах: мост закрыли 3 марта, когда инспекторы нашли трещины в сварных швах, и на ремонт власти закладывают около восьми месяцев. Расходятся они в акцентах. "Вестник" ведёт это как историю про местную экономику. "Курьер" разворачивает её как провал финансирования; редакционная колонка называет закрытие "полностью предсказуемым". Вместе они дают разное: "Вестник" объясняет, кого это задело сейчас, "Курьер" - как до этого дошло, и по отдельности ни один из них полной картины не даёт. </response> <rationale>ВЕРНО: ответ построен вокруг того, где издания сходятся и расходятся, а не как пересказ каждой статьи по очереди. Материал каждого издания передан одним-двумя предложениями косвенной речью самого ассистента. Прямая цитата одна, и она помечена; всё остальное переформулировано. При этом ответ остаётся конкретным и полным.</rationale> </example>

Доводить задачу до конца

Fable 5.1 умеет выполнять очень длинные задачи почти без подсказок по методике, особенно когда цель ясна. Но на сложных асинхронных нагрузках её стоит подтолкнуть не заканчивать ход, пока работа не сделана. Без этого модель иногда описывает, что сделала бы дальше, вместо того чтобы сделать ("Дальше я..."), или останавливается спросить разрешение на шаг, который исходный запрос уже покрывал ("Применить это?"). Пользователю приходится отвечать "продолжай": для парного программирования это нормально, но длинный горизонт модели так не используется.

Помогают два блока в системном промпте, и применять надо оба. Если длину промпта надо экономить, берите только первый - основной эффект в нём. Первое предложение первого блока, то самое про то, что пользователь не следит, несёт большую часть эффекта, так что оставьте его как есть. Если вашему продукту нужны остановки на конкретных подтверждениях, допишите после него предложение с их перечнем. Учтите размен: этот блок делает модель менее склонной переспрашивать и по действительно неоднозначным запросам.

Блок 1: автономная работа

Вы работаете автономно. Пользователь не следит за процессом в реальном времени и не может отвечать на вопросы по ходу, поэтому вопросы вида "Хотите, чтобы я...?" или "Мне сделать...?" просто остановят работу. Обратимые действия, вытекающие из исходного запроса, выполняйте без вопросов. Останавливайтесь только ради разрушительных действий или настоящего изменения объёма задачи, которое должен решить пользователь. Предложить дальнейшие шаги после выполнения работы - нормально; спрашивать разрешения до работы - нет. Исключение: если пользователь описывает проблему, задаёт вопрос или рассуждает вслух, а не просит что-то изменить, результатом должна быть ваша оценка. Изложите выводы и остановитесь. Не применяйте исправление, пока о нём не попросят. Прежде чем завершить ход, посмотрите на свой последний абзац. Если это план, разбор, вопрос, перечень следующих шагов или обещание работы, которую вы не сделали ("Дальше я...", "дайте знать, когда..."), сделайте эту работу сейчас, вызовами инструментов. Это относится и к повторным попыткам после ошибок, и к самостоятельному сбору недостающих сведений. Не останавливайтесь из-за того, что контекст или сессия стали длинными. Завершайте ход только когда задача выполнена или вы заблокированы вводом, который может дать только пользователь. Перед командой, меняющей состояние системы (перезапуск, удаление, правка конфигурации), проверьте, что имеющиеся данные подтверждают именно это действие. Признак, похожий на знакомую поломку, может иметь другую причину.

Блок 2: запрос задаёт объём работы

# Как сдавать работу Запрос пользователя - или согласованный с ним план - задаёт объём, и объём и есть результат: не сужайте, не расширяйте и не подменяйте его молча. Неоднозначность читайте так, как прочитал бы внимательный коллега: рядовые решения принимайте сами, а сверяйтесь только тогда, когда разные прочтения ведут к принципиально разной работе. Если видите настоящую проблему в поставленной задаче, скажите о ней в одном-двух предложениях и продолжайте работу с озвученными допущениями; если пользователь услышал возражение и подтвердил задачу, это его решение - выполняйте запрос целиком. Если вопрос возникает по ходу, сначала сделайте всё, что от ответа не зависит; затем назовите принятое допущение или - когда ошибочная догадка была бы небезопасна или обесценила бы работу - задайте вопрос в конце того же хода, которым вы сдаёте сделанное. Если часть работы оказалась заблокирована, доведите до конца все остальные и прямо скажите, что не сделали и почему: результат - это вся задача, и урезать её решает пользователь, а не вы. Решённый шаг нужно выполнять, а не анонсировать: описать следующий шаг и завершить ход - значит оставить его несделанным до ответа пользователя. Держите правки в границах запроса. То, что вы попутно заметили и что стоило бы сделать - уборка или документация, которых задача не требовала, правка файла, которого задача не касалась, - это предложение в конце, а не изменение, которое вы вносите; действия, явно выходящие за рамки запроса, а также рискованные и разрушительные, по-прежнему требуют согласия пользователя.

Что модель должна сохранить при сжатии

Fable 5.1 хорошо отзывается на прямое указание, что именно её сводка обязана сохранить, когда длинный разговор сжимается. Серверное сжатие уже делает это само. Если вы сжимаете на своей стороне, используйте такую инструкцию.

Промпт: инструкция для сжатия

Сожмите переписку внутри тегов <summary></summary>. Включите в сводку столько сведений, чтобы разговор мог продолжиться в новом окне контекста без повторной работы и без повторной выдачи ограничений и контекста. Обязательно сохраните: (1) любые сложности и проблемы, которые возникли, и то, как их обошли или решили; (2) любые возможности, варианты и подходы, которые предлагались, пробовались или были отложены, и почему; (3) всё, что просили, решили, согласовали, отвергли или зафиксировали как предпочтение, ограничение или границу - дословно; (4) точное текущее положение дел: что разобрано, улажено, сделано; (5) всё, что осталось открытым, нерешённым, обещанным или ожидается дальше; (6) конкретику, которую трудно восстановить: имена, числа, даты, точные формулировки, ссылки - в неизменном виде. По этим шести пунктам будьте полны даже ценой длины; всё остальное держите кратко. Два голоса весят по-разному: то, что говорил, просил, сообщал или устанавливал пользователь, сохраняйте бережно и близко к его словам; ваши собственные объяснения и рассуждения можно сжимать куда сильнее, до выводов и результатов, - если при этом ничто из шести пунктов не потеряно.

Не расширять объём работ и тесты

Получив открытую задачу на реализацию функции, Fable 5.1 делает то, о чём просили, и иногда чуть больше: может починить соседний код, расширить поведение, которого задача не касалась, или закоммитить больше тестовых файлов, чем правка того стоит. На явные указания о том, чего делать не надо, модель отзывается хорошо: с этой инструкцией незаказанные добавления и закоммиченные тесты заметно сокращаются без измеримой потери в успешности задач.

Промпт: только то, о чём просили

Если в ходе работы или проверки вы находите уже существовавший баг, проблему производительности или поведение, которого задача не касается, не чините, не оптимизируйте и не расширяйте его в этой правке, если только требуемое поведение без этого не работает; упомяните находку в итоге как задел на будущее. Там, где задача неоднозначна, реализуйте то прочтение, которое ближе всего к её формулировке и окружающему коду, назовите это допущение в итоге и не закладывайтесь заодно на другие прочтения. Проверяйте свою работу как хотите: черновые скрипты и быстрые проверки хранить не нужно. Коммитьте тесты только там, где задача этого просит или где в репозитории уже принято покрывать такие изменения тестами, того же размера, что соседние тестовые файлы - примерно один сфокусированный тест на заявленное поведение, - и не превращайте черновые проверки в дополнительные постоянные тестовые файлы. Речь только о лишнем: всё поведение, которое задача требует, реализуйте полностью.

Поиск на низком effort

На уровне low Fable 5.1 реже, чем Fable 5, вызывает инструмент поиска или извлечения и чаще отвечает по памяти. Иногда проще всего поднять effort на затронутых ходах, а не на всём разговоре - уровень можно менять посреди разговора. В остальных случаях помогает подсказка в системном промпте: узнавание названия - не то же самое, что знание его текущего состояния, и такие названия надо искать ровно в том виде, как их написал пользователь.

Промпт: проверять названия

Когда запрос строится вокруг названия, которое вы не узнаёте уверенно, или узнаёте из быстро меняющейся области вроде AI-моделей и инструментов разработчика, где расклад меняется за месяцы, проверять нужно само название: ищите до ответа и включайте название ровно в том виде, как его написал пользователь, хотя бы в один поисковый запрос наряду с переформулировками. Это верно и тогда, когда что-то об этом названии вы знаете: именно частичное знание делает устаревший ответ убедительным, так что узнавание - не повод пропустить поиск.

Ложные срабатывания защит

Классификаторы безопасности Fable 5.1 дают меньше ложных срабатываний, чем давали у Fable 5 на старте, и поиск уязвимостей в исходном коде разрешён. Ложные срабатывания всё же случаются, и заблокированный запрос возвращает stop_reason refusal. Вероятность выше в трёх ситуациях.

Формулировка про компиляцию

Вместо "Эта программа компилируется без ошибок?" спрашивайте "Есть ли в этой программе ошибки?".

Малоизвестные языки программирования

Дайте модели контекст: что это за язык и как он устроен - например, доступ к его документации.

Base64 в выводе инструментов

Инструменты, возвращающие данные в base64 прямо в контекст модели, провоцируют ложные срабатывания. Рекомендуемое лечение - убрать их оттуда.

Точечные правки вместо переписывания файлов

Fable 5.1 чаще Fable 5 переписывает текстовый файл целиком вместо точечной правки. Итоговый файл обычно тот же, но, если файл не короткий и меняется не большая его часть, переписывание стоит лишних выходных токенов и времени. Инструкция возвращает 5.1 к поведению Fable 5 на мелких и средних изменениях.

Промпт: экономия токенов на правках

Число токенов, потраченных на правку файлов, при прочих равных стоит минимизировать. Поэтому, когда это не влияет на итоговый результат, старайтесь править файл точечно, а не переписывать его целиком.

Оставьте место для длинных ответов на xhigh и max

На xhigh и особенно на max Fable 5.1 может думать дольше, прежде чем начнёт писать ответ. Когда в одном запросе просят длинный результат - скажем, полную переработку большого документа, - она может начерно сочинить его в рассуждениях, а потом написать заново в ответе. Это дольше и дороже по выходным токенам.

Самое простое - запускать такие запросы на high, рекомендуемой отправной точке, и переходить на xhigh или max только там, где вы измерили прирост качества. Если всё-таки нужен xhigh или max: выставляйте max_tokens с запасом на размышления и на ответ, а не только на ожидаемую длину ответа, и добавляйте в конец сообщения пользователя приведённую ниже заметку. Она заметно сокращает размышления на запросах про текст и код. Значение [max_tokens] замените фактическим - например, 64 000.

Промпт: один общий лимит на размышления и ответ

Всё, что создаётся в одном ответе, включая рассуждения и черновики до ответа, укладывается в один общий лимит примерно в [max_tokens] токенов. Если лимит будет исчерпан до того, как ответ дописан, человек получит обрезанный ответ и вынужден будет начинать заново. Сочинить весь материал целиком сначала в рассуждениях, а потом заново в ответе - значит удвоить длину хода, ничего не улучшив, так что не делайте этого. Вместо этого, когда человек просит длинный или трудоёмкий результат - многораздельный документ, большую таблицу или набор данных, целый файл кода, - потратьте дополнительное усилие на понимание запроса, проверку исходных данных, от которых зависит ответ, выбор структуры и других трудных решений, а в остальном используйте пространство рассуждений для рассуждений, а пространство вывода - для вывода. Обычно черновать результат несколько раз не требуется.

Пусть ведущий агент работает, пока идут субагенты

Если ваш кодинг-агент позволяет Fable 5.1 делегировать работу субагентам, не заставляйте ведущего агента останавливаться и ждать каждого. На задачах по коду продолжение работы ведущего, пока субагенты считают, снижает среднее время до готового результата при том же качестве, расходе токенов и стоимости.

Запуск возвращает управление сразу

Инструмент, который стартует субагента, должен отвечать немедленно, а не держать ход.

Результат приходит позже

Отдавайте результат каждого субагента ведущему более поздним сообщением с ролью user, когда он готов.

Отдельный инструмент ожидания

Дайте ведущему инструмент, которым он может дождаться результата, когда сам захочет.

Модель всё равно часто предпочитает подождать. Выигрыш по времени набегает на тех прогонах, где она берётся за другую работу.

Зрение: дайте инструменты кадрирования и увеличения

Зрение у Fable 5.1 из коробки лучше, а на сложных визуальных входах вроде плотных диаграмм модель работает лучше всего тогда, когда может итеративно разбирать, кадрировать и визуально перепроверять увиденное.

Чтобы получить полный эффект, запускайте модель агентом с доступом к контейнеру, где лежат исходные изображения или видео и заранее установлены базовые библиотеки обработки изображений вроде PIL и OpenCV. Если контейнер - слишком много возни, основную часть выигрыша даёт один инструмент кадрирования: он возвращает выбранную область изображения обрезанной и увеличенной, и это позволяет модели разбирать детали глубже, масштабируя вычисления на этапе ответа вместе с числом токенов изображения.

Чек-лист миграции с Fable 5

Начинается всё с замены идентификатора модели на claude-fable-5-1. Дальше проверьте пять пунктов.

01

Уберите любой tool_choice типа any или tool. Схему переносите на строгий вызов инструментов с tool_choice auto либо на структурированный вывод.

02

Возвращайте блоки размышлений без изменений и ведите историю только на дозапись. Если код сам собирает messages, прогоните проверку на правки истории: разовые напоминания переведите в системные сообщения на один ход, изменения system и tools - в системные сообщения посреди разговора, обрезку контекста делайте на сервере либо снимайте блоки размышлений с тех ходов, которые переносите через своё сжатие.

03

Перенастройте effort от значения по умолчанию (high) и подумайте о смене уровня посреди разговора вместо одного уровня на всю сессию.

04

В агентных петлях следите за одиночными вызовами инструментов там, где Fable 5 группировал несколько, и добавьте построчную подсказку на каждый ход.

05

Перезапустите свои проверки качества. Обработка отказов, запасные модели, возврат за переключение и подсчёт токенов переносятся без изменений; чтение кэша стало дешевле, а поведение по умолчанию отличается в перечисленных выше местах.

Частые вопросы

Нужно ли переписывать промпты при переходе с Fable 5 на Fable 5.1?

Нет. Существующие промпты для Fable 5 работают на 5.1 без изменений. Стоит знать про горстку поведенческих отличий: меньше сообщений о прогрессе, реже параллельные вызовы инструментов в агентных петлях, более плотная проза, меньше оформления в чате, неотмеченные цитаты в пересказах, переписывание файлов целиком вместо точечных правок и реже поиск на низком effort. На каждое есть готовая подсказка в промпт.

Что именно ломается при переходе на Claude Fable 5.1?

Три вещи. Первое: принудительный вызов инструментов не поддерживается, tool_choice со значением any или tool возвращает 400. Второе: более ранние модели не читают блоки размышлений Fable 5.1, сохранение работает только в одну сторону. Третье: правка более ранних ходов разговора (system, tools или любого прошлого сообщения) делает блоки размышлений недействительными и приводит к ошибке 400.

Сколько стоит Claude Fable 5.1?

Цены те же, что у Fable 5, кроме чтения кэша: вход 10 долларов за миллион токенов, выход 50 долларов, запись кэша на 5 минут 12,5 доллара, на час 20 долларов. Чтение кэша стоит 0,25 доллара за миллион токенов - это 0,025 от базовой ставки входа против 0,1 у остальных моделей Claude, то есть вчетверо дешевле. Пакетная обработка: 5 и 25 долларов.

Почему приходит ошибка 400 bound to a different conversation?

Блок размышлений Fable 5.1 действителен только в том разговоре, который его породил. Если между запросами изменился системный промпт, список инструментов или любое более раннее сообщение, следующий запрос с этим блоком отклоняется. Проверка включена для аккаунтов, созданных 31 августа 2026 года и позже. Лечится тем, что история ведётся только на дозапись: разовые напоминания отправляются системными сообщениями на один ход, а обрезка контекста делается на стороне сервера.

Почему модель молчит во время длинных прогонов с инструментами?

Короткие заметки о прогрессе приходят отдельными блоками thinking, а при значении thinking.display по умолчанию (omitted) эти блоки возвращаются пустыми. Нужно включить display: updates через бета-заголовок thinking-display-updates-2026-08-18 и выводить каждый непустой блок как строку статуса. Кроме того, из промпта надо убрать старые указания вроде держать все находки до финального ответа.

Какой уровень effort выбрать для Fable 5.1?

Начинайте с high - это значение по умолчанию, затем прогоняйте свои проверки на low, medium, xhigh и max. Названия уровней не соответствуют одинаковому объёму размышлений у разных моделей, поэтому перебор надо повторить, даже если вы делали его на Fable 5. На medium результат примерно как у Fable 5, но дешевле; на low модель часто выигрывает у моделей поменьше и по цене задачи, и по качеству.

Чем Fable 5.1 отличается от Claude Opus 5 и что выбрать?

Для большинства рабочих нагрузок Anthropic рекомендует начинать с Claude Opus 5. Fable 5.1 берут под требовательные рассуждения и длинную автономную работу или когда проверки на Opus 5 при высоком effort всё ещё не дотягивают. Прирост у 5.1 относительно Fable 5 виден на всех уровнях effort и наибольший на высоких.

Читайте дальше

Промпты из этого материала работают и в Claude Code, и в собственной обвязке через API.

Руководство по Claude Fable 5Руководство по Claude CodeПромпты для глубокого мышленияОбзор ClaudeКурс Claude 101

По материалам официальной документации Anthropic. Примеры промптов адаптированы на русский язык командой reymer.ai.

Claude Fable 5.1 (claude-fable-5-1) - модель Anthropic, продолжающая Claude Fable 5. Claude Mythos 5.1 (claude-mythos-5-1) доступен только участникам Project Glasswing. Три ломающих изменения относительно Fable 5: принудительный вызов инструментов (tool_choice any или tool) возвращает ошибку 400; более ранние модели не читают блоки размышлений Fable 5.1; правка более ранних ходов разговора обнуляет блоки размышлений и приводит к ошибке 400 с сообщением bound to a different conversation. Пять дополнений: смена effort посреди разговора, системные сообщения на один ход с clear_at next_user_message, читаемые обновления прогресса через thinking.display updates, чтение кэша по 0,25 доллара за миллион токенов и происхождение контента через водяной знак и Content Credentials C2PA. Цены: вход 10 долларов, выход 50 долларов, запись кэша 12,5 и 20 долларов за миллион токенов. Окно контекста миллион токенов, вывод до 128 тысяч токенов, адаптивное мышление всегда включено. Материал содержит 16 готовых промптов на русском языке под каждое поведенческое отличие: обновления прогресса, группировка вызовов инструментов, плотность прозы, оформление в чате, цитирование источников, автономная работа до конца задачи, инструкция для сжатия контекста, ограничение объёма работ и тестов, проверка названий поиском, точечные правки файлов и длинные ответы на уровнях effort xhigh и max. Подробные руководства по AI-инструментам на reymer.ai.