Русская адаптация официальной документации Anthropic. Сначала разбираем, что изменилось относительно Fable 5: три ломающих изменения, пять дополнений и новая цена на чтение кэша. Дальше - 16 готовых промптов на русском под каждое поведенческое отличие.
Claude Fable 5.1 продолжает Fable 5 по тем же ценам на вход и выход, но с чтением кэша вчетверо дешевле, и заметно сильнее в длительном агентном кодировании, многошаговых исследованиях и работе с документами, таблицами и презентациями. Claude Mythos 5.1 - та же модель с теми же возможностями, доступная только участникам программы Project Glasswing.
Важная оговорка от самой Anthropic: для большинства задач начинать рекомендуется с Claude Opus 5. Fable 5.1 берут под требовательные рассуждения и работу с длинным горизонтом либо тогда, когда собственные проверки качества на Opus 5 при высоком effort всё ещё не дотягивают.
Коротко: если вы уже вызываете Fable 5, три изменения ломающие - принудительный вызов инструментов возвращает ошибку, ранние модели не читают блоки размышлений 5.1, правка ранних ходов обнуляет блоки размышлений. Пять изменений добавляющие: effort на каждое сообщение, системные сообщения на один ход, читаемые обновления прогресса, более дешёвое чтение кэша и происхождение контента. Ваши промпты от Fable 5 при этом переписывать не нужно.
| Модель | ID в Claude API | Доступность |
|---|---|---|
| Claude Fable 5.1 | claude-fable-5-1 | Всем клиентам, в Claude API и на партнёрских площадках |
| Claude Mythos 5.1 | claude-mythos-5-1 | Только участникам Project Glasswing |
Эти три пункта надо проверить в коде до миграции. Всё остальное в 5.1 либо добавляется, либо настраивается промптом.
tool_choice со значением {"type": "any"} или {"type": "tool", "name": "..."} возвращает 400 invalid_request_error. Значения auto (по умолчанию) и none не изменились, та же проверка действует и на подсчёте токенов. Причина: мышление у модели включено всегда, а принудительный вызов его бы пропустил - модель писала бы рассуждения прямо в аргументы инструмента, и качество аргументов падало бы. Чтобы получить валидный по схеме JSON, оставьте auto и включите strict: true или перенесите схему в структурированный вывод. Чтобы модель точно вызвала инструмент, просто скажите в промпте, когда он применяется: явные указания про инструменты Fable 5.1 выполняет надёжно.
Каждый блок размышлений помнит, какая модель его создала, и переносится только в одну сторону: Fable 5.1 читает блоки более ранних моделей, а ни одна ранняя модель не читает блоки 5.1. Разговор, переехавший на Fable 5.1 с Opus 5, Fable 5 или чего-то ещё более раннего, сохраняет рассуждения. Разговор, уехавший с 5.1 на любую из этих моделей, теряет их на тех ходах, которые идут там. Нечитаемый блок API выбрасывает до того, как модель его увидит; выброшенные блоки не попадают в input_tokens и не тарифицируются. С бета-заголовком thinking-binding-controls-2026-08-01 факт выброса виден в массиве input_transformations, без него он молчаливый.
Изменение чего угодно, что стоит перед блоком размышлений Fable 5.1 - системного промпта, списка инструментов или более раннего сообщения, - приводит к ошибке на следующем запросе. Проверка включена для аккаунтов, созданных 31 августа 2026 года и позже; для более старых аккаунтов API фиксирует расхождение, но реагирует только если запрос выставил prefix_mismatch_behavior. Mythos 5.1 эту проверку не делает. Claude Code, claude.ai, управляемые агенты Claude и Claude Agent SDK сохраняют префикс за вас; если ваш код сам собирает массив messages, проверять надо до миграции.
Удаление блока размышлений откуда угодно, кроме начала серии, обнуляет все блоки после него.
Уровень effort можно менять по ходу разговора, не сбрасывая кэш промпта: поднять на трудном шаге и опустить на рутинных. Бета-заголовок mid-conversation-output-config-2026-07-01. Поддерживают Fable 5.1, Mythos 5.1 и Opus 5.
Сообщение с role: "system" и clear_at: "next_user_message" имеет авторитет системного промпта на текущем ходу, а после появления следующего сообщения пользователя перестаёт отображаться. Само сообщение остаётся в messages, вы шлёте его обратно дословно, ничего раньше в разговоре не меняется: кэш продолжает совпадать, блоки размышлений остаются действительными, а погашенное сообщение не стоит входных токенов. Бета-заголовок mid-conversation-system-clear-at-2026-08-21.
Короткие заметки между вызовами инструментов приходят отдельными блоками thinking. При значении display по умолчанию (omitted) они пустые, и длинный агентный ход выглядит для пользователя как тишина. Новое значение display: "updates" возвращает эти заметки текстом, оставляя сами рассуждения скрытыми. Бета-заголовок thinking-display-updates-2026-08-18. Значение summarized тоже их отдаёт, вперемешку с пересказанными рассуждениями.
Чтение кэша (попадания и обновления) стоит 0,025 от базовой ставки входа против 0,1 у остальных моделей Claude. Длинные агентные сессии, которые снова и снова перечитывают закэшированный префикс, платят четверть прежней цены. Запись кэша и минимальная длина кэшируемого промпта в 512 токенов не изменились. Побочный вывод: раннее сжатие контекста ради экономии может уже не быть правильным разменом, стоит попробовать сжимать позже.
Текст, созданный Fable 5.1 и Mythos 5.1, несёт статистический водяной знак Anthropic на всех платформах, где доступна модель. Изображения и видео поддерживаемых форматов, которые Claude создаёт через инструмент исполнения кода, несут подписанные Content Credentials C2PA при получении через Files API. Водяной знак не меняет смысл, качество и читаемость, не добавляет токенов и скрытых символов, не содержит сведений о вас и не требует правок в запросах.
Окно контекста на миллион токенов (и по умолчанию, и максимум) по стандартной цене за токен на всём окне, до 128 тысяч токенов вывода.
Адаптивное мышление включено всегда, глубина управляется параметром effort. Отключить его нельзя: и thinking с budget_tokens, и thinking disabled возвращают 400.
Тот же, что у Fable 5 (появился с Opus 4.7). По сравнению с моделями старше Opus 4.7 один и тот же текст даёт примерно на 30 процентов больше токенов - это надо учитывать в расчёте бюджета.
Отклонённый запрос возвращает HTTP 200 со stop_reason refusal и объектом stop_details, где названа сработавшая область политики. Разрешённые запасные модели для Fable 5.1 - Opus 4.8 и Opus 5. Отказ, пришедший до вывода, не тарифицируется, а возврат за переключение компенсирует стоимость кэша при смене модели.
| Статья | Цена за миллион токенов | Относительно Fable 5 |
|---|---|---|
| Вход | 10 долларов за миллион токенов | как у Fable 5 |
| Запись кэша, 5 минут | 12,5 доллара | как у Fable 5 |
| Запись кэша, 1 час | 20 долларов | как у Fable 5 |
| Чтение кэша | 0,25 доллара | вчетверо дешевле, 0,025 от базовой ставки |
| Выход | 50 долларов | как у Fable 5 |
| Пакетная обработка | 5 и 25 долларов | вход и выход |
Claude API - всем клиентам, как claude-fable-5-1. AWS: Claude в Amazon Bedrock, как anthropic.claude-fable-5-1, и Claude Platform на AWS, как claude-fable-5-1. Google Cloud: Claude на Google Cloud, как claude-fable-5-1. Microsoft Foundry: Claude на инфраструктуре Anthropic.
У обеих моделей 30-дневное хранение данных, и они недоступны в режиме нулевого хранения без явного разрешения Anthropic.
Многофайловые функции, крупные рефакторинги и миграции, отладка и code review в сессиях, которые идут часами.
Доведение разбора от первого вопроса до готового документа, таблицы с живыми формулами или презентации, собранной с чистого листа.
Выше точность на многошаговых веб-исследованиях и на глубоких изысканиях, которые идут по следам собственных находок.
Чтение плотных диаграмм, отчётности и таблиц, вложенных в PDF, в том числе с инструментами кадрирования и увеличения.
Рассуждение и связывание деталей на всём окне в миллион токенов.
Надёжнее водит браузер и настольные приложения, лучше восстанавливается после неудавшихся шагов.
Разрыв шире на высоких уровнях effort. Многоязычность осталась на уровне Fable 5.
Существующие промпты для Fable 5 работают на 5.1 без изменений. Но семь вещей модель делает иначе прямо из коробки, и каждая лечится строчкой в промпте. Найдите свой симптом и переходите к нужному разделу.
| Что вы наблюдаете | Чем лечится |
|---|---|
| В агентной петле один вызов инструмента за ход там, где Fable 5 делал несколько сразу | Одна строка-подсказка про группировку независимых вызовов |
| Между вызовами инструментов почти нет текста, пользователь видит тишину на минуты | Включить display: updates и попросить вступление, заметки по ходу и финальный итог |
| На низком effort модель отвечает по памяти вместо поиска | Поднять effort на нужных ходах или добавить подсказку про проверку названий |
| Проза плотнее, чем нужно: длинные предложения, мало абзацных разрывов | Инструкция, описывающая антипаттерн - манерную прозу |
| В чате меньше структуры, чем требует содержание | Убрать старые запреты на оформление, заменить правилом, когда оформление уместно |
| В пересказах документов куски источника идут без пометки, что это цитата | Один полный образцовый ответ в системном промпте |
| Мелкая правка, а файл переписан целиком | Инструкция про экономию токенов на правках |
| Ход заканчивается до того, как работа сделана, или модель спрашивает разрешение на уже заказанное | Два блока в системный промпт: автономность и границы объёма работ |
Effort остаётся главным рычагом размена между интеллектом, задержкой и стоимостью. Начинайте с high - это значение по умолчанию, затем прогоняйте остальные уровни (low, medium, xhigh, max) на своих проверках качества.
Перебор надо повторить, даже если вы уже делали его на Fable 5: названия уровней не соответствуют одинаковому объёму размышлений у разных моделей. На medium результат примерно совпадает с Fable 5, но дешевле, так что спускайтесь на medium или low везде, где ваши проверки показывают, что качество держится. На low модель часто конкурентна с Opus и Sonnet по стоимости задачи при более высоком результате - имеет смысл включать её в сравнение везде, где вы иначе взяли бы модель поменьше с более высоким effort.
Два поведения завязаны на конкретные уровни. На low модель реже вызывает поиск и извлечение - смотрите раздел про поиск. На xhigh и max она может думать дольше перед тем, как писать длинный результат - смотрите раздел про длинные ответы.
По умолчанию Fable 5.1 пишет меньше текста для пользователя во время длинных ходов с инструментами, чем Fable 5. Чем выше effort и длиннее цепочка вызовов, тем заметнее. Пользователь видит, как агент замолкает на минуты, или получает финальное сообщение, описывающее только последний шаг вместо всей задачи.
Сначала проверьте, доходят ли обновления вообще. Короткие заметки модели между вызовами инструментов - что она нашла и что делает дальше - приходят блоками thinking, а при значении thinking.display по умолчанию (omitted) эти блоки пустые. Выставьте display: "updates" (бета, заголовок thinking-display-updates-2026-08-18) и выводите каждый непустой блок thinking как строку статуса, либо возьмите "summarized", чтобы получать их вместе с пересказанными рассуждениями.
Второе: вычистите из промпта указания, подавляющие пояснения по ходу. Ранние модели рвались комментировать работу, и в системные промпты попадали строки вроде "держите все находки до финального ответа". Такие строки надо убрать до того, как добавлять что-то новое.
Добавьте в системный промпт, если нужно больше пояснений - например, при парном программировании.
Если ваш интерфейс сворачивает или прячет вывод инструментов, скажите об этом модели, иначе она будет запускать команды, чтобы показать пользователю то, что он никогда не увидит. Доставлять лучше системным сообщением на один ход.
Обычно Fable 5.1 выдаёт параллельные вызовы как положено: если в запросе названо несколько вещей, которые надо получить, она запрашивает их разом. Исключение - петли кодирования и управления компьютером, где следующие независимые вызовы вытекают из задачи, но прямо не названы: собственные кодинг-агенты, связки из терминала и редактора, компьютерное использование. Там модель может выдавать по одному вызову за ход.
На качество ответа это не влияет, но каждый лишний ход стоит токенов, круга по сети и времени. Лечится одним предложением в конце текущего запроса.
Каждый раз, отправляя результаты инструментов обратно, добавляйте свежую копию подсказки после сообщения пользователя - системным сообщением на один ход: запись с role "system" и clear_at "next_user_message" в массиве messages. Как только появляется более позднее сообщение пользователя, API гасит прежние копии, и модель читает только самую свежую. Это бета, нужен заголовок mid-conversation-system-clear-at-2026-08-21. Без беты кладите то же предложение текстовым блоком после блоков tool_result внутри того же сообщения пользователя.
Добавляйте новую копию каждый ход, а прежние оставляйте на месте байт в байт. Они остаются в массиве, но погашенные модель не видит, и входных токенов они не стоят. Удалять или переписывать их нельзя: это правка ранних ходов, которая сбрасывает кэш промпта и обнуляет блоки размышлений после них.
Добавляйте каждый ход ассистента в историю ровно в том виде, в каком его вернул API, вместе с блоками размышлений, и не правьте ранние ходы между запросами. Для аккаунтов, созданных 31 августа 2026 года и позже, блоки размышлений Fable 5.1 действительны только в том разговоре, который их породил: запрос, который проигрывает блок после изменения префикса (системного промпта, списка инструментов или любого более раннего сообщения), возвращает 400 либо роняет затронутые блоки, если выставить prefix_mismatch_behavior: "drop_block" (бета, заголовок thinking-binding-controls-2026-08-01). Ожидается, что будущие модели будут проверять это для всех аккаунтов, так что схему стоит принять сейчас, даже если у вас проверка пока не включена.
Правки истории, на которых спотыкается проверка, - ровно те же, что сбрасывают кэш промпта: вставка и удаление напоминаний на каждый ход, сжатие старых ходов прямо в истории, смена системного промпта посреди сессии. Разовые напоминания шлите системными сообщениями на один ход, инструкции и инструменты меняйте системным сообщением посреди разговора, а не переписыванием system и tools, а обрезку доверьте серверному сжатию или серверному редактированию контекста.
Если вы сжимаете контекст на своей стороне, самая простая схема - заменить всю историю одним сообщением со сводкой плюс новый ход пользователя и не проигрывать больше ничего: блоки размышлений не переносятся, значит ничего и не ломается, а модель думает заново уже над сжатым разговором.
Чтобы найти правки, которые ваша обвязка уже делает, прогоните сессию с prefix_mismatch_behavior: "drop_block" и пишите в лог input_transformations. Либо снимите точные запросы за несколько обычных ходов и убедитесь, что соседние запросы совпадают байт в байт вплоть до дописанных ходов.
Пишет Fable 5.1 в целом лучше предыдущих моделей Claude: меньше дежурных оборотов и меньше необъяснённого жаргона. Но местами проза выходит плотнее, чем у Fable 5: предложения длиннее, абзацных разрывов меньше. Помогает инструкция, которая описывает антипаттерн - манерную прозу. Кладите её в сообщение пользователя (предпочтительно) или в системный промпт.
Обычно тоже срабатывает.
Ранние модели злоупотребляли маркерами и жирным, и во множестве промптов до сих пор живут запреты на оформление, написанные, чтобы это сдержать. Fable 5.1 кренится в другую сторону: жирное выделение использует реже и реже тянется к заголовкам, спискам и кавычкам. Если в вашем промпте есть такие запреты, уберите их или замените правилом, которое говорит, когда конкретное оформление уместно.
Пересказывая документы, Fable 5.1 чаще Fable 5 воспроизводит куски исходного текста, не помечая их как цитату. Лечится одним полным образцовым ответом в системном промпте: запрос пользователя, ответ и предложение о том, почему этот ответ правильный. Строки вида [web_search: ...] замените именем своего инструмента, чтобы модель читала их как шаблон вызова, а не как текст, который надо выдать буквально.
Fable 5.1 умеет выполнять очень длинные задачи почти без подсказок по методике, особенно когда цель ясна. Но на сложных асинхронных нагрузках её стоит подтолкнуть не заканчивать ход, пока работа не сделана. Без этого модель иногда описывает, что сделала бы дальше, вместо того чтобы сделать ("Дальше я..."), или останавливается спросить разрешение на шаг, который исходный запрос уже покрывал ("Применить это?"). Пользователю приходится отвечать "продолжай": для парного программирования это нормально, но длинный горизонт модели так не используется.
Помогают два блока в системном промпте, и применять надо оба. Если длину промпта надо экономить, берите только первый - основной эффект в нём. Первое предложение первого блока, то самое про то, что пользователь не следит, несёт большую часть эффекта, так что оставьте его как есть. Если вашему продукту нужны остановки на конкретных подтверждениях, допишите после него предложение с их перечнем. Учтите размен: этот блок делает модель менее склонной переспрашивать и по действительно неоднозначным запросам.
Fable 5.1 хорошо отзывается на прямое указание, что именно её сводка обязана сохранить, когда длинный разговор сжимается. Серверное сжатие уже делает это само. Если вы сжимаете на своей стороне, используйте такую инструкцию.
Получив открытую задачу на реализацию функции, Fable 5.1 делает то, о чём просили, и иногда чуть больше: может починить соседний код, расширить поведение, которого задача не касалась, или закоммитить больше тестовых файлов, чем правка того стоит. На явные указания о том, чего делать не надо, модель отзывается хорошо: с этой инструкцией незаказанные добавления и закоммиченные тесты заметно сокращаются без измеримой потери в успешности задач.
На уровне low Fable 5.1 реже, чем Fable 5, вызывает инструмент поиска или извлечения и чаще отвечает по памяти. Иногда проще всего поднять effort на затронутых ходах, а не на всём разговоре - уровень можно менять посреди разговора. В остальных случаях помогает подсказка в системном промпте: узнавание названия - не то же самое, что знание его текущего состояния, и такие названия надо искать ровно в том виде, как их написал пользователь.
Классификаторы безопасности Fable 5.1 дают меньше ложных срабатываний, чем давали у Fable 5 на старте, и поиск уязвимостей в исходном коде разрешён. Ложные срабатывания всё же случаются, и заблокированный запрос возвращает stop_reason refusal. Вероятность выше в трёх ситуациях.
Вместо "Эта программа компилируется без ошибок?" спрашивайте "Есть ли в этой программе ошибки?".
Дайте модели контекст: что это за язык и как он устроен - например, доступ к его документации.
Инструменты, возвращающие данные в base64 прямо в контекст модели, провоцируют ложные срабатывания. Рекомендуемое лечение - убрать их оттуда.
Fable 5.1 чаще Fable 5 переписывает текстовый файл целиком вместо точечной правки. Итоговый файл обычно тот же, но, если файл не короткий и меняется не большая его часть, переписывание стоит лишних выходных токенов и времени. Инструкция возвращает 5.1 к поведению Fable 5 на мелких и средних изменениях.
На xhigh и особенно на max Fable 5.1 может думать дольше, прежде чем начнёт писать ответ. Когда в одном запросе просят длинный результат - скажем, полную переработку большого документа, - она может начерно сочинить его в рассуждениях, а потом написать заново в ответе. Это дольше и дороже по выходным токенам.
Самое простое - запускать такие запросы на high, рекомендуемой отправной точке, и переходить на xhigh или max только там, где вы измерили прирост качества. Если всё-таки нужен xhigh или max: выставляйте max_tokens с запасом на размышления и на ответ, а не только на ожидаемую длину ответа, и добавляйте в конец сообщения пользователя приведённую ниже заметку. Она заметно сокращает размышления на запросах про текст и код. Значение [max_tokens] замените фактическим - например, 64 000.
Если ваш кодинг-агент позволяет Fable 5.1 делегировать работу субагентам, не заставляйте ведущего агента останавливаться и ждать каждого. На задачах по коду продолжение работы ведущего, пока субагенты считают, снижает среднее время до готового результата при том же качестве, расходе токенов и стоимости.
Инструмент, который стартует субагента, должен отвечать немедленно, а не держать ход.
Отдавайте результат каждого субагента ведущему более поздним сообщением с ролью user, когда он готов.
Дайте ведущему инструмент, которым он может дождаться результата, когда сам захочет.
Модель всё равно часто предпочитает подождать. Выигрыш по времени набегает на тех прогонах, где она берётся за другую работу.
Зрение у Fable 5.1 из коробки лучше, а на сложных визуальных входах вроде плотных диаграмм модель работает лучше всего тогда, когда может итеративно разбирать, кадрировать и визуально перепроверять увиденное.
Чтобы получить полный эффект, запускайте модель агентом с доступом к контейнеру, где лежат исходные изображения или видео и заранее установлены базовые библиотеки обработки изображений вроде PIL и OpenCV. Если контейнер - слишком много возни, основную часть выигрыша даёт один инструмент кадрирования: он возвращает выбранную область изображения обрезанной и увеличенной, и это позволяет модели разбирать детали глубже, масштабируя вычисления на этапе ответа вместе с числом токенов изображения.
Начинается всё с замены идентификатора модели на claude-fable-5-1. Дальше проверьте пять пунктов.
Уберите любой tool_choice типа any или tool. Схему переносите на строгий вызов инструментов с tool_choice auto либо на структурированный вывод.
Возвращайте блоки размышлений без изменений и ведите историю только на дозапись. Если код сам собирает messages, прогоните проверку на правки истории: разовые напоминания переведите в системные сообщения на один ход, изменения system и tools - в системные сообщения посреди разговора, обрезку контекста делайте на сервере либо снимайте блоки размышлений с тех ходов, которые переносите через своё сжатие.
Перенастройте effort от значения по умолчанию (high) и подумайте о смене уровня посреди разговора вместо одного уровня на всю сессию.
В агентных петлях следите за одиночными вызовами инструментов там, где Fable 5 группировал несколько, и добавьте построчную подсказку на каждый ход.
Перезапустите свои проверки качества. Обработка отказов, запасные модели, возврат за переключение и подсчёт токенов переносятся без изменений; чтение кэша стало дешевле, а поведение по умолчанию отличается в перечисленных выше местах.
Нет. Существующие промпты для Fable 5 работают на 5.1 без изменений. Стоит знать про горстку поведенческих отличий: меньше сообщений о прогрессе, реже параллельные вызовы инструментов в агентных петлях, более плотная проза, меньше оформления в чате, неотмеченные цитаты в пересказах, переписывание файлов целиком вместо точечных правок и реже поиск на низком effort. На каждое есть готовая подсказка в промпт.
Три вещи. Первое: принудительный вызов инструментов не поддерживается, tool_choice со значением any или tool возвращает 400. Второе: более ранние модели не читают блоки размышлений Fable 5.1, сохранение работает только в одну сторону. Третье: правка более ранних ходов разговора (system, tools или любого прошлого сообщения) делает блоки размышлений недействительными и приводит к ошибке 400.
Цены те же, что у Fable 5, кроме чтения кэша: вход 10 долларов за миллион токенов, выход 50 долларов, запись кэша на 5 минут 12,5 доллара, на час 20 долларов. Чтение кэша стоит 0,25 доллара за миллион токенов - это 0,025 от базовой ставки входа против 0,1 у остальных моделей Claude, то есть вчетверо дешевле. Пакетная обработка: 5 и 25 долларов.
Блок размышлений Fable 5.1 действителен только в том разговоре, который его породил. Если между запросами изменился системный промпт, список инструментов или любое более раннее сообщение, следующий запрос с этим блоком отклоняется. Проверка включена для аккаунтов, созданных 31 августа 2026 года и позже. Лечится тем, что история ведётся только на дозапись: разовые напоминания отправляются системными сообщениями на один ход, а обрезка контекста делается на стороне сервера.
Короткие заметки о прогрессе приходят отдельными блоками thinking, а при значении thinking.display по умолчанию (omitted) эти блоки возвращаются пустыми. Нужно включить display: updates через бета-заголовок thinking-display-updates-2026-08-18 и выводить каждый непустой блок как строку статуса. Кроме того, из промпта надо убрать старые указания вроде держать все находки до финального ответа.
Начинайте с high - это значение по умолчанию, затем прогоняйте свои проверки на low, medium, xhigh и max. Названия уровней не соответствуют одинаковому объёму размышлений у разных моделей, поэтому перебор надо повторить, даже если вы делали его на Fable 5. На medium результат примерно как у Fable 5, но дешевле; на low модель часто выигрывает у моделей поменьше и по цене задачи, и по качеству.
Для большинства рабочих нагрузок Anthropic рекомендует начинать с Claude Opus 5. Fable 5.1 берут под требовательные рассуждения и длинную автономную работу или когда проверки на Opus 5 при высоком effort всё ещё не дотягивают. Прирост у 5.1 относительно Fable 5 виден на всех уровнях effort и наибольший на высоких.
Промпты из этого материала работают и в Claude Code, и в собственной обвязке через API.
По материалам официальной документации Anthropic. Примеры промптов адаптированы на русский язык командой reymer.ai.