Эволюция, экономия токенов, промпты, обвязки и построение навыков
1 сентября 2026 года Anthropic выпустила «Claude Fable 5.1». На момент написания этой статьи, 2 сентября 2026 года, прошёл всего один день с момента релиза. Поэтому вместо субъективных обзоров в соцсетях я систематизирую информацию на основе официальной документации Anthropic, API-документов и последних спецификаций Claude Code.
Сразу перейду к выводу: Fable 5.1 — это не просто «модель, которая отвечает на обычные вопросы немного умнее».
Её суть — в способности обрабатывать задачи, растянутые на часы или дни, не теряя из виду цель, копать до первопричин, а не поверхностных проблем, и проверять собственный вывод до самого конца.
Однако цена вдвое выше, чем у Opus 5, и в пять раз выше, чем у Sonnet 5. Кроме того, внутреннее мышление нельзя отключить. Если вы будете скармливать Fable 5.1 всё подряд, вы исчерпаете лимиты использования и бюджет, так и не успев по-настоящему воспользоваться её возможностями.
Ключ к освоению Fable 5.1 — не просто писать отличные промпты.
Это проектирование того, какие конкретные задачи поручить Fable, какую информацию загружать и какие процессы передать более дешёвым моделям или скриптам.
Часть 1: Полное объяснение Claude Fable 5.1
1. Что такое Claude Fable 5.1?
Claude Fable 5.1 позиционируется как модель с наивысшими возможностями среди всех, выпущенных Anthropic для публичного доступа.
Fable 5.1 и пригласительная Claude Mythos 5.1 — это, по сути, одна и та же модель. Разница в основном заключается в мерах безопасности. Общедоступная Fable включает строгие классификаторы для выявления областей высокого риска, таких как кибербезопасность, науки о жизни и химия. Mythos же используется проверенными организациями для оборонительных исследований и других целей. (Anthropic
Ключевые характеристики следующие:
Параметр | Claude Fable 5.1 |
|---|---|
Дата релиза | 1 сентября 2026 |
ID модели в API | claude-fable-5-1 |
Контекстное окно | 1 миллион токенов |
Максимальный вывод | 128 000 токенов |
Стандартная цена ввода | $10 за 1 млн токенов |
Стандартная цена вывода | $50 за 1 млн токенов |
Цена чтения из кэша | $0,25 за 1 млн токенов |
Метод мышления | Адаптивное мышление, всегда включено |
Стандартное усилие | high |
Дата среза знаний | Июнь 2026 |
Относительная скорость | Медленнее Opus 5 |
Основная доступность | Claude API, Bedrock, Google Cloud, Microsoft Foundry и др. |
Для индивидуальных пользователей Claude она доступна пользователям Pro, Max, Team и Enterprise. В API она доступна обычным клиентам без специального отбора. (Claude Platform
Контекст в 1 миллион токенов может, по простому расчёту, обработать от нескольких до дюжины книг, массивные кодовые базы или длинные истории разговоров за один раз.
Однако «в неё можно поместить 1 миллион токенов» отличается от «вы должны помещать в неё 1 миллион токенов».
Чем больше нерелевантных файлов, старых разговоров и длинных логов вы загружаете, тем сильнее зарывается важная информация. Хотя Fable 5.1 может обрабатывать массивные контексты, она не нейтрализует для вас нерелевантный контекст автоматически.
2. Эволюция Fable 5.1 — это «Работать дольше»
Самая значительная эволюция Fable 5.1 — это не точность одноразового ответа, а её способность сохранять согласованность во время длительных агентных задач.
Обычные AI-агенты склонны вызывать следующие проблемы по мере удлинения задач:
- Забывание изначальной цели.
- Выполнение только симптоматических исправлений без исследования причины.
- Многократное чтение одних и тех же файлов или веб-страниц.
- Произвольное сокращение объёма работы на полпути.
- Объявление «я протестирую это дальше» и простое завершение.
- Внесение масштабных изменений без выполнения финальной проверки работоспособности.
Fable 5.1 уделяет большое внимание улучшению этих срывов во время длительной работы. Официальные описания называют основными сценариями использования программирование, операции с браузером, исследования и создание документов/таблиц/слайдов, длящиеся от нескольких часов до нескольких дней. Она спроектирована так, чтобы восстанавливаться после неудачных шагов, переопределять приоритеты и продолжать работу, ведя собственные рабочие логи. (Anthropic
Компании, которые первыми внедрили модель, сообщили о следующих случаях:
В MongoDB она, как сообщается, исследовала сервисный код и документацию для создания нового дизайна, завершив сложный прототип примерно за три дня автономной работы. В Ramp она работала 38 часов подряд над проблемой машинного обучения, обнаружила ошибки разметки в прошлых результатах и, исправив их, выполнила шесть экспериментов параллельно. (Anthropic
Кроме того, в случае с Millennium сообщалось, что для сбоя, происходящего лишь один раз на миллион, модель дизассемблировала внешние библиотеки, сверила их с дампами памяти и дошла до причины, которая оставалась необнаруженной годами. Хотя это истории клиентов на официальной странице, а не результаты, воспроизведённые независимыми агентствами, они ясно указывают направление, к которому стремится Fable 5.1. (Anthropic
Короче говоря, Fable 5.1 — это не столько «AI, который пишет много кода», сколько:
Ответственный лид, который изолирует сложные проблемы, собирает необходимую информацию, пробует несколько методов, проверяет доказательства и, наконец, компилирует результаты.
3. Что улучшилось в бенчмарках?
Согласно основным показателям, опубликованным Anthropic, Fable 5.1 показала значительный рост в долгосрочных агентах, научных исследованиях и бизнес-автоматизации.
В Terminal-Bench-Science 0.1, измеряющем научные терминальные задачи, показатель вырос с 24,7% у Fable 5 до 52,6%. В Terminal-Bench 4.0, измеряющем общее агентное программирование, она набрала 55,8% по сравнению с 42,0% у Fable 5. Mythos 5.1 с другими ограничениями безопасности набрала 60,9%.
В AutomationBench, измеряющем бизнес-автоматизацию, показатель вырос с 17,1% у Fable 5 до 31,4%. В CursorBench 3.2 Fable 5.1 набрала 73,4% по сравнению с 70,5% у Fable 5 и 70,0% у Opus 5.
Кроме того, в Humanity’s Last Exam, измеряющем продвинутые рассуждения в нескольких областях, она набрала 60,9% без инструментов и 65,0% с инструментами. (Anthropic
Однако при чтении этих цифр нужна осторожность.
Это результаты оценки, опубликованные Anthropic. Кроме того, у Fable включены производственные классификаторы безопасности; в задачах, где классификатор вмешался, она может получить ноль, или процесс может переключиться на другую модель. Поэтому разница между Fable и Mythos может включать различия в настройках безопасности, а не только чистую способность модели. (Anthropic
Также на стадии «дня после релиза» важнее, чем быть номером один в бенчмарках, является «процент завершения задач» в вашей собственной практической работе.
Например, в производстве статей одной текстовой оценки недостаточно:
- Смогла ли она проверить факты по первоисточникам?
- Соблюла ли она указанное количество символов?
- Устранила ли она повторы и противоречия?
- Различала ли она цитаты и пересказы?
- Согласована ли она от заголовка до заключения?
Если вы не подготовите такие практические оценки, использование дорогой Fable может просто привести к долгим размышлениям без лучшего результата.
4. Адаптивное мышление теперь всегда включено
В Fable 5.1 адаптивное мышление всегда включено.
В отличие от предыдущих моделей, мышление нельзя полностью отключить. Указание thinking: {type: "disabled"} в API приведёт к ошибке. Метод, при котором человек задаёт фиксированное количество токенов для мышления, также недоступен; модель сама регулирует объём мышления в зависимости от задачи. (Claude Platform
Что пользователи могут настраивать, так это «усилие».
Доступно пять уровней:
- low
- medium
- high
- xhigh
- max
По умолчанию стоит high.
Официальная рекомендация — начинать с high, а затем понижать или повышать его на основе фактических результатов оценки. Для рутинной обработки используйте medium или low; используйте xhigh или max только для очень сложных задач проектирования, отладки, исследований или долгосрочной агентной работы.
Говорят, что Fable 5.1 показывает производительность, близкую к старой Fable 5, даже на уровне medium, а на уровне low она может иметь лучшее соотношение цены и производительности на задачу, чем запуск меньшей модели на высоком усилии для некоторых работ. (Claude Platform
Важно здесь то, что внутреннее мышление также тарифицируется как выходные токены и расходует max_tokens.
Например, даже если финальный текст, отображаемый на экране, составляет 10 000 токенов, но перед этим модель использовала эквивалент 10 000 токенов для размышлений, в общей сложности 20 000 токенов будут подлежать тарификации на стороне вывода. Поскольку цена за единицу вывода Fable составляет $50 за 1 миллион токенов, неоправданное использование max быстро увеличит расход. (Claude Platform
Fable 5.1 — это не модель, где «более высокое усилие всегда приносит прибыль».
Использование max для форматирования текста или суммаризации может просто увеличить количество случаев, когда модель пишет черновик внутри, а затем снова пишет его в поле ответа. Anthropic также советует в принципе использовать high для длинных результатов и переходить на xhigh или выше только в том случае, если можно измерить улучшение качества. (Claude Platform
5. Высокие цены, но чрезвычайно дешёвое кэширование
Стандартные тарифы Fable 5.1 составляют $10 за 1 миллион входных токенов и $50 за 1 миллион выходных токенов.
Поскольку Opus 5 стоит $5/$25, а Sonnet 5 — $2/$10, Fable в два раза дороже Opus и в пять раз дороже Sonnet по простой цене за токен. (Claude Platform Docs
С другой стороны, серьёзным изменением в Fable 5.1 является цена чтения из кэша.
В то время как в Fable 5 она составляла $1 за 1 миллион токенов, в Fable 5.1 она стала $0,25. Это 2,5% от обычной цены ввода. Anthropic оценивает, что при типичной обработке это приведёт к снижению затрат примерно на 25% по сравнению со старой Fable и до 45% для агентной обработки, которая многократно читает кэш. (Anthropic
Например, если вы каждый раз читаете фиксированный контекст из 100 000 токенов, это будет стоить $0,10 за раз по обычной цене ввода, но всего $0,0025, если это попадание в кэш.
Другими словами, работа, которая многократно читает одни и те же описания проектов, определения инструментов, предпосылки кодовой базы и истории разговоров в стабильной форме, более выгодна.
И наоборот, использование, которое каждый раз переписывает системный промпт, меняет порядок инструментов или удаляет и перестраивает старые разговоры, разрушает кэш.
В Fable 5.1 структура промпта без разрывов более напрямую связана со стоимостью, чем умный промпт.
6. Fable 5.1 может сломать существующие API-обвязки
При замене только имени модели с Fable 5 или Opus есть три момента, на которые следует обратить особое внимание:
Принудительный вызов инструмента недоступен
Принудительное указание any или конкретного имени инструмента в tool_choice приведёт к ошибке 400.
Причина в том, что принудительный вызов инструмента заставляет модель пропускать нормальные процессы мышления и начинать думать внутри аргументов инструмента, что ухудшает качество аргументов.
Вместо этого используйте tool_choice: auto и явно укажите «Пожалуйста, используйте инструмент XX для этого процесса» в промпте. Если вы хотите гарантировать JSON-формат, используйте strict: true или Structured Outputs. (Claude Platform
Историю разговора нельзя переписывать на полпути
Блок мышления в Fable 5.1 привязан к системному промпту, инструментам и прошлым сообщениям, существовавшим на момент генерации этого мышления.
Если вы удалите старые сообщения, перегенерируете системный промпт или перепишете определения прошлых инструментов на полпути, последующие блоки мышления станут недействительными. Для новых аккаунтов уже применяется механизм, делающий такое нарушение условия ошибкой. (Claude Platform
Основной принцип — не редактировать историю, а только добавлять в конец.
Временные инструкции следует добавлять как системные сообщения с областью действия «turn», а длинные контексты следует организовывать с помощью серверной компактизации или редактирования контекста.
Внутреннее мышление нельзя перенести при возврате к более дешёвым моделям
Fable 5.1 может читать блоки мышления, созданные предыдущими моделями, такими как Opus 5, Fable 5 или Sonnet.
Однако обратное невозможно. Если вы передадите блок мышления, созданный Fable 5.1, моделям Opus или Sonnet, эти модели не смогут его прочитать. (Claude Platform Docs
Поэтому, если вы переключаете модели в рамках одного разговора, следующий порядок обычно безопасен:
Исследовать дешёвыми моделями → Повысить до Fable
Если вы возвращаетесь к более дешёвой модели от Fable, вы должны оставить решения, нерешённые проблемы, необходимые файлы и результаты проверки в виде явного передаточного документа, не полагаясь на блок мышления.
7. Ограничения безопасности и хранение данных
В Fable 5.1 некоторые запросы, касающиеся кибербезопасности или наук о жизни, ограничиваются классификаторами безопасности.
В стандартном приложении Claude соответствующие процессы могут автоматически направляться на Opus 4.8 или Opus 5. В API вам нужно настроить параметры fallback. За процессы, переключённые на другие модели, с вас не будет взиматься плата по тарифам Fable. (Anthropic
Кроме того, Fable 5.1 обычно требует 30-дневного хранения данных. Если вы не получили явного разрешения от Anthropic, её нельзя использовать в стандартных средах с нулевым хранением данных (Zero Data Retention).
При работе с конфиденциальным корпоративным кодом, информацией о клиентах или неопубликованными исследовательскими материалами, вы должны внедрять её только после подтверждения контракта и условий хранения, а не просто использовать «потому что производительность высокая». (Claude Platform
8. Кому в конечном итоге нужна Fable 5.1?
Fable 5.1 предназначена для людей, для которых ценностью является процент завершения всей работы, а не единичный ответ модели.
- Исследование и модификация массивных кодовых баз.
- Анализ первопричин трудно воспроизводимых ошибок.
- Исследования, охватывающие десятки документов.
- Задачи, которые проходят путь от исследования до создания таблиц, документов и слайдов.
- Длительные операции с браузером или обработка бэклога.
- Исследования, которые автономно планируют и выполняют несколько экспериментов.
И наоборот, почти нет необходимости использовать Fable для создания писем, коротких резюме, простой генерации кода, рутинной организации документов или написания черновиков постов в соцсетях.
Anthropic сама рекомендует начинать общую обработку с Opus 5 и переходить на Fable только в том случае, если качество недостаточно даже при запуске Opus на высоком усилии. (Claude Platform Docs
Fable 5.1 — это не «стандартная модель для всех, чтобы начать с неё», а высококлассная модель для прорыва в сложных точках.
Часть 2: Экономия токенов, промпты, обвязки и построение навыков
1. Техники экономии токенов для Fable 5.1
Совет по экономии 1: Не заставляйте Fable делать всё с самого начала
Самый эффективный способ экономии — это не написание коротких предложений.
Это сокращение количества вызовов самой Fable.
Оставьте получение списков файлов, фильтрацию логов, классификацию материалов, простые резюме и преобразования форматов для Sonnet, Haiku или обычных скриптов.
Используйте Fable для таких этапов:
- Определение политики исследования
- Выбор наиболее многообещающей гипотезы из нескольких
- Интеграция противоречивой информации
- Выявление первопричин
- Аудит финальных результатов
- Повторное рассмотрение проблем, где другие модели потерпели неудачу
Официальная документация также предлагает конфигурации с использованием нескольких моделей, где недорогие модели выступают в роли исполнителей, а высококлассные — в роли советников или супервизоров. (Claude Platform Docs
Совет по экономии 2: Меняйте усилие для каждого шага
Вам не нужно устанавливать весь сеанс на max.
Я рекомендую следующее распределение:
Процесс | Усилие |
|---|---|
Исследование файлов / Организация информации | low или medium |
Обычная реализация / Создание текста | medium или high |
Проектирование / Анализ причин / Интеграция | high |
Финальный прорыв в сложных задачах | xhigh |
Финальная проверка, где цена ошибки чрезвычайно высока | max (только при необходимости) |
Fable 5.1 также предоставляет механизм для изменения усилия во время разговора. Вместо перезаписи настроек верхнего уровня добавление изменений усилия в виде системных сообщений на полпути позволяет поддерживать кэш промпта. (Claude Platform
Правильный подход — не «всегда максимальная производительность», а «максимальная производительность только для сложных ходов».
Совет по экономии 3: Храните историю в режиме «только добавление» для защиты кэша
В Fable 5.1 сохраняйте следующее содержимое фиксированным:
- Системный промпт
- Определения инструментов и их порядок
- Общие правила проекта
- Прошлые сообщения
- Блоки мышления
Все изменения добавляйте в конец.
Если вы создаёте свой собственный API, безопаснее поддерживать один и тот же префикс «байт-в-байт», а не пересобирать системный промпт каждый раз.
В Claude Code обработка кэша в основном автоматизирована, но вы можете использовать cache_control в API. Для многошаговых разговоров используйте автоматическое кэширование; для разделения длинных фиксированных материалов используйте явные границы кэша. (Claude
Совет по экономии 4: Не передавайте вывод инструментов как есть
Передавать Claude 10 000 строк логов и просить «найти ошибку» — расточительно.
Сначала отфильтруйте их с помощью скриптов или хуков.
Официальное руководство по стоимости Claude Code также рекомендует предварительно обрабатывать длинные логи с помощью хуков и передавать модели только необходимые несколько сотен строк. В нём также объясняется, что использование CLI, таких как gh, aws или gcloud, когда они доступны, облегчает подавление потребления контекста от определений инструментов, чем подключение большого количества MCP-серверов. (Claude
Прежде чем позволить AI читать, сократите то, что можно сократить машинным способом.
Совет по экономии 5: Группируйте независимые вызовы инструментов
При чтении пяти файлов, если вы разбиваете это на пять шагов по одному файлу, история разговора отправляется каждый раз.
Включение следующей инструкции в Fable 5.1 эффективно:
«Организуйте необходимую информацию внутри себя и выполняйте чтения, поиски и проверки, которые не зависят друг от друга, параллельно в рамках одного шага».
Anthropic также объясняет, что, поощряя группировку независимых вызовов инструментов в одном ответе, можно сократить количество раундов, токенов и время ожидания. (Claude Platform
Совет по экономии 6: Не позволяйте ей переписывать весь файл для небольших исправлений
Fable 5.1 может переписать весь файл даже для небольших изменений.
Включите эту фразу в свои общие правила:
«Если конечный результат не меняется, не переписывайте весь файл; редактируйте только необходимые части с минимальными diff-ами».
Это особенно эффективно для длинных Markdown, JSON, конфигурационных файлов, LP и массивных исходных кодов. Предотвращая полную регенерацию, вы можете подавить выходные токены и нагрузку по проверке diff-ов. (Claude Platform
Совет по экономии 7: Не продолжайте несвязанную работу в том же сеансе
В Claude Code используйте /clear при переходе к несвязанной работе.
В длинных разговорах даже добавление одного короткого вопроса означает повторную обработку прошлых разговоров, прочитанных файлов и результатов инструментов. Даже если кэш работает, это не бесплатно.
Если вы не хотите загрязнять историю временными вопросами, используйте /btw; если вы хотите сохранить только необходимое содержимое, используйте /compact. Переложите исследование кодовой базы на под-агентов и возвращайте в основной разговор только резюме. (Claude
2. Практические промпты для Fable 5.1
Для Fable 5.1 более эффективно чётко передавать цель, объём, условия завершения и методы проверки, чем указывать десятки детальных шагов мышления.
Ниже приведён базовый шаблон, который можно адаптировать для программирования, исследований, создания статей и документов.
Роль
Вы — человек, ответственный за выполнение этого запроса до конца.
Вы отвечаете не только за ответ, но и за необходимые исследования, работу, проверку и исправление.
Цель
[Напишите конечный продукт, который нужно создать, или проблему, которую нужно решить]
Ввод
[Напишите файлы, URL-адреса, материалы и предварительные условия]
Объём
Что нужно сделать:
- [Обязательная задача]
- [Обязательная задача]
Что не нужно делать:
- [Вне объёма]
- [Содержимое, которое вы не хотите, чтобы меняли произвольно]
Условия завершения
Задача считается выполненной, когда выполнены все следующие условия:
- [Условия для функции/содержимого]
- [Условия для формата/количества символов/качества]
- [Метод проверки]
- [Доказательство отсутствия ошибок]
Правила выполнения
- Сначала организуйте необходимую информацию и зависимости.
- Выполняйте поиски, чтения и проверки, которые не зависят друг от друга, параллельно.
- Продолжайте обратимую работу в рамках запроса, не спрашивая разрешения на полпути.
- Прежде чем исправлять, подтверждайте причину, а не только симптомы проблемы.
- Не выполняйте незапрошенные добавления функций, оптимизации или периферийные исправления; вынесите их как предложения в конец.
- Редактируйте файлы с минимальными diff-ами, когда это возможно.
- После работы проверяйте в соответствии с начальными условиями завершения.
- Если проверка не удалась, исследуйте причину, исправьте и проверьте снова.
- Не заканчивайте, написав «что делать дальше»; выполняйте эту работу.
- Запрашивайте разрешение перед выполнением только для деструктивных операций или серьёзных изменений спецификаций.
Финальный отчёт
В конце кратко отчитайтесь в следующем порядке:
- Что было сделано
- Внесённые изменения
- Результаты проверки и доказательства
- Оставшиеся проблемы
- Кандидаты на улучшение, которые были замечены, но выходят за рамки объёма
Fable 5.1 может продолжать работать в течение длительного времени, но если неясно, что считается завершением, она будет продолжать исследовать больше, чем необходимо.
Поэтому написание условий завершения и остановки важнее, чем фраза «думай глубже».
3. Дизайн обвязки для использования Fable 5.1
Обвязка — это механизм работы, окружающий модель.
Вместо того чтобы полагаться исключительно на возможности модели, вы извне решаете, какую информацию передавать, какие инструменты использовать, в каком порядке действовать, где проверять и сколько раз повторять попытку при сбое.
Я рекомендую следующую 6-уровневую структуру:
Уровень 1: Общие правила
В CLAUDE.md помещайте только факты о проекте, необходимые каждый раз.
Проект
- Этот репозиторий предназначен для сервиса XX
- Продуктивная среда — XX
- Для управления пакетами используйте pnpm
Обязательные проверки
pnpm lintпосле измененийpnpm testпосле изменений- Проверка типов при изменениях API
Ограничения
- Не нарушайте обратную совместимость с существующими API
- Не выводите секретную информацию в логи
- Не выполняйте рефакторинг за пределами запроса
Поскольку CLAUDE.md считывается в каждом сеансе, его чрезмерная длина будет расходовать контекст каждый раз. Официальная документация рекомендует держать один файл объемом менее 200 строк, а длинные процедуры выносить в Skills. (Claude
Уровень 2: Маршрутизатор
При получении запроса классифицируйте задачу, вместо того чтобы сразу запускать Fable.
- Простое извлечение/форматирование -> Haiku или скрипт
- Обычная реализация/исследование -> Sonnet
- Сложный дизайн/анализ -> Opus
- Долгосрочная работа/трудные проблемы -> Fable
- Только неудавшиеся сложные моменты -> Fable xhigh
При создании автоматического маршрутизатора оценивайте на основе «потерь при ошибке», «необходимого времени на автономную работу» и «сложности проверки», а не цены.
Уровень 3: Ведущий исследователь
Разделите исследование кода, сбор материалов и анализ конкурентов на под-агентов.
Каждый под-агент работает в независимом контексте и возвращает основному агенту только выводы и доказательства. Это предотвращает раздувание основной истории результатами чтения десятков файлов. (Claude
Уровень 4: Супервизор Fable
Fable принимает решения, используя результаты, возвращенные ведущими исследователями.
- Какую гипотезу принять
- Нужно ли дополнительное исследование
- Какие изменения внести
- Есть ли противоречия в результатах
- Выполнены ли условия завершения
Вместо того чтобы возлагать на Fable ответственность за всё, вплоть до сбора необработанных данных, передавайте ему организованные доказательства и позволяйте сосредоточиться на принятии решений.
Уровень 5: Детерминированная проверка
Не полагайтесь исключительно на промпты для проверки.
- Для кода: Тесты, Lint, проверки типов.
- Для статей: Количество символов, повторяющиеся выражения, URL, цитаты.
- Для таблиц: Ошибки в формулах, пропущенные значения, итоги.
- Для лендингов: Ссылки, нарушения верстки, сравнение скриншотов.
Используя хуки, вы можете запускать проверки до и после выполнения инструментов. Вместо того чтобы надеяться, что LLM вспомнит о проверке, выполняйте её автоматически при фиксированных условиях. (Claude Platform Docs
Уровень 6: Цикл исправления
Возвращайтесь к Fable только в случае неудачной проверки.
Создание -> Механическая проверка -> Успех (Завершено) / Неудача -> Анализ причин -> Минимальное исправление -> Повторная проверка
Важно не зацикливаться бесконечно.
Например, решите «не более 2 раз для одного и того же сбоя» или «остановиться с доказательствами после 3 общих сбоев». Для моделей, способных работать долгое время, затраты и объем работ будут расти без условий остановки.
Для процессов, использующих десятки или сотни под-агентов, переходите к Dynamic Workflow, а не позволяйте Claude управлять ими последовательно. В Workflow вы можете хранить промежуточные результаты в переменных скрипта и возвращать только финальный результат в основной контекст, что делает его подходящим для масштабных исследований или обработки огромных файлов. (Claude
4. Skills — это не «Хранилище длинных промптов»
Skills — это механизм для сохранения часто используемых рабочих процедур в виде SKILL.md.
Отличие от CLAUDE.md в том, что содержимое считывается только при необходимости.
- Информация о проекте и краткие правила, которым нужно следовать всегда: CLAUDE.md.
- Процедуры создания статей, развертывания, исследования, рецензирования и т.д.: Skills.
- Большие объемы примеров или спецификаций: Справочные файлы для Skills.
Это разделение напрямую ведет к экономии токенов. (Claude Platform Docs
Я рекомендую следующую структуру:
1.claude/2├── CLAUDE.md3├── skills/4│ └── deep-article/5│ ├── SKILL.md6│ ├── research-rules.md7│ ├── writing-rules.md8│ ├── examples.md9│ └── scripts/10│ ├── count_chars.py11│ └── check_repetition.py12├── agents/13│ ├── researcher.md14│ └── critic.md15└── settings.json
В SKILL.md размещайте только обзор, условия выполнения, процедуры и условия завершения.
Выносите объемные объяснения, спецификации API и истории успеха в отдельные файлы и позволяйте Claude читать их только при необходимости. Официальная документация рекомендует держать SKILL.md объемом менее 500 строк, а подробные материалы выносить в вспомогательные файлы. (Claude Platform Docs
5. Практический шаблон SKILL.md
Ниже приведен примера Skill для создания исследовательских статей.
name: deep-article
description: Исследует первичную информацию и создает развернутые статьи с доказательствами. Используйте, когда требуется тщательное объяснение последних новостей об AI, компаниях, системах или продуктах.
argument-hint: "[Тема] [Целевое количество символов]"
effort: high
Цель
Создать фактологически проверенную развернутую статью о $ARGUMENTS.
Основные правила
- Всегда проверяйте, актуальна ли последняя информация
- Отдавайте приоритет первичной информации
- Различайте факты, корпоративные заявления, сторонние оценки и предположения
- Привязывайте к числам целевые периоды и определения
- Не повторяйте одни и те же выводы или примеры
- Объясняйте технические термины при первом упоминании
- Не завершайте работу, если не достигнуто 90% указанного количества символов
- В конце сообщите количество символов и непроверенные пункты
Рабочий процесс
- Разделите тему на 3-7 пунктов исследования
- Исследуйте независимые пункты параллельно
- Соберите первичную информацию
- Изучите контраргументы или неблагоприятную информацию
- Создайте список фактов
- Определите структуру
- Создайте первый черновик
- Проверьте на дубликаты, логические скачки, цитаты, даты и числа
- Исправьте
- Проверьте количество символов
Условия завершения
- Вывод ясен с самого начала
- Читатель может принять решение о дальнейших действиях
- Важные факты имеют источники
- Факты и предположения не смешаны
- Соответствует указанному количеству символов
- Нет повторяющихся абзацев
Материалы для чтения только при необходимости
- Стандарты исследования: research-rules.md
- Стандарты стиля: writing-rules.md
- Хорошие примеры выполнения: examples.md
Финальная проверка
Выполните следующее:
python ${CLAUDE_SKILL_DIR}/scripts/count_chars.py <output-file>python ${CLAUDE_SKILL_DIR}/scripts/check_repetition.py <output-file>
Описание Skill функционирует как маршрутизатор, а не просто как объяснение.
Вместо расплывчатой фразы вроде «Пишите качественные статьи», написание «Используйте для развернутых запросов, исследующих первичную информацию о последних AI, компаниях и системах» облегчает его вызов в необходимых ситуациях.
Поскольку Claude Code помещает список описаний Skills в контекст, написание объемных описаний увеличивает постоянные затраты. Помещайте важные варианты использования в начало и делайте их краткими. (Claude Platform Docs
6. Продвинутое использование Skills
Skills, которые нельзя запускать автоматически
Развертывание, отправка, удаление, публикация и платежи не должны запускаться Claude произвольно.
Установите disable-model-invocation: true и запускайте их только тогда, когда пользователь явно вводит /deploy и т.д.
Skills, которые не должны загрязнять диалог
Для Skills, выполняющих масштабное исследование или исследование кода, установите context: fork.
Это приведет к их выполнению в отдельном контексте под-агента. Огромное содержимое файлов и история поиска не попадут в основной диалог; вернется только финальный результат. (Claude Platform Docs
Skills, которые автоматически внедряют текущее состояние
Внутри Skill вы можете предварительно вставлять результаты команд.
Текущее состояние
!git status --short
!git diff --stat
Claude получает результат выполнения, а не строку команды.
Однако вставлять полные git diff или огромные логи каждый раз контрпродуктивно. Вставляйте сначала только --stat или строки ошибок, и позволяйте читать детали только тогда, когда они становятся необходимыми. (Claude Platform Docs
Настройка effort для Skills
Установите для простых Skills значение medium, для рецензирования дизайна и глубоких исследований — high, а для чрезвычайно сложных проверок — xhigh.
Если каждый Skill имеет собственный effort, пользователю не нужно переключать его каждый раз.
7. Всегда сравнительно оценивайте Skills
Простое создание Skill не говорит о том, улучшилось ли качество.
Официальная документация рекомендует оценивать две вещи отдельно:
- Запускается ли Skill правильно для необходимых запросов?
- Улучшается ли результат в результате запуска?
Выполните один и тот же запрос в новых сеансах как «с Skill», так и «без Skill».
Для Skill по написанию статей сравните количество символов, отсутствующие источники, дубликаты, фактические ошибки и количество исправлений. Для Skill по написанию кода сравните процент успешных тестов, количество измененных файлов, ненужные изменения и количество переделок.
Тестирование в продолжении диалога, где вы создали Skill, скроет дефекты из-за дополнительной информации из диалога. Всегда оценивайте в новом сеансе. Claude Code также предоставляет официальный плагин skill-creator для поддержки этого сравнения. (Claude Platform Docs
Окончательный вывод
Claude Fable 5.1 — это не модель, которая просто ускоряет серию Claude.
Её величайшая ценность заключается в способности долгое время продолжать сложную работу, восстанавливаться после сбоев на полпути, искать корневые причины и доводить работу до завершения, проверяя собственные результаты.
С другой стороны, цены за единицу ввода и вывода вдвое выше, чем у Opus 5. Внутреннее мышление нельзя отключить, она несовместима с обвязками, перезаписывающими старые диалоги, и принудительный вызов инструментов недоступен.
Поэтому самый сильный способ её использования заключается в следующем:
**Сужайте информацию с помощью Sonnet или скриптов.
Отделяйте исследование с помощью под-агентов.
Назначайте Fable сложные решения и интеграцию.
Проверяйте механически с помощью хуков и тестов.
Повышайте effort только для неудавшихся сложных моментов.
Сохраняйте повторяющиеся процедуры в Skills.
Держите историю диалога в режиме append-only для защиты кэша.**
Если использовать Fable 5.1 как «элитный чат, отвечающий на всё», высокой будет только цена.
Истинное отличие от предыдущих поколений проявляется только тогда, когда вы позиционируете Fable 5.1 как супервизора, объединяющего дешевые модели, Skills, под-агентов, хуки и циклы проверки.





