Anthropic только что выпустила самую мощную модель из когда-либо созданных, и скачок в бенчмарках — едва ли не самая неинтересная её часть.
Claude Fable 5.1 ощущается не столько как улучшенный чат-бот, сколько как оператор нового типа. Он может часами работать над задачей, восстанавливаться, когда план ломается, координировать других агентов, проверять собственные результаты и продолжать движение, не требуя, чтобы кто-то спасал его каждые десять минут.
Цифры это подтверждают. Согласно опубликованным оценкам Anthropic, Fable 5.1 более чем вдвое превзошёл Fable 5 в агентных научных исследованиях, подскочил с 17,1% до 31,4% в бизнес-автоматизации и достиг 73,4% в CursorBench. Он также опередил Fable 5, Opus 5 и GPT-5.6 Sol по большинству тестов на кодинг, автоматизацию, использование компьютера и работу со знаниями, которые опубликовала Anthropic.
https://x.com/claudeai/status/2094848581425377479
Из коробки он исключительно хорош в сложном кодинге, долгосрочных задачах, исследованиях, планировании, использовании компьютера и создании готовых результатов. Но гораздо более важная возможность — это то, что происходит, когда вы перестаёте использовать его как человека, выполняющего каждую задачу, и ставите его во главе системы, которая делает работу.
Именно об этом данный курс: в чём Fable 5.1 действительно отличается, как поставить его на место лидера, как построить подчинённых ему рабочих, как давать ему промпты, не ограничивая его, как использовать цели и циклы, и пять рабочих процессов, где эта разница может превратиться в реальные деньги.
Если вам всё равно на терминалы, файлы агентов и оркестрацию, и вы просто хотите превратить идею в работающее приложение, для этого мы создали Shipper.
в чём эта модель действительно исключительна
Прежде чем перейти к методам, познакомьтесь с машиной. Вот пять способностей, которые делают Fable 5.1 непохожим на предыдущие модели.
он сохраняет связность при невероятно долгих сессиях
Дайте ему задачу на несколько часов, и он с гораздо меньшей вероятностью потеряет нить повествования на полпути.
Один из первых тестировщиков сообщил о 38-часовом запуске машинного обучения без присмотра, в ходе которого Fable диагностировал плохой предыдущий результат, исправил его, запустил шесть экспериментов параллельно и вернулся с выводами и следующими шагами. Другой сказал, что он вёл собственные записи, менял приоритеты при изменении условий и возобновлял работу с того места, где остановился.
Контекстное окно в 1 миллион токенов помогает, но размер контекста — это не главное улучшение. Главное улучшение в том, что модель может продолжать принимать полезные решения внутри этого контекста, а не просто помнить, что информация существует.
он ищет первопричину, а не самое быстрое исправление
Предыдущие агенты часто находили первое исправление, которое устраняло ошибку. Fable 5.1 более склонен продолжать копать, пока не поймёт, почему ошибка существовала.
В ходе тестирования запуска Anthropic компания Millennium дала ему сбой, который происходил примерно один раз на миллион запусков и оставался необъяснённым в течение четырёх-пяти лет. Fable 5.1 разобрал внешнюю библиотеку, связал её с дампом памяти и проследил сбой до фактической ошибки. Все остальные модели, которые они пробовали, включая Fable 5, её пропустили.
Это важно далеко за пределами отладки. Тот же инстинкт проявляется в исследованиях, стратегии, финансовом анализе и операционной деятельности: не оптимизируйте симптом, когда базовая система неверна.
он может видеть, действовать и проверять
Fable 5.1 может просматривать скриншоты, графики, PDF-файлы, интерфейсы и документы, а затем использовать увиденное для управления следующим действием.
Это означает, что он может восстановить интерфейс по референсам, прочитать цифры, спрятанные внутри финансового документа, управлять браузером, сравнить свою реализацию с исходным дизайном и выявить визуальные проблемы до того, как заявит о завершении работы.
Его показатель OSWorld по использованию компьютера в тестах Anthropic поднялся выше, чем у Fable 5 и Opus 5. Что ещё более важно, модель всё чаще способна использовать зрение как часть цикла проверки, а не просто описывать предоставленное изображение.
он возвращает работу, а не лекцию о работе
Дайте ему папку с документами и попросите инвестиционный меморандум, презентацию, рабочий прототип или анализ, и он с гораздо большей вероятностью вернёт сам артефакт.
Ранние тестировщики сообщали о лучших результатах Anthropic в PowerPoint, более точном цитировании финансовых документов, более лаконичных правках контрактов и лучшем выполнении сложных многосоставных запросов. Инженер MongoDB описал трёхдневный запуск прототипа, в ходе которого модель исследовала существующие сервисы, спроектировала систему, реализовала её без присмотра поэтапно и вернула визуальные прохождения с доказательствами того, что каждый этап сработал.
Практическая разница проста: вы тратите меньше времени на преобразование ответа в полезную работу.
он был создан, чтобы руководить
Fable 5.1 наиболее ценен, когда он решает, что должно произойти дальше.
Claude Code уже может давать ему подагентов, фоновые сессии, команды агентов, динамические рабочие процессы, цели, циклы, браузеры, терминалы и файлы проектов. Fable обладает достаточной глубиной планирования и контекстом, чтобы удерживать эти части нацеленными на один финиш гораздо дольше, чем могли предыдущие модели.
Вот почему описанная ниже настройка работает и почему курс начинается с того, чтобы вывести Fable из роли рабочего.
кабина пилота: все элементы управления, которые вам действительно нужны
Обновите Claude Code, прежде чем делать что-либо ещё. Согласно текущей документации по конфигурации модели, версия 2.1.255 или новее заставляет псевдоним fable разрешаться в Fable 5.1, а последние релизы включают элементы управления goal, loop, background-agent и effort, используемые ниже.
Затем выберите модель и уровень усилий:
/model fable
/effort high
High — разумное значение по умолчанию для серьёзной работы. Опуститесь до medium для более дешёвых и быстрых проходов. Переходите на xhigh или max только тогда, когда проблема достаточно сложна, чтобы оправдать больше размышлений. Адаптивное мышление Fable всегда включено, поэтому effort — это элемент управления, который имеет значение.
Остальные элементы управления просты:
/plan или Shift+Tab: позволяет ему изучить и спланировать, прежде чем изменять файлы
/goal: продолжает работу между ходами, пока не будет выполнено проверяемое условие
/loop: повторяет промпт по расписанию, пока сессия активна
/tasks: показывает, чем занимаются фоновые рабочие
/context: показывает, что потребляет контекстное окно
Это кабина пилота.
Остальная часть курса — знать, какой элемент управления использовать и когда.
главное событие: сделайте Fable лидером, а не рабочим
Самое большое улучшение — это смена роли.
Перестаньте давать Fable каждую задачу с клавиатуры. Сделайте так, чтобы он определял работу, разбивал её на чёткие направления, отправлял эти направления более дешёвым агентам и оценивал то, что возвращается.
Настройка выглядит так:
<strong>Fable формирует план:</strong>
переведите его в режим планирования и позвольте ему изучить проект, прежде чем предлагать изменения. Если запрос всё ещё расплывчатый, используйте
коллекцию навыков Мэтта Покока, чтобы допросить идею, превратить разговор в спецификацию и разбить спецификацию на задачи.
<strong>Fable делегирует изолированную работу:</strong>
реализация передаётся подагентам Opus или Sonnet, при этом каждый рабочий владеет одним ограниченным направлением. Codex также может быть рабочим, если вы уже используете его, но он должен следовать тем же границам файлов и правилам предоставления доказательств.
<strong>Отдельный агент проверяет:</strong>
рабочий не оценивает свою собственную домашнюю работу. Свежий верификатор читает план, проверяет diff, запускает проверки и либо пропускает этап, либо возвращает его с конкретным указанием на сбой.
<strong>Вы управляете на контрольных точках:</strong>
утверждаете план, рассматриваете значимые компромиссы и проверяете доказательства в конце. Вам не нужно следить за каждой командой.
Почему это работает: дорогая модель тратит свои токены на архитектуру, расстановку приоритетов, восстановление и оценку. Более дешёвые модели тратят их на ограниченное выполнение.
Экономика работает только тогда, когда направления действительно независимы. Согласно текущим ценам API Anthropic, Fable 5.1 стоит 10 долларов за миллион входных токенов и 50 долларов за миллион выходных токенов, в то время как Opus 5 стоит вдвое меньше, а Sonnet 5 — в пять раз меньше. Fable 5.1 также снизил стоимость чтения кэша до 0,25 доллара за миллион токенов, что делает длительные сессии со стабильным контекстом проекта гораздо более практичными.
Не распараллеливайте ради эффектности. Пять агентов, редактирующих одни и те же файлы, создадут пять счетов и одну проблему со слиянием. Распараллеливайте исследования, изолированные модули, тесты, документацию и другие направления, которые могут завершиться, не дожидаясь друг друга.
создайте своих рабочих
Лидеру нужна небольшая команда, а пользовательский рабочий — это всего лишь Markdown-файл внутри .claude/agents/.
Начните с одного рабочего по реализации:
name: implementation-worker
description: Реализует один изолированный этап из утверждённого плана. Используйте только тогда, когда этап владеет отдельными файлами.
model: opus
tools: Read, Grep, Glob, Edit, Write, Bash
maxTurns: 25
Вы владеете только этапом, назначенным вам.
Перед редактированием определите точные файлы и критерии приемки в вашем направлении.
Не изменяйте файлы, принадлежащие другому рабочему.
Реализуйте наименьшее полное решение, затем запустите соответствующие тесты.
Верните:
- изменённые файлы
- выполненные проверки и их реальный вывод
- всё, что всё ещё неопределённо
Не объявляйте об успехе без доказательств из этого запуска.
Затем создайте самого важного рабочего — верификатора:
name: verifier
description: Независимо проверяет завершённый этап на соответствие его плану и критериям приемки. Используйте после каждого этапа реализации.
model: opus
tools: Read, Grep, Glob, Bash
maxTurns: 15
Относитесь к сводке реализации как к ненадёжному утверждению.
Прочитайте план и проверьте фактический diff. Запустите соответствующие тесты самостоятельно.
Проверьте корректность, регрессии, объём и каждый критерий приемки.
Верните PASS или FAIL.
Для каждого сбоя приложите доказательства и наименьшее необходимое исправление.
Никогда не изменяйте реализацию, которую вы оцениваете.
Свежий взгляд замечает то, что автор считает нормой. Этап, проверенный немедленно, обходится гораздо дешевле, чем дефект, обнаруженный после того, как от него зависят ещё четыре этапа.
Четыре правила поддерживают скорость команды:
один рабочий, одно направление, с явным владением файлами
параллельная работа только тогда, когда направления не зависят друг от друга
Fable остаётся на месте лидера, пока Opus или Sonnet выполняет работу
каждое заявление о завершении проверяется на соответствие файлам, тестам или реальному результату
секрет 1: не предписывайте маршрут
Большинство советов по промптингу были написаны, чтобы удержать более слабые модели от блуждания.
Длинные процедуры, жёсткие списки шагов и огромные блоки правил помогали, когда модель не могла планировать. С Fable 5.1 те же самые леса могут заставить его пойти по худшему пути, чем тот, который он нашёл бы сам.
Хитрость в том, чтобы быть строгим в отношении пункта назначения и свободным в отношении маршрута.
Дайте ему четыре вещи:
<strong>результат:</strong>
что должно существовать, когда работа будет завершена
<strong>ограничения:</strong>
что он не может сломать, потратить, раскрыть или изменить
<strong>причину:</strong>
для кого это и какое решение или задачу должен поддерживать результат
<strong>доказательство:</strong>
какие наблюдаемые доказательства будут считаться завершением
Эта последняя часть меняет всё. «Сделай так, чтобы оформление заказа работало» провоцирует правдоподобное утверждение. «Выполни тестовую покупку в песочнице и покажи результирующую строку заказа» даёт модели финишную черту, которую она не сможет обойти разговорами.
Не просите демонстрации скрытой цепочки рассуждений. Просите план, важные решения, доказательства и оставшуюся неопределённость. Мышление Fable уже всегда включено. Для вас важно то, выдерживает ли результат проверку.
И не напоминайте ему постоянно, что бюджет заканчивается. Вместо этого установите границу в системе: ограничьте количество ходов рабочих, определите допустимые расходы и скажите ему, что делать, когда лимит будет достигнут.
секрет 2: держите CLAUDE.md лёгким
CLAUDE.md загружается в начале каждой сессии Claude Code. Это делает его полезным, но также означает, что каждая нерелевантная строка облагает налогом каждую будущую задачу.
Anthropic теперь рекомендует держать каждый файл объёмом менее 200 строк. На практике ваш обычно может быть намного короче.
Три раздела охватывают большинство проектов:
<strong>что это за проект:</strong>
продукт, архитектура и важные границы
<strong>как проверять работу:</strong>
команды для сборки, тестирования, линтинга и локального предварительного просмотра
<strong>что он постоянно делает неправильно:</strong>
специфические для проекта соглашения и повторяющиеся ошибки
Процедуры, которые нужны только иногда, относятся к навыкам. Правила, которые применяются только к определённым файлам, относятся к правилам с областью действия пути. Исторические заметки относятся к документации, а не в промпт каждой сессии.
Откройте свой CLAUDE.md сегодня вечером и оспорьте каждую строку: если её удаление не вызовет реальной ошибки, удалите её.
Более лёгкий файл обычно является более сильным.
секрет 3: злоупотребляйте целями и циклами
Здесь Fable перестаёт быть разговором и становится процессом, который может продолжаться, пока вы занимаетесь чем-то другим.
Цели: /goal даёт сессии одно проверяемое условие завершения. После каждого хода отдельная небольшая модель проверяет, выполнено ли условие. Если нет, Fable начинает следующий ход вместо того, чтобы передавать управление вам. Цель заканчивается, когда она пройдена, становится невозможной, возникает неисправимая ошибка или вы её отменяете.
Мастерство заключается в написании финишной черты, которую он не может подделать:
требуйте наблюдаемых доказательств: «все тесты аутентификации пройдены, и вывод приложен» сильнее, чем «исправь аутентификацию»
определите путь отказа: если реальный блокировщик делает цель невозможной, сообщите о блокировщике и доказательствах вместо того, чтобы выдумывать прогресс
ограничьте рискованные части: используйте maxTurns для рабочих, лимиты расходов для платных сервисов и явные границы для развёртываний или производственных данных
держите одно правило честности в каждом кратком описании: каждое заявление о прогрессе должно указывать на результат, полученный или проверенный во время этого запуска
Запускайте цели в автоматическом режиме только в тех границах, которые вы готовы оставить без присмотра. У более умного агента больше радиус поражения, когда краткое описание неверно.
Циклы: /loop повторяет промпт через определённый интервал. Используйте /loop 15m check the deployment and investigate any failure для фиксированной периодичности или опустите интервал и позвольте Claude решить, когда проверять снова.
Циклы внутри Claude Code ограничены сессией и со временем истекают. Используйте их для сборок, пул-реквестов, миграций и временного мониторинга. Используйте постоянную процедуру или запланированную задачу рабочего стола для работы, которая должна сохраниться после закрытия сессии или машины.
Благодаря целям и циклам вы можете заставить Fable работать столько, сколько действительно нужно для задачи, с доказательствами, ожидающими в конце, вместо очередного уверенного абзаца.
как сделать реальный проект за один подход
Теперь соберите всю систему вокруг одной сборки.
Пример — целевая страница с работающим списком ожидания. Замените проект, и та же последовательность сохранится.
шаг 1: напишите краткое описание
Отправьте одно сообщение:
Я запускаю [продукт] для [аудитории]. Им нужна целевая страница, которая делает одно чёткое обещание и собирает
email'ы.Build Одна адаптивная страница с работающей формой, которая сохраняет регистрации.Ограничения: никакого фреймворка, за которым нужно присматривать, никаких платных зависимостей, быстро на мобильных устройствах и никакого развёртывания, пока я не утвержу.Завершено означает, что страница работает локально, тестовый email появляется в хранилище, мобильный макет проверен на 390px, и результат показан с тестовым выводом и скриншотами.Сначала изучите проект и спланируйте. Делегируйте только независимые этапы. Проверьте каждый завершённый этап.
Краткое описание даёт ему пункт назначения, не разрабатывая реализацию за него.
шаг 2: утвердите план
Войдите в режим планирования с помощью /plan или Shift+Tab, прежде чем он что-либо изменит.
Если идея недостаточно конкретна, установите коллекцию Мэтта Покока с помощью /plugin install mattpocock-skills, один раз запустите /setup-matt-pocock-skills и используйте /grill-with-docs, прежде чем превращать результат в спецификацию.
Прочитайте план. Вырежьте функции, которые вам не нужны. Убедитесь, что каждый этап имеет наблюдаемое условие прохождения. Затем утвердите его.
шаг 3: позвольте команде работать
Fable назначает первый изолированный этап рабочему по реализации. Верификатор проверяет фактический diff и вывод тестов. Зависимый этап начинается только после того, как предыдущий пройден.
Вы можете покинуть терминал. Используйте /tasks, когда хотите увидеть, что ещё выполняется.
шаг 4: установите финишную черту
Используйте цель, которая называет состояние и доказательство:
/goal страница работает локально, форма сохраняет тестовую регистрацию, и макет работает на 390px, что подтверждается реальным выводом теста, сохранённой записью и текущим скриншотом. Если реальный блокировщик делает это невозможным, остановитесь и сообщите о доказательствах вместо того, чтобы заявлять об успехе.
Это условие гораздо труднее удовлетворить одними словами.
шаг 5: проверьте результат
Вернитесь к diff, выводу тестов, сохранённой регистрации и скриншотам.
Проверьте продукт как пользователь, а не как менеджер модели. Попросите изменения, которые вы действительно можете увидеть, выполните один последний независимый проход проверки и запускайте в производство, когда доказательства соответствуют краткому описанию.
Первый запуск покажется сложным.
Во второй раз вы заметите, что та же последовательность работает почти для любого проекта, который вы откладывали.
пять рабочих процессов, где это приносит реальные деньги
Теперь направьте настройку на работу, достаточно ценную, чтобы оправдать модель.
Вот пять рабочих процессов, где Fable 5.1 может создать измеримую разницу.
Работа с кодовой базой, которую никто не хочет делать: миграция, оценённая в три недели, редкий производственный сбой, проблема производительности, распределённая по восьми сервисам. Fable составляет карту системы, рабочие берут изолированные срезы, верификатор проверяет каждый этап, а прогресс привязан к тестам, а не к оптимизму.
Исследования на уровне принятия решений: один вопрос входит, исследовательские рабочие параллельно собирают данные из первоисточников, скептический рецензент атакует каждое важное утверждение, а лидер превращает то, что выжило, в меморандум. Это может подпитывать приобретение, запуск, рыночное решение или инвестиционный тезис.
Бизнес-операции: предоставьте ему доступ к нужным инструментам и позвольте сверять данные, расследовать аномалии, готовить отчёты, контролировать процесс или обрабатывать операционный бэклог. Fable 5.1 почти вдвое превзошёл показатель Fable 5 в AutomationBench от Anthropic, что является одним из самых чётких практических скачков в релизе.
Работа с продуктом на основе референсов: дайте ему скриншоты желаемого опыта, фактические ресурсы и доступ к работающему приложению. Он может реализовать на основе референса, открыть результат, сравнить их и продолжать, пока видимый разрыв не закроется. Вы обеспечиваете вкус. Он обеспечивает глаза, руки и терпение.
Система накопления знаний: направьте его на всё, что стоит сохранить в вашей компании, и позвольте ему превратить разрозненные документы в поддерживаемый, связанный источник истины. Копирайтер может построить его из отличных страниц продаж, агентство — из своих кейсов, а SaaS-компания — из звонков с клиентами, решений, экспериментов и истории поддержки. Каждый будущий агент начинает умнее, потому что полезный контекст уже существует.
Каждый из них когда-то был проектом «когда-нибудь».
Fable 5.1 превращает многие из них в проекты «на этой неделе», при условии, что вы дадите системе реальную финишную черту и способ доказать, что она её пересекла.
вся настройка в одном блоке
запустите Fable 5.1 как лидера: он планирует, делегирует, проверяет и принимает решения
используйте Opus или Sonnet для ограниченной работы, по одному рабочему на независимое направление
дайте ему результат, ограничения, причину и доказательство, затем позвольте ему выбрать маршрут
держите CLAUDE.md коротким и перемещайте случайные процедуры в навыки
используйте цели для проверяемого завершения и циклы для запланированных проверок
контролируйте стоимость с помощью уровней усилий, более дешёвых рабочих, кэшированного контекста и жёстких границ
направьте систему на кодовые базы, исследования, операции, работу с продуктом и знания, которые накапливаются
Модель — самая заметная часть настройки, но это не всё преимущество.
Преимущество в том, чтобы дать такой способной модели чёткий пункт назначения, компетентную команду, доступ к реальности и никакой возможности спутать убедительный ответ с законченной работой.





