Як опанувати Fable 5.1 та Mythos 5.1 (Повний посібник)

@chddaniel
АНГЛІЙСЬКА01 вер. 2026 р.
204K
262
27
7
1.1K

Коротко

Цей посібник досліджує агентні можливості Fable 5.1 від Anthropic, зосереджуючись на його здатності керувати командами AI, виконувати довгострокові завдання та перевіряти власну роботу через практичне делегування та постановку цілей.

Anthropic щойно випустила найпотужнішу модель, яку коли-небудь створювала, і стрибок у бенчмарках — майже найменш цікава її частина.

Claude Fable 5.1 відчувається не стільки як кращий чат-бот, скільки як новий тип оператора. Вона може годинами працювати над проблемою, відновлюватися, коли план ламається, координувати інших агентів, перевіряти власні результати та продовжувати рух, не потребуючи, щоб хтось рятував її кожні десять хвилин.

Цифри це підтверджують. Згідно з опублікованими оцінками Anthropic, Fable 5.1 більш ніж удвічі перевершила Fable 5 в агентних наукових дослідженнях, стрибнула з 17,1% до 31,4% в автоматизації бізнесу та досягла 73,4% у CursorBench. Вона також випередила Fable 5, Opus 5 та GPT-5.6 Sol у більшості тестів з кодування, автоматизації, використання комп'ютера та роботи зі знаннями, про які повідомляла Anthropic.

https://x.com/claudeai/status/2094848581425377479

З коробки вона виняткова у складному кодуванні, довгостроковій роботі, дослідженнях, плануванні, використанні комп'ютера та створенні завершених результатів. Але більша можливість полягає в тому, що відбувається, коли ви перестаєте використовувати її як людину, яка виконує кожне завдання, і ставите її на чолі системи, яка виконує роботу.

Саме це охоплює цей курс: у чому Fable 5.1 справді відрізняється, як поставити її на місце лідера, як побудувати працівників під нею, як давати їй підказки, не пригнічуючи її, як використовувати цілі та цикли, а також п'ять робочих процесів, де різниця може перетворитися на реальні гроші.

Якщо вам байдуже до терміналів, файлів агентів та оркестрації, і ви просто хочете перетворити ідею на робочий застосунок, саме для цього ми створили Shipper.

у чому ця модель справді виняткова

Перш ніж перейти до методів, познайомтеся з машиною. Ось п'ять здібностей, які роблять Fable 5.1 відмінною від попередніх моделей.

вона залишається зв'язною протягом неймовірно довгих сесій

Дайте їй завдання, яке триває годинами, і вона набагато рідше втрачає нитку посередині.

Один ранній тестувальник повідомив про безконтрольний 38-годинний запуск машинного навчання, під час якого Fable діагностувала поганий попередній результат, виправила його, запустила шість експериментів паралельно та повернулася з висновками та наступними кроками. Інший сказав, що вона вела власні записи, змінювала пріоритети, коли умови змінювалися, і продовжувала з того місця, де зупинилася.

Контекстне вікно на 1 мільйон токенів допомагає, але розмір контексту — це не справжнє оновлення. Справжнє оновлення полягає в тому, що модель може продовжувати приймати корисні рішення в цьому контексті, а не просто пам'ятати, що інформація існує.

вона шукає першопричину, а не найшвидший патч

Попередні агенти часто знаходили перше виправлення, яке змушувало помилку зникнути. Fable 5.1 більш схильна копати далі, поки не зрозуміє, чому помилка існувала.

Під час тестування запуску Anthropic, Millennium дав їй збій, який траплявся приблизно один раз на мільйон запусків і залишався непоясненим протягом чотирьох-п'яти років. Fable 5.1 розібрала зовнішню бібліотеку, пов'язала її з дампом пам'яті та простежила збій до фактичної помилки. Кожна інша модель, яку вони пробували, включаючи Fable 5, пропустила її.

Це має значення далеко за межами налагодження. Той самий інстинкт проявляється в дослідженнях, стратегії, фінансовому аналізі та операціях: не оптимізуйте симптом, коли основна система неправильна.

вона може бачити, діяти та перевіряти

Fable 5.1 може переглядати скріншоти, діаграми, PDF-файли, інтерфейси та документи, а потім використовувати побачене, щоб спрямувати наступну дію.

Це означає, що вона може відтворити інтерфейс за посиланнями, прочитати цифри, заховані у фінансовому документі, керувати браузером, порівняти свою реалізацію з оригінальним дизайном і виявити візуальні проблеми, перш ніж оголосити роботу завершеною.

Її показник використання комп'ютера OSWorld зріс вище, ніж у Fable 5 та Opus 5 у тестуванні Anthropic. Що важливіше, модель дедалі краще використовує зір як частину циклу перевірки, а не просто описує надане зображення.

вона повертає роботу, а не лекцію про роботу

Дайте їй папку з документами та попросіть інвестиційний меморандум, презентацію, робочий прототип або аналіз, і вона набагато частіше поверне сам артефакт.

Ранні тестувальники повідомили про найкращі результати PowerPoint від Anthropic, краще цитування фінансових документів, більш лаконічні виправлення контрактів та краще виконання складних багаточастинних запитів. Інженер MongoDB описав триденний запуск прототипу, під час якого модель дослідила існуючі сервіси, спроектувала систему, реалізувала її безконтрольними етапами та повернула візуальні огляди з доказами, що кожен етап працював.

Практична різниця проста: ви витрачаєте менше часу на перетворення відповіді на корисну роботу.

вона створена, щоб керувати

Fable 5.1 найбільш цінна, коли вона вирішує, що має статися далі.

Claude Code вже може надавати їй підагентів, фонові сесії, команди агентів, динамічні робочі процеси, цілі, цикли, браузери, термінали та файли проєктів. Fable має достатню глибину планування та контексту, щоб утримувати ці частини спрямованими на одну фінішну лінію набагато довше, ніж попередні моделі.

Ось чому наведена нижче конфігурація працює і чому курс починається з виведення Fable з ролі працівника.

кабіна пілота: всі елементи керування, які вам дійсно потрібні

Оновіть Claude Code перед будь-якими іншими діями. Згідно з поточною документацією з конфігурації моделі, версія 2.1.255 або новіша змушує псевдонім fable вирішуватися на Fable 5.1, а останні релізи включають елементи керування goal, loop, background-agent та effort, які використовуються нижче.

Потім виберіть модель та рівень зусиль:

/model fable

/effort high

High — це розумний вибір за замовчуванням для значної роботи. Знизьте до medium для дешевших і швидших проходів. Переходьте на xhigh або max лише тоді, коли проблема досить складна, щоб виправдати більше обдумування. Адаптивне мислення Fable завжди увімкнене, тому effort — це елемент керування, який має значення.

Інші елементи керування прості:

/plan або Shift+Tab: дозволяє їй перевірити та спланувати перед внесенням змін до файлів

/goal: продовжувати роботу між раундами, доки не буде виконано тестовану умову

/loop: повторювати підказку за розкладом, поки сесія активна

/tasks: побачити, що роблять фонові працівники

/context: побачити, що споживає контекстне вікно

Це кабіна пілота.

Решта курсу — знати, за який елемент керування братися і коли.

головна подія: зробіть Fable лідером, а не працівником

Найбільше оновлення — це зміна ролі.

Перестаньте давати Fable кожне завдання з клавіатури. Змусьте її визначати роботу, розбивати її на чіткі напрямки, відправляти ці напрямки дешевшим агентам і оцінювати те, що повертається.

Конфігурація виглядає так:

Fable формує план:

переведіть її в режим планування та дозвольте їй перевірити проєкт, перш ніж вона запропонує зміни. Якщо запит все ще розпливчастий, використовуйте

колекцію навичок Метта Покока щоб допитати ідею, перетворити розмову на специфікацію та розбити специфікацію на завдання.

Fable делегує ізольовану роботу:

реалізація переходить до підагентів Opus або Sonnet, причому кожен працівник володіє одним обмеженим напрямком. Codex також може бути іншим працівником, якщо ви вже ним користуєтеся, але він повинен дотримуватися тих самих меж файлів і правил доказів.

Окремий агент перевіряє:

працівник не оцінює власну домашню роботу. Новий верифікатор читає план, перевіряє фактичний diff, запускає перевірки та або пропускає етап, або повертає його з конкретною помилкою.

Ви керуєте на контрольних точках:

схвалюйте план, переглядайте значущі компроміси та перевіряйте докази в кінці. Вам не потрібно спостерігати за кожною командою.

Чому це працює: дорога модель витрачає свої токени на архітектуру, пріоритезацію, відновлення та судження. Дешевші моделі витрачають свої на обмежене виконання.

Економіка працює лише тоді, коли напрямки справді незалежні. Згідно з поточним ціноутворенням API Anthropic, Fable 5.1 коштує $10 за мільйон вхідних токенів і $50 за мільйон вихідних токенів, тоді як Opus 5 коштує вдвічі менше, а Sonnet 5 — вп'ятеро менше. Fable 5.1 також знизила читання кешу до $0,25 за мільйон токенів, що робить довгі сесії зі стабільним контекстом проєкту набагато практичнішими.

Не розпаралелюйте заради театру. П'ять агентів, які редагують одні й ті самі файли, створять п'ять рахунків і одну проблему злиття. Розпаралелюйте дослідження, ізольовані модулі, тести, документацію та інші напрямки, які можуть завершитися, не чекаючи один на одного.

побудуйте своїх працівників

Лідеру потрібна невелика команда, а користувацький працівник — це лише файл Markdown у .claude/agents/.

Почніть з одного працівника реалізації:


name: implementation-worker

description: Реалізує один ізольований етап із затвердженого плану. Використовуйте лише тоді, коли етап володіє окремими файлами.

model: opus

tools: Read, Grep, Glob, Edit, Write, Bash

maxTurns: 25


Ви володієте лише етапом, призначеним вам.

Перед редагуванням визначте точні файли та критерії прийняття у вашому напрямку.

Не змінюйте файли, якими володіє інший працівник.

Реалізуйте найменше повне рішення, а потім запустіть відповідні тести.

Поверніть:

  1. змінені файли
  2. запущені перевірки та їхні реальні результати
  3. все, що все ще невизначено

Не оголошуйте про успіх без доказів із цього запуску.

Потім створіть працівника, який має найбільше значення, — верифікатора:


name: verifier

description: Незалежно перевіряє завершений етап на відповідність його плану та критеріям прийняття. Використовуйте після кожного етапу реалізації.

model: opus

tools: Read, Grep, Glob, Bash

maxTurns: 15


Ставтеся до підсумку реалізації як до неперевіреного твердження.

Прочитайте план і перевірте фактичний diff. Запустіть відповідні тести самостійно.

Перевірте правильність, регресії, обсяг і кожен критерій прийняття.

Поверніть PASS або FAIL.

Для кожної помилки додайте докази та найменшу необхідну корекцію.

Ніколи не змінюйте реалізацію, яку ви оцінюєте.

Свіжий погляд помічає те, що автор нормалізував. Етап, перевірений негайно, набагато дешевший, ніж дефект, виявлений після того, як від нього залежать ще чотири етапи.

Чотири правила підтримують швидкість команди:

один працівник, один напрямок, з чітким володінням файлами

паралельна робота лише тоді, коли напрямки не залежать один від одного

Fable залишається на місці лідера, поки Opus або Sonnet виконує роботу

кожне твердження про завершення перевіряється на відповідність файлам, тестам або живому результату

секрет 1: не прописуйте маршрут

Більшість порад щодо створення підказок були написані, щоб запобігти блуканню слабших моделей.

Довгі процедури, жорсткі списки кроків і величезні блоки правил допомагали, коли модель не могла планувати. З Fable 5.1 те саме каркас може змусити її піти гіршим шляхом, ніж той, який вона знайшла б сама.

Хитрість полягає в тому, щоб бути суворим щодо пункту призначення і вільним щодо маршруту.

Дайте їй чотири речі:

результат:

що має існувати, коли роботу буде завершено

обмеження:

що вона не може зламати, витратити, розкрити або змінити

причину:

для кого це призначено і яке рішення або завдання має підтримувати результат

доказ:

які спостережувані докази вважатимуться завершенням

Остання частина змінює все. "Зроби, щоб оформлення замовлення працювало" запрошує правдоподібне твердження. "Виконай тестову покупку в пісочниці та покажи отриманий рядок замовлення" дає моделі фінішну лінію, яку вона не зможе обійти словами.

Не просіть демонстрації прихованого ланцюжка думок. Просіть план, важливі рішення, докази та залишкову невизначеність. Мислення Fable завжди увімкнене. Для вас важливо, чи витримує результат перевірку.

І не нагадуйте їй постійно, що бюджет зникає. Краще встановіть межу в системі: обмежте кількість раундів працівника, визначте дозволені витрати та скажіть, що робити, коли ліміт буде досягнуто.

секрет 2: тримайте CLAUDE.md легким

CLAUDE.md завантажується на початку кожної сесії Claude Code. Це робить його корисним, але це також означає, що кожен нерелевантний рядок обтяжує кожне майбутнє завдання.

Anthropic тепер рекомендує тримати кожен файл менше 200 рядків. На практиці ваш зазвичай може бути набагато коротшим.

Три розділи охоплюють більшість проєктів:

що це за проєкт:

продукт, архітектура та важливі межі

як перевірити роботу:

команди для збірки, тестування, лінтування та локального попереднього перегляду

що він постійно робить неправильно:

специфічні для проєкту угоди та повторювані помилки

Процедури, які мають значення лише іноді, належать до навичок. Правила, які застосовуються лише до певних файлів, належать до правил, обмежених шляхом. Історичні нотатки належать до документації, а не до підказки кожної сесії.

Відкрийте свій CLAUDE.md сьогодні ввечері та поставте під сумнів кожен рядок: якщо його видалення не призведе до реальної помилки, видаліть його.

Легший файл зазвичай є сильнішим.

секрет 3: зловживайте цілями та циклами

Ось де Fable перестає бути розмовою і стає процесом, який може продовжувати рухатися, поки ви займаєтеся чимось іншим.

Цілі: /goal дає сесії одну тестовану умову завершення. Після кожного раунду окрема невелика модель перевіряє, чи виконана умова. Якщо ні, Fable починає інший раунд замість того, щоб передавати контроль вам. Ціль закінчується, коли вона проходить, стає неможливою, досягає непереборної помилки або ви її очищаєте.

Майстерність полягає в написанні фінішної лінії, яку вона не може підробити:

вимагайте спостережуваних доказів: "всі тести автентифікації проходять, а результат додано" сильніше, ніж "виправити автентифікацію"

визначте шлях невдачі: якщо реальний блокер робить ціль неможливою, повідомте про блокер і докази замість того, щоб вигадувати прогрес

обмежте ризиковані частини: використовуйте maxTurns для працівників, ліміти витрат для платних сервісів і чіткі межі для розгортань або виробничих даних

тримайте одне правило чесності в кожному брифі: кожне твердження про прогрес має вказувати на результат, створений або перевірений під час цього запуску

Запускайте цілі в автоматичному режимі лише в межах, з якими вам комфортно залишати без нагляду. Розумніший агент має більший радіус ураження, коли бриф неправильний.

Цикли: /loop повторює підказку через певний інтервал. Використовуйте /loop 15m, щоб перевірити розгортання та розслідувати будь-яку помилку з фіксованою періодичністю, або пропустіть інтервал і дозвольте Claude вирішити, коли перевіряти знову.

Цикли всередині Claude Code обмежені сесією і з часом закінчуються. Використовуйте їх для збірок, запитів на злиття, міграцій та тимчасового моніторингу. Використовуйте постійну процедуру або заплановане завдання робочого столу для роботи, яка має тривати після завершення сесії або закриття машини.

Між цілями та циклами ви можете тримати Fable в роботі стільки, скільки дійсно потребує завдання, з доказами, що чекають в кінці, замість чергового впевненого абзацу.

як створити реальний проєкт одним пострілом

Тепер зберіть всю систему навколо однієї збірки.

Приклад — цільова сторінка з робочим списком очікування. Замініть проєкт, і та сама послідовність діє.

крок 1: напишіть бриф

Надішліть одне повідомлення:

Я запускаю [продукт] для [аудиторії]. Їм потрібна цільова сторінка, яка робить одну чітку обіцянку та збирає

емейли.Побудуйте одну адаптивну сторінку з робочою формою, яка зберігає реєстрації.Обмеження: жодного фреймворку, за яким я маю наглядати, жодної платної залежності, швидко на мобільних пристроях і жодного розгортання, доки я не схвалю.Завершено означає, що сторінка працює локально, тестовий емейл з'являється в сховищі, мобільний макет перевірено на 390px, а результат показано з тестовим результатом і скріншотами.Спочатку перевірте проєкт і сплануйте. Делегуйте лише незалежні етапи. Перевірте кожен завершений етап.

Бриф дає їй пункт призначення, не проектуючи реалізацію за неї.

крок 2: схваліть план

Увійдіть у режим планування за допомогою /plan або Shift+Tab, перш ніж вона щось змінить.

Якщо ідея недостатньо визначена, встановіть колекцію Метта Покока за допомогою /plugin install mattpocock-skills, запустіть /setup-matt-pocock-skills один раз і використовуйте /grill-with-docs, перш ніж перетворити результат на специфікацію.

Прочитайте план. Виріжте функції, які вам не потрібні. Переконайтеся, що кожен етап має спостережувану умову проходження. Потім схваліть його.

крок 3: дозвольте команді працювати

Fable призначає перший ізольований етап працівнику реалізації. Верифікатор перевіряє фактичний diff і результати тестів. Залежний етап починається лише після того, як попередній пройде.

Ви можете залишити термінал. Використовуйте /tasks, коли хочете побачити, що ще працює.

крок 4: встановіть фінішну лінію

Використовуйте ціль, яка називає стан і доказ:

/goal сторінка працює локально, форма зберігає тестову реєстрацію, а макет працює на 390px, що підтверджується реальним результатом тесту, збереженим записом і поточним скріншотом. Якщо справжній блокер робить це неможливим, зупиніться та повідомте про докази замість того, щоб заявляти про успіх.

Цю умову набагато важче задовольнити лише словами.

крок 5: перегляньте результат

Поверніться до diff, результату тесту, збереженої реєстрації та скріншотів.

Перегляньте продукт як користувач, а не як менеджер моделі. Попросіть про зміни, які ви можете реально побачити, запустіть один остаточний незалежний прохід перевірки та випускайте, коли докази відповідають брифу.

Перший запуск здаватиметься складним.

Вдруге ви помітите, що та сама послідовність працює майже для кожного проєкту, який ви відкладали.

п'ять робочих процесів, де це приносить реальні гроші

Тепер спрямуйте налаштування на роботу, достатньо цінну, щоб виправдати модель.

Ось п'ять робочих процесів, де Fable 5.1 може створити вимірну різницю.

Робота з кодовою базою, яку ніхто не хоче робити: міграція, оцінена в три тижні, рідкісний виробничий збій, проблема продуктивності, розподілена між вісьмома сервісами. Fable картографує систему, працівники беруть ізольовані фрагменти, верифікатор перевіряє кожен етап, а прогрес прив'язаний до тестів, а не до оптимізму.

Дослідження на рівні прийняття рішень: одне запитання входить, дослідницькі працівники паралельно збирають інформацію з першоджерел, скептичний рецензент атакує кожне важливе твердження, а лідер перетворює те, що вижило, на меморандум. Це може живити придбання, запуск, ринкове рішення або інвестиційну тезу.

Бізнес-операції: надайте їй доступ до правильних інструментів і дозвольте їй звіряти дані, розслідувати аномалії, готувати звіти, контролювати процес або опрацьовувати операційний завал. Fable 5.1 майже подвоїла показник Fable 5 в AutomationBench від Anthropic, що є одним із найчіткіших практичних стрибків у релізі.

Робота над продуктом на основі референсів: надайте їй скріншоти бажаного досвіду, фактичні активи та доступ до запущеного застосунку. Вона може реалізувати відповідно до референсу, відкрити результат, порівняти їх і продовжувати, доки видима прогалина не закриється. Ви забезпечуєте смак. Вона забезпечує очі, руки та терпіння.

Система знань, що накопичуються: спрямуйте її на все, що варто зберегти у вашій компанії, і дозвольте їй перетворити розрізнені документи на підтримуване, пов'язане джерело істини. Копірайтер може побудувати одну з чудових сторінок продажів, агентство — зі своїх кейсів, а SaaS-компанія — з дзвінків клієнтів, рішень, експериментів та історії підтримки. Кожен майбутній агент починає розумнішим, тому що корисний контекст вже існує.

Кожен із них раніше був проєктом "колись".

Fable 5.1 робить багато з них проєктами "цього тижня", за умови, що ви дасте системі реальну фінішну лінію та спосіб довести, що вона її перетнула.

вся конфігурація в одному блоці

запустіть Fable 5.1 як лідера: вона планує, делегує, переглядає та вирішує

використовуйте Opus або Sonnet для обмеженої роботи, з одним працівником на незалежний напрямок

дайте їй результат, обмеження, причину та доказ, а потім дозвольте їй вибрати маршрут

тримайте CLAUDE.md коротким і переносьте епізодичні процедури в навички

використовуйте цілі для перевіреного завершення та цикли для запланованих перевірок

контролюйте витрати за допомогою рівнів зусиль, дешевших працівників, кешованого контексту та жорстких меж

спрямуйте систему на кодові бази, дослідження, операції, роботу над продуктом і знання, які накопичуються

Модель є найпомітнішою частиною конфігурації, але це не вся перевага.

Перевага полягає в тому, щоб дати такій здатній моделі чіткий пункт призначення, компетентну команду, доступ до реальності та жодного способу сплутати переконливу відповідь із завершеною роботою.

Переробити в YouMind

Перетворіть одну віральну статтю на повноцінний робочий процес

Збирайте джерела, розшифровуйте патерни, створюйте матеріали, пишіть чернетки та поширюйте контент в одному AI-робочому просторі.

Дослідити YouMind
Для авторів

Перетворіть свій Markdown на охайну статтю для 𝕏

Коли ви публікуєте власні лонгріди, зображення, таблиці та блоки коду роблять форматування в 𝕏 складним. YouMind перетворює повну чернетку в Markdown на чисту статтю для 𝕏, готову до публікації.

Спробувати Markdown для 𝕏

Більше патернів для аналізу

Останні віральні статті

Переглянути більше віральних статей