Kimi K3 Swarm Max: як запустити 300 дослідницьких агентів з одного запиту

@choopyplug1
АНГЛІЙСЬКА1 день тому · 22 лип. 2026 р.
105K
46
5
7
74

Коротко

У цьому посібнику пояснюється, як використовувати функцію Swarm Max у Kimi K3 для запуску 300 паралельних агентів для складних досліджень, з акцентом на структуровані специфікації та етапи перевірки.

Kimi K3 вийшла 16 липня 2026 року. 2,8 трильйона параметрів. Контекст у 1 мільйон токенів. Найбільша модель з відкритою вагою, коли-небудь випущена.

Головна особливість — K3 Swarm Max: до 300 підагентів, що працюють паралельно, координуючись на 4000 кроках, створюючи реальні файли замість текстових відповідей. Два варіанти використовують той самий «мозок». K3 Max обробляє повсякденні завдання. K3 Swarm Max спрямовує цілу флотилію на проблему.

chuplung - inline image

Більшість людей відкривають Kimi, вводять запитання, отримують відповідь і закривають вкладку. Це приблизно 10% того, на що здатен продукт. Цей посібник охоплює інші 90%.

chuplung - inline image

Рій — це не просто додаткова функція. Оркестратор — це навчена політика, тренована за допомогою Parallel-Agent Reinforcement Learning. Ви описуєте мету. Рій вирішує, як її розділити, скільки агентів створити і як зібрати результати воєдино. Рої найкраще справляються з широкими, паралелізованими завданнями: дослідженнями з 50+ джерел, пакетним аналізом, конкурентним моніторингом, створенням наборів даних. Вони зазнають труднощів із глибокими послідовними завданнями, де крок 3 залежить від кроку 2.

chuplung - inline image
  • Пишіть специфікацію, а не запит

«Досліди ринок фітнес-додатків» — це спосіб спалити кредити та отримати сміття. Однорядковий запит дає рою дозвіл вирішувати все самостійно. І він вирішить неправильно.

chuplung - inline image

Ставтеся до рою як до підрядника. Специфікація визначає, що збирати, що вважати достовірним, які джерела дозволені, точний формат виведення та що робити в разі конфлікту. Специфікація — це єдиний найважливіший артефакт у всьому робочому процесі, тому що на Рівні 2 вона стає основою вашого багаторазового Навику.

text
1# ПРОЄКТ: [назва]
2МЕТА: [одне речення, результат, а не тема]
3ОБСЯГ: [що входить, що чітко виключено]
4ПРАВИЛА: [валідація, що вважається підтвердженим висновком]
5ДЖЕРЕЛА: [офіційні пости, статті, лише першоджерела, без агрегаторів]
6ВИВЕДЕННЯ: [тип файлу / кількість / іменування / деталі формату]
7ПРИ КОНФЛІКТІ: позначте рядок, ніколи не вирішуйте мовчки
8УМОВА ЗУПИНКИ: [коли зупинитися і повідомити, а не гадати]
  • Прочитайте план декомпозиції, перш ніж витрачати ресурси

Після того, як ви надішлете специфікацію, Kimi покаже план виконання до запуску: скільки підагентів, що робить кожен, порядок залежностей, бюджет кроків. Це крок, який новачки пропускають, і це найдорожчий крок для пропуску.

chuplung - inline image

Рій із 200 агентів, декомпонований неправильно, коштує реальних грошей. Перевірка плану нічого не коштує. Ви шукаєте три речі: чи розуміє він обсяг, чи є кількість агентів розумною для завдання, чи відповідає план виведення тому, що вам насправді потрібно.

text
1Покажи запропоновану декомпозицію перед запуском:
2- скільки підагентів і що робить кожен
3- порядок залежностей (що блокує що)
4- приблизний бюджет кроків
5- де найбільший ризик втрати якості
6НЕ виконуй ще. Чекай на моє підтвердження.

Одна деталь, яку варто знати: 4000 кроків — це загальний скоординований бюджет для всього рою, а не 4000 на агента. Запуск із 300 агентів у середньому становить приблизно 13 кроків на кожного. Це підкаже, чи підходить ваше завдання під таку структуру.

  • Запустіть його

Тепер виконуйте. До 300 підагентів запускаються паралельними хвилями, кожен у власному обмеженому контексті. Лише структуровані вихідні дані повертаються до координатора.

text
1Виконай специфікацію від початку до кінця.
2Паралелізуй усюди, де дозволяє план.
3Негайно повідомляй про будь-який блокер, не обходь його мовчки.
4Об'єднай усе в ВИВЕДЕННЯ, визначене в специфікації.

Що ви маєте після Рівня 1

Одиночний результат рою, створений за вашою специфікацією. Сирий, неперевірений, але структурований. Більшість людей зупиняються тут. Цінність починається на Рівні 2.

chuplung - inline image
  • Вимагайте реальні файли, а не відповідь у чаті

«Всебічний звіт» дає агентам дозвіл зупинитися раніше. «PDF на 40 сторінок + один CSV із 20 000 рядків + 14 діаграм PNG, готових до експорту» — дає їм цільовий показник якості.

Завжди починайте специфікацію з виведення. Конкретика на рівні виведення — це різниця між дослідницькою командою та дорогою скринькою пропозицій.

text
1# сильні приклади виведення:
2ВИВЕДЕННЯ: 1 .xlsx, один рядок на модель, + короткий опис на 200 слів
3ВИВЕДЕННЯ: 30 HTML-файлів, один на магазин, названі за бізнесом
4ВИВЕДЕННЯ: PDF на 40 сторінок + CSV на 20 000 рядків + 14 діаграм PNG
  • Вимагайте реальні файли, а не відповідь у чаті

«Всебічний звіт» дає агентам дозвіл зупинитися раніше. «PDF на 40 сторінок + один CSV із 20 000 рядків + 14 діаграм PNG, готових до експорту» — дає їм цільовий показник якості. Завжди починайте специфікацію з виведення. Конкретика на рівні виведення — це різниця між дослідницькою командою та дорогою скринькою пропозицій.

text
1# сильні приклади виведення:
2ВИВЕДЕННЯ: 1 .xlsx, один рядок на модель, + короткий опис на 200 слів
3ВИВЕДЕННЯ: 30 HTML-файлів, один на магазин, названі за бізнесом
4ВИВЕДЕННЯ: PDF на 40 сторінок + CSV на 20 000 рядків + 14 діаграм PNG
  • Спрямуйте окрему модель на перевірку результату

Відомий недолік рою: якщо ви явно не вимагаєте верифікації, він створює впевнені, але недостатньо цитовані твердження, а незалежні підагенти іноді суперечать один одному. «Виглядає готовим» і «є правильним» — це різні планети.

Використовуйте другу модель як шлюз верифікації. Її єдина робота: спростовувати, а не хвалити. Ви платите не за те, щоб генерувати преміальними токенами. Ви платите за те, щоб виявити приховану помилку, перш ніж наступний крок збереже робочий процес як багаторазовий Навик.

chuplung - inline image
text
1Ти — ВЕРИФІКАТОР. Рій агентів створив прикріплений результат.
2Твоя єдина робота — знайти, що не так.
3
4Перевір:
5- Чи кожна заявлена цифра посилається на назване джерело?
6- Чи є суперечності між будь-якими двома розділами?
7- Чи подається щось як факт, що насправді є висновком?
8- Чи відповідає результат вимогам формату зі специфікації?
9
10Для кожної проблеми: вкажи точне місце та виправлення.
11Якщо все гаразд: СХВАЛЕНО.
12Якщо хоч щось не так: ВІДХИЛЕНО + найкритичніше виправлення першим.
  • Збережіть весь робочий процес як Навик

Після верифікованого запуску попросіть Kimi зафіксувати весь робочий процес: формат введення, кроки агентів, формат виведення, правила валідації. Перший запуск займає 20 хвилин. Кожен наступний — 30 секунд. Навик — це причина, чому система накопичує досвід, а не починає все спочатку щоразу.

text
1Збережи цей робочий процес як багаторазовий навик: "[назва]"
2Зафіксуй:
3- формат введення (які файли / форму специфікації він очікує)
4- кроки агентів, які спрацювали
5- формат виведення та угоду про іменування
6- правила валідації зі специфікації
7Наступного разу, коли я запускатиму це, я прикріплю нові файли та отримаю такий самий результат.

Що ви маєте після Рівня 2

Верифікований результат, якому можна довіряти, і збережений Навик, який можна відтворити без повторної розробки специфікації. Тут цикл починає накопичувати досвід.

chuplung - inline image
  • Завантажте власні документи як знання рою

Навики фіксують процес. Перетворення документа на навик фіксує предметну область. Завантажте свою найкращу роботу, і Kimi зафіксує її структурний відбиток як навик, який застосовуватиме кожен майбутній рій.

chuplung - inline image

Кожен PDF, транскрипт або електронна таблиця, які ви завантажуєте, стають контекстом, на який спираються всі 300 агентів, замість того, щоб покладатися на тренувальні дані. Чим більше ви їх завантажуєте, тим більше результат виглядає як ваша робота, а не як стандартний ШІ.

text
1Зафіксуй цей документ як багаторазовий навик. Визнач, що робить його ефективним:
2- структура та порядок розділів
3- тон і стиль мовлення
4- глибина аналізу в кожному розділі
5Збережи його як "[назва]". Потім створи новий документ на [іншу тему],
6використовуючи збережений навик. Відповідай рівню якості, а не змісту.
  • Перетворюйте кожне відхилення на постійне правило

Крок верифікації виявляє помилку один раз. Цей крок гарантує, що рій ніколи не повторить її. Відфільтруйте зворотний зв'язок у жорсткі правила та запишіть їх у файл обмежень, який рій читає перед виконанням будь-яких дій.

text
1# CONSTRAINTS.md, завантажується автоматично
2- кожна заявлена цифра повинна посилатися на першоджерело або бути позначена
3- без тихого вирішення конфліктів: показуйте суперечності
4- [правило, отримане зі зворотного зв'язку верифікатора останнього запуску]
5- [помилка, яку ви ніколи не хочете повторювати]
6Обмеження обсягу: не виходьте за межі блоку ОБСЯГ зі специфікації.
  • Відтворіть навик на нових даних

Ось де «накопичення» перестає бути просто модним слівцем і з'являється в рахунку-фактурі. Другий запуск не починається з нуля. Він починається з навику, знань рою та файлу обмежень, які ви створили вище. Той самий робочий процес, нові файли, значно менше часу на налаштування.

Економіка кардинально змінюється при повторному відтворенні. Ціни на кеш-хіти K3 знижуються до $0,30 за мільйон токенів для повторного контексту, що в 10 разів дешевше, ніж ціна першого запуску. Навик, обмеження та специфікація — це весь повторний контекст. Лише ваші нові вхідні файли коштують за повною ставкою. Перший запуск — це інвестиція. Кожен наступний запуск приносить прибуток.

chuplung - inline image

Результат також структурно покращується. Навик забезпечує дотримання формату. Обмеження блокують кожну помилку, яку вже виявив верифікатор. Знання рою спрямовують кожного агента на ваші фактичні документи, а не на тренувальні дані. Четвертий запуск не просто коштує менше, ніж перший. Він дає кращі результати, тому що система навчилася на трьох циклах реального зворотного зв'язку.

chuplung - inline image
text
1Виконай збережений навик "[назва]" на цих нових даних.
2Застосуй CONSTRAINTS.md. Використовуй збережений формат виведення.
3[прикріпи нові файли]
4
5Порівняй результат цього запуску з попереднім.
6Повідом:
7- нові знахідки, яких не було минулого разу
8- знахідки, які змінилися з минулого разу
9- все, що зникло (познач як потенційну прогалину)
10- відхилення від очікуваної форми навику

Що ви маєте після Рівня 3

Конвеєр досліджень, що самовдосконалюється. Кожен запуск дешевший, швидший і точніший за попередній, оскільки бібліотека навиків, база знань і файл обмежень постійно зростають.

chuplung - inline image
  • Підвищіть навик до рівня запланованого агента

Як тільки цикл стабілізований і підкріплений навиком, ви припиняєте запускати його вручну. Вкажіть Kimi на тригер: розклад, нове завантаження файлу, відстежуваний URL. Дозвольте йому запускати весь рій проактивно, показуючи лише результат і відхилення, які варті вашої уваги.

chuplung - inline image

Конкурентний моніторинг — це найкращий приклад. Запуск перший: ви будуєте та перевіряєте вручну. До того моменту, як це стане фоновим агентом, він щотижня перевірятиме всіх конкурентів паралельно і надсилатиме короткий звіт у вашу поштову скриньку з нульовими додатковими витратами часу. Єдине, що залишається в циклі за участю людини — це питання, яке ви поставили, і рішення, яке ви приймаєте на основі відповіді.

text
1Виконуй навик "[назва]" за щотижневим розкладом.
2Тригер: [розклад / новий файл / відстежуваний URL]
3При кожному запуску: виконай рій, застосуй CONSTRAINTS.md,
4верифікуй, потім достав ВИВЕДЕННЯ + різницю з минулим запуском.
5Повідомляй мене, лише якщо відхилення перевищує [поріг].

Чого 2,8 Т параметрів не виправляють

chuplung - inline image

Галюцинація масштабується з паралелізмом. Більше агентів, які шукають, означає більше впевнених неправильних відповідей, якщо ви не запускаєте крок верифікації. Рій не перевіряє факти самостійно.

K3 коштує в 3-4 рази дорожче, ніж K2.6. Введення: $3,00/М проти $0,95/М. Виведення: $15,00/М проти $4,00/М. Кеш допомагає при повторних запусках, але перший запуск є дорогим. Для чистої оптимізації витрат K2.6 все ще є бюджетним варіантом.

Відкриті ваги ще не вийшли. Moonshot обіцяла їх до 27 липня 2026 року. До того часу K3 працює лише через API та додаток Kimi.

Рої підсилюють погані специфікації. Розпливчастий запит через одного агента витрачає один контекстний вікно. Через 300 агентів він витрачає 300 паралельно.

Короткий список

  • Однорядкові запити. Рій вирішує все самостійно. І вирішує неправильно.
  • Пропуск перевірки декомпозиції. Найдорожчий крок для пропуску.
  • Відсутність кроку верифікації. «Виглядає готовим» — це не «є правильним».
  • Збереження неперевіреного результату як навику. Помилка накопичується при кожному майбутньому запуску.
  • 300 агентів для послідовного завдання. Рій не може паралелізувати ланцюжок міркувань.
  • Використання K3 там, де достатньо K2.6. Не кожне завдання потребує 2,8 трильйона параметрів.

Висновок

Більшість людей відкриють Kimi, введуть запитання, закриють вкладку. Це чат-вікно. Це приблизно 10% того, на що здатний K3.

Інші 90% — це дослідницька команда, яку ви будуєте один раз і відтворюєте вічно. Кожен рівень відкриває більше можливостей: спочатку запуск, потім довіра, потім накопичення, потім автономність. Вам не потрібні всі чотири в перший день. Почніть з Рівня 1 з однією специфікацією. Якщо результат корисний, перейдіть на Рівень 2 і верифікуйте його. Якщо плануєте запускати його знову, збережіть Навик. Система ставатиме гострішою сама по собі.

Пишіть специфікацію, а не запит. Верифікуйте перед збереженням. І тоді спостерігайте, як кожен запуск стає дешевшим і гострішим за попередній.

Переробити в YouMind

Перетворіть одну віральну статтю на повноцінний робочий процес

Збирайте джерела, розшифровуйте патерни, створюйте матеріали, пишіть чернетки та поширюйте контент в одному AI-робочому просторі.

Дослідити YouMind
Для авторів

Перетворіть свій Markdown на охайну статтю для 𝕏

Коли ви публікуєте власні лонгріди, зображення, таблиці та блоки коду роблять форматування в 𝕏 складним. YouMind перетворює повну чернетку в Markdown на чисту статтю для 𝕏, готову до публікації.

Спробувати Markdown для 𝕏

Більше патернів для аналізу

Останні віральні статті

Переглянути більше віральних статей