Kimi K3 Swarm Max: как запустить 300 исследовательских агентов с помощью одного промпта

@choopyplug1
АНГЛИЙСКИЙ1 день назад · 22 июл. 2026 г.
105K
46
5
7
74

Суть

В этом руководстве объясняется, как использовать функцию Swarm Max в Kimi K3 для запуска 300 параллельных агентов при проведении сложных исследований, с акцентом на структурированные спецификации и этапы проверки.

Kimi K3 вышел 16 июля 2026 года. 2,8 триллиона параметров. Контекст в 1 миллион токенов. Самая большая open-weight модель из когда-либо выпущенных.

Ключевая особенность — K3 Swarm Max: до 300 параллельно работающих саб-агентов, координируемых на 4 000 шагов, создающих реальные файлы вместо ответов в чате. Два варианта используют один и тот же «мозг». K3 Max справляется с повседневными задачами. K3 Swarm Max направляет целый флот на проблему.

chuplung - inline image

Большинство людей открывают Kimi, задают вопрос, получают ответ и закрывают вкладку. Это примерно 10% возможностей продукта. Это руководство охватывает остальные 90%.

chuplung - inline image

Рой — это не дополнительная опция. Оркестратор — это обученная политика, тренированная с помощью параллельного обучения с подкреплением (Parallel-Agent Reinforcement Learning). Вы описываете цель. Рой решает, как её разделить, сколько агентов запустить и как собрать результаты обратно. Рои эффективны для широких, параллелизуемых задач: исследование по 50+ источникам, пакетный анализ, конкурентный мониторинг, создание наборов данных. Они плохо справляются с глубокими последовательными задачами, где шаг 3 зависит от шага 2.

chuplung - inline image
  • Пишите спецификацию, а не промпт

«Исследуй рынок фитнес-приложений» — это способ сжечь кредиты и получить мусор. Однострочный промпт даёт рою разрешение решать всё самостоятельно. Он решит неправильно.

chuplung - inline image

Относитесь к рою как к подрядчику. Спецификация определяет, что собирать, что считать валидным, какие источники разрешены, точный формат вывода и что делать при конфликте. Спецификация — это единственный элемент с наибольшим рычагом влияния во всём рабочем процессе, потому что на Уровне 2 она становится основой вашего многоразового навыка (Skill).

text
1# ПРОЕКТ: [название]
2ЦЕЛЬ: [одно предложение, результат, а не тема]
3ОБЪЕМ: [что входит, что явно исключено]
4ПРАВИЛА: [валидация, что считается подтвержденной находкой]
5ИСТОЧНИКИ: [официальные посты, статьи, только первоисточники, без агрегаторов]
6ВЫВОД: [тип файла / количество / именование / детали форматирования]
7ПРИ КОНФЛИКТЕ: отметь строку, никогда не решай молча
8УСЛОВИЕ ОСТАНОВКИ: [когда остановиться и сообщить вместо того, чтобы угадывать]
  • Прочитайте план декомпозиции, прежде чем тратить

После отправки спецификации Kimi показывает план выполнения до запуска: сколько саб-агентов, за что отвечает каждый, порядок зависимостей, бюджет шагов. Это шаг, который новички пропускают, и его пропуск — самый дорогой.

chuplung - inline image

Рой из 200 агентов, декомпозированный неправильно, стоит реальных денег. Проверка плана ничего не стоит. Вы ищете три вещи: понимает ли он объём, разумно ли количество агентов для задачи, и соответствует ли план вывода тому, что вам на самом деле нужно.

text
1Покажи предлагаемую декомпозицию перед запуском:
2- сколько саб-агентов и за что отвечает каждый
3- порядок зависимостей (что блокирует что)
4- примерный бюджет шагов
5- где находится наибольший риск падения качества
6НЕ выполняй пока. Жди моего подтверждения.

Одна деталь, которую стоит знать: 4 000 шагов — это общий координированный бюджет на весь рой, а не 4 000 на агента. Запуск с 300 агентами в среднем даёт примерно 13 шагов на каждого. Это говорит о том, подходит ли ваша задача под такой формат.

  • Запустите его

Теперь вы выполняете. До 300 саб-агентов запускаются параллельными волнами, каждый в своём ограниченном контексте. Только структурированный вывод возвращается координатору.

text
1Выполни спецификацию от начала до конца.
2Распараллеливай везде, где это позволяет план.
3Немедленно сообщай о любом блокере, не обходи его молча.
4Объедини всё в ВЫВОД, определённый в спецификации.

Что у вас есть после Уровня 1

Один результат работы роя, созданный по вашей спецификации. Сырой, непроверенный, но структурированный. Большинство останавливаются здесь. Ценность начинается на Уровне 2.

chuplung - inline image
  • Требуйте реальные файлы, а не ответ в чате

«Всеобъемлющий отчёт» даёт агентам разрешение остановиться раньше времени. «PDF на 40 страниц + CSV с 20 000 строк + 14 готовых к экспорту PNG-диаграмм» задаёт им целевой показатель качества.

Всегда начинайте спецификацию с вывода. Конкретика на уровне вывода — это разница между исследовательской командой и дорогим ящиком для предложений.

text
1# сильные примеры вывода:
2ВЫВОД: 1 .xlsx, одна строка на модель, + краткое описание на 200 слов
3ВЫВОД: 30 HTML-файлов, по одному на магазин, названных по бизнесу
4ВЫВОД: PDF на 40 страниц + CSV на 20 000 строк + 14 PNG-диаграмм
  • Требуйте реальные файлы, а не ответ в чате

«Всеобъемлющий отчёт» даёт агентам разрешение остановиться раньше времени. «PDF на 40 страниц + CSV с 20 000 строк + 14 готовых к экспорту PNG-диаграмм» задаёт им целевой показатель качества. Всегда начинайте спецификацию с вывода. Конкретика на уровне вывода — это разница между исследовательской командой и дорогим ящиком для предложений.

text
1# сильные примеры вывода:
2ВЫВОД: 1 .xlsx, одна строка на модель, + краткое описание на 200 слов
3ВЫВОД: 30 HTML-файлов, по одному на магазин, названных по бизнесу
4ВЫВОД: PDF на 40 страниц + CSV на 20 000 строк + 14 PNG-диаграмм
  • Направьте отдельную модель на проверку вывода

Известный недостаток роя: если вы явно не потребуете проверки, он выдаёт уверенные, но слабо подтверждённые утверждения, а независимые саб-агенты иногда противоречат друг другу. «Выглядит готовым» и «является правильным» — это разные планеты.

Используйте вторую модель как шлюз верификации. Её единственная задача: опровергать, а не хвалить. Вы платите премиальные токены не за генерацию. Вы платите за то, чтобы поймать тихую ошибку до того, как следующий шаг сохранит рабочий процесс как многоразовый навык.

chuplung - inline image
text
1Ты — ВЕРИФИКАТОР. Рой агентов создал приложенный вывод.
2Твоя единственная задача — найти, что не так.
3Проверь:
4- Каждое ли заявленное число ведёт к названному источнику?
5- Противоречат ли какие-либо два раздела друг другу?
6- Представлено ли что-либо как факт, хотя на самом деле это вывод?
7- Соответствует ли вывод требованиям к формату из спецификации?
8Для каждой проблемы: укажи точное местоположение и исправление.
9Если всё в порядке: ОДОБРЕНО.
10Если что-то не так: ОТКЛОНЕНО + сначала самое критическое исправление.
  • Сохраните весь рабочий процесс как навык

После проверенного запуска скажите Kimi захватить весь рабочий процесс: формат ввода, шаги агентов, формат вывода, правила валидации. Первый запуск занимает 20 минут. Каждый последующий — 30 секунд. Навык — это причина, по которой система накапливает результат, а не начинается с нуля каждый раз.

text
1Сохрани весь этот рабочий процесс как многоразовый навык: «[название]»
2Захвати:
3- формат ввода (какие файлы / форму спецификации он ожидает)
4- шаги агентов, которые сработали
5- формат вывода и соглашение об именовании
6- правила валидации из спецификации
7В следующий раз, когда я запущу это, я прикреплю новые файлы и получу ту же структуру.

Что у вас есть после Уровня 2

Проверенный результат, которому можно доверять, и сохранённый навык, который можно воспроизвести без повторного создания спецификации. Здесь начинается цикл накопления.

chuplung - inline image
  • Загружайте свои собственные документы как знания для роя

Навыки захватывают процесс. Конвертация документа в навык (Document-to-Skill) захватывает предметную область. Загрузите свои лучшие работы, и Kimi зафиксирует их структурный «отпечаток» как навык, который будет применять каждый будущий рой.

chuplung - inline image

Каждый загруженный PDF, расшифровка или электронная таблица становятся контекстом, с которым сверяются все 300 агентов, вместо того чтобы полагаться на обучающие данные. Чем больше вы загружаете, тем больше результат напоминает вашу работу, а не generic AI.

text
1Захвати этот документ как многоразовый навык. Определи, что делает его работающим:
2- структура и порядок разделов
3- тон и голос
4- глубина анализа по разделам
5Сохрани его как «[название]». Затем создай новый документ на [другую тему],
6используя захваченный навык. Соответствуй планке качества, а не содержанию.
  • Превращайте каждое отклонение в постоянное правило

Шаг верификации ловит ошибку один раз. Этот шаг гарантирует, что рой больше никогда её не совершит. Извлеките обратную связь в жёсткие правила и запишите их в файл ограничений, который рой читает перед началом работы.

text
1# CONSTRAINTS.md, загружается автоматически
2- каждое заявленное число должно вести к первоисточнику или быть помечено
3- никакого молчаливого разрешения конфликтов: выявляй противоречия
4- [правило, извлечённое из обратной связи верификатора после последнего запуска]
5- [ошибка, которую ты не хочешь повторять никогда]
6Ограничение области: не выходи за пределы блока ОБЪЕМ в спецификации.
  • Воспроизводите навык на новых вводных данных

Здесь «накопление» перестаёт быть просто модным словом и проявляется в результатах. Второй запуск не начинается с нуля. Он начинается с навыка, знаний роя и файла ограничений, которые вы создали выше. Тот же рабочий процесс, новые файлы, доля затрат на настройку.

Экономика кардинально меняется при повторном использовании. Цены на кэш-хиты K3 падают до $0,30 за миллион токенов для повторного контекста — это в 10 раз дешевле, чем цена первого запуска. Навык, ограничения и спецификация — всё это повторяющийся контекст. Только ваши новые вводные файлы оплачиваются по полной ставке. Первый запуск — это инвестиция. Каждый последующий запуск приносит прибыль.

chuplung - inline image

Результат также структурно улучшается. Навык обеспечивает соблюдение формата. Ограничения блокируют каждую ошибку, которую верификатор уже поймал. Знания роя привязывают каждого агента к вашим реальным документам, а не к обучающим данным. Четвёртый запуск не просто стоит меньше, чем первый. Он даёт лучшие результаты, потому что система научилась на трёх раундах реальной обратной связи.

chuplung - inline image
text
1Запусти сохранённый навык «[название]» на этих новых вводных данных.
2Примени CONSTRAINTS.md. Используй захваченный формат вывода.
3[прикрепи новые файлы]
4Сравни вывод этого запуска с выводом предыдущего.
5Сообщи:
6- новые находки, которых не было в прошлый раз
7- находки, которые изменились с прошлого запуска
8- всё, что исчезло (отметь как потенциальный пробел)
9- отклонения от ожидаемой структуры навыка

Что у вас есть после Уровня 3

Самообучающийся исследовательский конвейер. Каждый запуск дешевле, быстрее и точнее предыдущего, потому что библиотека навыков, база знаний и файл ограничений продолжают расти.

chuplung - inline image
  • Повысьте навык до запланированного агента

Как только цикл станет стабильным и основанным на навыке, вы перестаёте запускать его вручную. Укажите Kimi триггер: расписание, появление нового файла, отслеживаемый URL. Позвольте ему запускать весь рой проактивно, предоставляя вам только результат и отклонения, заслуживающие вашего внимания.

chuplung - inline image

Конкурентный мониторинг — наглядный пример. Первый запуск: вы строите и проверяете вручную. К тому моменту, как это станет фоновым агентом, он будет еженедельно проверять каждого конкурента параллельно и сбрасывать краткий отчёт в ваш почтовый ящик с нулевыми дополнительными временными затратами. Единственный человек, оставшийся в цикле, — это вы с поставленным вопросом и принятым на основе ответа решением.

text
1Запускай навык «[название]» по еженедельному расписанию.
2Триггер: [расписание / новый файл / отслеживаемый URL]
3При каждом запуске: выполни рой, примени CONSTRAINTS.md,
4проверь, затем доставь ВЫВОД + различия с прошлым запуском.
5Сообщай мне только если отклонение превышает [порог].

Что 2,8 трлн параметров не исправляют

chuplung - inline image

Галлюцинации масштабируются вместе с параллелизмом. Больше ищущих агентов означает больше уверенных неправильных ответов, если вы не запустите проход верификации. Рой сам себя не проверяет на факты.

K3 стоит в 3-4 раза дороже K2.6. Ввод: $3,00/М против $0,95/М. Вывод: $15,00/М против $4,00/М. Кэш помогает при повторных запусках, но первый запуск дорог. Для чистой оптимизации затрат K2.6 всё ещё остаётся бюджетным вариантом.

Open weights ещё не вышли. Moonshot обещал их к 27 июля 2026 года. До тех пор K3 работает только через API и приложение Kimi.

Рои усиливают плохие спецификации. Расплывчатый промпт через одного агента тратит один контекстный окно. Через 300 агентов он тратит 300 окон параллельно.

Краткий список «что не делать»

  • Однострочные промпты. Рой решает всё. Он решает неправильно.
  • Пропуск проверки декомпозиции. Самый дорогой шаг для пропуска.
  • Отсутствие прохода верификации. «Выглядит готовым» — это не «является правильным».
  • Сохранение непроверенного вывода как навыка. Ошибка накапливается при каждом будущем запуске.
  • 300 агентов на последовательную задачу. Рой не может распараллелить цепочку рассуждений.
  • Использование K3 там, где достаточно K2.6. Не каждая задача требует 2,8 трлн параметров.

Заключение

Большинство людей откроют Kimi, зададут вопрос, закроют вкладку. Это просто чат-бокс. Это примерно 10% того, что умеет K3.

Остальные 90% — это исследовательская команда, которую вы создаёте один раз и воспроизводите вечно. Каждый уровень открывает больше рычагов влияния: сначала запуск, затем доверие, затем накопление, затем автономия. Вам не нужны все четыре в первый же день. Начните с Уровня 1 с одной спецификации. Если результат полезен, переходите на Уровень 2 и проверьте его. Если планируете запускать снова, сохраните навык. Дальше система будет становиться умнее сама.

Пишите спецификацию, а не промпт. Проверяйте, прежде чем сохранять. И наблюдайте, как каждый запуск становится дешевле и точнее предыдущего.

Переделать в YouMind

Превратите одну вирусную статью в полноценный рабочий процесс создания контента

Собирайте источники, расшифровывайте паттерны, создавайте активы, пишите черновики и публикуйте контент из одного рабочего пространства ИИ.

Исследовать YouMind
Для авторов

Превратите ваш Markdown в аккуратную статью для 𝕏

Когда вы публикуете длинные тексты, изображения, таблицы и блоки кода, форматирование в 𝕏 становится мучением. YouMind превращает полный черновик в Markdown в чистую статью, готовую к публикации в 𝕏.

Попробовать Markdown для 𝕏

Другие паттерны для анализа

Недавние виральные статьи

Смотреть другие виральные статьи