YouMind
Войти

OpenAI Dots: Как создать команду из 4 агентов, которая не отклоняется от задачи (Полное руководство)

@fleyta88
АНГЛИЙСКИЙ01 окт. 2026 г.
126K
90
5
10
150

Суть

Это руководство объясняет, как настроить агентов OpenAI Dots для предотвращения отклонения от задачи, используя систему ролей на четыре места (Наблюдатель, Создатель, Скептик, Исполнитель) и строгие контрольные точки из пяти шагов с лестницей разрешений.

8,6% при 5 задачах. 19,7% при 10.

Это данные из собственной system card (карты системы) OpenAI для dots. Свяжите пять задач в цепочку — и в 8,6% запусков система зафиксирует выход за рамки. Свяжите десять — и показатель вырастет более чем вдвое.

В день запуска все публиковали фото плюшевых маскотов. Эту строчку не опубликовал почти никто.

Большинство гайдов по dots советуют связывать всё в одну цепь и просто дать агенту работать. Этот текст о том, где именно нужно разрезать цепочку, чтобы агент мог трудиться всю неделю, не выходя за рамки порученной задачи.

Один dot, четыре «кресла», лестница разрешений и контрольная точка каждые пять шагов.

TL;DR: опишите задачу до того, как подключите хотя бы одно приложение; дайте dot'у четыре кресла, в которых он сидит по очереди; никогда не позволяйте цепочке работать больше пяти шагов без контрольной точки и держите количество согласований ниже пяти в день. Промпты — в разделах с 6 по 8, математика — в разделах 3 и 8.

1. Сначала цифры

text
1запуск 29 сентября 2026 года
2модель GPT-6 Astra
3доступные приложения 4000+
4первый dot включён в тарифы Pro и Business Premium
5тарифы Pro $100 / $200 / $500 в месяц
6Business Premium $125 за пользователя в месяц, $100 при оплате за год
7общение с dot не учитывается в лимитах ChatGPT
8задачи, запущенные в Codex или Work учитываются в лимитах как обычно
9где работает десктоп, веб и мобильная версия ChatGPT, Slack, Teams
10SMS «скоро»
11
12из system card
13срабатывания защиты, цепочка из 5 задач 8,6%
14срабатывания защиты, цепочка из 10 задач 19,7%
15непрямые инъекции, внутренние тесты отражено 99,79%
16внешний red team, 1810 атак прошло 8,5%
17задачи с дезинформацией 0 отклонений из 151

Верхнюю таблицу уже опубликовали все. А вот нижняя должна изменить ваш подход к настройке.

2. Что такое dot на одном экране

Dot — это постоянно работающий агент, который принадлежит вам. Четыре вещи отличают его от обычного чата в ChatGPT:

text
1модель GPT-6 Astra, а не урезанная модель за красивым интерфейсом
2свой компьютер облачная машина с собственным браузером, работает, пока ваш ноутбук выключен
3работает между «проактивный поиск» в подключённых приложениях, только чтение
4вашими сообщениями не может отправлять данные, менять контент приложений или управлять вашим ПК там
5одна личность один и тот же dot и память в ChatGPT, Slack и Teams

И два инструмента управления, которыми вы будете пользоваться чаще всего:

text
1Custom Rules разрешить действие, требовать подтверждения или заблокировать его
2auto-review проверяет действия, которые могут затронуть ваши аккаунты или передать данные

OpenAI завершает пост о запуске так: dots всё ещё могут ошибаться, поэтому всегда проверяйте важную работу. Всё, что написано ниже, посвящено тому, как сделать эту проверку настолько быстрой, чтобы вы действительно её проводили.

3. Цифра, которую никто не опубликовал

Я быстро прикинул математику на основе двух цифр из system card.

Если бы каждый шаг в цепочке имел одинаковую небольшую и независимую вероятность выйти за рамки, переход от 5 шагов к 10 считался бы элементарно:

text
1отмечена цепочка из 5 шагов 8,6%
2вероятность на один шаг 1 - (1 - 0,086)^(1/5) = 1,78%
3
410 шагов, если бы они были независимы 1 - (1 - 0,0178)^10 = 16,5%
510 шагов, фактический замер из карты 19,7%

Фактическая цифра выше расчётной для независимых событий.

Мой вывод: ошибки накапливаются. Шаг, который слегка сбился с курса, передаёт следующему шагу чуть искажённую картину, а тот строит свою работу поверх неё. Поэтому риск растёт быстрее, чем сама цепочка.

У нас есть всего две цифры, и OpenAI не уточнила, в чём именно заключались зафиксированные проблемы, так что воспринимайте это как примерный ориентир. Но его достаточно, чтобы выстроить систему:

text
1правило, на котором построен этот гайд
2не больше 5 шагов между контрольными точками

4. Четыре кресла, один dot

Dot, которому сказали «ты мой ассистент», выдаёт результат в стиле ассистента: полезный, размытый и слегка многословный. Dot, которому сказали «прямо сейчас ты Скептик, и Скептик ищет только то, что не работает», выдаёт то, что можно использовать.

Поэтому у dot'а есть четыре кресла. Он сидит только в одном за раз и указывает, в каком именно, в начале каждого ответа.

text
1LOOKOUT (НАБЛЮДАТЕЛЬ) читет подключённые приложения, сообщает об изменениях, ничего не пишет
2MAKER (СОЗДАТЕЛЬ) работает на своём компьютере, отдаёт вам сам артефакт
3SKEPTIC (СКЕПТИК) сверяет артефакт с ТЗ, перечисляет недочёты
4RUNNER (КУРЬЕР) переносит одобренную работу туда, где ей место, спрашивает перед любой отправкой

Это режимы одного агента, а не четыре разных агента. Одна память, один свод правил, четыре узкие задачи.

fleyta - inline image

5. Настройка в правильном порядке

text
11 откройте ChatGPT на компьютере первый dot создаётся в десктопной или веб-версии,
2 мобильная может с ним общаться, но не создавать
32 найдите dots в боковой панели нет пункта = не тот тариф, регион ещё не поддерживается
4 или админ не включил функцию
53 дайте имя короткое, строчными буквами, без пробелов
6 вам придётся вводить его в Slack в 7 утра
74 вставьте описание задачи раздел 6, до всего остального
85 подключите источники только после того, как он подтвердит вам задачу
96 добавьте в Slack или Teams когда он поймёт, зачем нужен

Шаг 5 после шага 4 — главная ошибка. Агент с 40 подключёнными приложениями, но без ТЗ, прекрасно информирован и не делает ничего полезного.

6. Описание задачи

Вставьте это первым сообщением. Замените только текст в скобках.

text
1Ты мой постоянный операционный агент. Относись к этому сообщению как к своему ТЗ
2для каждой задачи, включая те, что я запускаю из Slack или с телефона.
3
4КТО Я
5Я [должность] в [компания или проект]. Моя неделя в основном состоит из [одно предложение].
6
7ЗА ЧТО ТЫ ОТВЕЧАЕШЬ (результаты, а не процессы)
81. [результат один]
92. [результат два]
103. [результат три]
11
12КРЕСЛА
13Ты сидишь в одном кресле за раз и указываешь его название в начале каждого ответа:
14LOOKOUT, MAKER, SKEPTIC, RUNNER.
15- LOOKOUT только читает и отчитывается.
16- MAKER показывает мне сам артефакт, а не его описание.
17- SKEPTIC сверяет работу MAKER с этим ТЗ и перечисляет недочёты.
18- RUNNER переносит только одобренную работу и спрашивает перед любой отправкой.
19
20ПРАВИЛО ЦЕПОЧКИ
21Никогда не делай больше 5 шагов подряд. После 5-го шага остановись, переключись на
22SKEPTIC, проведи контрольную точку и жди PASS (ОДОБРЕНО), прежде чем продолжить.
23
24КАК ТЫ СО МНОЙ ОБЩАЕШЬСЯ
25- Сначала результат. Затем максимум три вопроса, которые мне нужно решить.
26- Если застрял: что ты попробовал и что тебе нужно, в две строки.
27- Не уверен, входит ли что-то в задачу: прочитай, затем задай один вопрос. Не действуй.
28
29Подтверди, пересказав своими словами четыре кресла, три результата и правило цепочки.
30Затем остановись.

Не пропускайте последнюю строку. Если dot перескажет «подготовь еженедельный отчёт» как «напиши отчёт о прошедшей неделе», вы поймаете проблему одним сообщением, а не неделей неверных отчётов.

7. Лестница разрешений с бюджетом на согласования

Custom Rules дают вам три ступени: разрешить, требовать подтверждения, заблокировать. Большинство людей пишут стену запретов, потом согласовывают по 40 действий в день и перестают читать, что именно они одобряют.

Сначала пропишите ступень разрешений. Будьте щедры внизу и строги наверху.

text
1РАЗРЕШИТЬ
2- Читать всё в моих подключённых источниках.
3- Искать информацию в открытом интернете, использовать свой компьютер, запускать код.
4- Создавать и переписывать черновики в своём рабочем пространстве и в Space [ИМЯ].
5
6СПРОСИТЬ ПЕРЕД ДЕЙСТВИЕМ
7- Любое сообщение человеку: email, личное сообщение, пост в канале, приглашение, комментарий.
8- Любое изменение файла, который ты не создавал.
9- Любое действие в репозитории, включая открытие pull request.
10- Любая покупка, подписка или отправка формы.
11
12ЗАБЛОКИРОВАТЬ
13- Пароли, 2FA, биллинг, настройки платежей.
14- Удаление чего-либо.
15- Публикации от моего имени.
16- Контакты с людьми, не указанными в ТЗ задачи.
17
18ПРОБЕЛЫ В ПРАВИЛАХ
19Всё, что не покрыто правилами, считается «СПРОСИТЬ ПЕРЕД ДЕЙСТВИЕМ».
20Сообщай мне, какое правило оказалось неясным. Никогда не трактуй пробел в пользу действия.

Затем установите себе бюджет. Вот пример недели для dot'а, который занимается ресерчем, черновиками и еженедельным дайджестом. Распределение — моя оценка, а не точный замер:

text
1пример одной недели, 420 действий лестница выше «спрашивать обо всём»
2чтение и интернет 300 разрешить спросить
3черновики в рабочей среде 80 разрешить спросить
4сообщения людям 28 спросить спросить
5изменения в репозитории и файлах 8 спросить спросить
6заблокированные попытки 4 заблокировать спросить
7ваших кликов «одобрить» 36 в неделю 420 в неделю
8в рабочий день ~7 ~84

Никто не будет вдумчиво проверять 84 запроса в день. А вот семь — будете. В этом и есть настоящий смысл лестницы: держать количество согласований таким, чтобы вы их действительно читали.

Моя цель: меньше пяти в день. Если две недели подряд вы превышаете лимит, спустите одно регулярное действие на ступень ниже или сузьте источник данных.

8. Контрольная точка каждые пять шагов

Именно здесь появляются те самые 19,7%.

Длинная задача не выполняется одной цепочкой. Она разбивается на этапы максимум по пять шагов, и каждый этап заканчивается Скептиком.

text
1КОНТРОЛЬНАЯ ТОЧКА (SKEPTIC, в конце каждого этапа)
2
3Ответь на все пять вопросов, по одной строке на каждый:
41. Этот этап сделал то, что просило ТЗ, или что-то похожее, но попроще?
52. Обращался ли какой-либо шаг к источнику или человеку, не указанному в ТЗ?
63. Каждая ли цифра либо рассчитана тобой, либо имеет ссылку на источник?
74. Есть ли утверждения, под которые ты не можешь подвести доказательную базу? Перечисли их.
85. Если я одобрю этот этап, а он окажется ошибочным, что сломается?
9
10Вердикт:
11PASS переходи к следующему этапу
12HOLD остановись, сначала покажи мне пункты 2, 4 и 5

А теперь та же прикидка, что и в разделе 3. Предположим, что Скептик ловит 4 из 5 проблем на контрольной точке. Это моё допущение, а не измеренный показатель:

text
1одна цепочка из 10 шагов без проверки 19,7% срабатываний (system card)
2
3два этапа по 5 шагов с контрольной точкой
4 срабатываний на этап 8,6%
5 остаётся после контрольной точки 8,6% x 0,2 = 1,7%
6 за оба этапа 1 - (1 - 0,017)^2 = 3,4%

Даже если Скептик ловит только половину ошибок, два этапа дадут около 8,6% вместо 19,7%. Разбиение делает основную работу, процент отлова — остальную.

fleyta - inline image

9. Дайте работе место для посадки

Работа, которая живёт в длинном треде чата, — это работа, которую вы больше никогда не найдёте. Dots интегрируются с ChatGPT Spaces и Pages, где можете работать вы, ваша команда и сам dot.

Один Space, четыре страницы:

text
100 index одна строка на запуск: дата, использованные кресла, артефакт, вердикт
201 inbox находки LOOKOUT, новые сверху, с датой
302 review артефакты MAKER с контрольной точкой SKEPTIC под каждым
403 shipped то, что вы одобрили, с датой одобрения

Объясните dot'у эту структуру один раз. Через пару недель страница index станет самым полезным элементом всей системы: единственной читаемой историей того, что постоянно работающий агент делал с вашей неделей.

10. Первый реальный запуск

Начните с чего-то полезного, повторяющегося и дешёвого в переделке, если что-то пойдёт не так. Пятничный дайджест задействует все четыре кресла и безопасно ломается.

text
1Постоянная задача. Каждую пятницу в 16:00 и когда я говорю «запусти дайджест».
2
3ЭТАП 1 (максимум 5 шагов)
4LOOKOUT [календарь], [почта], [репозиторий]: что изменилось за неделю такого,
5 что нужно знать новичку, вышедшему в понедельник. Максимум 5 пунктов,
6 каждый заканчивается на «нужно решение» или «действий не требуется».
7MAKER только на основе этих пунктов: SHIPPED (ГОТОВО), MOVED (СДВИНУЛОСЬ), WAITING (ЖДЁТ).
8 Максимум 120 слов на раздел, ссылки для каждого пункта SHIPPED.
9SKEPTIC контрольная точка. Всё в SHIPPED без ссылки переносится в WAITING.
10
11ЭТАП 2 (только при PASS)
12RUNNER сохрани в 02 review как «Неделя [дата]», добавь одну строку в 00 index.
13 Никому не отправляй.
14
15Затем напиши мне ответ только на пункт 5 контрольной точки, ничего больше.

11. Dots против Grok Bot

Одна категория, но разная архитектура по умолчанию.

text
1 DOTS GROK BOT
2архитектура один агент, много кресел несколько именованных ботов
3память одна, общая для всех кресел своя у каждого бота
4где работает ChatGPT, Slack, Teams своё приложение и чаты
5для чего лучше неделя одного человека, один свод отдельные задачи, которые
6 правил никогда не пересекаются

Если ваши задачи делят контекст (почта питает дайджест, дайджест питает план на понедельник), один dot с четырьмя креслами будет проще. Если они вообще не должны видеть друг друга (клиент A и клиент B), отдельные боты обеспечат более чистое разграничение.

12. Предохранители

text
1цепочка длиннее 5 шагов -> стоп, контрольная точка, ждём PASS
2пробел в правилах -> СПРОСИТЬ ПЕРЕД ДЕЙСТВИЕМ, назвать непонятное правило
3сообщение любому человеку -> СПРОСИТЬ ПЕРЕД ДЕЙСТВИЕМ, всегда
4пароль, биллинг, удаление, паблик-> ЗАБЛОКИРОВАТЬ
5логин или капча посреди задачи -> перехватить управление на компьютере dot'а
65+ согласований в день 2 недели -> сдвинуть ступень или сузить источник
7SKEPTIC пишет похвалу -> переписать контрольную точку, а не артефакт

Каждый предохранитель направляет неопределённость к вам, а не к действию.

13. Что я не тестировал

Математику дрейфа. Две цифры из одной system card — это примерный сигнал, а не доказанная модель. OpenAI не раскрыла суть зафиксированных проблем с границами, поэтому я не могу оценить их серьёзность.

Процент отлова Скептиком. 4 из 5 — это допущение, чтобы показать логику расчётов. Dot, проверяющий собственную работу, не является независимым ревизором, поэтому реальный показатель может быть ниже.

Пример недели. 420 действий и их распределение по ступеням — моя оценка для dot'а, занимающегося ресерчем и черновиками, а не лог реального аккаунта.

Цены на дополнительные dots. OpenAI заявляет, что можно будет добавлять dots и масштабировать скорость или объём работы в месяц, но эти цены ещё не опубликованы.

14. Шпаргалка

Опишите задачу до того, как подключите хотя бы одно приложение.

Один агент, четыре кресла, одно кресло за раз.

Разрезайте каждую цепочку на пять шагов. Контрольная точка, затем продолжение.

Сначала пишите список разрешений. Пробелы идут в «СПРОСИТЬ ПЕРЕД ДЕЙСТВИЕМ».

Держите число согласований ниже пяти в день, иначе вы перестанете их читать.

Дайте работе место для посадки и читайте index по пятницам.

fleyta - inline image

Главная мысль

Dots — первый агент, которого большинство людей оставит работать, пока спит. Это меняет вопрос с «может ли он выполнить задачу» на «как далеко он зайдёт, прежде чем кто-то посмотрит».

Собственная карта OpenAI даёт подсказку: удваиваем цепочку — получаем более чем двукратный рост срабатываний защиты.

Поэтому не стройте более длинные цепочки. Стройте короткие этапы, ставьте Скептика в конец каждого из них и используйте лестницу, которая спрашивает вас только о том, о чём действительно стоит спросить.

Пять шагов, затем проверка. Вот и всё.

Детали запуска взяты из анонса dots от OpenAI. Данные system card приведены по публикации The New Stack. Цены на тарифы указаны по материалам о запуске на 1 октября 2026 года и могут измениться.

Сохранение в один клик

Используйте YouMind для глубокого чтения вирусных статей с помощью ИИ

Сохраняйте источники, задавайте точные вопросы, обобщайте аргументы и превращайте вирусные статьи в полезные заметки в одном рабочем пространстве ИИ.

Исследовать YouMind
Для авторов

Превратите ваш Markdown в аккуратную статью для 𝕏

Когда вы публикуете длинные тексты, изображения, таблицы и блоки кода, форматирование в 𝕏 становится мучением. YouMind превращает полный черновик в Markdown в чистую статью, готовую к публикации в 𝕏.

Попробовать Markdown для 𝕏

Другие паттерны для анализа

Недавние виральные статьи

Смотреть другие виральные статьи