8,6% при 5 задачах. 19,7% при 10.
Это данные из собственной system card (карты системы) OpenAI для dots. Свяжите пять задач в цепочку — и в 8,6% запусков система зафиксирует выход за рамки. Свяжите десять — и показатель вырастет более чем вдвое.
В день запуска все публиковали фото плюшевых маскотов. Эту строчку не опубликовал почти никто.
Большинство гайдов по dots советуют связывать всё в одну цепь и просто дать агенту работать. Этот текст о том, где именно нужно разрезать цепочку, чтобы агент мог трудиться всю неделю, не выходя за рамки порученной задачи.
Один dot, четыре «кресла», лестница разрешений и контрольная точка каждые пять шагов.
TL;DR: опишите задачу до того, как подключите хотя бы одно приложение; дайте dot'у четыре кресла, в которых он сидит по очереди; никогда не позволяйте цепочке работать больше пяти шагов без контрольной точки и держите количество согласований ниже пяти в день. Промпты — в разделах с 6 по 8, математика — в разделах 3 и 8.
1. Сначала цифры
1запуск 29 сентября 2026 года2модель GPT-6 Astra3доступные приложения 4000+4первый dot включён в тарифы Pro и Business Premium5тарифы Pro $100 / $200 / $500 в месяц6Business Premium $125 за пользователя в месяц, $100 при оплате за год7общение с dot не учитывается в лимитах ChatGPT8задачи, запущенные в Codex или Work учитываются в лимитах как обычно9где работает десктоп, веб и мобильная версия ChatGPT, Slack, Teams10SMS «скоро»1112из system card13срабатывания защиты, цепочка из 5 задач 8,6%14срабатывания защиты, цепочка из 10 задач 19,7%15непрямые инъекции, внутренние тесты отражено 99,79%16внешний red team, 1810 атак прошло 8,5%17задачи с дезинформацией 0 отклонений из 151
Верхнюю таблицу уже опубликовали все. А вот нижняя должна изменить ваш подход к настройке.
2. Что такое dot на одном экране
Dot — это постоянно работающий агент, который принадлежит вам. Четыре вещи отличают его от обычного чата в ChatGPT:
1модель GPT-6 Astra, а не урезанная модель за красивым интерфейсом2свой компьютер облачная машина с собственным браузером, работает, пока ваш ноутбук выключен3работает между «проактивный поиск» в подключённых приложениях, только чтение4вашими сообщениями не может отправлять данные, менять контент приложений или управлять вашим ПК там5одна личность один и тот же dot и память в ChatGPT, Slack и Teams
И два инструмента управления, которыми вы будете пользоваться чаще всего:
1Custom Rules разрешить действие, требовать подтверждения или заблокировать его2auto-review проверяет действия, которые могут затронуть ваши аккаунты или передать данные
OpenAI завершает пост о запуске так: dots всё ещё могут ошибаться, поэтому всегда проверяйте важную работу. Всё, что написано ниже, посвящено тому, как сделать эту проверку настолько быстрой, чтобы вы действительно её проводили.
3. Цифра, которую никто не опубликовал
Я быстро прикинул математику на основе двух цифр из system card.
Если бы каждый шаг в цепочке имел одинаковую небольшую и независимую вероятность выйти за рамки, переход от 5 шагов к 10 считался бы элементарно:
1отмечена цепочка из 5 шагов 8,6%2вероятность на один шаг 1 - (1 - 0,086)^(1/5) = 1,78%3410 шагов, если бы они были независимы 1 - (1 - 0,0178)^10 = 16,5%510 шагов, фактический замер из карты 19,7%
Фактическая цифра выше расчётной для независимых событий.
Мой вывод: ошибки накапливаются. Шаг, который слегка сбился с курса, передаёт следующему шагу чуть искажённую картину, а тот строит свою работу поверх неё. Поэтому риск растёт быстрее, чем сама цепочка.
У нас есть всего две цифры, и OpenAI не уточнила, в чём именно заключались зафиксированные проблемы, так что воспринимайте это как примерный ориентир. Но его достаточно, чтобы выстроить систему:
1правило, на котором построен этот гайд2не больше 5 шагов между контрольными точками
4. Четыре кресла, один dot
Dot, которому сказали «ты мой ассистент», выдаёт результат в стиле ассистента: полезный, размытый и слегка многословный. Dot, которому сказали «прямо сейчас ты Скептик, и Скептик ищет только то, что не работает», выдаёт то, что можно использовать.
Поэтому у dot'а есть четыре кресла. Он сидит только в одном за раз и указывает, в каком именно, в начале каждого ответа.
1LOOKOUT (НАБЛЮДАТЕЛЬ) читет подключённые приложения, сообщает об изменениях, ничего не пишет2MAKER (СОЗДАТЕЛЬ) работает на своём компьютере, отдаёт вам сам артефакт3SKEPTIC (СКЕПТИК) сверяет артефакт с ТЗ, перечисляет недочёты4RUNNER (КУРЬЕР) переносит одобренную работу туда, где ей место, спрашивает перед любой отправкой
Это режимы одного агента, а не четыре разных агента. Одна память, один свод правил, четыре узкие задачи.

5. Настройка в правильном порядке
11 откройте ChatGPT на компьютере первый dot создаётся в десктопной или веб-версии,2 мобильная может с ним общаться, но не создавать32 найдите dots в боковой панели нет пункта = не тот тариф, регион ещё не поддерживается4 или админ не включил функцию53 дайте имя короткое, строчными буквами, без пробелов6 вам придётся вводить его в Slack в 7 утра74 вставьте описание задачи раздел 6, до всего остального85 подключите источники только после того, как он подтвердит вам задачу96 добавьте в Slack или Teams когда он поймёт, зачем нужен
Шаг 5 после шага 4 — главная ошибка. Агент с 40 подключёнными приложениями, но без ТЗ, прекрасно информирован и не делает ничего полезного.
6. Описание задачи
Вставьте это первым сообщением. Замените только текст в скобках.
1Ты мой постоянный операционный агент. Относись к этому сообщению как к своему ТЗ2для каждой задачи, включая те, что я запускаю из Slack или с телефона.34КТО Я5Я [должность] в [компания или проект]. Моя неделя в основном состоит из [одно предложение].67ЗА ЧТО ТЫ ОТВЕЧАЕШЬ (результаты, а не процессы)81. [результат один]92. [результат два]103. [результат три]1112КРЕСЛА13Ты сидишь в одном кресле за раз и указываешь его название в начале каждого ответа:14LOOKOUT, MAKER, SKEPTIC, RUNNER.15- LOOKOUT только читает и отчитывается.16- MAKER показывает мне сам артефакт, а не его описание.17- SKEPTIC сверяет работу MAKER с этим ТЗ и перечисляет недочёты.18- RUNNER переносит только одобренную работу и спрашивает перед любой отправкой.1920ПРАВИЛО ЦЕПОЧКИ21Никогда не делай больше 5 шагов подряд. После 5-го шага остановись, переключись на22SKEPTIC, проведи контрольную точку и жди PASS (ОДОБРЕНО), прежде чем продолжить.2324КАК ТЫ СО МНОЙ ОБЩАЕШЬСЯ25- Сначала результат. Затем максимум три вопроса, которые мне нужно решить.26- Если застрял: что ты попробовал и что тебе нужно, в две строки.27- Не уверен, входит ли что-то в задачу: прочитай, затем задай один вопрос. Не действуй.2829Подтверди, пересказав своими словами четыре кресла, три результата и правило цепочки.30Затем остановись.
Не пропускайте последнюю строку. Если dot перескажет «подготовь еженедельный отчёт» как «напиши отчёт о прошедшей неделе», вы поймаете проблему одним сообщением, а не неделей неверных отчётов.
7. Лестница разрешений с бюджетом на согласования
Custom Rules дают вам три ступени: разрешить, требовать подтверждения, заблокировать. Большинство людей пишут стену запретов, потом согласовывают по 40 действий в день и перестают читать, что именно они одобряют.
Сначала пропишите ступень разрешений. Будьте щедры внизу и строги наверху.
1РАЗРЕШИТЬ2- Читать всё в моих подключённых источниках.3- Искать информацию в открытом интернете, использовать свой компьютер, запускать код.4- Создавать и переписывать черновики в своём рабочем пространстве и в Space [ИМЯ].56СПРОСИТЬ ПЕРЕД ДЕЙСТВИЕМ7- Любое сообщение человеку: email, личное сообщение, пост в канале, приглашение, комментарий.8- Любое изменение файла, который ты не создавал.9- Любое действие в репозитории, включая открытие pull request.10- Любая покупка, подписка или отправка формы.1112ЗАБЛОКИРОВАТЬ13- Пароли, 2FA, биллинг, настройки платежей.14- Удаление чего-либо.15- Публикации от моего имени.16- Контакты с людьми, не указанными в ТЗ задачи.1718ПРОБЕЛЫ В ПРАВИЛАХ19Всё, что не покрыто правилами, считается «СПРОСИТЬ ПЕРЕД ДЕЙСТВИЕМ».20Сообщай мне, какое правило оказалось неясным. Никогда не трактуй пробел в пользу действия.
Затем установите себе бюджет. Вот пример недели для dot'а, который занимается ресерчем, черновиками и еженедельным дайджестом. Распределение — моя оценка, а не точный замер:
1пример одной недели, 420 действий лестница выше «спрашивать обо всём»2чтение и интернет 300 разрешить спросить3черновики в рабочей среде 80 разрешить спросить4сообщения людям 28 спросить спросить5изменения в репозитории и файлах 8 спросить спросить6заблокированные попытки 4 заблокировать спросить7ваших кликов «одобрить» 36 в неделю 420 в неделю8в рабочий день ~7 ~84
Никто не будет вдумчиво проверять 84 запроса в день. А вот семь — будете. В этом и есть настоящий смысл лестницы: держать количество согласований таким, чтобы вы их действительно читали.
Моя цель: меньше пяти в день. Если две недели подряд вы превышаете лимит, спустите одно регулярное действие на ступень ниже или сузьте источник данных.
8. Контрольная точка каждые пять шагов
Именно здесь появляются те самые 19,7%.
Длинная задача не выполняется одной цепочкой. Она разбивается на этапы максимум по пять шагов, и каждый этап заканчивается Скептиком.
1КОНТРОЛЬНАЯ ТОЧКА (SKEPTIC, в конце каждого этапа)23Ответь на все пять вопросов, по одной строке на каждый:41. Этот этап сделал то, что просило ТЗ, или что-то похожее, но попроще?52. Обращался ли какой-либо шаг к источнику или человеку, не указанному в ТЗ?63. Каждая ли цифра либо рассчитана тобой, либо имеет ссылку на источник?74. Есть ли утверждения, под которые ты не можешь подвести доказательную базу? Перечисли их.85. Если я одобрю этот этап, а он окажется ошибочным, что сломается?910Вердикт:11PASS переходи к следующему этапу12HOLD остановись, сначала покажи мне пункты 2, 4 и 5
А теперь та же прикидка, что и в разделе 3. Предположим, что Скептик ловит 4 из 5 проблем на контрольной точке. Это моё допущение, а не измеренный показатель:
1одна цепочка из 10 шагов без проверки 19,7% срабатываний (system card)23два этапа по 5 шагов с контрольной точкой4 срабатываний на этап 8,6%5 остаётся после контрольной точки 8,6% x 0,2 = 1,7%6 за оба этапа 1 - (1 - 0,017)^2 = 3,4%
Даже если Скептик ловит только половину ошибок, два этапа дадут около 8,6% вместо 19,7%. Разбиение делает основную работу, процент отлова — остальную.

9. Дайте работе место для посадки
Работа, которая живёт в длинном треде чата, — это работа, которую вы больше никогда не найдёте. Dots интегрируются с ChatGPT Spaces и Pages, где можете работать вы, ваша команда и сам dot.
Один Space, четыре страницы:
100 index одна строка на запуск: дата, использованные кресла, артефакт, вердикт201 inbox находки LOOKOUT, новые сверху, с датой302 review артефакты MAKER с контрольной точкой SKEPTIC под каждым403 shipped то, что вы одобрили, с датой одобрения
Объясните dot'у эту структуру один раз. Через пару недель страница index станет самым полезным элементом всей системы: единственной читаемой историей того, что постоянно работающий агент делал с вашей неделей.
10. Первый реальный запуск
Начните с чего-то полезного, повторяющегося и дешёвого в переделке, если что-то пойдёт не так. Пятничный дайджест задействует все четыре кресла и безопасно ломается.
1Постоянная задача. Каждую пятницу в 16:00 и когда я говорю «запусти дайджест».23ЭТАП 1 (максимум 5 шагов)4LOOKOUT [календарь], [почта], [репозиторий]: что изменилось за неделю такого,5 что нужно знать новичку, вышедшему в понедельник. Максимум 5 пунктов,6 каждый заканчивается на «нужно решение» или «действий не требуется».7MAKER только на основе этих пунктов: SHIPPED (ГОТОВО), MOVED (СДВИНУЛОСЬ), WAITING (ЖДЁТ).8 Максимум 120 слов на раздел, ссылки для каждого пункта SHIPPED.9SKEPTIC контрольная точка. Всё в SHIPPED без ссылки переносится в WAITING.1011ЭТАП 2 (только при PASS)12RUNNER сохрани в 02 review как «Неделя [дата]», добавь одну строку в 00 index.13 Никому не отправляй.1415Затем напиши мне ответ только на пункт 5 контрольной точки, ничего больше.
11. Dots против Grok Bot
Одна категория, но разная архитектура по умолчанию.
1 DOTS GROK BOT2архитектура один агент, много кресел несколько именованных ботов3память одна, общая для всех кресел своя у каждого бота4где работает ChatGPT, Slack, Teams своё приложение и чаты5для чего лучше неделя одного человека, один свод отдельные задачи, которые6 правил никогда не пересекаются
Если ваши задачи делят контекст (почта питает дайджест, дайджест питает план на понедельник), один dot с четырьмя креслами будет проще. Если они вообще не должны видеть друг друга (клиент A и клиент B), отдельные боты обеспечат более чистое разграничение.
12. Предохранители
1цепочка длиннее 5 шагов -> стоп, контрольная точка, ждём PASS2пробел в правилах -> СПРОСИТЬ ПЕРЕД ДЕЙСТВИЕМ, назвать непонятное правило3сообщение любому человеку -> СПРОСИТЬ ПЕРЕД ДЕЙСТВИЕМ, всегда4пароль, биллинг, удаление, паблик-> ЗАБЛОКИРОВАТЬ5логин или капча посреди задачи -> перехватить управление на компьютере dot'а65+ согласований в день 2 недели -> сдвинуть ступень или сузить источник7SKEPTIC пишет похвалу -> переписать контрольную точку, а не артефакт
Каждый предохранитель направляет неопределённость к вам, а не к действию.
13. Что я не тестировал
Математику дрейфа. Две цифры из одной system card — это примерный сигнал, а не доказанная модель. OpenAI не раскрыла суть зафиксированных проблем с границами, поэтому я не могу оценить их серьёзность.
Процент отлова Скептиком. 4 из 5 — это допущение, чтобы показать логику расчётов. Dot, проверяющий собственную работу, не является независимым ревизором, поэтому реальный показатель может быть ниже.
Пример недели. 420 действий и их распределение по ступеням — моя оценка для dot'а, занимающегося ресерчем и черновиками, а не лог реального аккаунта.
Цены на дополнительные dots. OpenAI заявляет, что можно будет добавлять dots и масштабировать скорость или объём работы в месяц, но эти цены ещё не опубликованы.
14. Шпаргалка
Опишите задачу до того, как подключите хотя бы одно приложение.
Один агент, четыре кресла, одно кресло за раз.
Разрезайте каждую цепочку на пять шагов. Контрольная точка, затем продолжение.
Сначала пишите список разрешений. Пробелы идут в «СПРОСИТЬ ПЕРЕД ДЕЙСТВИЕМ».
Держите число согласований ниже пяти в день, иначе вы перестанете их читать.
Дайте работе место для посадки и читайте index по пятницам.

Главная мысль
Dots — первый агент, которого большинство людей оставит работать, пока спит. Это меняет вопрос с «может ли он выполнить задачу» на «как далеко он зайдёт, прежде чем кто-то посмотрит».
Собственная карта OpenAI даёт подсказку: удваиваем цепочку — получаем более чем двукратный рост срабатываний защиты.
Поэтому не стройте более длинные цепочки. Стройте короткие этапы, ставьте Скептика в конец каждого из них и используйте лестницу, которая спрашивает вас только о том, о чём действительно стоит спросить.
Пять шагов, затем проверка. Вот и всё.
Детали запуска взяты из анонса dots от OpenAI. Данные system card приведены по публикации The New Stack. Цены на тарифы указаны по материалам о запуске на 1 октября 2026 года и могут измениться.





