YouMind
Увійти

OpenAI Dots: Як створити команду агентів із 4 ролями, яка зупиняється до відхилення (Повний посібник)

@fleyta88
АНГЛІЙСЬКА01 жовт. 2026 р.
126K
90
5
10
150

Коротко

Цей посібник пояснює, як налаштувати агенти OpenAI Dots для запобігання дрейфу завдань, використовуючи систему чотирьох ролей (Lookout, Maker, Skeptic, Runner) та впроваджуючи суворі контрольні точки з п’яти кроків і драбину дозволів.

8,6% на 5 завданнях. 19,7% на 10.

Це дані з власної системної картки OpenAI для dots. З'єднайте п'ять завдань у ланцюжок — і в 8,6% запусків система сигналізує про вихід за межі. З'єднайте десять — і цей показник більш ніж подвоюється.

У день запуску всі постили плюшевих маскотів. Цей рядок не запостив майже ніхто.

Більшість гайдів по dots радять зв'язати все докупи й дозволити агенту працювати. Цей — про те, де саме розрізати ланцюжок, щоб агент міг працювати весь тиждень і не вийшов за межі поставленого завдання.

Один dot, чотири «крісла», драбина дозволів і контрольна точка кожні п'ять кроків.

TLDR: опишіть завдання ще до того, як підключите хоча б один додаток; дайте dot чотири крісла, в яких він сидітиме по черзі; ніколи не дозволяйте ланцюжку працювати більше п'яти кроків без контрольної точки; тримайте кількість схвалень менше п'яти на день. Промпти — у розділах від 6 до 8, математика — у розділах 3 і 8.

1. Спочатку цифри

text
1запуск 29 вересня 2026 року
2модель GPT-6 Astra
3додатки для підключення 4000+
4перший dot включено в Pro та Business Premium
5тарифи Pro $100 / $200 / $500 на місяць
6Business Premium $125 за користувача на місяць, $100 при річній оплаті
7спілкування з dot не враховується в лімітах ChatGPT
8завдання, які він запускає в Codex або Work враховуються як зазвичай
9де живе десктопний, веб- і мобільний ChatGPT, Slack, Teams
10повідомлення "незабаром"
11
12із системної картки
13спрацювання обмежень, ланцюжок із 5 завдань 8,6%
14спрацювання обмежень, ланцюжок із 10 завдань 19,7%
15непряма ін'єкція, внутрішні тести 99,79% заблоковано
16зовнішня red team, 1810 атак 8,5% пройшли
17завдання з дезінформацією 0 відхилень зі 151

Верхню таблицю вже запостили всі. Нижня — це те, що має змінити ваш підхід до налаштування.

2. Що таке dot — на одному екрані

Dot — це агент, який завжди онлайн і належить вам. Чотири речі відрізняють його від звичайного чату в ChatGPT:

text
1модель GPT-6 Astra, а не полегшена версія під гарним інтерфейсом
2власний комп'ютер хмарна машина зі своїм браузером, працює, навіть коли ваш ноутбук вимкнений
3працює між "проактивний ресерч" у ваших підключених додатках, лише читання
4вашими повідомленнями він не може нічого надсилати, змінювати контент додатків чи керувати вашим комп'ютером
5одна особистість той самий dot і та сама пам'ять у ChatGPT, Slack та Teams

І два елементи керування, якими ви користуватиметесь найчастіше:

text
1Custom Rules дозволити дію, вимагати схвалення або заблокувати її
2auto-review перевіряє дії, які можуть торкнутися ваших акаунтів або передати дані

OpenAI завершує пост про запуск так: dots все ще можуть помилятися, тому завжди перевіряйте важливу роботу. Усе, що нижче — про те, як зробити цю перевірку настільки швидкою, щоб ви справді її робили.

3. Цифра, яку ніхто не запостив

Я зробив кілька швидких розрахунків на основі двох чисел із системної картки.

Якби кожен крок у ланцюжку мав однакову, невелику й незалежну ймовірність вийти за межі, перехід від 5 кроків до 10 описувався б простою математикою:

text
1ланцюжок із 5 кроків із прапорцем 8,6%
2ймовірність на один крок, що з цього випливає 1 - (1 - 0,086)^(1/5) = 1,78%
3
410 кроків, якби вони були незалежними 1 - (1 - 0,0178)^10 = 16,5%
510 кроків, фактичний результат із картки 19,7%

Фактичне значення вище за розраховане для незалежних подій.

Моя інтерпретація: помилки накопичуються. Крок, який трохи відхилився, передає наступному кроку злегка викривлену картину, а той будує на ній свою роботу. Тому ризик зростає швидше, ніж довжина ланцюжка.

Це лише дві цифри, і OpenAI не пояснила, якими саме були проблеми з межами, тож сприймайте це як приблизний сигнал. Але його достатньо, щоб побудувати навколо нього систему:

text
1правило, на якому побудований цей гайд
2не більше 5 кроків між контрольними точками

4. Чотири крісла, один dot

Dot, якому сказали «ти мій асистент», видає роботу в стилі асистента: корисну, розмиту й трохи задовгу. Dot, якому сказали «зараз ти Скептик, і Скептик шукає лише те, що не працює», видає щось, що можна реально використати.

Тому dot отримує чотири крісла. Він сидить лише в одному водночас і на початку кожної відповіді каже, в якому саме.

text
1LOOKOUT читає ваші підключені додатки, звітує про зміни, нічого не пише
2MAKER працює на своєму комп'ютері, віддає вам сам артефакт
3SKEPTIC перевіряє артефакт за брифом, перелічує недоліки
4RUNNER переміщує схвалену роботу туди, де їй місце, питає дозволу, перш ніж щось піде далі

Це режими одного агента, а не чотири різні агенти. Одна пам'ять, один набір правил, чотири вузькі завдання.

fleyta - inline image

5. Налаштування в правильному порядку

text
11 відкрийте ChatGPT на комп'ютері перший dot створюється в десктопі або вебі,
2 телефон може з ним спілкуватися, але не створювати
32 знайдіть dots у бічній панелі немає пункту = не той тариф, ринок ще не доступний
4 або адміністратор не ввімкнув функцію
53 дайте йому ім'я коротке, малі літери, без пробілів
6 ви будете вводити його в Slack о 7-й ранку
74 вставте опис завдання розділ 6, перш ніж робити будь-що інше
85 підключіть джерела лише після того, як він підтвердить вам завдання
96 додайте його в Slack або Teams коли він уже знатиме, для чого існує

Крок 5 після кроку 4 — це те, з чим усі помиляються. Агент із 40 підключеними додатками, але без брифа, дуже добре обізнаний і не видає нічого корисного.

6. Опис завдання

Вставте це першим повідомленням. Замініть лише текст у дужках, більше нічого.

text
1Ти — мій постійний операційний агент. Вважай це повідомлення своїм описом
2роботи для кожного завдання, включно з тими, які я запускаю зі Slack або телефону.
3
4ХТО Я
5Я [роль] у [компанія або проєкт]. Мій тиждень переважно складається з [одне речення].
6
7ЗА ЩО ТИ ВІДПОВІДАЄШ (результати, а не процеси)
81. [результат один]
92. [результат два]
103. [результат три]
11
12КРІСЛА
13Ти сидиш лише в одному кріслі водночас і називаєш його на початку кожної відповіді:
14LOOKOUT, MAKER, SKEPTIC, RUNNER.
15- LOOKOUT лише читає та звітує.
16- MAKER показує мені артефакт, а не його опис.
17- SKEPTIC перевіряє роботу MAKER за цим брифом і перелічує недоліки.
18- RUNNER лише переміщує схвалену роботу і питає дозволу, перш ніж щось піде далі.
19
20ПРАВИЛО ЛАНЦЮЖКА
21Ніколи не роби більше 5 кроків поспіль. Після 5-го кроку зупинись, перемкнись на
22SKEPTIC, виконай контрольну точку і чекай на PASS, перш ніж продовжувати.
23
24ЯК ТИ ЗІ МНОЮ СПІЛКУЄШСЯ
25- Спочатку результат. Потім максимум три речі, які я маю вирішити.
26- Заблоковано: що ти спробував і що тобі потрібно, у два рядки.
27- Не впевнений, чи це входить у скоуп: прочитай, потім постав одне запитання. Не дій.
28
29Підтвердь, переказавши своїми словами чотири крісла, три результати та правило ланцюжка.
30Потім зупинись.

Не пропускайте останній рядок. Якщо dot переказує «скласти тижневий звіт» як «написати звіт про тиждень», ви виявили проблему одним повідомленням, а не тижнем хибних звітів.

7. Драбина дозволів із бюджетом на схвалення

Custom Rules дають вам три сходинки: дозволити, вимагати схвалення, заблокувати. Більшість людей пишуть стіну заборон, потім схвалюють 40 речей на день і перестають читати, що саме схвалюють.

Спочатку напишіть сходинку «дозволити». Будьте щедрими внизу та суворими нагорі.

text
1ДОЗВОЛИТИ
2- Читати будь-що в моїх підключених джерелах.
3- Шукати інформацію у відкритому вебі, використовувати свій комп'ютер, запускати код.
4- Створювати та переписувати чернетки у своєму робочому просторі та в Space [НАЗВА].
5
6СПИТАТИ СПЕРШУ
7- Будь-яке повідомлення людині: email, DM, пост у каналі, запрошення, коментар.
8- Будь-яка зміна файлу, який ти не створював.
9- Будь-яка дія в репозиторії, включно зі створенням pull request.
10- Будь-яка покупка, підписка або відправка форми.
11
12ЗАБЛОКУВАТИ
13- Паролі, 2FA, білінг, налаштування платежів.
14- Видалення будь-чого.
15- Публікації від мого імені.
16- Контакти з будь-ким, хто не згаданий у брифі завдання.
17
18ПРОГАЛИНИ
19Усе, що не покривають правила, вважається СПИТАТИ СПЕРШУ.
20Кажи мені, яке правило було незрозумілим. Ніколи не трактуй прогалину на користь дії.

Потім виділіть собі бюджет. Ось приклад тижня для dot, який займається ресерчем, чернетками та тижневим дайджестом. Розподіл — моя оцінка, а не точні вимірювання:

text
1один приклад тижня, 420 дій драбина вище "питати про все"
2читання та веб 300 дозволити питати
3чернетки у своєму просторі 80 дозволити питати
4повідомлення людям 28 питати питати
5зміни в репо та файлах 8 питати питати
6заблоковані спроби 4 блокувати питати
7схвалення, які ви клікаєте 36 на тиждень 420 на тиждень
8на робочий день ~7 ~84

Ніхто не читає 84 схвалення на день. А от сім — прочитаєте. У цьому й полягає справжня суть драбини: тримати кількість схвалень такою малою, щоб ви їх усе ще переглядали.

Моя мета: менше п'яти на день. Якщо два тижні поспіль ви перевищуєте цю позначку, перенесіть одну регулярну дію на сходинку нижче або звузьте джерело.

8. Контрольна точка кожні п'ять кроків

Саме тут з'являються ті 19,7%.

Довге завдання не виконується одним ланцюжком. Воно виконується етапами максимум по п'ять кроків, і кожен етап завершує Скептик.

text
1КОНТРОЛЬНА ТОЧКА (Skeptic, наприкінці кожного етапу)
2
3Дай відповідь на всі п'ять, по одному рядку на кожне:
41. Цей етап зробив те, що просив бриф, чи щось простіше поруч?
52. Чи звертався якийсь крок до джерела або людини, не згаданих у брифі?
63. Кожне число або обчислене тобою, або має посилання на джерело?
74. Є твердження, які ти не можеш підтвердити доказами? Перелічи їх.
85. Якщо я схвалю цей етап, а він хибний, що зламається?
9
10Вердикт:
11PASS переходь до наступного етапу
12HOLD зупинись, спершу покажи мені пункти 2, 4 та 5

А тепер ті самі прикидки, що й у розділі 3. Припустимо, Скептик ловить 4 з 5 проблем на контрольній точці. Це моє припущення, а не виміряний показник:

text
1один ланцюжок із 10 кроків, без контрольної точки 19,7% із прапорцем (системна картка)
2
3два етапи по 5 кроків із контрольною точкою на кожному
4 із прапорцем на етап 8,6%
5 залишається після контрольної точки 8,6% x 0,2 = 1,7%
6 за обидва етапи 1 - (1 - 0,017)^2 = 3,4%

Навіть якщо Скептик ловить лише половину, два етапи дають близько 8,6% замість 19,7%. Розрізання робить основну роботу, решту — рівень виявлення.

fleyta - inline image

9. Дайте роботі місце для посадки

Робота, яка живе в треді чату — це робота, яку ви більше ніколи не знайдете. Dots інтегруються в ChatGPT Spaces та Pages, де працюєте ви, ваша команда і сам dot.

Один Space, чотири сторінки:

text
100 index один рядок на запуск: дата, використані крісла, артефакт, вердикт
201 inbox знахідки LOOKOUT, найновіші зверху, з датами
302 review артефакти MAKER із контрольною точкою SKEPTIC під кожним
403 shipped те, що ви схвалили, із датою схвалення

Поясніть dot цю карту один раз. Через два тижні сторінка index стане найкориснішою річчю в усій системі: єдиним читабельним записом того, що агент, який завжди онлайн, робив із вашим тижнем.

10. Перший реальний запуск

Почніть із чогось корисного, повторюваного й дешевого для переробки, якщо щось піде не так. П'ятничний дайджест використовує всі чотири крісла і безпечно ламається.

text
1Постійне завдання. Щоп''ятниці о 16:00 та коли я кажу "run the digest".
2
3ЕТАП 1 (максимум 5 кроків)
4LOOKOUT [календар], [email], [репо]: що змінилося цього тижня такого,
5 що треба знати людині, яка приєдналася в понеділок. Максимум п'ять булітів,
6 кожен закінчується на "потрібне рішення" або "дій не потрібно".
7MAKER лише на основі цих булітів: SHIPPED, MOVED, WAITING.
8 Максимум 120 слів на розділ, посилання для кожного пункту SHIPPED.
9SKEPTIC контрольна точка. Усе в SHIPPED без посилання переноситься у WAITING.
10
11ЕТАП 2 (лише після PASS)
12RUNNER збережи в 02 review як "Тиждень [дата]", додай один рядок у 00 index.
13 Нікому не надсилай.
14
15Потім надішли мені лише відповідь на пункт 5 контрольної точки, більше нічого.

11. Dots проти Grok Bot

Одна категорія, різна форма за замовчуванням.

text
1 DOTS GROK BOT
2форма за замовчуванням один агент, багато крісел кілька іменованих ботів
3пам'ять одна, спільна для всіх крісел окрема для кожного бота
4де живе ChatGPT, Slack, Teams власний додаток і чати
5для чого підходить тиждень однієї людини, один набір правил окремі завдання, які ніколи не перетинаються

Якщо ваші завдання мають спільний контекст (ваша пошта живить дайджест, який живить план на понеділок), один dot із чотирма кріслами буде простішим. Якщо вони ніколи не повинні бачити одне одного (клієнт A і клієнт B), окремі боти створять чистішу межу.

12. Запобіжники

text
1ланцюжок довший за 5 кроків -> зупинись, контрольна точка, чекай на PASS
2прогалина в правилах -> СПИТАТИ СПЕРШУ, назви незрозуміле правило
3повідомлення будь-якій людині -> СПИТАТИ СПЕРШУ, завжди
4пароль, білінг, видалення, публічне -> ЗАБЛОКУВАТИ
5логін або капча під час завдання -> перебери керування з комп'ютера dot
65+ схвалень на день протягом 2 тижнів -> опусти дію на сходинку нижче або звузь джерело
7SKEPTIC пише похвалу -> перепиши контрольну точку, а не артефакт

Кожен запобіжник скеровує невизначеність до вас, а ніколи — до дії.

13. Чого я не тестував

Математику дрейфу. Дві цифри з однієї системної картки — це приблизний сигнал, а не доведена модель. OpenAI не пояснила, якими саме були проблеми з межами, тому я не можу сказати, наскільки вони серйозні.

Рівень виявлення Скептика. 4 з 5 — це припущення, щоб показати формулу. Dot, який перевіряє власну роботу, не є незалежним рецензентом, тому реальний показник може бути нижчим.

Приклад тижня. 420 дій і розподіл за сходинками — моя оцінка для dot, що займається ресерчем і чернетками, а не лог реального акаунта.

Ціни після першого dot. OpenAI каже, що ви зможете додавати dots і масштабувати швидкість або обсяг роботи на місяць, але ціни ще не опубліковані.

14. Плейбук

Опишіть завдання до того, як підключите хоча б один додаток.

Один агент, чотири крісла, одне крісло водночас.

Розрізайте кожен ланцюжок на п'ять кроків. Контрольна точка, потім продовження.

Спочатку напишіть список дозволів. Прогалини йдуть у СПИТАТИ СПЕРШУ.

Тримайте кількість схвалень менше п'яти на день, інакше ваша перевірка перестане бути реальною.

Дайте роботі місце для посадки і читайте index по п'ятницях.

fleyta - inline image

Головна думка

Dots — це перший агент, якого більшість людей залишатиме працювати, поки вони сплять. Це змінює питання з «чи зможе він виконати завдання» на «як далеко він зайде, перш ніж хтось подивиться».

Власна картка OpenAI дає підказку щодо відповіді: подвійте ланцюжок — і кількість спрацювань збільшиться більш ніж удвічі.

Тому не будуйте довший ланцюжок. Будуйте коротші етапи, ставте Скептика наприкінці кожного та драбину, яка питає вас лише про те, про що варто питати.

П'ять кроків, потім перевірка. Ось і все.

Деталі запуску взято з анонсу dots від OpenAI. Дані системної картки наведено за матеріалами The New Stack. Ціни тарифів актуальні станом на 1 жовтня 2026 року за даними оглядів запуску і можуть змінитися.

Збереження в один клік

Використовуйте YouMind для AI-глибокого читання віральних статей

Зберігайте джерела, ставте цілеспрямовані запитання, підсумовуйте аргументи та перетворюйте віральні статті на корисні нотатки в одному AI-робочому просторі.

Дослідити YouMind
Для авторів

Перетворіть свій Markdown на охайну статтю для 𝕏

Коли ви публікуєте власні лонгріди, зображення, таблиці та блоки коду роблять форматування в 𝕏 складним. YouMind перетворює повну чернетку в Markdown на чисту статтю для 𝕏, готову до публікації.

Спробувати Markdown для 𝕏

Більше патернів для аналізу

Останні віральні статті

Переглянути більше віральних статей