YouMind
로그인

OpenAI Dots: 표류 없는 4인 에이전트 팀 구축 가이드 (완벽한 설정법)

@fleyta88
영어2026년 10월 01일
126K
90
5
10
150

TL;DR

이 가이드는 OpenAI Dots 에이전트를 구성하여 작업 표류를 방지하는 방법을 설명합니다. 룩아웃(Lookout), 메이커(Maker), 스켑틱(Skeptic), 러너(Runner)로 구성된 4석 역할 시스템과 엄격한 5단계 체크포인트 및 권한 사다리를 적용하는 방식을 다룹니다.

5 개 작업 시 8.6%. 10 개 시 19.7%.

이는 OpenAI 가 직접 공개한 dots 시스템 카드에 나온 수치다. 작업을 5 개 연결하면 실행의 8.6% 가 경계 이탈 문제로 플래그가 지정된다. 10 개를 연결하면 그 비율이 두 배 이상으로 뛴다.

출시일에 모두가 봉제 인형 마스코트 사진을 올렸다. 하지만 저 한 줄을 공유한 사람은 거의 없었다.

대부분의 dots 가이드는 모든 걸 연결하고 에이전트가 알아서 돌게 내버려 두라고 말한다. 이 글은 체인을 어디서 끊어야 하는지에 관한 이야기다. 그래야 에이전트가 일주일 내내 일하면서도 당신이 맡긴 업무 범위를 벗어나지 않는다.

dot 하나, 네 개의 자리, 권한 사다리, 그리고 5 단계마다 한 번씩 거치는 체크포인트.

요약: 앱을 단 하나도 연동하기 전에 먼저 업무를 정의하라. dot 에게 한 번에 하나씩 쓰는 네 개의 자리를 주고, 체크포인트 없이 5 단계를 초과하는 체인이 실행되도록 절대 두지 마라. 승인 횟수는 하루 5 회 미만으로 유지하라. 프롬프트는 6~8 섹션에, 계산 근거는 3 섹션과 8 섹션에 있다.

1. 숫자부터 확인하자

text
1출시일 2026 년 9 월 29 일
2모델 GPT-6 Astra
3연동 가능한 앱 수 4,000 개 이상
4첫 번째 dot Pro 및 Business Premium 요금제에 포함
5Pro 요금제 월 $100 / $200 / $500
6Business Premium 사용자당 월 $125, 연간 결제 시 $100
7dot 와의 대화 ChatGPT 사용량 제한에 포함되지 않음
8Codex 또는 Work 에서 시작하는 작업 평소와 동일하게 사용량에 포함됨
9사용 환경 ChatGPT 데스크톱, 웹, 모바일, Slack, Teams
10문자 메시지 "출시 예정"
11
12시스템 카드 기준
13경계 플래그, 5 개 작업 체인 8.6%
14경계 플래그, 10 개 작업 체인 19.7%
15간접 인젝션, 내부 테스트 99.79% 방어
16외부 레드팀, 1,810 건 공격 8.5% 통과
17오정보 생성 작업 151 건 중 0 건 오정렬

위쪽 표는 이미 모두가 공유했다. 진짜 당신의 설정 방식을 바꿔야 할 부분은 아래쪽 표다.

2. dot 란 무엇인가, 한 화면 요약

dot 는 당신에게 속한 상시 대기 에이전트다. 일반 ChatGPT 대화와 구별되는 네 가지 특징은 다음과 같다.

text
1모델 예쁜 인터페이스 뒤에 숨은 경량 모델이 아닌 GPT-6 Astra
2자체 컴퓨터 자체 브라우저가 있는 클라우드 머신, 노트북 전원이 꺼져도 작동
3메시지 사이에서 연동된 앱에서 "선제적 조사" 수행, 읽기 전용
4작업 메시지를 보내거나 앱 내용을 변경하거나 컴퓨터를 조작할 수 없음
5하나의 정체성 ChatGPT, Slack, Teams 전반에서 동일한 dot 와 메모리 공유

그리고 다른 어떤 기능보다 자주 쓰게 될 두 가지 제어 장치:

text
1Custom Rules 작업 허용, 승인 요구, 또는 차단
2auto-review 계정 접근이나 데이터 공유 가능성이 있는 작업 검사

OpenAI 는 출시 글을 이렇게 마무리했다. dots 도 여전히 실수할 수 있으므로, 중요한 작업은 반드시 검토하라는 것이다. 아래 내용은 그 검토를 실제로 실행할 수 있을 만큼 빠르게 만드는 방법이다.

3. 아무도 언급하지 않은 숫자

시스템 카드에 나온 두 숫자로 간단한 계산을 해봤다.

체인의 각 단계가 동일한 확률로 독립적으로 경계를 벗어난다면, 5 단계에서 10 단계로의 변화는 단순 계산으로 구할 수 있다.

text
15 단계 체인 플래그 지정 8.6%
2이를 역산한 단계별 확률 1 - (1 - 0.086)^(1/5) = 1.78%
3
4단계가 독립적일 경우 10 단계 1 - (1 - 0.0178)^10 = 16.5%
5카드에서 실제 측정한 10 단계 19.7%

실측값이 독립 가정 계산값보다 높다.

내 해석은 이렇다. 오류는 쌓인다. 살짝 어긋난 단계가 다음 단계에 약간 잘못된 그림을 넘기고, 다음 단계는 그 위에 집을 짓는다. 그래서 위험은 체인 길이보다 더 빠르게 커진다.

숫자가 두 개뿐이고 OpenAI 가 플래그가 지정된 문제가 구체적으로 무엇인지 밝히지 않았으므로, 대략적인 신호로만 받아들이자. 그래도 이를 바탕으로 규칙을 세우기엔 충분하다.

text
1이 가이드의 기반이 되는 규칙
2체크포인트 사이는 절대 5 단계를 넘기지 않는다

4. 네 개의 자리, 하나의 dot

"너는 내 비서야"라고 지시받은 dot 는 비서다운 결과물을 내놓는다. 친절하고, 모호하며, 조금 장황하다. 반면 "지금 너는 Skeptic 이고, Skeptic 은 실패하는 부분만 찾아낸다"라고 지시받은 dot 는 바로 쓸 수 있는 결과물을 만든다.

그래서 dot 에게 네 개의 자리를 준다. 한 번에 하나의 자리에 앉으며, 모든 답변 맨 위에 자신이 어떤 자리인지 명시한다.

text
1LOOKOUT 연동된 앱을 읽고 변경 사항을 보고함, 절대 기록하지 않음
2MAKER 자체 컴퓨터에서 작업하여 결과물 자체를 전달함
3SKEPTIC 결과물을 지시사항과 대조해 검증하고 실패한 부분을 나열함
4RUNNER 승인된 작업을 필요한 곳으로 이동시키며, 외부 전송 전 반드시 질문함

이것은 네 개의 에이전트가 아니라 하나의 에이전트가 가진 네 가지 모드다. 메모리는 하나, 규칙집은 하나, 좁은 역할만 네 개다.

fleyta - inline image

5. 설정, 중요한 순서대로

text
11 컴퓨터에서 ChatGPT 열기 첫 번째 dot 는 데스크톱이나 웹에서 생성됨,
2 모바일에서는 대화만 가능하고 생성은 불가
32 사이드바에서 dots 찾기 없으면 요금제가 다르거나, 아직 해당 지역에 미지원이거나,
4 관리자가 기능을 켜지 않은 것
53 이름 짓기 짧게, 소문자, 공백 없이
6 아침 7 시에 Slack 에서 직접 타이핑할 이름
74 업무 설명 붙여넣기 6 섹션 참조, 다른 어떤 것보다 먼저
85 소스 연동 dot 가 업무를 복창해 확인한 후에만 진행
96 Slack 또는 Teams 에 추가 용도를 명확히 인지시킨 후 진행

4 단계 이후에 5 단계를 진행해야 하는데, 많은 사람이 여기서 실수한다. 40 개 앱이 연동되어 있지만 업무 지시가 없는 에이전트는 정보만 잔뜩 쥐고 아무 쓸모없는 결과물을 만들어낸다.

6. 업무 설명

아래 내용을 첫 메시지로 붙여넣어라. 대괄호 안만 수정하고 나머지는 그대로 둔다.

text
1너는 나의 상주 운영 에이전트다. 이 메시지를 Slack 이나 휴대폰에서 시작하는 작업을 포함한
2모든 업무의 직무 기술서로 취급하라.
3
4나는 누구인가
5나는 [회사 또는 프로젝트] 의 [역할] 이다. 내 한 주는 주로 [한 문장 설명] 으로 채워진다.
6
7네가 책임질 영역 (활동이 아닌 결과)
81. [결과 1]
92. [결과 2]
103. [결과 3]
11
12자리(SEATS)
13너는 한 번에 하나의 자리에 앉으며, 모든 답변 맨 위에 그 이름을 명시해야 한다:
14LOOKOUT, MAKER, SKEPTIC, RUNNER.
15- LOOKOUT 은 읽고 보고만 한다.
16- MAKER 는 설명이 아닌 결과물 자체를 보여준다.
17- SKEPTIC 은 MAKER 의 결과물을 이 지시사항과 대조해 검증하고 실패한 부분을 나열한다.
18- RUNNER 는 승인된 작업만 이동시키며, 외부로 나가기 전 반드시 질문한다.
19
20체인 규칙
21절대 연속 5 단계를 초과해 실행하지 마라. 5 단계 후에는 멈추고,
22SKEPTIC 으로 전환하여 체크포인트를 실행한 뒤, PASS 를 받을 때까지 기다려라.
23
24나와 소통하는 방식
25- 결과를 먼저 말하라. 그다음 내가 결정해야 할 사항을 최대 3 개까지만 제시하라.
26- 막혔을 때: 시도한 것과 필요한 것을 딱 두 줄로 적어라.
27- 업무 범위인지 불확실할 때: 먼저 읽고, 질문 하나만 던져라. 임의로 행동하지 마라.
28
29네 개의 자리, 세 가지 결과, 체인 규칙을 너의 언어로 다시 설명하여 확인하라.
30그리고 멈춰라.

마지막 줄을 건너뛰지 마라. dot 가 "주간 보고서 초안 작성"을 "한 주에 대한 보고서 작성"으로 복창한다면, 일주일치 잘못된 보고서 대신 메시지 하나로 문제를 잡아낸 셈이다.

7. 승인 예산이 포함된 권한 사다리

Custom Rules 는 허용, 승인 요구, 차단이라는 세 가지 단계를 제공한다. 대부분 금지 목록을 벽처럼 쌓아올린 뒤, 하루에 40 건씩 승인하다가 결국 자신이 무엇을 승인하는지도 읽지 않게 된다.

'허용' 단계부터 작성하라. 하단은 넉넉하게, 상단은 엄격하게 설정한다.

text
1허용(ALLOW)
2- 연동된 소스의 모든 내용 읽기.
3- 공개 웹 탐색, 자체 컴퓨터 사용, 코드 실행.
4- 자체 워크스페이스 및 [이름] Space 에서 초안 작성 및 재작성.
5
6사전 요청(ASK FIRST)
7- 사람에게 보내는 모든 메시지: 이메일, DM, 채널 게시글, 초대, 댓글.
8- 본인이 생성하지 않은 파일에 대한 모든 변경.
9- 풀 리퀘스트 생성을 포함한 리포지토리의 모든 작업.
10- 모든 구매, 구독 또는 양식 제출.
11
12차단(BLOCK)
13- 비밀번호, 2FA, 청구, 결제 설정.
14- 모든 항목 삭제.
15- 내 이름으로 공개 게시.
16- 업무 지시사항에 명시되지 않은 사람과의 연락.
17
18공백(GAPS)
19규칙에 명시되지 않은 모든 것은 '사전 요청'으로 간주한다.
20어떤 규칙이 불분명했는지 알려줘라. 공백을 임의로 판단해 행동으로 이어지게 하지 마라.

그다음 스스로 예산을 정하라. 다음은 리서치, 초안 작성, 주간 다이제스트를 담당하는 dot 의 한 주 예시다. 비율은 측정값이 아닌 내 추정치다.

text
1예시: 한 주, 총 420 건 작업 위 사다리 적용 "모든 것 요청" 적용
2읽기 및 웹 300 허용 요청
3자체 워크스페이스 초안 80 허용 요청
4사람에게 보내는 메시지 28 요청 요청
5리포지토리 및 파일 변경 8 요청 요청
6차단된 시도 4 차단 요청
7클릭해야 하는 승인 횟수 주 36 회 주 420 회
8근무일 기준 약 7 회 약 84 회

하루 84 건의 승인을 꼼꼼히 읽을 사람은 없다. 하지만 7 건이라면 실제로 읽게 된다. 이것이 권한 사다리의 진짜 목적이다. 승인 횟수를 적게 유지해 당신이 계속 확인하도록 만드는 것이다.

내 목표는 하루 5 회 미만이다. 2 주 연속 이를 초과한다면, 반복 작업 하나를 한 단계 낮추거나 소스 범위를 좁혀라.

8. 5 단계마다 거치는 체크포인트

앞서 언급한 19.7% 가 여기서 등장한다.

긴 작업은 하나의 체인으로 실행되지 않는다. 최대 5 단계로 이루어진 구간(leg) 단위로 실행되며, 모든 구간은 Skeptic 으로 끝난다.

text
1체크포인트 (Skeptic, 모든 구간 종료 시)
2
3다음 다섯 가지 질문에 각각 한 줄로 답하라:
41. 이번 구간이 지시사항이 요구한 일을 했는가, 아니면 더 쉬운 비슷한 일을 했는가?
52. 지시사항에 명시되지 않은 소스나 사람에게 접근한 단계가 있는가?
63. 모든 숫자가 직접 계산되었거나 출처가 링크되어 있는가?
74. 증거를 댈 수 없는 주장이 있는가? 있다면 나열하라.
85. 내가 이 구간을 승인했는데 틀렸다면, 무엇이 망가지는가?
9
10판정:
11PASS 다음 구간으로 진행
12HOLD 중단하고, 2, 4, 5 번 항목을 먼저 보여줄 것

이제 3 섹션과 같은 방식으로 대략적인 계산을 해보자. Skeptic 이 체크포인트에서 문제 5 개 중 4 개를 잡아낸다고 가정한다. 이는 측정값이 아닌 내 가정이다.

text
1체크포인트 없는 10 단계 체인 1 개 19.7% 플래그 지정 (시스템 카드)
2
3각각 체크포인트가 있는 5 단계 구간 2 개
4 구간당 플래그 지정 8.6%
5 체크포인트 후 잔존 8.6% x 0.2 = 1.7%
6 두 구간 합산 1 - (1 - 0.017)^2 = 3.4%

Skeptic 이 절반만 잡아내더라도, 두 구간으로 나누면 19.7% 가 아닌 8.6% 근처로 떨어진다. 체인을 끊는 것이 대부분의 역할을 하고, 포착률이 나머지를 해결한다.

fleyta - inline image

9. 결과물이 착륙할 곳을 마련하라

채팅 스레드에 묻힌 작업은 다시는 찾을 수 없는 작업이다. dots 는 ChatGPT Spaces 와 Pages 에 연동되며, 여기서는 당신과 팀, 그리고 dot 모두가 함께 작업한다.

Space 하나, 페이지 네 개:

text
100 index 실행당 한 줄: 날짜, 사용된 자리, 결과물, 판정
201 inbox LOOKOUT 발견 사항, 최신순, 날짜 포함
302 review MAKER 결과물과 그 아래에 SKEPTIC 체크포인트 기록
403 shipped 승인한 항목과 승인 날짜

이 구조를 dot 에게 한 번만 알려주면 된다. 2 주가 지나면 인덱스 페이지가 전체 설정 중 가장 유용한 자산이 된다. 상시 대기 에이전트가 당신의 한 주 동안 무엇을 했는지 보여주는 유일한 가독성 높은 기록이기 때문이다.

10. 첫 실전 실행

유용하고, 반복되며, 잘못되어도 다시 하기 부담 없는 것으로 시작하라. 금요일 다이제스트는 네 자리를 모두 사용하면서도 안전하게 실패할 수 있다.

text
1상주 작업. 매주 금요일 16:00, 그리고 내가 "다이제스트 실행"이라고 말할 때마다.
2
3구간 1 (최대 5 단계)
4LOOKOUT [캘린더], [이메일], [리포지토리]: 월요일에 합류한 사람이 알아야 할
5 이번 주 변경 사항. 최대 5 개 글머리 기호, 각 항목은
6 "결정 필요" 또는 "조치 불필요"로 끝낼 것.
7MAKER 위 글머리 기호만 기반으로: SHIPPED, MOVED, WAITING 분류.
8 섹션당 최대 120 단어, 모든 SHIPPED 항목에 링크 포함.
9SKEPTIC 체크포인트. 링크 없는 SHIPPED 항목은 모두 WAITING 으로 이동.
10
11구간 2 (PASS 시에만)
12RUNNER "Week of [날짜]" 형식으로 02 review 에 저장하고, 00 index 에 한 줄 추가.
13 누구에게도 보내지 말 것.
14
15그런 다음 체크포인트 5 번 항목의 답변만 나에게 메시지로 보내라. 다른 것은 필요 없다.

11. Dots vs Grok Bot

같은 카테고리지만 기본 형태가 다르다.

text
1 DOTS GROK BOT
2기본 형태 하나의 에이전트, 여러 자리 이름이 지정된 여러 봇
3메모리 모든 자리가 공유하는 하나 봇당 하나
4사용 환경 ChatGPT, Slack, Teams 자체 앱 및 채팅
5적합한 용도 한 사람의 한 주, 하나의 규칙집 절대 섞이지 않는 분리된 작업들

작업들이 맥락을 공유한다면(받은 편지함이 다이제스트로, 다이제스트가 월요일 계획으로 이어진다면), 네 자리를 가진 dot 하나가 더 간단하다. 서로를 절대 봐서는 안 된다면(고객 A 와 고객 B), 별도 봇이 경계를 더 깔끔하게 나눈다.

12. 안전장치

text
15 단계를 초과하는 체인 -> 중단, 체크포인트, PASS 대기
2규칙 공백 -> 사전 요청, 불분명한 규칙 명시
3사람에게 보내는 모든 메시지 -> 항상 사전 요청
4비밀번호, 청구, 삭제, 공개 -> 차단
5작업 중 로그인 또는 캡차 발생 -> dot 의 컴퓨터에서 직접 인수
62 주 연속 하루 5 건 이상 승인 -> 단계 조정 또는 소스 축소
7SKEPTIC 이 칭찬을 작성할 때 -> 결과물이 아닌 체크포인트 재작성

모든 안전장치는 불확실성을 행동이 아닌 당신에게로 향하게 만든다.

13. 아직 테스트하지 못한 것들

이탈률 계산. 하나의 시스템 카드에서 나온 두 숫자는 대략적인 신호일 뿐, 증명된 모델이 아니다. OpenAI 가 플래그가 지정된 경계 문제가 무엇인지 밝히지 않아, 그 심각성을 단정할 수 없다.

Skeptic 의 포착률. 5 개 중 4 개는 계산의 형태를 보여주기 위한 가정이다. dot 가 자신의 작업을 검수하는 것은 독립적인 검토자가 아니므로, 실제 포착률은 더 낮을 수 있다.

예시로 든 한 주. 420 건의 작업과 단계별 분포는 리서치 및 초안 작성용 dot 를 위한 내 추정치이며, 실제 계정의 로그가 아니다.

두 번째 dot 부터의 가격. OpenAI 는 dot 를 추가하고 속도나 월간 작업량을 확장할 수 있다고 밝혔지만, 아직 해당 가격을 공개하지 않았다.

14. 플레이북

앱을 하나라도 연동하기 전에 업무를 먼저 정의하라.

에이전트는 하나, 자리는 네 개, 한 번에 하나의 자리만 사용한다.

모든 체인은 5 단계에서 끊어라. 체크포인트를 거친 뒤 계속 진행한다.

허용 목록부터 작성하라. 공백은 '사전 요청'으로 처리한다.

승인은 하루 5 회 미만으로 유지하라. 그렇지 않으면 검토는 형식적으로 변한다.

결과물이 착륙할 곳을 마련하고, 금요일마다 인덱스를 읽어라.

fleyta - inline image

핵심 요약

dots 는 대부분의 사람들이 잠든 사이에도 돌아가게 둘 최초의 에이전트다. 이로 인해 질문은 "이 작업을 할 수 있는가"에서 "누군가 확인하기 전까지 어디까지 가는가"로 바뀐다.

OpenAI 의 시스템 카드가 그 힌트를 준다. 체인이 두 배가 되면 플래그는 두 배 이상으로 뛴다.

그러니 체인을 길게 늘리지 마라. 구간을 짧게 끊고, 각 구간의 끝에 Skeptic 을 배치하며, 정말 물어볼 가치가 있는 것만 당신에게 묻는 사다리를 세워라.

5 단계, 그리고 확인. 그게 전부다.

출시 세부 정보는 OpenAI 의 dots 발표 자료를 참고했다. 시스템 카드 수치는 The New Stack 의 보도 기준이다. 요금제 가격은 2026 년 10 월 1 일 기준 출시 보도 자료에 따랐으며 변경될 수 있다.

원클릭 저장

YouMind로 바이럴 글을 AI 심층 읽기

소스를 저장하고, 핵심 질문을 던지고, 주장을 요약해 바이럴 글을 다시 활용할 수 있는 노트로 바꾸세요. 하나의 AI 워크스페이스에서 모두 할 수 있습니다.

YouMind 둘러보기
크리에이터를 위해

당신의 Markdown을 깔끔한 𝕏 글로

직접 쓴 장문을 올릴 때 이미지, 표, 코드 블록을 𝕏에 맞게 정리하는 일은 번거롭습니다. YouMind는 전체 Markdown 초안을 깔끔하고 바로 게시할 수 있는 𝕏 글로 바꿔 줍니다.

Markdown → 𝕏 사용해 보기

분석할 패턴 더 보기

최근 바이럴 아티클

더 많은 바이럴 아티클 보기