5 개 작업 시 8.6%. 10 개 시 19.7%.
이는 OpenAI 가 직접 공개한 dots 시스템 카드에 나온 수치다. 작업을 5 개 연결하면 실행의 8.6% 가 경계 이탈 문제로 플래그가 지정된다. 10 개를 연결하면 그 비율이 두 배 이상으로 뛴다.
출시일에 모두가 봉제 인형 마스코트 사진을 올렸다. 하지만 저 한 줄을 공유한 사람은 거의 없었다.
대부분의 dots 가이드는 모든 걸 연결하고 에이전트가 알아서 돌게 내버려 두라고 말한다. 이 글은 체인을 어디서 끊어야 하는지에 관한 이야기다. 그래야 에이전트가 일주일 내내 일하면서도 당신이 맡긴 업무 범위를 벗어나지 않는다.
dot 하나, 네 개의 자리, 권한 사다리, 그리고 5 단계마다 한 번씩 거치는 체크포인트.
요약: 앱을 단 하나도 연동하기 전에 먼저 업무를 정의하라. dot 에게 한 번에 하나씩 쓰는 네 개의 자리를 주고, 체크포인트 없이 5 단계를 초과하는 체인이 실행되도록 절대 두지 마라. 승인 횟수는 하루 5 회 미만으로 유지하라. 프롬프트는 6~8 섹션에, 계산 근거는 3 섹션과 8 섹션에 있다.
1. 숫자부터 확인하자
1출시일 2026 년 9 월 29 일2모델 GPT-6 Astra3연동 가능한 앱 수 4,000 개 이상4첫 번째 dot Pro 및 Business Premium 요금제에 포함5Pro 요금제 월 $100 / $200 / $5006Business Premium 사용자당 월 $125, 연간 결제 시 $1007dot 와의 대화 ChatGPT 사용량 제한에 포함되지 않음8Codex 또는 Work 에서 시작하는 작업 평소와 동일하게 사용량에 포함됨9사용 환경 ChatGPT 데스크톱, 웹, 모바일, Slack, Teams10문자 메시지 "출시 예정"1112시스템 카드 기준13경계 플래그, 5 개 작업 체인 8.6%14경계 플래그, 10 개 작업 체인 19.7%15간접 인젝션, 내부 테스트 99.79% 방어16외부 레드팀, 1,810 건 공격 8.5% 통과17오정보 생성 작업 151 건 중 0 건 오정렬
위쪽 표는 이미 모두가 공유했다. 진짜 당신의 설정 방식을 바꿔야 할 부분은 아래쪽 표다.
2. dot 란 무엇인가, 한 화면 요약
dot 는 당신에게 속한 상시 대기 에이전트다. 일반 ChatGPT 대화와 구별되는 네 가지 특징은 다음과 같다.
1모델 예쁜 인터페이스 뒤에 숨은 경량 모델이 아닌 GPT-6 Astra2자체 컴퓨터 자체 브라우저가 있는 클라우드 머신, 노트북 전원이 꺼져도 작동3메시지 사이에서 연동된 앱에서 "선제적 조사" 수행, 읽기 전용4작업 메시지를 보내거나 앱 내용을 변경하거나 컴퓨터를 조작할 수 없음5하나의 정체성 ChatGPT, Slack, Teams 전반에서 동일한 dot 와 메모리 공유
그리고 다른 어떤 기능보다 자주 쓰게 될 두 가지 제어 장치:
1Custom Rules 작업 허용, 승인 요구, 또는 차단2auto-review 계정 접근이나 데이터 공유 가능성이 있는 작업 검사
OpenAI 는 출시 글을 이렇게 마무리했다. dots 도 여전히 실수할 수 있으므로, 중요한 작업은 반드시 검토하라는 것이다. 아래 내용은 그 검토를 실제로 실행할 수 있을 만큼 빠르게 만드는 방법이다.
3. 아무도 언급하지 않은 숫자
시스템 카드에 나온 두 숫자로 간단한 계산을 해봤다.
체인의 각 단계가 동일한 확률로 독립적으로 경계를 벗어난다면, 5 단계에서 10 단계로의 변화는 단순 계산으로 구할 수 있다.
15 단계 체인 플래그 지정 8.6%2이를 역산한 단계별 확률 1 - (1 - 0.086)^(1/5) = 1.78%34단계가 독립적일 경우 10 단계 1 - (1 - 0.0178)^10 = 16.5%5카드에서 실제 측정한 10 단계 19.7%
실측값이 독립 가정 계산값보다 높다.
내 해석은 이렇다. 오류는 쌓인다. 살짝 어긋난 단계가 다음 단계에 약간 잘못된 그림을 넘기고, 다음 단계는 그 위에 집을 짓는다. 그래서 위험은 체인 길이보다 더 빠르게 커진다.
숫자가 두 개뿐이고 OpenAI 가 플래그가 지정된 문제가 구체적으로 무엇인지 밝히지 않았으므로, 대략적인 신호로만 받아들이자. 그래도 이를 바탕으로 규칙을 세우기엔 충분하다.
1이 가이드의 기반이 되는 규칙2체크포인트 사이는 절대 5 단계를 넘기지 않는다
4. 네 개의 자리, 하나의 dot
"너는 내 비서야"라고 지시받은 dot 는 비서다운 결과물을 내놓는다. 친절하고, 모호하며, 조금 장황하다. 반면 "지금 너는 Skeptic 이고, Skeptic 은 실패하는 부분만 찾아낸다"라고 지시받은 dot 는 바로 쓸 수 있는 결과물을 만든다.
그래서 dot 에게 네 개의 자리를 준다. 한 번에 하나의 자리에 앉으며, 모든 답변 맨 위에 자신이 어떤 자리인지 명시한다.
1LOOKOUT 연동된 앱을 읽고 변경 사항을 보고함, 절대 기록하지 않음2MAKER 자체 컴퓨터에서 작업하여 결과물 자체를 전달함3SKEPTIC 결과물을 지시사항과 대조해 검증하고 실패한 부분을 나열함4RUNNER 승인된 작업을 필요한 곳으로 이동시키며, 외부 전송 전 반드시 질문함
이것은 네 개의 에이전트가 아니라 하나의 에이전트가 가진 네 가지 모드다. 메모리는 하나, 규칙집은 하나, 좁은 역할만 네 개다.

5. 설정, 중요한 순서대로
11 컴퓨터에서 ChatGPT 열기 첫 번째 dot 는 데스크톱이나 웹에서 생성됨,2 모바일에서는 대화만 가능하고 생성은 불가32 사이드바에서 dots 찾기 없으면 요금제가 다르거나, 아직 해당 지역에 미지원이거나,4 관리자가 기능을 켜지 않은 것53 이름 짓기 짧게, 소문자, 공백 없이6 아침 7 시에 Slack 에서 직접 타이핑할 이름74 업무 설명 붙여넣기 6 섹션 참조, 다른 어떤 것보다 먼저85 소스 연동 dot 가 업무를 복창해 확인한 후에만 진행96 Slack 또는 Teams 에 추가 용도를 명확히 인지시킨 후 진행
4 단계 이후에 5 단계를 진행해야 하는데, 많은 사람이 여기서 실수한다. 40 개 앱이 연동되어 있지만 업무 지시가 없는 에이전트는 정보만 잔뜩 쥐고 아무 쓸모없는 결과물을 만들어낸다.
6. 업무 설명
아래 내용을 첫 메시지로 붙여넣어라. 대괄호 안만 수정하고 나머지는 그대로 둔다.
1너는 나의 상주 운영 에이전트다. 이 메시지를 Slack 이나 휴대폰에서 시작하는 작업을 포함한2모든 업무의 직무 기술서로 취급하라.34나는 누구인가5나는 [회사 또는 프로젝트] 의 [역할] 이다. 내 한 주는 주로 [한 문장 설명] 으로 채워진다.67네가 책임질 영역 (활동이 아닌 결과)81. [결과 1]92. [결과 2]103. [결과 3]1112자리(SEATS)13너는 한 번에 하나의 자리에 앉으며, 모든 답변 맨 위에 그 이름을 명시해야 한다:14LOOKOUT, MAKER, SKEPTIC, RUNNER.15- LOOKOUT 은 읽고 보고만 한다.16- MAKER 는 설명이 아닌 결과물 자체를 보여준다.17- SKEPTIC 은 MAKER 의 결과물을 이 지시사항과 대조해 검증하고 실패한 부분을 나열한다.18- RUNNER 는 승인된 작업만 이동시키며, 외부로 나가기 전 반드시 질문한다.1920체인 규칙21절대 연속 5 단계를 초과해 실행하지 마라. 5 단계 후에는 멈추고,22SKEPTIC 으로 전환하여 체크포인트를 실행한 뒤, PASS 를 받을 때까지 기다려라.2324나와 소통하는 방식25- 결과를 먼저 말하라. 그다음 내가 결정해야 할 사항을 최대 3 개까지만 제시하라.26- 막혔을 때: 시도한 것과 필요한 것을 딱 두 줄로 적어라.27- 업무 범위인지 불확실할 때: 먼저 읽고, 질문 하나만 던져라. 임의로 행동하지 마라.2829네 개의 자리, 세 가지 결과, 체인 규칙을 너의 언어로 다시 설명하여 확인하라.30그리고 멈춰라.
마지막 줄을 건너뛰지 마라. dot 가 "주간 보고서 초안 작성"을 "한 주에 대한 보고서 작성"으로 복창한다면, 일주일치 잘못된 보고서 대신 메시지 하나로 문제를 잡아낸 셈이다.
7. 승인 예산이 포함된 권한 사다리
Custom Rules 는 허용, 승인 요구, 차단이라는 세 가지 단계를 제공한다. 대부분 금지 목록을 벽처럼 쌓아올린 뒤, 하루에 40 건씩 승인하다가 결국 자신이 무엇을 승인하는지도 읽지 않게 된다.
'허용' 단계부터 작성하라. 하단은 넉넉하게, 상단은 엄격하게 설정한다.
1허용(ALLOW)2- 연동된 소스의 모든 내용 읽기.3- 공개 웹 탐색, 자체 컴퓨터 사용, 코드 실행.4- 자체 워크스페이스 및 [이름] Space 에서 초안 작성 및 재작성.56사전 요청(ASK FIRST)7- 사람에게 보내는 모든 메시지: 이메일, DM, 채널 게시글, 초대, 댓글.8- 본인이 생성하지 않은 파일에 대한 모든 변경.9- 풀 리퀘스트 생성을 포함한 리포지토리의 모든 작업.10- 모든 구매, 구독 또는 양식 제출.1112차단(BLOCK)13- 비밀번호, 2FA, 청구, 결제 설정.14- 모든 항목 삭제.15- 내 이름으로 공개 게시.16- 업무 지시사항에 명시되지 않은 사람과의 연락.1718공백(GAPS)19규칙에 명시되지 않은 모든 것은 '사전 요청'으로 간주한다.20어떤 규칙이 불분명했는지 알려줘라. 공백을 임의로 판단해 행동으로 이어지게 하지 마라.
그다음 스스로 예산을 정하라. 다음은 리서치, 초안 작성, 주간 다이제스트를 담당하는 dot 의 한 주 예시다. 비율은 측정값이 아닌 내 추정치다.
1예시: 한 주, 총 420 건 작업 위 사다리 적용 "모든 것 요청" 적용2읽기 및 웹 300 허용 요청3자체 워크스페이스 초안 80 허용 요청4사람에게 보내는 메시지 28 요청 요청5리포지토리 및 파일 변경 8 요청 요청6차단된 시도 4 차단 요청7클릭해야 하는 승인 횟수 주 36 회 주 420 회8근무일 기준 약 7 회 약 84 회
하루 84 건의 승인을 꼼꼼히 읽을 사람은 없다. 하지만 7 건이라면 실제로 읽게 된다. 이것이 권한 사다리의 진짜 목적이다. 승인 횟수를 적게 유지해 당신이 계속 확인하도록 만드는 것이다.
내 목표는 하루 5 회 미만이다. 2 주 연속 이를 초과한다면, 반복 작업 하나를 한 단계 낮추거나 소스 범위를 좁혀라.
8. 5 단계마다 거치는 체크포인트
앞서 언급한 19.7% 가 여기서 등장한다.
긴 작업은 하나의 체인으로 실행되지 않는다. 최대 5 단계로 이루어진 구간(leg) 단위로 실행되며, 모든 구간은 Skeptic 으로 끝난다.
1체크포인트 (Skeptic, 모든 구간 종료 시)23다음 다섯 가지 질문에 각각 한 줄로 답하라:41. 이번 구간이 지시사항이 요구한 일을 했는가, 아니면 더 쉬운 비슷한 일을 했는가?52. 지시사항에 명시되지 않은 소스나 사람에게 접근한 단계가 있는가?63. 모든 숫자가 직접 계산되었거나 출처가 링크되어 있는가?74. 증거를 댈 수 없는 주장이 있는가? 있다면 나열하라.85. 내가 이 구간을 승인했는데 틀렸다면, 무엇이 망가지는가?910판정:11PASS 다음 구간으로 진행12HOLD 중단하고, 2, 4, 5 번 항목을 먼저 보여줄 것
이제 3 섹션과 같은 방식으로 대략적인 계산을 해보자. Skeptic 이 체크포인트에서 문제 5 개 중 4 개를 잡아낸다고 가정한다. 이는 측정값이 아닌 내 가정이다.
1체크포인트 없는 10 단계 체인 1 개 19.7% 플래그 지정 (시스템 카드)23각각 체크포인트가 있는 5 단계 구간 2 개4 구간당 플래그 지정 8.6%5 체크포인트 후 잔존 8.6% x 0.2 = 1.7%6 두 구간 합산 1 - (1 - 0.017)^2 = 3.4%
Skeptic 이 절반만 잡아내더라도, 두 구간으로 나누면 19.7% 가 아닌 8.6% 근처로 떨어진다. 체인을 끊는 것이 대부분의 역할을 하고, 포착률이 나머지를 해결한다.

9. 결과물이 착륙할 곳을 마련하라
채팅 스레드에 묻힌 작업은 다시는 찾을 수 없는 작업이다. dots 는 ChatGPT Spaces 와 Pages 에 연동되며, 여기서는 당신과 팀, 그리고 dot 모두가 함께 작업한다.
Space 하나, 페이지 네 개:
100 index 실행당 한 줄: 날짜, 사용된 자리, 결과물, 판정201 inbox LOOKOUT 발견 사항, 최신순, 날짜 포함302 review MAKER 결과물과 그 아래에 SKEPTIC 체크포인트 기록403 shipped 승인한 항목과 승인 날짜
이 구조를 dot 에게 한 번만 알려주면 된다. 2 주가 지나면 인덱스 페이지가 전체 설정 중 가장 유용한 자산이 된다. 상시 대기 에이전트가 당신의 한 주 동안 무엇을 했는지 보여주는 유일한 가독성 높은 기록이기 때문이다.
10. 첫 실전 실행
유용하고, 반복되며, 잘못되어도 다시 하기 부담 없는 것으로 시작하라. 금요일 다이제스트는 네 자리를 모두 사용하면서도 안전하게 실패할 수 있다.
1상주 작업. 매주 금요일 16:00, 그리고 내가 "다이제스트 실행"이라고 말할 때마다.23구간 1 (최대 5 단계)4LOOKOUT [캘린더], [이메일], [리포지토리]: 월요일에 합류한 사람이 알아야 할5 이번 주 변경 사항. 최대 5 개 글머리 기호, 각 항목은6 "결정 필요" 또는 "조치 불필요"로 끝낼 것.7MAKER 위 글머리 기호만 기반으로: SHIPPED, MOVED, WAITING 분류.8 섹션당 최대 120 단어, 모든 SHIPPED 항목에 링크 포함.9SKEPTIC 체크포인트. 링크 없는 SHIPPED 항목은 모두 WAITING 으로 이동.1011구간 2 (PASS 시에만)12RUNNER "Week of [날짜]" 형식으로 02 review 에 저장하고, 00 index 에 한 줄 추가.13 누구에게도 보내지 말 것.1415그런 다음 체크포인트 5 번 항목의 답변만 나에게 메시지로 보내라. 다른 것은 필요 없다.
11. Dots vs Grok Bot
같은 카테고리지만 기본 형태가 다르다.
1 DOTS GROK BOT2기본 형태 하나의 에이전트, 여러 자리 이름이 지정된 여러 봇3메모리 모든 자리가 공유하는 하나 봇당 하나4사용 환경 ChatGPT, Slack, Teams 자체 앱 및 채팅5적합한 용도 한 사람의 한 주, 하나의 규칙집 절대 섞이지 않는 분리된 작업들
작업들이 맥락을 공유한다면(받은 편지함이 다이제스트로, 다이제스트가 월요일 계획으로 이어진다면), 네 자리를 가진 dot 하나가 더 간단하다. 서로를 절대 봐서는 안 된다면(고객 A 와 고객 B), 별도 봇이 경계를 더 깔끔하게 나눈다.
12. 안전장치
15 단계를 초과하는 체인 -> 중단, 체크포인트, PASS 대기2규칙 공백 -> 사전 요청, 불분명한 규칙 명시3사람에게 보내는 모든 메시지 -> 항상 사전 요청4비밀번호, 청구, 삭제, 공개 -> 차단5작업 중 로그인 또는 캡차 발생 -> dot 의 컴퓨터에서 직접 인수62 주 연속 하루 5 건 이상 승인 -> 단계 조정 또는 소스 축소7SKEPTIC 이 칭찬을 작성할 때 -> 결과물이 아닌 체크포인트 재작성
모든 안전장치는 불확실성을 행동이 아닌 당신에게로 향하게 만든다.
13. 아직 테스트하지 못한 것들
이탈률 계산. 하나의 시스템 카드에서 나온 두 숫자는 대략적인 신호일 뿐, 증명된 모델이 아니다. OpenAI 가 플래그가 지정된 경계 문제가 무엇인지 밝히지 않아, 그 심각성을 단정할 수 없다.
Skeptic 의 포착률. 5 개 중 4 개는 계산의 형태를 보여주기 위한 가정이다. dot 가 자신의 작업을 검수하는 것은 독립적인 검토자가 아니므로, 실제 포착률은 더 낮을 수 있다.
예시로 든 한 주. 420 건의 작업과 단계별 분포는 리서치 및 초안 작성용 dot 를 위한 내 추정치이며, 실제 계정의 로그가 아니다.
두 번째 dot 부터의 가격. OpenAI 는 dot 를 추가하고 속도나 월간 작업량을 확장할 수 있다고 밝혔지만, 아직 해당 가격을 공개하지 않았다.
14. 플레이북
앱을 하나라도 연동하기 전에 업무를 먼저 정의하라.
에이전트는 하나, 자리는 네 개, 한 번에 하나의 자리만 사용한다.
모든 체인은 5 단계에서 끊어라. 체크포인트를 거친 뒤 계속 진행한다.
허용 목록부터 작성하라. 공백은 '사전 요청'으로 처리한다.
승인은 하루 5 회 미만으로 유지하라. 그렇지 않으면 검토는 형식적으로 변한다.
결과물이 착륙할 곳을 마련하고, 금요일마다 인덱스를 읽어라.

핵심 요약
dots 는 대부분의 사람들이 잠든 사이에도 돌아가게 둘 최초의 에이전트다. 이로 인해 질문은 "이 작업을 할 수 있는가"에서 "누군가 확인하기 전까지 어디까지 가는가"로 바뀐다.
OpenAI 의 시스템 카드가 그 힌트를 준다. 체인이 두 배가 되면 플래그는 두 배 이상으로 뛴다.
그러니 체인을 길게 늘리지 마라. 구간을 짧게 끊고, 각 구간의 끝에 Skeptic 을 배치하며, 정말 물어볼 가치가 있는 것만 당신에게 묻는 사다리를 세워라.
5 단계, 그리고 확인. 그게 전부다.
출시 세부 정보는 OpenAI 의 dots 발표 자료를 참고했다. 시스템 카드 수치는 The New Stack 의 보도 기준이다. 요금제 가격은 2026 년 10 월 1 일 기준 출시 보도 자료에 따랐으며 변경될 수 있다.





