YouMind
Accedi

OpenAI Dots: Come costruire un team di agenti a 4 posti che si ferma prima di deviare (Guida completa)

@fleyta88
INGLESE01 ott 2026
126K
90
5
10
150

TL;DR

Questa guida spiega come configurare gli agenti OpenAI Dots per prevenire la deriva dei compiti utilizzando un sistema di ruoli a quattro posti (Lookout, Maker, Skeptic, Runner) e applicando rigorosi checkpoint in cinque passaggi con una scala delle autorizzazioni.

8,6% con 5 task. 19,7% con 10.

Questi dati provengono dalla system card ufficiale di OpenAI per dots. Concatena cinque task e l'8,6% delle esecuzioni viene segnalato per problemi di confine (boundary problems). Concatenane dieci e la percentuale più che raddoppia.

Il giorno del lancio tutti hanno postato le mascotte di peluche. Quasi nessuno ha condiviso quella riga.

La maggior parte delle guide su dots ti dice di concatenare tutto e lasciare che l'agente faccia il suo corso. Questa invece spiega dove spezzare la catena, in modo che l'agente possa lavorare tutta la settimana senza uscire dai binari del compito che gli hai assegnato.

Un dot, quattro ruoli, una scala dei permessi e un checkpoint ogni cinque passaggi.

TLDR: definisci il lavoro prima di collegare anche una sola app, assegna al dot quattro ruoli da indossare uno alla volta, non far mai superare i cinque passaggi a una catena senza un checkpoint e mantieni le approvazioni sotto le cinque al giorno. I prompt si trovano nelle sezioni da 6 a 8, i calcoli nelle sezioni 3 e 8.

1. Prima i numeri

text
1lancio 29 settembre 2026
2modello GPT-6 Astra
3app collegabili oltre 4.000
4primo dot incluso nei piani Pro e Business Premium
5piani Pro 100 $ / 200 $ / 500 $ al mese
6Business Premium 125 $ per utente al mese, 100 $ con piano annuale
7chattare con un dot non incide sui limiti di ChatGPT
8task avviati in Codex o Work vengono conteggiati normalmente
9dove si trova ChatGPT desktop, web, mobile, Slack, Teams
10messaggistica SMS "in arrivo"
11
12dalla system card
13segnalazioni di confine, catena da 5 8,6%
14segnalazioni di confine, catena da 10 19,7%
15iniezione indiretta, test interni 99,79% bloccate
16red team esterno, 1.810 attacchi 8,5% andati a segno
17task con informazioni fuorvianti 0 disallineamenti su 151

Tutti hanno già pubblicato il primo blocco. Ma è quello inferiore che dovrebbe cambiare il tuo modo di configurarlo.

2. Cos'è un dot, in una schermata

Un dot è un agente sempre attivo che ti appartiene. Quattro elementi lo distinguono da una normale chat di ChatGPT:

text
1il modello GPT-6 Astra, non un modello più leggero nascosto dietro un'interfaccia migliore
2il suo computer una macchina cloud con browser dedicato, operativa anche quando il tuo portatile è spento
3lavora tra "ricerca proattiva" nelle tue app collegate, in sola lettura
4i tuoi messaggi non può inviare contenuti, modificarli nelle app o controllare il tuo computer lì
5un'unica identità lo stesso dot e la stessa memoria su ChatGPT, Slack e Teams

E due controlli che userai più di qualsiasi altra cosa:

text
1Regole personalizzate consenti un'azione, richiedi approvazione o bloccala
2revisione automatica verifica le azioni che potrebbero toccare i tuoi account o condividere dati

OpenAI chiude il post di lancio così: i dots possono ancora commettere errori, quindi revisiona sempre il lavoro che ha conseguenze importanti. Tutto ciò che segue serve a rendere questa revisione abbastanza rapida da farti fare davvero.

3. Il numero che nessuno ha pubblicato

Ho fatto qualche rapido calcolo sui due numeri della system card.

Se ogni passaggio di una catena avesse la stessa piccola probabilità indipendente di uscire dai confini, potresti passare da 5 a 10 passaggi con una semplice formula:

text
1catena da 5 passaggi segnalata 8,6%
2probabilità per singolo passaggio implicata 1 - (1 - 0,086)^(1/5) = 1,78%
3
410 passaggi, se fossero indipendenti 1 - (1 - 0,0178)^10 = 16,5%
510 passaggi, dato misurato dalla card 19,7%

Il valore misurato è superiore a quello teorico basato sull'indipendenza.

La mia interpretazione: gli errori si accumulano. Un passaggio leggermente fuori strada consegna un quadro un po' distorto al passaggio successivo, che ci costruisce sopra. Così il rischio cresce più velocemente della catena.

Sono solo due numeri e OpenAI non ha specificato quali fossero i problemi segnalati, quindi prendilo come un segnale indicativo. Resta comunque una base sufficiente su cui costruire:

text
1la regola su cui si basa questa guida
2mai più di 5 passaggi tra un checkpoint e l'altro

4. Quattro ruoli, un solo dot

A un dot a cui dici "sei il mio assistente" produce un lavoro da assistente: utile, vago, un po' troppo lungo. A un dot a cui dici "in questo momento sei lo Scettico, e lo Scettico individua solo ciò che non funziona" produce qualcosa di concretamente utilizzabile.

Ecco perché il dot ha quattro ruoli. Ne indossa uno alla volta e dichiara quale sta usando all'inizio di ogni risposta.

text
1SENTINELLA legge le tue app collegate, segnala i cambiamenti, non scrive mai
2CREATORE lavora sul proprio computer, ti consegna direttamente l'artefatto
3SCETTICO confronta l'artefatto con il brief, elenca ciò che non funziona
4CORRIERE sposta il lavoro approvato nella destinazione corretta, chiede conferma prima di inviare qualsiasi cosa

Non sono quattro agenti diversi, ma quattro modalità dello stesso agente. Una memoria, un unico regolamento, quattro compiti specifici.

fleyta - inline image

5. Configurazione, nell'ordine giusto

text
11 apri ChatGPT dal computer il primo dot si crea da desktop o web,
2 da mobile puoi parlarci ma non crearlo
32 cerca dots nella barra laterale se manca = piano sbagliato, mercato non ancora raggiunto,
4 oppure un admin non lo ha attivato
53 dagli un nome breve, minuscolo, senza spazi
6 dovrai digitarlo su Slack alle 7 del mattino
74 incolla la descrizione del lavoro sezione 6, prima di qualsiasi altra cosa
85 collega le fonti solo dopo che ti ha confermato il compito
96 aggiungilo a Slack o Teams una volta che sa a cosa serve

Il passaggio 5 dopo il 4 è quello in cui quasi tutti sbagliano. Un agente con 40 app collegate e nessun brief è informatissimo, ma non produce nulla di utile.

6. La descrizione del lavoro

Incolla questo testo come primo messaggio. Sostituisci solo le parentesi quadre, nient'altro.

text
1Sei il mio agente operativo permanente. Considera questo messaggio come la tua
2descrizione del lavoro per ogni task, inclusi quelli che avvio da Slack o dal telefono.
3
4CHI SONO
5Sono [ruolo] presso [azienda o progetto]. La mia settimana consiste principalmente in [una frase].
6
7DI COSA TI OCCUPI (risultati, non attività)
81. [primo risultato]
92. [secondo risultato]
103. [terzo risultato]
11
12RUOLI
13Indossi un ruolo alla volta e lo dichiari all'inizio di ogni risposta:
14SENTINELLA, CREATORE, SCETTICO, CORRIERE.
15- SENTINELLA si limita a leggere e riferire.
16- CREATORE mi mostra l'artefatto, mai una sua descrizione.
17- SCETTICO confronta il lavoro del CREATORE con questo brief ed elenca ciò che non funziona.
18- CORRIERE sposta solo il lavoro approvato e chiede conferma prima di inviare qualsiasi cosa.
19
20LA REGOLA DELLA CATENA
21Non eseguire mai più di 5 passaggi consecutivi. Dopo il quinto, fermati, passa al
22ruolo SCETTICO, esegui il checkpoint e attendi il VIA LIBERA prima di continuare.
23
24COME COMUNICHI CON ME
25- Prima il risultato. Poi al massimo tre punti su cui devo decidere.
26- Se sei bloccato: cosa hai provato e cosa ti serve, in due righe.
27- Se non sai se qualcosa rientra nel perimetro: leggi, poi fai una domanda. Non agire.
28
29Conferma riformulando con parole tue i quattro ruoli, i tre risultati e la regola della catena.
30Poi fermati.

Non saltare l'ultima riga. Se il dot riformula "prepara il report settimanale" con "scrivi un resoconto sulla settimana", hai intercettato il problema con un solo messaggio invece di ritrovarti con una settimana di report sbagliati.

7. La scala dei permessi, con un budget di approvazioni

Le Regole personalizzate ti offrono tre livelli: consenti, richiedi approvazione, blocca. Molti scrivono un muro di divieti, finiscono per approvare 40 cose al giorno e smettono di leggere cosa stanno approvando.

Definisci prima il livello "consenti". Sii generoso alla base e rigoroso in cima.

text
1CONSENTI
2- Leggere qualsiasi contenuto nelle mie fonti collegate.
3- Navigare sul web pubblico, usare il tuo computer, eseguire codice.
4- Creare e riscrivere bozze nel tuo spazio di lavoro e nello Space [NOME].
5
6CHIEDI PRIMA
7- Qualsiasi messaggio rivolto a una persona: email, DM, post in un canale, inviti, commenti.
8- Qualsiasi modifica a un file che non hai creato tu.
9- Qualsiasi azione in un repository, inclusa l'apertura di una pull request.
10- Qualsiasi acquisto, abbonamento o invio di moduli.
11
12BLOCCA
13- Password, 2FA, fatturazione, impostazioni di pagamento.
14- L'eliminazione di qualsiasi elemento.
15- Pubblicazioni pubbliche a mio nome.
16- Contatti con persone non menzionate nel brief del task.
17
18ZONE GRIGIE
19Tutto ciò che le regole non coprono rientra in CHIEDI PRIMA.
20Segnalami quale regola non era chiara. Non risolvere mai una zona grigia procedendo con l'azione.

Poi stabilisci un budget. Ecco un esempio di settimana tipo per un dot che si occupa di ricerca, bozze e un digest settimanale. La suddivisione è una mia stima, non un dato misurato:

text
1una settimana tipo, 420 azioni scala precedente "chiedi per tutto"
2letture e web 300 consenti chiedi
3bozze nel suo workspace 80 consenti chiedi
4messaggi a persone 28 chiedi chiedi
5modifiche a repo e file 8 chiedi chiedi
6tentativi bloccati 4 blocca chiedi
7approvazioni da cliccare 36 a settimana 420 a settimana
8per giorno lavorativo ~7 ~84

Nessuno legge 84 approvazioni al giorno. Sette, invece, le leggerai davvero. Questo è il vero scopo della scala: mantenere le approvazioni così poche da farti effettivamente controllare.

Il mio obiettivo: meno di cinque al giorno. Se superi questa soglia per due settimane, sposta un'azione ricorrente di un livello verso il basso o restringi una fonte.

8. Il checkpoint ogni cinque passaggi

È qui che entra in gioco quel 19,7%.

Un lavoro lungo non va eseguito come un'unica catena. Va suddiviso in tratte di massimo cinque passaggi, e ogni tratta si chiude con lo Scettico.

text
1CHECKPOINT (Scettico, alla fine di ogni tratta)
2
3Rispondi a tutte e cinque le domande, una riga ciascuna:
41. Questa tratta ha fatto ciò che chiedeva il brief, o qualcosa di simile ma più facile?
52. Qualche passaggio ha raggiunto una fonte o una persona non citata nel brief?
63. Ogni numero è stato calcolato da te o è collegato alla fonte da cui l'hai letto?
74. C'è qualche affermazione di cui non puoi fornire prove? Elencala.
85. Se approvo questa tratta ma è sbagliata, cosa si rompe?
9
10Verdetto:
11VIA LIBERA prosegui con la tratta successiva
12ATTESA fermati, mostrami prima i punti 2, 4 e 5

Ora rifacciamo lo stesso calcolo approssimativo della sezione 3. Supponiamo che lo Scettico intercetti 4 problemi su 5 a ogni checkpoint. È una mia ipotesi, non un tasso misurato:

text
1una catena da 10 passaggi, senza checkpoint 19,7% segnalata (system card)
2
3due tratte da 5 passaggi con un checkpoint ciascuna
4 segnalazioni per tratta 8,6%
5 residuo dopo il checkpoint 8,6% x 0,2 = 1,7%
6 su entrambe le tratte 1 - (1 - 0,017)^2 = 3,4%

Anche se lo Scettico ne intercettasse solo la metà, due tratte si fermerebbero intorno all'8,6% invece del 19,7%. Lo spezzare la catena fa la maggior parte del lavoro, il tasso di intercettazione fa il resto.

fleyta - inline image

9. Dai al lavoro un posto dove atterrare

Il lavoro che resta sepolto in una chat è lavoro che non ritroverai mai più. I dots si integrano negli Spaces e nelle Pages di ChatGPT, dove lavorate tu, il tuo team e il dot stesso.

Uno Space, quattro pagine:

text
100 indice una riga per esecuzione: data, ruoli usati, artefatto, verdetto
201 inbox scoperte della SENTINELLA, le più recenti in alto, con data
302 revisione artefatti del CREATORE con il checkpoint dello SCETTICO sotto ciascuno
403 rilasciato ciò che hai approvato, con la data di approvazione

Spiega questa mappa al dot una sola volta. Dopo due settimane, la pagina indice sarà la risorsa più utile di tutta la configurazione: l'unico registro leggibile di ciò che un agente sempre attivo ha fatto durante la tua settimana.

10. La prima vera esecuzione

Parti da qualcosa di utile, ripetitivo e poco costoso da rifare in caso di errore. Un digest del venerdì sfrutta tutti e quattro i ruoli e fallisce senza danni.

text
1Task permanente. Ogni venerdì alle 16:00 e quando dico "esegui il digest".
2
3TRATTA 1 (max 5 passaggi)
4SENTINELLA [calendario], [email], [repo]: cosa è cambiato questa settimana che servirebbe
5 a chi si unisce lunedì. Massimo cinque punti elenco, ognuno termina con
6 "decisione richiesta" o "nessuna azione".
7CREATORE basandoti solo su quei punti: RILASCIATO, SPOSTATO, IN ATTESA.
8 Max 120 parole per sezione, link per ogni elemento RILASCIATO.
9SCETTICO checkpoint. Tutto ciò che è in RILASCIATO senza link passa a IN ATTESA.
10
11TRATTA 2 (solo con VIA LIBERA)
12CORRIERE salvalo in 02 revisione come "Settimana del [data]", aggiungi una riga a 00 indice.
13 Non inviarlo a nessuno.
14
15Poi scrivimi solo la risposta al punto 5 del checkpoint, nient'altro.

11. Dots vs Grok Bot

Stessa categoria, struttura predefinita diversa.

text
1 DOTS GROK BOT
2struttura base un agente, molti ruoli diversi bot con un nome
3memoria unica, condivisa tra tutti i ruoli una per bot
4si trova in ChatGPT, Slack, Teams la sua app e le sue chat
5ideale per la settimana di una persona, lavori separati che non devono
6 un unico regolamento mai mescolarsi

Se i tuoi lavori condividono contesto (la posta alimenta il digest che alimenta il piano del lunedì), un dot con quattro ruoli è la soluzione più semplice. Se non devono mai incrociarsi (cliente A e cliente B), bot separati garantiscono confini più netti.

12. Le barriere di sicurezza

text
1catena oltre i 5 passaggi -> stop, checkpoint, attendi il VIA LIBERA
2zona grigia nelle regole -> CHIEDI PRIMA, segnala la regola poco chiara
3messaggio a qualsiasi persona -> CHIEDI PRIMA, sempre
4password, fatturazione, elimina, -> BLOCCA
5pubblico
6login o captcha durante un task -> subentra dal computer del dot
75+ approvazioni al giorno per -> abbassa un livello o restringi una fonte
82 settimane
9lo SCETTICO scrive complimenti -> riscrivi il checkpoint, non l'artefatto

Ogni barriera spinge l'incertezza verso di te, mai verso l'azione.

13. Cosa non ho testato

I calcoli sulla deriva. Due numeri tratti da una singola system card sono un segnale indicativo, non un modello validato. OpenAI non ha spiegato quali fossero i problemi di confine segnalati, quindi non posso valutarne la gravità.

Il tasso di intercettazione dello Scettico. 4 su 5 è un'ipotesi usata per mostrare l'andamento matematico. Un dot che controlla il proprio lavoro non è un revisore indipendente, quindi il tasso reale potrebbe essere inferiore.

La settimana tipo. Le 420 azioni e la loro distribuzione per livello sono una mia stima per un dot dedicato a ricerca e bozze, non il log di un account reale.

I prezzi oltre il primo dot. OpenAI afferma che sarà possibile aggiungere dots e scalare velocità o volume di lavoro mensile, ma non ha ancora pubblicato i relativi costi.

14. Il manuale operativo

Definisci il lavoro prima di collegare anche una sola app.

Un agente, quattro ruoli, un ruolo alla volta.

Spezza ogni catena a cinque passaggi. Checkpoint, poi si continua.

Scrivi prima la lista delle azioni consentite. Le zone grigie vanno in CHIEDI PRIMA.

Mantieni le approvazioni sotto le cinque al giorno, altrimenti la revisione perde di senso.

Dai al lavoro un posto dove atterrare e leggi l'indice il venerdì.

fleyta - inline image

Il punto centrale

I dots sono i primi agenti che la maggior parte delle persone lascerà attivi mentre dorme. Questo sposta la domanda da "può svolgere il task?" a "fino a che punto arriva prima che qualcuno lo controlli?".

La system card di OpenAI offre un indizio sulla risposta: raddoppi la catena, più che raddoppiano le segnalazioni.

Quindi non costruire catene più lunghe. Costruisci tratte più brevi, metti uno Scettico alla fine di ognuna e usa una scala dei permessi che ti interpelli solo sulle cose che contano.

Cinque passaggi, poi controllo. Tutto qui.

I dettagli sul lancio provengono dall'annuncio ufficiale di OpenAI sui dots. I dati della system card sono riportati da The New Stack. I prezzi dei piani derivano dalla copertura del lancio aggiornata al 1° ottobre 2026 e potrebbero subire variazioni.

Salva con un clic

Leggi in profondità gli articoli virali con l’AI di YouMind

Salva la fonte, fai domande mirate, riassumi l’argomentazione e trasforma un articolo virale in note riutilizzabili in un unico spazio di lavoro AI.

Scopri YouMind
Per i creator

Trasforma il tuo Markdown in un articolo 𝕏 pulito

Quando pubblichi i tuoi testi lunghi, formattare immagini, tabelle e blocchi di codice per 𝕏 è una seccatura. YouMind trasforma un'intera bozza Markdown in un articolo 𝕏 pulito e pronto da pubblicare.

Prova Markdown verso 𝕏

Altri pattern da decodificare

Articoli virali recenti

Esplora altri articoli virali