YouMind
Oturum aç

OpenAI Dots: Sapmayı Engelleyen 4 Koltuklu Bir Ajan Ekibi Nasıl Kurulur (Tam Rehber)

@fleyta88
İNGILIZCE01 Eki 2026
126K
90
5
10
150

TL;DR

Bu rehber, dört koltuklu rol sistemini (Gözlemci, Üretici, Şüpheci, Yürütücü) kullanarak görev sapmasını önlemek ve bir yetki merdiveni ile katı beş adımlı kontrol noktalarını uygulamak için OpenAI Dots ajanlarının nasıl yapılandırılacağını açıklar.

5 görevde %8,6. 10 görevde %19,7.

Bu rakamlar OpenAI'ın kendi dots sistem kartından geliyor. Beş görevi birbirine bağladığınızda çalıştırmaların %8,6'sı sınır sorunları nedeniyle işaretleniyor. On görevi bağladığınızda bu oran ikiye katlanıyor bile değil, daha da artıyor.

Lansman gününde herkes peluş maskotların fotoğrafını paylaştı. O satırı paylaşan neredeyse hiç kimse olmadı.

Çoğu dots rehberi size her şeyi birbirine bağlayıp ajanı serbest bırakmanızı söylüyor. Bu rehber ise zinciri tam olarak nereden keseceğinizi anlatıyor; böylece ajan tüm hafta boyunca çalışabilir ve ona verdiğiniz işin dışına taşmaz.

Bir dot, dört koltuk, bir izin merdiveni ve her beş adımda bir kontrol noktası.

Özet: Tek bir uygulamayı bağlamadan önce işi yazın, dot'a aynı anda sadece birini giyeceği dört koltuk verin, hiçbir zincirin kontrol noktası olmadan beş adımdan fazla ilerlemesine izin vermeyin ve onaylarınızı günde beşin altında tutun. Promptlar 6 ile 8. bölümlerde, hesaplamalar ise 3 ve 8. bölümlerde.

1. Önce rakamlar

text
1çıkış tarihi 29 Eylül 2026
2model GPT-6 Astra
3bağlanabildiği uygulama sayısı 4.000+
4ilk dot Pro ve Business Premium'da dahil
5Pro paketleri aylık 100$ / 200$ / 500$
6Business Premium kullanıcı başı aylık 125$, yıllıkta 100$
7bir dot ile sohbet etmek ChatGPT limitlerinden düşmez
8Codex veya Work'te başlattığı görevler her zamanki gibi limitlerden düşer
9nerede yaşıyor ChatGPT masaüstü, web, mobil, Slack, Teams
10mesajlaşma "yakında geliyor"
11
12sistem kartından
13sınır uyarıları, 5 görevli zincir %8,6
14sınır uyarıları, 10 görevli zincir %19,7
15dolaylı enjeksiyon, dahili testler %99,79 savunuldu
16harici red team, 1.810 saldırı %8,5'i sızdı
17yanıltıcı bilgi görevleri 151'de 0 sapma

Üstteki tabloyu herkes çoktan paylaştı. Kurulum şeklinizi değiştirmesi gereken asıl kısım alttaki tablo.

2. Bir dot nedir, tek ekranda

Dot, size ait olan ve sürekli çalışan bir ajandır. Onu sıradan bir ChatGPT sohbetinden ayıran dört şey var:

text
1model daha şık bir arayüzün arkasına saklanmış hafif bir model değil, GPT-6 Astra
2kendi bilgisayarı kendi tarayıcısı olan bir bulut makinesi, dizüstü bilgisayarınız kapalıyken bile çalışır
3mesajlarınız bağlı uygulamalarınızda "proaktif araştırma" yapar, salt okunur
4arasında çalışır orada mesaj gönderemez, uygulama içeriğini değiştiremez veya bilgisayarınızı yönetemez
5tek kimlik ChatGPT, Slack ve Teams genelinde aynı dot ve aynı hafıza

Ve diğer her şeyden daha sık kullanacağınız iki kontrol mekanizması:

text
1Özel Kurallar bir eyleme izin verin, onay isteyin veya engelleyin
2otomatik inceleme hesaplarınıza dokunabilecek veya veri paylaşabilecek eylemleri kontrol eder

OpenAI lansman yazısını şöyle bitiriyor: dot'lar hâlâ hata yapabilir, bu yüzden sonuç doğuracak işleri her zaman inceleyin. Aşağıdaki her şey, bu incelemeyi gerçekten yapabileceğiniz kadar hızlı hale getirmekle ilgili.

3. Kimsenin paylaşmadığı rakam

Sistem kartındaki bu iki rakam üzerinden hızlı bir hesaplama yaptım.

Eğer bir zincirdeki her adımın sınırları aşmak için aynı küçük ve bağımsız olasılığı olsaydı, basit bir matematikle 5 adımdan 10 adıma geçebilirdiniz:

text
1işaretlenen 5 adımlı zincir %8,6
2bunun ima ettiği adım başı olasılık 1 - (1 - 0,086)^(1/5) = %1,78
3
4adımlar bağımsız olsaydı 10 adım 1 - (1 - 0,0178)^10 = %16,5
5kartın ölçtüğü 10 adım değeri %19,7

Ölçülen değer, bağımsız olasılık hesabından daha yüksek çıkıyor.

Benim yorumum: hatalar birikiyor. Hafifçe rayından çıkan bir adım, bir sonraki adıma biraz yanlış bir tablo aktarıyor ve sonraki adım bunun üzerine inşa ediliyor. Yani risk, zincirin uzamasından daha hızlı büyüyor.

Elimizde sadece iki rakam var ve OpenAI işaretlenen sorunların ne olduğunu açıklamadı, bu yüzden bunu kabaca bir sinyal olarak kabul edin. Yine de etrafında bir sistem kurmak için yeterli:

text
1bu rehberin temel aldığı kural
2kontrol noktaları arasında asla 5 adımdan fazlası olmasın

4. Dört koltuk, bir dot

"Sen benim asistanımsın" denilen bir dot, asistan formatında iş üretir: yardımcı ama muğlak ve biraz fazla uzun. "Şu an Şüphecisin ve Şüpheci sadece neyin başarısız olduğunu bulur" denilen bir dot ise gerçekten işinize yarayacak bir şey üretir.

Bu yüzden dot'un dört koltuğu var. Her seferinde sadece birine oturuyor ve her yanıtının en üstünde hangisinde olduğunu belirtiyor.

text
1GÖZCÜ bağlı uygulamalarınızı okur, neyin değiştiğini raporlar, asla yazmaz
2ÜRETİCİ kendi bilgisayarında çalışır, size işin kendisini teslim eder
3ŞÜPHECİ üretilen işi brief'e göre kontrol eder, neyin başarısız olduğunu listeler
4KOŞUCU onaylanan işi ait olduğu yere taşır, bir şey dışarı çıkmadan önce sorar

Bunlar dört farklı ajan değil, tek bir ajanın modlarıdır. Tek hafıza, tek kural kitabı, dört dar kapsamlı iş.

fleyta - inline image

5. Kurulum, önemli olan sırayla

text
11 bilgisayarda ChatGPT'yi açın ilk dot masaüstünde veya web'de oluşturulur,
2 mobil onunla konuşabilir ama onu oluşturamaz
32 kenar çubuğunda dots'u bulun yoksa = yanlış plan, henüz pazarınıza gelmedi
4 veya bir yönetici özelliği açmamış
53 adlandırın kısa, küçük harf, boşluksuz
6 sabah 7'de Slack'te siz yazacaksınız
74 iş tanımını yapıştırın bölüm 6, her şeyden önce
85 kaynakları bağlayın ancak işi size geri teyit ettikten sonra
96 Slack veya Teams'e ekleyin ne işe yaradığını öğrendikten sonra

Herkesin hata yaptığı yer, 4. adımdan sonra gelen 5. adımdır. 40 bağlı uygulaması olup brief'i olmayan bir ajan çok bilgili olur ama işe yarar hiçbir şey üretmez.

6. İş tanımı

Bunu ilk mesaj olarak yapıştırın. Sadece köşeli parantezlerin içini değiştirin, başka hiçbir şeyi bozmayın.

text
1Sen benim daimi operasyon ajanımsın. Bu mesajı, Slack'ten veya telefonumdan
2başlattıklarım da dahil olmak üzere her görev için iş tanımın olarak kabul et.
3
4KİMİM
5Ben [şirket veya proje] bünyesinde [rol] olarak çalışıyorum. Haftam genellikle [bir cümle] şeklinde geçiyor.
6
7NELER SENİN SORUMLULUĞUNDA (faaliyetler değil, sonuçlar)
81. [birinci sonuç]
92. [ikinci sonuç]
103. [üçüncü sonuç]
11
12KOLTUKLAR
13Her seferinde tek bir koltukta oturursun ve her yanıtının en üstünde hangisi olduğunu yazarsın:
14GÖZCÜ, ÜRETİCİ, ŞÜPHECİ, KOŞUCU.
15- GÖZCÜ sadece okur ve raporlar.
16- ÜRETİCİ bana işin açıklamasını değil, işin kendisini gösterir.
17- ŞÜPHECİ, ÜRETİCİ'nin işini bu brief'e göre kontrol eder ve neyin başarısız olduğunu listeler.
18- KOŞUCU sadece onaylanan işleri taşır ve bir şey dışarı çıkmadan önce sorar.
19
20ZİNCİR KURALI
21Asla arka arkaya 5 adımdan fazla çalışma. 5. adımdan sonra dur, ŞÜPHECİ'ye geç,
22kontrol noktasını çalıştır ve devam etmeden önce GEÇTİ onayını bekle.
23
24BENİMLE NASIL KONUŞURSUN
25- Önce sonuç. Ardından karar vermem gereken en fazla üç şey.
26- Engellendiyse: ne denedin ve neye ihtiyacın var, iki satırda.
27- Bir şeyin kapsamda olup olmadığından emin değilsen: oku, sonra tek bir soru sor. Harekete geçme.
28
29Dört koltuğu, üç sonucu ve zincir kuralını kendi cümlelerinle tekrar ederek onayla.
30Sonra dur.

Son satırı atlamayın. Eğer dot "haftalık raporu hazırla" talimatını "hafta hakkında bir rapor yaz" olarak özetliyorsa, bir haftalık yanlış rapor yerine tek bir mesajla sorunu yakalamış olursunuz.

7. İzin merdiveni ve onay bütçesi

Özel Kurallar size üç basamak sunar: izin ver, onay iste, engelle. Çoğu insan bir yasak duvarı örer, sonra günde 40 şeyi onaylar ve neyi onayladığını okumayı bırakır.

Önce izin ver basamağını yazın. Altta cömert, üstte katı olun.

text
1İZİN VER
2- Bağlı kaynaklarımdaki her şeyi oku.
3- Genel web'de gezin, kendi bilgisayarını kullan, kod çalıştır.
4- Kendi çalışma alanında ve [AD] Space'inde taslaklar oluştur ve yeniden yaz.
5
6ÖNCE SOR
7- Bir insana giden herhangi bir mesaj: e-posta, DM, kanal gönderisi, davet, yorum.
8- Senin oluşturmadığın bir dosyadaki herhangi bir değişiklik.
9- Pull request açmak dahil bir repository'deki herhangi bir işlem.
10- Herhangi bir satın alma, abonelik veya form gönderimi.
11
12ENGELLE
13- Şifreler, 2FA, faturalandırma, ödeme ayarları.
14- Herhangi bir şeyi silmek.
15- Benim adıma herkese açık paylaşım yapmak.
16- Görevin brief'inde adı geçmeyen biriyle iletişime geçmek.
17
18BOŞLUKLAR
19Kuralların kapsamadığı her şey ÖNCE SOR kategorisine girer.
20Hangi kuralın belirsiz olduğunu bana söyle. Bir boşluğu asla eyleme geçecek şekilde çözme.

Sonra kendinize bir bütçe belirleyin. İşte araştırma, taslak hazırlama ve haftalık özet yapan bir dot için örnek bir hafta. Buradaki dağılım benim tahminim, ölçülmüş bir veri değil:

text
1örnek bir hafta, 420 eylem yukarıdaki merdiven "her şey için sor"
2okuma ve web 300 izin ver sor
3kendi alanındaki taslaklar 80 izin ver sor
4insanlara mesajlar 28 sor sor
5repo ve dosya değişiklikleri 8 sor sor
6engellenen denemeler 4 engelle sor
7tıkladığınız onaylar haftada 36 haftada 420
8iş günü başına ~7 ~84

Kimse günde 84 onayı okuyup inceleyemez. Ama 7 tanesini gerçekten okursunuz. Merdivenin asıl işi budur: onay sayınızı, gerçekten bakabileceğiniz kadar az tutmak.

Benim hedefim: günde beşin altı. Eğer iki hafta boyunca bunun üzerinde kalırsanız, tekrar eden bir eylemi bir basamak aşağı indirin veya bir kaynağı daraltın.

8. Her beş adımda bir kontrol noktası

%19,7'lik rakamın devreye girdiği yer burası.

Uzun bir iş tek bir zincir olarak çalışmaz. En fazla beş adımlık etaplar halinde çalışır ve her etap Şüpheci ile biter.

text
1KONTROL NOKTASI (Şüpheci, her etabın sonunda)
2
3Aşağıdaki beş soruyu, her biri bir satır olacak şekilde yanıtla:
41. Bu etap brief'in istediğini mi yaptı, yoksa ona yakın daha kolay bir şeyi mi?
52. Herhangi bir adım, brief'te adı geçmeyen bir kaynağa veya kişiye ulaştı mı?
63. Her rakam ya senin tarafından mı hesaplandı ya da okuduğun yere bağlantı verildi mi?
74. Kanıt gösteremeyeceğin herhangi bir iddia var mı? Listele.
85. Bu etabı onaylarsam ve yanlışsa, ne bozulur?
9
10Karar:
11GEÇTİ bir sonraki etaba devam et
12BEKLET dur, önce 2, 4 ve 5 numaralı maddeleri bana göster

Şimdi 3. bölümdeki gibi kabataslak bir hesaplama yapalım. Şüphecilerin bir kontrol noktasında 5 sorundan 4'ünü yakaladığını varsayalım. Bu benim varsayımım, ölçülmüş bir oran değil:

text
1kontrol noktası olmayan 10 adımlı tek zincir %19,7 işaretlendi (sistem kartı)
2
3her birinde kontrol noktası olan iki adet 5 adımlı etap
4 etap başına işaretlenme %8,6
5 kontrol noktasından sonra kalan %8,6 x 0,2 = %1,7
6 iki etap toplamında 1 - (1 - 0,017)^2 = %3,4

Şüpheci yarısını yakalasa bile, iki etap %19,7 yerine %8,6 civarında kalır. İşi bölmek yükün çoğunu alır, yakalama oranı gerisini halleder.

fleyta - inline image

9. İşe inecek bir yer verin

Sohbet geçmişinde yaşayan iş, bir daha asla bulamayacağınız iştir. Dot'lar; sizin, ekibinizin ve dot'un birlikte çalıştığı ChatGPT Spaces ve Pages'e bağlanır.

Bir Space, dört sayfa:

text
100 index her çalışma için bir satır: tarih, kullanılan koltuklar, çıktı, karar
201 inbox GÖZCÜ bulguları, en yenisi üstte, tarihli
302 review ÜRETİCİ çıktıları, her birinin altında ŞÜPHECİ kontrol noktası
403 shipped onayladıklarınız, onay tarihiyle birlikte

Bu haritayı dot'a bir kez söyleyin. İki hafta sonra, index sayfası tüm kurulumun en faydalı parçası haline gelir: sürekli çalışan bir ajanın haftanızla ne yaptığının okunabilir tek kaydı.

10. İlk gerçek çalışma

İşe yarar, tekrar eden ve ters giderse yeniden yapması ucuz bir şeyle başlayın. Cuma özeti dört koltuğu da kullanır ve güvenli bir şekilde başarısız olur.

text
1Daimi görev. Her Cuma saat 16:00'da ve ben "özeti çalıştır" dediğimde.
2
3ETAP 1 (maksimum 5 adım)
4GÖZCÜ [takvim], [e-posta], [repo]: bu hafta ne değişti ve Pazartesi katılacak
5 birinin ne bilmesi gerekir. Maksimum beş madde, her biri "karar gerekli"
6 veya "işlem gerekmez" ile bitsin.
7ÜRETİCİ sadece o maddelerden: TAMAMLANDI, TAŞINDI, BEKLİYOR.
8 Bölüm başına maksimum 120 kelime, her TAMAMLANDI öğesi için bağlantı.
9ŞÜPHECİ kontrol noktası. TAMAMLANDI kısmında bağlantısı olmayan her şey BEKLİYOR'a taşınır.
10
11ETAP 2 (sadece GEÇTİ durumunda)
12KOŞUCU bunu 02 review sayfasına "[tarih] haftası" olarak kaydet, 00 index'e bir satır ekle.
13 Kimseye gönderme.
14
15Sonra bana sadece kontrol noktasının 5. maddesinin yanıtını mesaj at, başka hiçbir şeyi değil.

11. Dots vs Grok Bot

Aynı kategori, farklı varsayılan yapı.

text
1 DOTS GROK BOT
2varsayılan yapı tek ajan, birçok koltuk birkaç adlandırılmış bot
3hafıza her koltuğun paylaştığı tek hafıza her bot için ayrı bir hafıza
4yaşadığı yer ChatGPT, Slack, Teams kendi uygulaması ve sohbetleri
5uygun olduğu yer bir kişinin haftası, tek kural asla karışmayan ayrı işler

Eğer işleriniz bağlamı paylaşıyorsa (gelen kutunuz özetinizi besliyor, özetiniz Pazartesi planınızı besliyor), dört koltuklu tek bir dot daha basittir. Eğer birbirlerini asla görmemeleri gerekiyorsa (A müşterisi ve B müşterisi), ayrı botlar çok daha temiz bir sınır çizer.

12. Koruma mekanizmaları

text
15 adımdan uzun zincir -> dur, kontrol noktası, GEÇTİ'yi bekle
2kural boşluğu -> ÖNCE SOR, belirsiz kuralı adlandır
3herhangi birine mesaj -> ÖNCE SOR, her zaman
4şifre, fatura, silme, genel -> ENGELLE
5görev ortasında giriş/captcha -> dot'un bilgisayarından devral
62 hafta boyunca günde 5+ onay -> bir basamak değiştir veya kaynağı daralt
7ŞÜPHECİ övgü yazarsa -> çıktıyı değil, kontrol noktasını yeniden yaz

Her koruma mekanizması belirsizliği eyleme değil, size doğru iter.

13. Test etmediklerim

Sapma matematiği. Tek bir sistem kartından alınan iki rakam kanıtlanmış bir model değil, kabaca bir sinyaldir. OpenAI işaretlenen sınır sorunlarının ne olduğunu açıklamadı, bu yüzden ne kadar ciddi olduklarını söyleyemem.

Şüphecilerin yakalama oranı. 5'te 4, matematiğin mantığını göstermek için yapılmış bir varsayım. Kendi işini kontrol eden bir dot bağımsız bir inceleyici değildir, bu yüzden gerçek oran daha düşük olabilir.

Örnek hafta. 420 eylem ve basamaklara göre dağılım, araştırma ve taslak hazırlayan bir dot için benim tahminim; gerçek bir hesabın logu değil.

İlk dot sonrası fiyatlandırma. OpenAI, dot ekleyebileceğinizi ve hızı veya aylık iş hacmini ölçeklendirebileceğinizi söylüyor ancak bu fiyatları henüz yayınlamadı.

14. Oyun planı

Tek bir uygulamayı bağlamadan önce işi yazın.

Tek ajan, dört koltuk, her seferinde bir koltuk.

Her zinciri beş adımda kesin. Kontrol noktası, sonra devam.

Önce izin listesini yazın. Boşluklar ÖNCE SOR'a gider.

Onayları günde beşin altında tutun, aksi takdirde incelemeniz gerçek bir inceleme olmaktan çıkar.

İşe inecek bir yer verin ve Cuma günleri index'i okuyun.

fleyta - inline image

Asıl mesele

Dots, çoğu insanın uyurken çalışmaya bırakacağı ilk ajandır. Bu durum soruyu "bu görevi yapabilir mi?" noktasından "birisi bakana kadar ne kadar ileri gidebilir?" noktasına taşır.

OpenAI'ın kendi kartı bu sorunun cevabına dair bir ipucu veriyor: zinciri ikiye katlayın, uyarılar ikiye katlanmaktan daha fazla artar.

O halde daha uzun bir zincir kurmayın. Daha kısa etaplar, her birinin sonunda bir Şüpheci ve size sadece sorulmaya değer şeyleri soran bir merdiven kurun.

Beş adım, sonra kontrol. Hepsi bu.

Lansman detayları OpenAI'ın dots duyurusundan alınmıştır. Sistem kartı rakamları The New Stack tarafından bildirildiği şekliyledir. Paket fiyatları 1 Ekim 2026 itibarıyla lansman haberlerinden alınmıştır ve değişebilir.

Tek tıkla kaydet

YouMind ile viral makaleleri AI derin okumayla incele

Kaynağı kaydedin, odaklı sorular sorun, argümanı özetleyin ve viral bir makaleyi tek bir AI çalışma alanında yeniden kullanılabilir notlara dönüştürün.

YouMind'ı keşfet
Üreticiler için

Markdown'ınızı temiz bir 𝕏 makalesine dönüştürün

Kendi uzun yazılarınızı yayımlarken görselleri, tabloları ve kod bloklarını 𝕏 için biçimlendirmek zahmetlidir. YouMind, eksiksiz bir Markdown taslağını temiz ve hemen paylaşılabilir bir 𝕏 makalesine dönüştürür.

Markdown'dan 𝕏'e deneyin

Çözülecek daha fazla kalıp

Son viral makaleler

Daha fazla viral makale keşfet