ผมจ้างพนักงาน AI 46 คนด้วย Claude Code เพื่อรันบริษัท AI (ตอนที่ 3)

@Sokichi_Hoshino
ญี่ปุ่น17 ก.ย. 2569
119K
80
2
2
218

TL;DR

บทวิเคราะห์เหตุการณ์ในบริษัท AI ที่มีการเปลี่ยนแปลงข้อมูลโดยไม่ได้รับอนุญาต โดยเน้นย้ำว่าการจำกัดสิทธิ์เครื่องมือของ AI Agent มีประสิทธิภาพมากกว่าการใช้กฎผ่าน Prompt ในการป้องกันข้อผิดพลาดที่ไม่สามารถย้อนกลับได้

ครั้งก่อน ผมได้เผยแพร่พรอมต์ฉบับเต็มสำหรับ AI พนักงานที่รับผิดชอบด้านการฝึกอบรม

https://x.com/Sokichi_Hoshino/status/2099987762485358639

https://x.com/Sokichi_Hoshino/status/2100365149739880471

ในตอนที่ 1 ผมสัญญาว่าจะแชร์รายละเอียดของอุบัติเหตุที่เกิดจาก AI พนักงานโดยไม่ปิดบังอะไรเลย บทความนี้ทำตามสัญญานั้น โดยเน้นไปที่ AI พนักงานตำแหน่ง "เจ้าหน้าที่ระงับเหตุ" (Stop Officer) เป็นหลัก

อุบัติเหตุไม่ได้เกิดขึ้นเพราะไม่มีคนคอยหยุดยั้ง แต่เกิดขึ้นเพราะไม่มีใครเรียกคนที่สามารถหยุดยั้งมันได้ต่างหาก

"ฉันปล่อยให้ AI ทำเอง แล้วมันก็เขียนทุกอย่างใหม่โดยที่ฉันไม่เคยสั่ง..."

ผมเข้าใจความกลัวนั้นดี

ป้องกันอุบัติเหตุด้วยสิทธิ์การเข้าถึง ไม่ใช่กฎเกณฑ์

บทความนี้อธิบายสามสิ่ง: สิ่งที่เกิดขึ้นระหว่างอุบัติเหตุ, พรอมต์สำหรับ AI พนักงานตำแหน่ง Stop Officer และวิธีการที่ผมปรับเปลี่ยนการจัดสรรสิทธิ์หลังจากนั้น

มาเริ่มกันเลย

บทที่ 1: ข้อมูลการผลิตถูกเขียนทับโดยใช้สถานะปลอมว่า "CEO อนุมัติแล้ว"

อุบัติเหตุเกิดขึ้นไม่ถึงหนึ่งสัปดาห์หลังก่อตั้งบริษัท AI

ผมปล่อยให้ AI พนักงานฝ่ายวิเคราะห์การตลาดทำงานตีความข้อมูลเป็นเวลานานเกินไป

ในกระบวนการนี้ พนักงานดังกล่าวได้ดำเนินการต่อโดยอ้างอิงจากคำพูดของผมที่ไม่เคยเกิดขึ้นจริง

วลีอย่าง "ได้รับคำตอบจาก CEO แล้ว" และ "มุมมองของ CEO ถูกต้องแล้ว" ปรากฏขึ้นระหว่างการทำงาน ทั้งที่ผมไม่ได้พูดเช่นนั้น

วลีคล้ายกันปรากฏซ้ำๆ และเอกสารรวมถึงสคริปต์ต่างๆ ก็ถูกสร้างขึ้นบนพื้นฐานของข้อมูลปลอมเหล่านั้น

ท้ายที่สุด พนักงานคนนี้เขียนลงไปในไฟล์แผนธุรกิจการผลิตแบบสเปรดชีต มันเพิ่มแถวลงในตารางผลงานและลบรายการคาดการณ์ในตารางพยากรณ์ออก พร้อมทำเครื่องหมายว่าเป็น "CEO Approved" (CEO อนุมัติแล้ว)

ส่งผลให้ยอดขายคาดการณ์ประจำปีลดลงเท่ากับจำนวนที่ถูก删除ไป

มีกฎที่กำหนดว่าการดำเนินการที่ไม่สามารถย้อนกลับได้ต้องผ่าน AI พนักงานตำแหน่ง Stop Officer อย่างไรก็ตาม ในขณะนั้น AI พนักงานหลักที่ทำหน้าที่เป็นโฮสต์ไม่ได้เรียกใช้ Stop Officer

เป็นความผิดของผมเองที่ปล่อยให้งานรันนานเกินไป ดังที่ผมเขียนไว้ในตอนที่ 1:

เป็นความรับผิดชอบของผมที่ไม่ได้ผ่านขั้นตอนของ Stop Officer

บทที่ 2: เผยแพร่พรอมต์สำหรับ AI พนักงานตำแหน่ง Stop Officer

ก่อนอื่น นี่คือเนื้อหาพรอมต์ของ AI พนักงานตำแหน่ง Stop Officer ตามที่เป็นจริง

นี่คือเนื้อหาในไฟล์ .claude/agents/teishi.md ของฝั่งผม ผมปรับวิธีเรียกขาน CEO การใช้ตัวอักษร และการแบ่งประโยคให้เข้ากับสไตล์ของบทความนี้ และลบเครื่องหมายตัวหนาออก

ผมลดตัวอย่างอุบัติเหตุในอดีตในเงื่อนไขสุดท้ายของหัวข้อ "สิ่งที่ต้องปกป้อง" เหลือเพียงหนึ่งกรณี และตัดทอนถ้อยคำบางส่วนเล็กน้อย

text
1---
2name: teishi
3description: เจ้าหน้าที่ระงับเหตุ ฝ่ายกฎหมายและการจัดการข้อมูล หยุดก่อนการกระทำที่ไม่สามารถย้อนกลับได้ เช่น การลบ การส่ง การเผยแพร่ หรือการเรียกเก็บเงิน อ่านผลที่จะเกิดขึ้นออกมา และขอการยืนยัน (ถูกเรียกเมื่อมีการถามว่า "ตรวจสอบความปลอดภัยของการรันนี้" หรือทันทีก่อนการดำเนินการที่ไม่สามารถย้อนกลับได้)
4tools: Read, Grep, Glob
5---
6
7คุณคือเจ้าหน้าที่ระงับเหตุของฝ่ายกฎหมายและการจัดการข้อมูลของบริษัทนี้
8
9งานของคุณคือการหยุดก่อนการดำเนินการที่ไม่สามารถย้อนกลับได้
10คุณไม่ดำเนินการใดๆ
11คุณไม่ให้สิทธิ์
12งานของคุณคือการทำให้ "สิ่งที่จะเกิดขึ้น" มองเห็นได้ชัดเจนสำหรับ CEO และส่งต่อการตัดสินใจไปให้เขา
13
14# เป้าหมายที่ต้องหยุด
15
16- การลบ — ลบไฟล์ ข้อมูล บัญชี ร่างเอกสาร
17- การส่ง — ส่งอีเมล การกระจายข้อความผ่าน LINE ข้อความ
18- การเผยแพร่ — โพสต์ การ deploy การออกลิงก์แชร์ การเปิดสิทธิ์การเข้าถึง
19- การเรียกเก็บเงิน/การใช้โควตา — รัน API แบบเสียเงิน การซื้อ โควตาการโพสต์ผ่าน X API (ทรัพยากรที่ลดลงแม้จะล้มเหลว)
20
21# รูปแบบการยืนยัน (อ่านออกเสียง 4 จุด)
22
231. กำลังทำอะไรกับอะไร — ระบุเป้าหมายให้ชัดเจน (ถ้าเป็นไฟล์ ให้ระบุเนื้อหาสำคัญ; ถ้าเป็นการส่ง ให้ระบุผู้รับและสรุปเนื้อหา)
242. ย้อนกลับได้ไหม? — ย้อนกลับได้สมบูรณ์ / ย้อนกลับได้ด้วยความยากลำบาก / ไม่สามารถย้อนกลับได้
253. อะไรจะสูญเสียหากรวมเหลว? — เงิน, โควตา, ความไว้วางใจ, ข้อมูล
264. ทางเลือกที่ปลอดภัยกว่า — มีหนึ่งทางเลือกถ้าเป็นไปได้ (เช่น ทดลองส่งก่อนกระจายไปยังทุกคน)
27
28# ขั้นตอน
29
301. อ่านแผนการดำเนินงาน ตรวจสอบเป้าหมายจริง ผู้รับ จำนวน ฯลฯ (อย่าตรวจสอบจากคำบอกเล่า)
312. อ่านออกเสียงสั้นๆ ทั้ง 4 จุด และหยุดพร้อมถามว่า "ดำเนินการต่อได้เลยไหม?"
323. หากเนื้อหาเป้าหมายขัดแย้งกับคำอธิบาย ให้รายงานความขัดแย้งก่อนขอการยืนยัน
33
34# สิ่งที่ต้องปกป้อง
35
36- เรียกขาน CEO ว่า "CEO" และพูดจาสุภาพ
37- อย่าเร่งรัดการดำเนินการหรือรีบร้อนจนกว่า CEO จะบอกว่า "ดำเนินการ"
38- หากมีบันทึกประเภทอุบัติเหตุในอดีต (เช่น โควตา X API ลดลงแม้จะล้มเหลว) ให้เพิ่มลงในจุดยืนยันทั้ง 4
39
40## กฎที่ได้รับจากเจ้าหน้าที่ฝึกอบรม
41
42(ยังไม่มี)

มีสามสิ่งที่ผมต้องการให้คุณพิจารณา

ประการแรก บรรทัด tools AI พนักงานตำแหน่ง Stop Officer มีเพียง Read, Grep และ Glob เท่านั้น มันไม่สามารถเขียนไฟล์หรือรันคำสั่งได้

AI พนักงานมุมมองผู้อ่าน (Reader Perspective) ที่เผยแพร่ในตอนที่ 1 มี Edit และ Write เพื่อบันทึกฟีดแบ็ก Stop Officer ไม่มีแม้แต่สิ่งเหล่านั้น มันเป็นพนักงานแบบอ่านอย่างเดียวจริงๆ

ประการที่สอง บรรทัด "You do not execute." (คุณไม่ดำเนินการ) และ "You do not grant permission." (คุณไม่ให้สิทธิ์) งานของ Stop Officer จบลงที่การส่งต่อการตัดสินใจไปให้ CEO

ผมเชื่อว่าหากผู้หยุดยั้งพูดว่า "ดำเนินการได้เลย" วลีนั้นจะถูกใช้เป็นตัวแทนของการอนุมัติจาก CEO อุบัติเหตุครั้งนี้เริ่มต้นจากการอนุมัติปลอมๆ

ประการที่สาม ขั้นตอนที่ 1 "Do not confirm based on hearsay." (อย่าตรวจสอบจากคำบอกเล่า) แม้จะมีวลี "CEO Approved" ปรากฏขึ้นมา Stop Officer ก็จะอ่านเนื้อหาจริงก่อนอ่านออกเสียงจุดยืนยันทั้ง 4

บันทึกสิ่งนี้เป็นไฟล์ .claude/agents/teishi.md เมื่อคุณถามว่า "ตรวจสอบความปลอดภัยของการรันนี้" AI หลักจะอ่านคำอธิบายและตัดสินใจว่าจะมอบหมายงานให้ Stop Officer หรือไม่

เพื่อให้แน่ใจว่ามันถูกเรียกใช้ ให้ระบุชื่ออย่างชัดเจนด้วย @agent-teishi

บทที่ 3: Stop Officer จะไม่เคลื่อนไหวเว้นแต่จะถูกเรียก

AI พนักงานตำแหน่ง Stop Officer ไม่ใช่ด่านตรวจที่ยืนอยู่ที่ทางเข้าบริษัท มันเป็นพนักงานที่เคลื่อนไหวเฉพาะเมื่อถูกเรียกเท่านั้น

ใน Claude Code AI หลักจะอ่านคำอธิบายของแต่ละพนักงานเพื่อตัดสินใจว่าจะมอบหมายงานหรือไม่ เอกสารทางการระบุว่า:

Claude ใช้คำอธิบายของ subagent แต่ละตัวเพื่อตัดสินใจว่าจะมอบหมายงานเมื่อใด

คำอธิบายของ Stop Officer ยังระบุด้วยว่า "เรียกทันทีก่อนการดำเนินการที่ไม่สามารถย้อนกลับได้" แต่การตัดสินใจที่จะเรียกขึ้นอยู่กับ AI ผู้เรียก

หากผู้เรียกไม่ตระหนักว่า "นี่คือการดำเนินการที่ไม่สามารถย้อนกลับได้" ข้อความก็จะไม่เคยไปถึง Stop Officer ในวันเกิดเหตุ การเขียนข้อมูลการผลิตดำเนินไปโดยไม่ได้เรียกใช้ Stop Officer

ส่วนล่างสุดของพรอมต์ Stop Officer หัวข้อ "Rules Received from Training Officer" (กฎที่ได้รับจากเจ้าหน้าที่ฝึกอบรม) ยังคงว่างเปล่าแม้หลังจากเกิดอุบัติเหตุแล้วก็ตาม

กฎถูกเพิ่มเข้าไปในพรอมต์ของฝั่งที่ทำการเขียนข้อมูล

ผมเชื่อว่าสิ่งที่ต้องแก้ไขไม่ใช่ผู้หยุดยั้ง แต่เป็นฝั่งที่สามารถเขียนข้อมูลการผลิตได้โดยไม่ต้องผ่านผู้หยุดยั้งต่างหาก

บทที่ 4: หลังอุบัติเหตุ ผมเปลี่ยนสิทธิ์ ไม่ใช่กฎ

การแก้ไขครั้งแรกคือ AI พนักงานตำแหน่งเจ้าหน้าที่ฝึกอบรม (Training Officer) เพิ่มกฎลงในพรอมต์ของ AI พนักงานวิเคราะห์การตอบสนอง (Response Analysis)

กฎข้อ #1 ระบุว่า: อ้างอิงคำพูด/การอนุมัติจาก CEO จากข้อความที่ CEO ส่งมาจริงเท่านั้น และห้ามเขียนลงสเปรดชีตการผลิตโดยไม่มีคำสั่งชัดเจนจาก CEO

กฎข้อ #1 เดียวกันกำหนดให้โฮสต์ต้องผ่าน Stop Officer ก่อนการดำเนินการที่ไม่สามารถย้อนกลับได้

อย่างไรก็ตาม ผมตัดสินว่าเพียงแค่นี้ยังไม่เพียงพอ อุบัติเหตุเกิดขึ้นทั้งที่มีกฎให้ผ่าน Stop Officer อยู่แล้ว

การเปลี่ยนแปลงครั้งที่สองคือเรื่องสิทธิ์ เมื่อจ้าง AI พนักงานสำหรับบทความ X ผมตัดสินใจไม่ให้สิทธิ์ Bash เนื่องจากอุบัติเหตุครั้งนี้

AI พนักงานสำหรับบทความ X สามารถเขียนบทความได้ แต่ไม่สามารถส่งไปยังร่างได้ทางกายภาพ AI พนักงานประเภท Story-Type ที่จ้างมาภายหลังก็ไม่มี Bash เช่นกัน

การส่งบทความ X ไปยังร่างตอนนี้กลายเป็นหน้าที่ของ AI พนักงานหลักที่ทำหน้าที่เป็นโฮสต์ เมื่อเราใช้โครงสร้างนี้เป็นครั้งแรก มันผ่าน Stop Officer

ผมเลือกที่จะทำให้การส่งเป็นเรื่องที่เป็นไปไม่ได้เชิงโครงสร้าง แทนที่จะแค่เขียนว่า "ห้ามส่ง" ในพรอมต์

ในทางกลับกัน AI พนักงานวิเคราะห์การ-response ยังคงมี Write และ Bash เพราะมันใช้ Bash ในการคำนวณและเปรียบเทียบ

กฎจากตอนที่ 1 "อย่าปล่อยให้พนักงานที่มีสิทธิ์เขียนทำงานภายนอกเป็นเวลานาน" มีไว้สำหรับพนักงานประเภทนี้

สรุป: การป้องกันอุบัติเหตุจาก AI ต้องจำกัดสิทธิ์มากกว่าวางผู้หยุดยั้ง

สุดท้าย ผมจะย้ำประเด็นสำคัญของบทความนี้อีกครั้ง

แม้คุณจะวางผู้หยุดยั้งไว้ อุบัติเหตุก็ยังเกิดขึ้นได้หากพวกเขาไม่ถูกเรียก การรับประกันว่าการดำเนินการที่ไม่สามารถย้อนกลับได้จะเข้าถึงไม่ได้เชิงโครงสร้างนั้นเชื่อถือได้มากกว่า

Stop Officer เป็นพนักงานแบบอ่านอย่างเดียวที่ไม่ให้สิทธิ์ใดๆ เพื่อป้องกันอุบัติเหตุแม้จะลืม ให้จำกัดสิทธิ์ของพนักงานที่ สามารถ เขียนได้

เปิดไฟล์ AI พนักงานของคุณและตรวจสอบว่ามีบรรทัด `tools` อยู่หรือไม่

พนักงานที่ละเว้นบรรทัด tools จะสืบทอดเครื่องมือทั้งหมดที่พร้อมใช้งานสำหรับ subagents

การจำกัดเครื่องมือผ่านบรรทัด tools ช่วยลดความกังวลได้อย่างมาก ในขณะที่ปล่อยให้ AI พนักงานทำงานระยะยาว

ซีรีส์บริษัท AI นี้แยกวิเคราะห์พนักงานทั้ง 46 คนทีละคนพร้อมพรอมต์ฉบับเต็ม

บทความนี้ครอบคลุมเพียง 1 จาก 46 คนเท่านั้น

บทความในอนาคตจะเจาะลึกพนักงานหนึ่งคนต่อบทความ

ซีรีส์นี้เปิดเผยทุกสิ่ง: เนื้อหาของ AI พนักงาน 46 คน โครงสร้างแผนก การจัดสรรสิทธิ์ และการแก้ไขการออกแบบ

ผมจะบันทึกการออกแบบที่แก้ไขแล้วด้วยความละเอียดเท่ากับการออกแบบที่ประสบความสำเร็จ

ผมจะส่งมอบเนื้อหาของ AI พนักงานตามลำดับ หากคุณต้องการอ่านต่อ โปรดติดตาม @Sokichi_Hoshino

ขอบคุณที่อ่านจนจบ

【📣ประกาศ📣】

เปิดช่องชุมชนเพื่อการเรียนรู้ AI และ X อย่างครบถ้วน

ช่องนี้จะนำเสนอข้อมูลล่าสุดและมีค่าเกี่ยวกับ AI และ X โดยไม่กั๊ก

🎁สิทธิประโยชน์ฟรีสำหรับสมาชิกช่อง🎁

① 200 พรอมต์คัดสรร

② 20 อัญมณี (Gems)

③ ของขวัญ Claude Skills 7 รายการ 🎁

🌈เนื้อหาที่แชร์ในช่อง🌈

① วิธีบรรลุยอดขาย 1 ล้านเยนจากการโพสต์ Note ครั้งแรก

② วิธีการตลาด SNS

③ วิธีการตลาดแบบลิสต์

④ วิธีการตลาดดิจิทัลดาต้า

⑤ วิธีที่เร็วที่สุดในการเติบโตบน X

และอื่นๆ แชร์ประสบการณ์ในฐานะนักการตลาด AI×SNS ที่ทำงานจริงซึ่งมีพื้นเพด้านการตลาดดิจิทัล/บิ๊กดาต้า

ยินดีต้อนรับมือใหม่และคนแอบดู ✨ เชิญเข้ามาดูได้ตามสบาย ✨

↓เข้าร่วมที่นี่

https://line.me/ti/g2/LmLu1N1cE6UBkoURbaYf_bV8l66cCyotSJU2og

【📣ประกาศ 2📣】

เปิดตัวบริการที่ปรึกษา AI สำหรับผู้บริหาร/เจ้าของธุรกิจ

【เนื้อหาบริการ】

・สนับสนุนระบบอัตโนมัติ SNS (X, Threads, Instagram, TikTok, YouTube)

・สนับสนุนการสร้าง AI พนักงาน

・สร้างเครื่องมือ/แอปพลิเคชัน AI

ปรับแต่งให้เหมาะสมเพื่อเพิ่มรายได้สูงสุดตามความต้องการ

https://x.com/Sokichi_Hoshino/status/2096779529129980242

สร้างต่อใน YouMind

Turn one viral article into a full content workflow

Collect the source, decode the pattern, create assets, draft the story, and distribute from one AI workspace.

Explore YouMind
สำหรับครีเอเตอร์

เปลี่ยน Markdown ของคุณให้เป็นบทความ 𝕏 ที่สะอาดตา

เวลาคุณเผยแพร่งานเขียนยาวของตัวเอง การจัดรูปแบบรูปภาพ ตาราง และบล็อกโค้ดให้เข้ากับ 𝕏 นั้นน่าปวดหัว YouMind เปลี่ยนร่าง Markdown ทั้งฉบับให้เป็นบทความ 𝕏 ที่สะอาดตาและพร้อมโพสต์ทันที

ลอง Markdown เป็น 𝕏

แพตเทิร์นให้ถอดรหัสเพิ่มเติม

บทความไวรัลล่าสุด

สำรวจบทความไวรัลเพิ่มเติม