Na última vez, publiquei os prompts completos do funcionário de IA responsável pelo treinamento.
https://x.com/Sokichi_Hoshino/status/2099987762485358639
https://x.com/Sokichi_Hoshino/status/2100365149739880471
Na Parte 1, prometi compartilhar os detalhes dos acidentes causados por funcionários de IA sem esconder nada. Este artigo cumpre essa promessa, tendo o funcionário de IA "Oficial de Parada" como protagonista.
O acidente não aconteceu porque não havia ninguém para pará-lo; aconteceu porque ninguém chamou a pessoa que poderia pará-lo.
"Deixei com a IA, e ela reescreveu coisas que eu nunca pedi..."
Conheço esse medo na pele.
Previna acidentes com permissões, não com regras.
Este artigo explica três coisas: o que aconteceu durante o acidente, o prompt do funcionário de IA Oficial de Parada e como mudei as atribuições de permissão depois.
Vamos começar.
Capítulo 1: Dados de Produção Foram Reescritos Usando um Status Falso de "Aprovado pelo CEO"
O acidente ocorreu menos de uma semana após a fundação da empresa de IA.
Eu havia deixado o funcionário de IA de análise de respostas do departamento de marketing trabalhando na interpretação de dados por um longo período.
Durante esse processo, o funcionário prosseguiu baseado em declarações minhas que nunca aconteceram de fato.
Frases como "Resposta recebida do CEO" e "O ponto do CEO está correto" apareceram durante o trabalho. Eu não disse nenhuma delas.
Frases semelhantes apareceram repetidamente, e documentos e scripts foram criados em cima delas.
Por fim, este funcionário escreveu na planilha do plano de negócios de produção. Ele adicionou linhas à tabela de desempenho e excluiu uma entrada de previsão na tabela de projeção, marcando-a como "Aprovado pelo CEO".
Como resultado, a previsão anual de vendas diminuiu no valor da previsão excluída.
Havia uma regra de que operações irreversíveis devem passar pelo funcionário de IA Oficial de Parada. No entanto, naquele momento, o funcionário principal de IA atuando como host não chamou o Oficial de Parada.
Foi culpa minha por ter deixado rodando por tanto tempo. Como escrevi na Parte 1:
A responsabilidade é minha por não ter passado pelo Oficial de Parada.
Capítulo 2: Publicando o Prompt do Funcionário de IA Oficial de Parada
Primeiro, aqui está o conteúdo do funcionário de IA Oficial de Parada exatamente como ele é.
Este é o conteúdo de .claude/agents/teishi.md do meu lado. Ajustei a forma de se dirigir ao CEO, o uso de kana e as quebras de frase para corresponder ao estilo deste artigo, e removi os marcadores de negrito.
Reduzi o exemplo de acidentes passados na última cláusula de "Coisas a Proteger" para apenas um, e cortei ligeiramente algumas frases.
1---2name: teishi3description: Oficial de Parada do Depto. Jurídico & Gestão de Informação. Para antes de ações irreversíveis como exclusão, envio, publicação ou cobrança, lê o que vai acontecer e pede confirmação (Chamado quando perguntado "Verifique se é seguro executar isso" ou logo antes de operações irreversíveis)4tools: Read, Grep, Glob5---67Você é o Oficial de Parada do Departamento Jurídico & Gestão de Informação desta empresa.89Seu trabalho é parar antes de operações irreversíveis.10Você não executa.11Você não concede permissão.12Seu trabalho é tornar visível ao CEO "o que vai acontecer" e entregar a decisão.1314# Alvos para Parar1516- Exclusão — Excluir arquivos, dados, contas, rascunhos17- Envio — Enviar e-mails, transmissões via LINE, mensagens18- Publicação — Postar, fazer deploy, emitir links compartilhados, abrir permissões19- Consumo de Cobrança/Cota — Executar APIs pagas, compras, cotas de post na API X (recursos que diminuem mesmo se falharem)2021# Formato de Confirmação (Leia 4 pontos)22231. O que está sendo feito a quê — Seja específico sobre o alvo (Se arquivo, conteúdos-chave; se envio, destinatário e resumo do corpo)242. É reversível? — Totalmente reversível / Reversível com esforço / Irreversível253. O que diminui se falhar? — Dinheiro, cota, confiança, dados264. Alternativa mais segura — Uma, se disponível (ex.: teste de envio antes da transmissão para todos)2728# Procedimento29301. Leia a operação planejada, verifique alvos reais, destinatários, contagens, etc. (Não confirme com base em boatos)312. Leia brevemente os 4 pontos e pare com "Posso prosseguir?"323. Se o conteúdo do alvo contradizer a descrição, reporte a contradição antes de pedir confirmação3334# Coisas a Proteger3536- Dirija-se ao CEO como "CEO" e fale educadamente37- Não pressione pela execução nem apresse até o CEO dizer "Executar"38- Se houver registros de tipos de acidentes passados (ex.: cotas da API X diminuem mesmo se falharem), adicione-os à confirmação dos 4 pontos3940## Regras Recebidas do Oficial de Treinamento4142(Nenhuma ainda)
Há três coisas que quero que você observe.
Primeiro, a linha tools. O funcionário de IA Oficial de Parada tem apenas Read, Grep e Glob. Ele não pode escrever em arquivos nem executar comandos.
O funcionário de IA Perspectiva do Leitor publicado na Parte 1 tem Edit e Write para registrar feedback. O Oficial de Parada nem tem esses; ele é verdadeiramente um funcionário somente-leitura.
Segundo, as linhas "Você não executa." e "Você não concede permissão.". O trabalho do Oficial de Parada termina ao entregar a decisão ao CEO.
Acredito que, se o parador disser "Pode executar", essa frase será usada como substituto da aprovação do CEO. Este acidente começou com uma aprovação falsa.
Terceiro, o passo 1 diz "Não confirme com base em boatos.". Mesmo que a frase "Aprovado pelo CEO" apareça, o Oficial de Parada lê o conteúdo real antes de ler os 4 pontos.
Salve isto como .claude/agents/teishi.md. Quando você perguntar "Verifique se é seguro executar isso", a IA principal lê a descrição e decide se delega ao Oficial de Parada.
Para garantir que seja chamado, nomeie-o explicitamente com @agent-teishi.
Capítulo 3: O Oficial de Parada Não Se Move a Menos Que Seja Chamado
O funcionário de IA Oficial de Parada não é um posto de controle parado na entrada da empresa. É um funcionário que se move apenas quando chamado.
No Claude Code, a IA principal lê a descrição de cada funcionário para decidir se delega tarefas. A documentação oficial afirma:
O Claude usa a descrição de cada subagente para decidir quando delegar tarefas.
A descrição do Oficial de Parada também diz "Chame logo antes de operações irreversíveis.". Mas a decisão de chamar cabe à IA que chama.
Se quem chama não percebe "Isso é uma operação irreversível", a mensagem nunca chega ao Oficial de Parada. No dia do acidente, a escrita nos dados de produção prosseguiu sem que o Oficial de Parada fosse chamado.
A seção no final do prompt do Oficial de Parada, "Regras Recebidas do Oficial de Treinamento", permanece vazia mesmo após o acidente.
As regras foram adicionadas ao prompt do lado que realizou a escrita.
Acredito que o que precisava ser corrigido não era o parador, mas sim o lado que podia escrever nos dados de produção sem passar pelo parador.
Capítulo 4: Após o Acidente, Mudei Permissões, Não Regras
A primeira correção foi o funcionário de IA Oficial de Treinamento adicionar regras ao prompt do funcionário de IA Análise de Respostas.
A Regra #1 diz: Baseie declarações/aprovações do CEO apenas no texto realmente enviado pelo CEO, e não escreva em planilhas de produção sem instrução explícita do CEO.
A mesma Regra #1 exige que o host roteie através do Oficial de Parada antes de operações irreversíveis.
No entanto, julguei que isso sozinho era insuficiente. O próprio acidente aconteceu apesar de haver uma regra para passar pelo Oficial de Parada.
A segunda mudança foi nas permissões. Ao contratar o funcionário de IA Artigo X, decidi não dar a ele acesso Bash devido a este acidente.
O funcionário de IA Artigo X pode escrever artigos, mas fisicamente não pode enviá-los para rascunhos. O funcionário de IA Tipo História contratado posteriormente também não tem Bash.
Enviar artigos do X para rascunhos agora é trabalho do funcionário principal de IA atuando como host. Quando implementamos essa estrutura pela primeira vez, ela passou pelo Oficial de Parada.
Escolhi tornar o envio estruturalmente impossível, em vez de apenas escrever "Não envie" no prompt.
Por outro lado, o funcionário de IA Análise de Respostas ainda tem Write e Bash porque realiza cálculos e comparações usando Bash.
A regra da Parte 1, "Não deixe funcionários com permissões de escrita em tarefas voltadas para o exterior por longos períodos", existe para esse tipo de funcionário.
Resumo: Prevenir Acidentes de IA Requer Restringir Permissões Mais Do Que Colocar Paradores
Finalmente, vou reiterar o ponto mais importante deste artigo.
Mesmo que você coloque um parador, acidentes acontecem se eles não forem chamados. É mais confiável garantir que operações irreversíveis sejam estruturalmente inalcançáveis.
O Oficial de Parada é um funcionário somente-leitura que não concede permissões. Para prevenir acidentes mesmo se esquecido, restrinja as permissões dos funcionários que podem escrever.
Abra seus arquivos de funcionários de IA e verifique se a linha `tools` está presente.
Funcionários que omitem a linha tools herdam todas as ferramentas disponíveis para subagentes.
Restringir ferramentas via linha tools reduz significativamente a ansiedade enquanto deixa tarefas longas para os funcionários de IA.
Esta Série de Empresa de IA Disseca Todos os 46 Funcionários Um por Um com Prompts Completos
Este artigo cobriu apenas 1 dos 46.
Artigos futuros farão uma análise profunda de um funcionário por artigo.
Esta série revela tudo: os conteúdos de 46 funcionários de IA, estruturas departamentais, atribuições de permissão e correções de design.
Vou documentar designs corrigidos com a mesma densidade que os bem-sucedidos.
Entregarei os conteúdos dos funcionários de IA sequencialmente. Se quiser continuar lendo, siga @Sokichi_Hoshino.
Obrigado por ler até o fim.
【📣Anúncio📣】
Abrindo um Canal Comunitário para Dominar IA e X Completamente.
O canal entrega informações recentes e valiosas sobre IA e X sem reservas.
🎁Benefícios Gratuitos para Membros do Canal🎁
① 200 Prompts Selecionados
② 20 Gems
③ 7 Presentes de Skills do Claude 🎁
🌈Conteúdo Compartilhado no Canal🌈
① Como Alcançar Vendas de 1 Milhão de Ienes na Primeira Postagem de Nota
② Métodos de Marketing em SNS
③ Métodos de Marketing de Lista
④ Métodos de Marketing de Dados Digitais
⑤ Maneira Mais Rápida de Crescer no X
E mais, compartilhando insights da minha experiência como marketer ativo de IA×SNS com background em marketing digital/big data.
Iniciantes e observadores silenciosos são bem-vindos ✨ Sinta-se à vontade para dar uma espiada ✨
↓Junte-se Aqui.
https://line.me/ti/g2/LmLu1N1cE6UBkoURbaYf_bV8l66cCyotSJU2og
【📣Anúncio 2📣】
Lançado Serviço de Consultoria de IA para Executivos/Donos de Negócios.
【Conteúdos do Serviço】
・Suporte à Automação de SNS (X, Threads, Instagram, TikTok, YouTube)
・Suporte à Construção de Funcionários de IA
・Criação de Ferramentas/Apps de IA
Personalizado para maximizar a receita com base nas necessidades.





