Você quer criar imagens com a mesma atmosfera, mas sai uma figura diferente toda vez.
Quando você alinha três miniaturas, elas parecem ter sido feitas por três pessoas diferentes. Você quer gerar a mesma pessoa de antes, mas o rosto dela muda. Mesmo se você escrever "igual da última vez", parece não funcionar de jeito nenhum.
Este é o obstáculo que a maioria das pessoas que começam a usar geração de imagens com IA no trabalho enfrenta primeiro.
No entanto, isso não está acontecendo porque seus prompts são ruins. A causa é muito mais simples: você está escrevendo-os do zero toda vez.
Além disso, a OpenAI forneceu oficialmente uma resposta para esse problema. Um template que divide prompts de imagem em 14 itens foi lançado. Ele inclui 11 tipos para diferentes usos, 8 tipos para edição e exemplos completos.
Aqui estão as quatro coisas que vou compartilhar:
- O texto completo dos 14 itens do template oficial e o que escrever em cada um.
- Uma lista de 11 tipos para especificar casos de uso em uma palavra e 8 tipos para edição.
- O método oficial para continuar gerando o "mesmo rosto" e o "mesmo estilo".
- Uma forma de evitar colar aquele template toda vez (incluindo um registro de como eu realmente executei).
A segunda metade é baseada em medições reais. Enviei uma imagem de referência, criei um template e passei pelo processo de criar um documento de 10 páginas. Vou escrever exatamente quanto tempo levou, o fato de que refiz 7 vezes e como descobri que você não deve usar o ImageGen diretamente para a criação de documentos.
Primeiro, aqui está o objeto em si. Este é o framework oficial.
Texto original oficial (do Shared Prompt Scaffolding da skill imagegen da OpenAI)
1Use case: <taxonomy slug>2Asset type: <where the asset will be used>3Primary request: <user's main prompt>4Input images: <Image 1: role; Image 2: role> (optional)5Scene/backdrop: <environment>6Subject: <main subject>7Style/medium: <photo/illustration/3D/etc>8Composition/framing: <wide/close/top-down; placement>9Lighting/mood: <lighting + mood>10Color palette: <palette notes>11Materials/textures: <surface details>12Text (verbatim): "<exact text>"13Constraints: <must keep/must avoid>14Avoid: <negative constraints>
Fonte: https://github.com/openai/skills/blob/main/skills/.system/imagegen/SKILL.md
Só de olhar para isso, você pode pensar "está em inglês" e parar, então, daqui em diante, vou traduzir cada item para o português e detalhar como preenchê-los. Por fim, vou fornecer uma versão em português do template que você pode copiar e usar como está.
O motivo de variar toda vez não é porque seus prompts são ruins
A causa está na estrutura das instruções, não no conteúdo.
Você digita "crie uma imagem de cabeçalho de blog estilosa" em texto livre. No dia seguinte, digita "imagem de cabeçalho simples e moderna". Na mente de um ser humano, essas duas têm a intenção de ser o mesmo pedido, mas são instruções diferentes.
A primeira só tem "estilosa" como pista. A segunda tem "simples" e "moderna". As partes que você não especifica são preenchidas pela IA toda vez. Como a forma de preencher é diferente a cada vez, as imagens são diferentes a cada vez.
⚡ Não é a IA que está hesitando; são as nossas instruções.
É aqui que entram os 14 itens. Se os itens são fixos, você consegue ver de relance onde esqueceu de preencher. Se você abrir o arquivo anterior e reescrever apenas as linhas que quer mudar, todo o resto será igual ao da última vez.
Pare de "escrever" prompts toda vez e passe a "preencher" prompts. Essa é a essência desta discussão.
A política oficial é "não expandir arbitrariamente"
Há outra filosofia de design que é útil conhecer.
A definição oficial da skill afirma:
1If the prompt is already specific and detailed, preserve that specificity and only normalize/structure it. If the prompt is generic, you may add tasteful augmentation when it will materially improve the result.
Fonte: https://github.com/openai/skills/blob/main/skills/.system/imagegen/SKILL.md
Se a instrução é específica, mantenha essa especificidade e apenas organize a estrutura. Somente quando a instrução é vaga é permitido adicionar elementos na medida em que o resultado melhora. É assim que está decidido.
Em outras palavras, quanto mais detalhado você escreve, menos arbítrio a IA tem. Menos arbítrio significa menos variação.
Por outro lado, para instruções vagas, a IA tem permissão oficial para "ser prestativa e adicionar coisas". As partes adicionadas de boa vontade são diferentes toda vez. Essa é a fonte da variação.
📌 Portanto, os 14 itens são ferramentas para dar informação à IA e, ao mesmo tempo, ferramentas para tirar a liberdade da IA. Se você enxergar assim, não vai usá-los incorretamente.
Antes disso: você provavelmente já tem essa ferramenta
Nenhuma instalação é necessária.
imagegen é uma "skill de sistema" que está no Codex desde o início. Não é algo que os usuários adicionam depois; está pronta para uso no momento em que é iniciada. Nenhum contrato adicional ou chaves de API são necessários.
Na descrição oficial, o comportamento padrão é um modo que usa a ferramenta interna image_gen, que se parece com isto:
Ferramenta integrada (padrão): não exige OPENAI_API_KEY.
Uma chave de API só é necessária para o fallback de CLI (scripts/image_gen.py) que roda apenas quando solicitado explicitamente. Para uso normal, isso não importa.
⚠️ É aqui que 90% das pessoas tropeçam: o símbolo de chamada é diferente dependendo do local.
Se você não sabe disso, vai travar na primeira linha. A documentação oficial descreve assim:
1In Codex CLI or the IDE extension, run /skills or type $ to mention a skill.
1In ChatGPT Work, use @skill-creator format.
Fonte: https://learn.chatgpt.com/docs/build-skills
No Codex CLI e nas extensões de IDE, é $. No ChatGPT Work, é @.
Mesmo sendo a mesma função, o símbolo de chamada é diferente. Quando o procedimento que você encontrou online não funciona, geralmente é só porque a tela em que você está é diferente da tela do artigo. A gramática não está errada.
A documentação oficial também lista onde ela pode ser usada:
1Standalone skills are available in the ChatGPT desktop app, Codex CLI, and IDE extension. Skills bundled in plugins are also available in Chat and Work across ChatGPT on the web, desktop, and mobile.
Fonte: https://learn.chatgpt.com/docs/build-skills
Aplicativo desktop, Codex CLI e extensão de IDE. Esses três são a arena das skills autônomas.
🎯 Mesmo quem não consegue usar a skill pode usar o template a partir de hoje.
Este é um ponto importante, então vou deixá-lo claro. Para pessoas que não usam o Codex ou o aplicativo desktop, o imagegen em si é irrelevante. Se você simplesmente abrir o ChatGPT no navegador, nada vai aparecer se digitar $.
No entanto, o template de 14 itens é apenas um formato de texto. Você pode colá-lo diretamente no campo de geração de imagens do ChatGPT no navegador, do Gemini ou do Claude. A skill é apenas um "mecanismo que escreve nesse formato para você", e o formato em si pode ser usado por qualquer pessoa.
Portanto, o valor deste artigo não muda dependendo se você consegue usar a skill. Quem consegue deve tratá-la como automação, e quem não consegue deve tratá-la como um template de copiar e colar.
Template de Prompt: Todos os 14 Itens
A partir daqui é o corpo principal. Vamos ver para que serve cada campo, em ordem. São 14 itens, mas você não precisa preencher todos. É apenas uma relação em que a IA complementa as partes que você não preencheu. Basta preencher apenas os itens com os quais você está tendo problemas de variação.
- Use case Este é o campo para especificar o gênero da imagem usando uma palavra fixa. Em vez de palavras livres, você escolhe entre as palavras preparadas pela OpenAI (taxonomy slug). Há 11 tipos no total, como product-mockup, ui-mockup e logo-brand. Uma lista é resumida em um capítulo posterior. Decidir isso primeiro determina automaticamente como preencher os itens subsequentes. Se é uma foto de produto, você precisa de iluminação. Se é um diagrama, você precisa de texto. Uma vez decidido o caso de uso, os campos necessários também são decididos.
- Asset type Escreva onde a imagem será colocada em última instância. "Imagem de cabeçalho de blog", "fundo hero de landing page", "ícone de UI de jogo". Se o caso de uso (nº 1) é uma categoria ampla, este é o local real de instalação. Mesmo para o mesmo estilo de imagem fotográfica, as margens necessárias e a proporção de aspecto mudam dependendo se é colocada em um cabeçalho ou em um ícone. Este é o campo para transmitir isso.
- Primary request Este é o campo para colocar o "faça aquilo" que você normalmente digita em texto livre. Na explicação oficial, é <user's main prompt>. Em outras palavras, esses 14 itens não são um mecanismo para descartar texto livre. É uma estrutura em que você coloca o texto livre no campo nº 3 e alinha condições ao redor dele. Se isso estiver vazio, nada começa. Por outro lado, se você só preencher isso, é o mesmo estado de antes.
- Input images Ao passar imagens que você tem em mãos, este é o campo para escrever qual papel cada uma desempenha. O formato oficial é <Image 1: role; Image 2: role>. Você declara o número e o papel como um conjunto, como "Image 1 é uma foto de pessoa, Image 2 é uma referência de roupa". Como é um item opcional, você pode deixá-lo vazio ao criar do zero. No entanto, quando você quer continuar gerando a mesma pessoa, este campo se torna o protagonista. Mais sobre isso no capítulo de edição.
- Scene/backdrop O ambiente onde a imagem está situada. "Sobre uma mesa de madeira", "dentro de um hangar industrial", "cinza claro com uma leve textura". Pode ser um lugar real ou um fundo abstrato. Se você não escrever o fundo, ele vai mudar toda vez. O motivo pelo qual a atmosfera das miniaturas não combina geralmente é porque este campo está vazio.
- Subject O que colocar no centro da tela. Você pode escrever não apenas o objeto em si, mas também como ele é colocado, como "Uma única garrafa colocada no centro, com um leve reflexo". O ponto é escrever o fundo (nº 5) e o assunto (nº 6) separadamente; se você combiná-los em uma única frase, a IA não conseguirá julgar qual priorizar.
- Style/medium É uma foto, uma ilustração ou 3D? Nos exemplos oficiais, é escrito em uma granularidade como "ilustração fosca", "concept art cinematográfica" ou "diagrama em estilo vetorial". "Estilosa" e "moderna" não são palavras para colocar aqui. Pense nisso como um campo para escrever o nome da técnica.
- Composition/framing É um plano aberto ou um close-up, de cima para baixo, e onde colocar o assunto? O exemplo oficial tem uma forma de escrever como "composição ampla com espaço negativo utilizável para texto da página". Isso significa uma composição horizontal com margens à esquerda e à direita para colocar texto. Este campo é eficaz para imagens em que você adicionará texto depois, como miniaturas ou cabeçalhos. Se você não reservar as margens primeiro, o assunto virá em tela cheia e o texto não caberá.
- Lighting/mood É luz suave da manhã, iluminação de estúdio ou raios de luz na neblina? Os exemplos oficiais usam expressões como "luz suave da manhã", "iluminação softbox, brilhos limpos, sombras controladas" e "raios de luz volumétricos cortando a neblina". Se você quer estabilizar a aparência de foto, o caminho mais rápido é fixar as mesmas palavras aqui toda vez.
- Color palette A política para as cores a usar. "Cores da marca", "cores neutras suaves", "verde escuro e off-white". Pode ser nomes de cores específicos ou uma direção. Se você quer mostrar consistência de marca, escreva suas cores aqui e fixe-as. Só isso já alinhará a impressão quando elas estiverem lado a lado.
- Materials/textures A textura da superfície. Escreva informações relacionadas a como a luz quica, como "plástico fosco, rótulo claramente impresso". Este campo é eficaz para fotos de produto e pode ser omitido para paisagens ou ilustrações sem problema.
- Text (verbatim) Um campo para escrever o texto a ser incluído na imagem exatamente como está. O ponto é que o formato oficial é Text (verbatim): "<exact text>", e verbatim significa "exatamente como no original". Você passa a string exata que quer gerar, entre aspas, não um conteúdo resumido. No exemplo oficial para um diagrama, está escrito assim:
1Text (verbatim): "Bean Hopper", "Grinder", "Brew Group", "Boiler", "Water Tank", "Drip Tray"
Ouvimos com frequência que texto em imagens de IA fica distorcido, mas em muitos casos o texto exato a ser incluído nem foi passado corretamente em primeiro lugar. Só de preencher isso já pode mudar o resultado.
- Constraints Um campo para listar "mantenha isto" e "não faça isto". O conjunto mais comum nos exemplos oficiais é "sem texto; sem logotipos; sem marca d'água". Para imagens destinadas a receber texto depois, incluir esses três toda vez reduz acidentes. Isso impede a IA de adicionar frases de efeito em inglês por conta própria.
- Avoid Enquanto o nº 13 é para condições gerais, este campo é restrito a "coisas que você não quer que sejam geradas". Gradientes, 3D, ser colocado dentro de um mockup. No exemplo oficial para um logotipo, está escrito como "sem gradientes; sem mockups; sem 3D; sem marca d'água". Como os papéis se sobrepõem ao nº 13, geralmente apenas um é usado nos templates oficiais reais. Em vez de distingui-los estritamente, basta entender que "há dois lugares para escrever coisas que você quer que parem de ser feitas".
Especifique o caso de uso em uma palavra. 11 tipos preparados oficialmente
Esta é uma lista de palavras para colocar no nº 1, Use case. Na coleção oficial de exemplos, 11 tipos são listados para geração.
- photorealistic-natural (fotos realistas, cenas naturais)
- product-mockup (fotos de produto, embalagens)
- ui-mockup (mockups de design de tela)
- infographic-diagram (diagramas, infográficos)
- scientific-educational (diagramas para ciência e educação)
- logo-brand (logotipos, marcas)
- illustration-story (ilustrações para histórias)
- stylized-concept (concept art estilizada)
- ads-marketing (materiais de publicidade e marketing)
- productivity-visual (visuais para documentos e negócios)
- historical-scene (cenas históricas)
Além desses, também são preparados templates por local de instalação. Para sites (hero images, ilustrações de seção, cabeçalhos de blog), para jogos (conceitos de fundo, personagens, ícones de UI, texturas), wireframes (PC, páginas de preço, onboarding de smartphone), logotipos (marcas abstratas, monogramas, wordmarks). Para imagens de cabeçalho de blog, o exemplo oficial é fornecido como está.
Texto original oficial (exemplo de Website assets: imagem de cabeçalho de blog)
1Use case: photorealistic-natural2Asset type: blog header image3Primary request: overhead desk scene with notebook, pen, and coffee cup4Scene/backdrop: warm wooden tabletop5Style/medium: photorealistic photo6Composition/framing: wide crop with clean room for page copy7Lighting/mood: soft morning light8Constraints: no text; no logos; no watermark
Observe que apenas 8 dos 14 itens são preenchidos. A própria OpenAI não preenche todos. Isso serve como um exemplo de que você só precisa preencher os campos necessários.
Continuar gerando o mesmo rosto e estilo. 8 tipos para edição
Esta é a resposta direta para "varia toda vez". Na coleção oficial de exemplos, há 8 tipos de casos de uso para editar imagens existentes.
- text-localization (substituir apenas texto, como tradução)
- identity-preserve (alterar mantendo a identidade da pessoa)
- precise-object-edit (substituir apenas objetos específicos)
- lighting-weather (alterar apenas luz e clima)
- style-transfer (transferir o estilo de uma imagem de referência)
- compositing (compor assuntos de outra imagem)
- character consistency workflow (gerar o mesmo personagem em uma cena diferente)
- sketch-to-render (transformar um esboço em imagem final)
O que funciona para o problema do rosto que muda é o identity-preserve. O exemplo oficial é o seguinte:
Texto original oficial (Edição: identity-preserve)
1Use case: identity-preserve2Input images: Image 1: person photo; Image 2..N: clothing references3Primary request: replace only the clothing with the provided garments4Constraints: preserve face, body shape, pose, hair, expression, and identity; match lighting and shadows; keep the background unchanged; no accessories or text
A parte-chave é a linha Constraints. Preserve rosto, formato do corpo, pose, cabelo, expressão e identidade. Combine iluminação e sombras. Mantenha o fundo inalterado. Em outras palavras, em vez de dizer "faça a mesma pessoa", ele lista as coisas que você quer que sejam as mesmas pelo nome. Essa forma de escrever é a resposta oficial.
🔥 Se você está gerando muitos personagens, use este formato
Para usos como miniaturas de série ou gerar a mesma pessoa muitas vezes, há um formato mais detalhado.
Texto original oficial (Edição: character consistency workflow)
1Use case: identity-preserve2Input images: Image 1: previous character anchor illustration3Primary request: continue the story with the same character in a new scene and action4Scene/backdrop: snowy forest after a winter storm5Subject: same young forest hero gently helping a frightened squirrel out of a fallen tree6Style/medium: same children's book watercolor illustration style as Image 17Constraints: do not redesign the character; preserve facial features, proportions, outfit, color palette, and personality; no text; no watermark
O termo "character anchor" usado aqui é a chave. Você especifica uma imagem que serve como padrão como uma "âncora", e a partir daí, você instrui apenas as diferenças em relação a ela. O ponto de que o campo Style/medium é "mesmo estilo de ilustração em aquarela de livro infantil da Image 1" também é importante; ele não explica o estilo em palavras. Ele o especifica por referência como "igual à Image 1". Tentar reproduzir um estilo com palavras sempre leva a desvios. Apontar por referência é mais preciso.
Se você só quer alinhar o estilo, use o style-transfer
Se você quer alinhar o tom geral em vez da pessoa, use este:
Texto original oficial (Edição: style-transfer)
1Use case: style-transfer2Input images: Image 1: style reference3Primary request: apply Image 1's visual style to a man riding a motorcycle on a plain white backdrop4Constraints: preserve palette, texture, and brushwork; no extra elements
Preserve a paleta, a textura e o traço. Não adicione elementos extras. Se você tem uma imagem de que gosta em mãos, coloque-a na Image 1 e depois troque o conteúdo. O tom e a maneira da marca ficarão mais estáveis nesse formato.
Versão em português do template que pode ser usada como está
Os dois exemplos a seguir não são os prompts em si distribuídos pela OpenAI. Eles foram reconstruídos em uma forma que pode ser preenchida em português com base na estrutura oficial de itens citada acima. Os nomes dos itens mantêm os rótulos oficiais em inglês.
★ Aplicação (criado com base na estrutura oficial de itens. Não é um prompt distribuído pela OpenAI)
1Use case:2Asset type:3Primary request:4Input images:5Scene/backdrop:6Subject:7Style/medium:8Composition/framing:9Lighting/mood:10Color palette:11Materials/textures:12Text (verbatim):13Constraints: sem texto; sem logotipos; sem marca d'água14Avoid:
Crie apenas um desses em um arquivo de texto e guarde-o. Da próxima vez, abra este arquivo e reescreva apenas as linhas que quer mudar. Se você preenchê-lo para uma miniatura, ficará assim:
★ Aplicação (baseado no exemplo oficial de Website assets / blog header, reconstruído em português)
1Use case: photorealistic-natural2Asset type: Imagem de cabeçalho de artigo de blog (horizontal)3Primary request: Composição olhando para uma mesa de cima, diagonalmente. Caderno, caneta e caneca4Scene/backdrop: Mesa de madeira quente com textura de grão5Subject: Caderno levemente à esquerda do centro, caneca no primeiro plano à direita6Style/medium: Foto realista7Composition/framing: Horizontal. Deixar margens à direita para colocar o título8Lighting/mood: Luz natural suave da manhã9Color palette: Esquema de cores calmo centrado em marrom-madeira e off-white10Constraints: sem texto; sem logotipos; sem marca d'água
A partir da segunda vez, reescreva apenas as duas linhas: Primary request e Subject. Mantenha todo o resto como estava da última vez. Isso vai alinhar a "mesma atmosfera de antes". O truque é decidir quais linhas fixar e quais alterar no início. Acho que a divisão de fixar as quatro linhas de fundo, estilo, luz e paleta de cores, e mover apenas o assunto e a composição, é a mais fácil de lidar.
Se colar o template toda vez é um incômodo, você pode criar o template completo
A partir daqui estão os registros do que eu realmente executei. Sinceramente, é um saco copiar e colar os 14 itens toda vez. Um mecanismo para resolver isso foi preparado no lado do Codex. Quando você adiciona o Image Gen ao campo de entrada, um contêiner chamado Template Gallery aparece. Você pode colocar seus próprios templates aqui. Ao criá-lo, perguntei ao Template Creator assim:
★ Aplicação (instruções que eu realmente enviei. Não é um prompt distribuído pela OpenAI)
1Por favor, use o Template Creator para criar um novo template de imagem para o ImageGen. Primeiro, explique como o template funciona e como usá-lo. Em seguida, peça o upload de uma imagem PNG de referência e pergunte-me quando e como usar o template, se necessário.
A resposta veio em 27 segundos. Foi bom que ele tenha feito duas perguntas primeiro em vez de começar o trabalho de repente. A primeira foi "Você quer que o template penda para o design do slide inteiro, ou quer usá-lo para gerar ilustrações e diagramas?" A segunda foi "O uso principal é mais próximo de um relatório de pesquisa, materiais de seminário, materiais de vendas ou um carrossel de redes sociais?" Essas duas perguntas são os pontos de ramificação do design. Mesmo com o mesmo "querer alinhar o design", o template resultante muda dependendo se você está criando um visual completo ou uma imagem destinada a ter texto colocado nas margens. Faz sentido ter isso decidido primeiro.
⚠️ A verdadeira identidade não era "registro de template", mas "salvamento de skill"
Eu também entendi errado até a metade do processo, então vou deixar claro. Não é que exista um mecanismo de registro de template como o Canva dentro do ImageGen. De acordo com o Codex, era na verdade um mecanismo em que regras para imagens de referência, paletas de cores, expressões e layouts são salvas como uma "skill" no Codex e chamadas a partir do ImageGen. Uma skill é um fluxo de trabalho reutilizável que combina instruções, materiais de referência, scripts etc. A explicação oficial está aqui.
Fonte: https://developers.openai.com/plugins/concepts/skills.md
Como chamar o template criado
Quando concluído, o template é nomeado e colocado na galeria. A partir da próxima vez, você pode chamá-lo de duas maneiras:
- Adicione o Image Gen ao campo de entrada e escolha na galeria
- Especifique diretamente o ID começando com $artifact-template-
Você também pode chamá-lo pelo nome. Escrever "Crie com o design de (nome do template)" funcionou. 📌 Em outras palavras, os 14 itens são um "formato escrito à mão", e o template é "esse formato salvo como uma skill". Quanto à ordem, é mais seguro escrever à mão primeiro para entender o formato e depois transformá-lo em um template. Se você criar um template de repente, não conseguirá explicar o que fixou por conta própria.
Se você está criando documentos, não deve usar o ImageGen diretamente
Esta foi a descoberta mais importante desta vez. Agora que o template estava pronto, tentei fazê-lo criar um documento de 10 páginas. Como resultado, ele conseguiu criar, mas quando perguntei ao próprio Codex "qual é a forma correta de pedir no futuro", obtive uma resposta diferente do que esperava. Usar o ImageGen diretamente é adequado para produção de imagens individuais. Especificamente, quando você quer fazer uma ilustração, quando quer fazer apenas uma imagem de capa, quando quer corrigir a cor ou a composição de uma imagem existente, ou quando quer gerar uma proposta de design como teste. Por outro lado, não é adequado para a produção do documento inteiro. O motivo também ficou claro. É porque é difícil gerenciar coletivamente pesquisa, design de estrutura de 10 páginas, unidade entre as páginas e conversão para PowerPoint e PDF.
🎯 O ImageGen é uma ferramenta especializada em uma imagem. Deixe o documento para a skill. Se você fizer com que ele crie um documento sem conhecer essa linha, será um desvio.
A forma correta de pedir é "instruir o todo com uma skill e fazer com que ela use o ImageGen dentro disso"
A divisão de papéis era a seguinte:
- Template de design (aquele que você mesmo criou): reproduz paleta de cores, decoração e visão de mundo
- Skill para geração de slides: responsável por pesquisa, estrutura, geração de imagens, verificação e conversão para PPTX e PDF
- ImageGen: realmente gera as imagens concluídas para cada página
Se você especificar os dois primeiros e enviar, o ImageGen é chamado internamente. Esta é a forma de escrita que foi realmente orientada:
★ Aplicação (a forma de especificação orientada pelo Codex. A parte do tema está oculta e generalizada)
1Usando $imagegen-slide-deck e $artifact-template-(nome do seu template), crie um documento de 10 páginas sobre o tema "XX". Com o mesmo design desta vez, salve o PowerPoint e o PDF com o título oficial como nome do arquivo.
Se apenas a reprodução do design for suficiente, o lado do template sozinho já basta.
★ Aplicação (mesmo que acima)
1Usando $artifact-template-(nome do seu template), crie um slide de 10 páginas sobre o tema "XX". Pesquise o conteúdo e salve como PowerPoint e PDF.
⚡ O PPTX resultante não pode ter seu texto editado
Se você não sabe disso, um acidente certamente vai acontecer. O PowerPoint que sai dessa forma tem cada página como uma imagem concluída. Em outras palavras, mesmo se você abrir o PowerPoint, não pode reescrever o texto diretamente. Existe uma solução alternativa, e me disseram que se eu declarar claramente "em um PowerPoint com texto editável" ao solicitar, tudo bem. Para documentos que você quer ajustar por conta própria antes de distribuir, adicione isso desde o início. Atenção também é necessária com o nome do arquivo. Se deixado como estava, ele era salvo com um nome genérico como deck.pptx. Eu garanto de escrever "salve com o título oficial como nome do arquivo" toda vez.
Peça para incluir as fontes nas notas do apresentador
Isso foi sutilmente eficaz, então vou anotar. Consegui fazer com que os URLs das fontes pesquisadas fossem colocados nas notas do apresentador do PowerPoint. Como posso rastrear "de onde tirei essa descrição" depois, acho que é uma prática essencial para documentos distribuídos a outras pessoas. Quando pedi uma verificação de fatos separada, ele retornou a resposta listando os URLs das evidências e separando as partes que não foram comprovadas e as partes em que as interpretações divergiam por escola ou posição. Essa foi uma parte que honestamente foi útil.
Tempo necessário
Medição real. Foram 7 rodadas no total. A primeira consulta de design do template foi de 27 segundos. Do envio da imagem de referência à criação do corpo do template e da primeira versão de 10 páginas, foram 23 minutos e 9 segundos. A segunda vez, quando reconstruí a estrutura, levou 13 minutos e 13 segundos. Corrigir apenas uma página levou 11 minutos e 34 segundos. Verificação de fatos e correção levaram 14 minutos e 18 segundos. Mudar o texto mais uma vez levou 6 minutos e 52 segundos. Salvar e verificar o template levou 3 minutos e 11 segundos. Organizar os nomes dos arquivos levou 1 minuto e 10 segundos. No total, cerca de uma hora e meia. No entanto, esse não foi o tempo em que fiquei grudado na tela, mas o tempo que passei esperando após enviar. Eu estava fazendo outro trabalho nesse meio tempo.
Obstáculos encontrados depois de refazer 7 vezes
Isto pode ser o que mais quero transmitir. Não foi concluído de uma vez. Passei por 7 rodadas. A primeira versão saiu, reconstruí a estrutura fundamentalmente, corrigi apenas uma página, verifiquei os fatos, mudei o texto, salvei e organizei os nom





