100 mil pessoas salvaram o @karpathy nos favoritos post:
Depois ele publicou um GitHub Gist completo. 5.000+ estrelas. 1.400+ forks. Dois dias.
A maioria das pessoas também vai salvar isso nos favoritos. E não fazer nada.
Não porque seja difícil. Mas porque ninguém deu a elas os prompts exatos.
Eu vou resolver isso.
Vou te guiar por todo o sistema, entregar prompts prontos para copiar e colar em cada etapa, e te dizer onde isso quebra para que você não perca um fim de semana com algo que desmorona em escala.
"O trabalho do humano é selecionar fontes, direcionar a análise, fazer boas perguntas e pensar sobre o que tudo isso significa. O trabalho do LLM é todo o resto." — Andrej Karpathy
O Conceito (Versão de 60 Segundos)
Você tem conhecimento espalhado por toda parte. Artigos salvos em 4 aplicativos. Favoritos de 2023 que você nunca mais vai revisitar. Anotações de reuniões que vivem em uma pasta que você esqueceu que existia.
Agora, quando você faz uma pergunta à IA sobre suas coisas, ela começa do zero toda vez. Envie documentos, faça uma pergunta, obtenha uma resposta. Próxima sessão? Ela esqueceu tudo. É assim que funcionam os uploads de arquivos do ChatGPT, NotebookLM e a maioria dos sistemas RAG. Zero acúmulo.
A ideia do Karpathy inverte isso.
Em vez de a IA pesquisar seus arquivos brutos toda vez, a IA lê suas fontes uma vez e compila uma wiki estruturada. Resumos, referências cruzadas, conexões entre ideias, contradições sinalizadas.
Tudo mantido pela IA. Tudo em arquivos markdown simples.
Da próxima vez que você fizer uma pergunta, a IA não vasculha documentos brutos. Ela lê a wiki que já construiu.
As conexões já estão lá.
A síntese já reflete tudo o que você leu.
Cada nova fonte que você adiciona enriquece a wiki. Cada pergunta que você faz pode ser arquivada de volta. O conhecimento se acumula em vez de ser redefinido.
O resultado dele: ~100 artigos, ~400.000 palavras em um único tópico de pesquisa. Ele não escreveu uma palavra disso. A IA escreveu, vinculou, categorizou e manteve tudo.
Sem banco de dados. Sem embeddings. Sem vector store. Apenas pastas e arquivos de texto.
Por Que Você Deveria se Importar?
Três casos de uso que importam agora:
Se você é um criador ou profissional de marketing, isso é um motor de pesquisa de conteúdo. Despeje análises de concorrentes, artigos em alta, insights de público em raw/. A wiki revela padrões e ângulos que você nunca encontraria manualmente.
Se você é um fundador ou consultor, isso é seu segundo cérebro para trabalho com clientes, pesquisa de mercado ou análise competitiva. Cada relatório que você gera alimenta o sistema. No terceiro mês, sua IA conhece seu domínio melhor do que a maioria dos contratados.
Se você é um estudante ou pesquisador, isso é para o que Karpathy realmente construiu. Pesquisa aprofundada em dezenas de artigos, com a IA rastreando como as ideias se conectam, onde os autores discordam e quais lacunas permanecem.
*Isso também pode ser usado para muitos fluxos de trabalho de P&D empresarial.
Antes de Construirmos: O Que Você Precisa
→ Qualquer ferramenta de IA de codificação que leia arquivos locais (Claude Code, Cursor, Codex ou similar)
→ Um editor de texto (Obsidian é recomendado, mas VS Code, Notepad, qualquer um funciona)
→ 10+ documentos fonte sobre um tópico que te importa
→ 30 minutos para a configuração inicial, depois 10 minutos por fonte a partir daí
É só isso. Sem software especial. Sem contas para criar. Sem plugins para instalar.
O resto deste artigo é a construção. 7 etapas. Cada etapa tem o prompt exato que você vai colar na sua IA. Siga-os em ordem.
Etapa 1: Crie a Estrutura de Pastas (2 Minutos)
Crie isso em qualquer lugar da sua máquina:
1my-knowledge-base/2├── raw/ # Seu material de origem. A IA lê mas nunca modifica.3│ └── assets/ # Imagens, capturas de tela, diagramas4├── wiki/ # Wiki mantida pela IA. Você lê. A IA escreve.5├── outputs/ # Relatórios, análises, respostas de consultas6└── CLAUDE.md # O arquivo de esquema que faz tudo isso funcionar
Três pastas, um arquivo. Se você está gastando mais de 2 minutos aqui, está pensando demais.
Etapa 2: Escreva Seu Arquivo de Esquema (A Etapa Que Todo Mundo Pula. Não Pule.)
O esquema é a diferença entre um chatbot genérico e um mantenedor de wiki disciplinado.
Ele diz à sua IA sobre o que é a base de conhecimento, como organizá-la e o que fazer quando você adiciona fontes, faz perguntas ou executa manutenção.
Todo outro guia te dá um template de 10 linhas. Aqui está o esquema de produção completo, baseado no gist do Karpathy, projetado para uso real:
1# Esquema da Base de Conhecimento23## Identidade4Esta é uma base de conhecimento pessoal sobre [SEU TÓPICO].5Mantida por um agente LLM. O humano seleciona fontes e faz perguntas. O LLM faz todo o resto.67## Arquitetura8- raw/ contém documentos fonte imutáveis. NUNCA modifique arquivos em raw/.9- wiki/ contém a wiki compilada. O LLM é dono total deste diretório.10- outputs/ contém relatórios gerados, análises e respostas a consultas.1112## Convenções da Wiki13- Cada tópico tem seu próprio arquivo .md em wiki/14- Todo arquivo da wiki começa com frontmatter YAML:15 ---16 title: [Nome do Tópico]17 created: [Data]18 last_updated: [Data]19 source_count: [Número de fontes brutas que alimentaram esta página]20 status: [rascunho | revisado | precisa_atualizar]21 ---22- Após o frontmatter, um resumo de um parágrafo23- Use [[nome-do-topico]] para links internos entre páginas da wiki24- Cada afirmação factual cita sua fonte: [Fonte: arquivo.md]25- Quando uma nova informação contradiz o conteúdo existente, sinalize explicitamente:26 > CONTRAÇÃO: [afirmação antiga] vs [nova afirmação] de [fonte]2728## Índice e Registro29- wiki/index.md lista cada página com uma descrição de uma linha, por categoria30- wiki/log.md é um registro cronológico somente de adição31- Formato da entrada do registro: ## [AAAA-MM-DD] ação | Descrição32 (Ações: ingest, query, lint, update)3334## Fluxo de Ingestão35Ao processar uma nova fonte:361. Leia o documento fonte completo372. Discuta os principais pontos com o usuário383. Crie ou atualize uma página de resumo em wiki/394. Atualize wiki/index.md405. Atualize TODAS as páginas de entidades e conceitos relevantes em toda a wiki416. Adicione backlinks de páginas existentes para o novo conteúdo427. Sinalize quaisquer contradições com o conteúdo existente da wiki438. Acrescente entrada em wiki/log.md449. Uma única fonte deve tocar 10-15 páginas da wiki4546## Fluxo de Consulta47Ao responder a uma pergunta:481. Leia wiki/index.md primeiro para encontrar páginas relevantes492. Leia todas as páginas relevantes da wiki503. Sintetize a resposta com citações [Fonte: nome-da-pagina]514. Se a resposta revelar novos insights, ofereça para arquivá-los de volta em wiki/525. Salve respostas valiosas em outputs/5354## Fluxo de Lint (Mensal)55Verifique por:56- Contradições entre páginas57- Afirmações desatualizadas substituídas por fontes mais recentes58- Páginas órfãs sem links de entrada59- Conceitos mencionados mas nunca explicados60- Referências cruzadas faltando61- Afirmações sem atribuição de fonte62Saída: wiki/lint-report-[data].md com níveis de gravidade6364## Áreas de Foco65[Liste 3-5 tópicos que esta base de conhecimento cobre]
Copie isso. Personalize as áreas de foco. Coloque na raiz do seu projeto como CLAUDE.md.
Etapa 3: Preencha Sua Pasta Raw (10 Minutos de Despejo, Zero Organização)
Abra raw/ e despeje tudo lá:
→ Copie e cole artigos em arquivos .md ou .txt
→ Exporte anotações do aplicativo que você está usando agora
→ Salve capturas de tela e diagramas em raw/assets/
→ Cole artigos de pesquisa, PDFs, análises de concorrentes
→ Despeje favoritos que você está acumulando há meses
Não organize. Não renomeie nada. Não limpe. Esse é o trabalho da IA.
Dica profissional do Karpathy: A extensão de navegador Obsidian Web Clipper converte qualquer artigo da web em markdown com um clique.
Defina uma tecla de atalho (Configurações → Teclas de Atalho → "Download attachments") para puxar todas as imagens localmente para que a IA possa referenciá-las.
Se você não usa Obsidian, copiar e colar do seu navegador funciona bem.
O objetivo é volume. Não perfeição.
Etapa 4: Execute Sua Primeira Ingestão
Abra seu agente de IA. Aponte-o para sua pasta de projeto. Cole isto:
PROMPT DE INGESTÃO:
1"Leia o esquema em CLAUDE.md. Em seguida, processe [NOME_DO_ARQUIVO] de raw/. Leia-o completamente, discuta os principais pontos comigo, então: crie uma página de resumo em wiki/, atualize wiki/index.md, atualize todas as páginas de conceitos e entidades relevantes, adicione backlinks, sinalize quaisquer contradições e acrescente a wiki/log.md."
Comece com uma fonte de cada vez. Karpathy faz o mesmo. Leia os resumos. Verifique as atualizações. Guie a IA sobre o que enfatizar. Isso produz resultados dramaticamente melhores do que processar tudo em lote de uma vez.
Após 5-10 fontes, sua pasta wiki/ terá um índice, um registro e 15-30 páginas interconectadas.
É quando as coisas se encaixam.
Etapa 5: Comece a Consultar Sua Base de Conhecimento
Depois que você tiver 10+ páginas na wiki, o sistema se torna genuinamente útil. Cole isto:
PROMPT DE CONSULTA:
1"Leia wiki/index.md. Com base no que está na base de conhecimento, responda: [SUA PERGUNTA]. Cite quais páginas da wiki informaram sua resposta. Se isso revelar novas conexões que valem a pena preservar, crie uma nova página em wiki/ e atualize o índice."
Perguntas que extraem mais valor:
→ "Quais são as três maiores lacunas nesta base de conhecimento?"
→ "Quais fontes discordam entre si, e sobre o quê?"
→ "O que devo pesquisar a seguir com base no que está aqui?"
→ "Escreva um briefing de 500 palavras sobre [tópico] usando apenas o conteúdo da wiki"
→ "Que conexões existem entre [conceito A] e [conceito B]?"
O ciclo crítico: boas respostas devem ser arquivadas de volta na wiki.
Uma comparação, uma análise, uma conexão que você descobriu.
Elas se acumulam na base de conhecimento assim como as fontes ingeridas.
Cada pergunta torna a próxima resposta melhor.
Etapa 6: Execute Verificações de Saúde Mensais
Esta é a etapa que ninguém faz. É a etapa que impede todo o sistema de apodrecer lentamente. Cole isto:
PROMPT DE LINT:
1"Execute uma verificação de saúde completa em wiki/ de acordo com o fluxo de lint em CLAUDE.md. Gere a saída em wiki/lint-report-[data].md com níveis de gravidade (🔴 erros, 🟡 avisos, 🔵 informações). Sugira 3 artigos para preencher as maiores lacunas de conhecimento."
Por que isso importa: quando a IA escreve algo ligeiramente errado e você o salva de volta, a próxima resposta se baseia na coisa errada.
Dois meses depois, você tem cinco páginas reforçando o mesmo erro. As verificações de saúde detectam isso antes que se torne uma bola de neve.
Uma verificação por mês. Dez minutos do seu tempo. Inegociável se você quer que o sistema permaneça confiável.
Etapa 7: Deixe Acumular
É aqui que o sistema mostra seu valor.
Após 4-6 semanas de uso consistente, você não está apenas pesquisando anotações.
Você está consultando um sistema de conhecimento estruturado que entende as conexões entre suas fontes melhor do que você.
Três maneiras de acelerar o acúmulo:
Arquive saídas de exploração de volta: Quando a IA gera uma comparação ou análise que você considera valiosa, salve-a em wiki/ ou outputs/.
Karpathy diz que suas próprias explorações e consultas "sempre se somam" na base de conhecimento.
Adicione saídas visuais: Peça à IA para renderizar respostas como tabelas markdown, gráficos ou apresentações de slides (formato Marp).
Elas se tornam ativos reutilizáveis, não mensagens de chat descartáveis.
Coloque tudo sob controle de versão: Sua wiki são apenas arquivos markdown.
Inicialize um repositório git. Você terá histórico completo, ramificações e a capacidade de desfazer qualquer coisa que a IA estragar.
Ok. Essa é a construção. Agora aqui está a parte que ninguém mais vai te contar.
Onde Este Sistema Quebra (A Versão Honesta)
Este é um padrão nascente, não um produto acabado. O próprio Karpathy o chamou de "uma coleção improvisada de scripts" e disse que há espaço para um produto real.
Aqui está o que você precisa saber antes de confiar seu conhecimento a ele:
Teto do Contexto.
A wiki do Karpathy funciona com ~100 artigos e ~400K palavras. Mas mesmo janelas de contexto de 128K tokens só comportam ~96K palavras. A IA lê seletivamente através do índice, o que significa que pode perder coisas. Pesquisas mostram que LLMs sofrem com efeitos de "perdidos no meio", onde informações no centro de entradas longas são despriorizadas. Seus resultados de consulta terão pontos cegos. Aceite isso.
Acúmulo de Erros.
A IA escreve uma página da wiki com um erro sutil. Você a consulta. O erro entra na sua resposta. Você arquiva essa resposta de volta. Agora duas páginas reforçam o mesmo erro. A lintagem mensal ajuda, mas a IA que faz a lintagem tem os mesmos pontos cegos que a IA que cometeu o erro. Este é o maior risco individual. Um comentarista no gist do Karpathy acertou em cheio: "Quando as saídas são arquivadas de volta, os erros também se acumulam."
Alucinação Não Desaparece.
A abordagem da wiki reduz a alucinação porque a IA fundamenta as respostas em suas fontes. Mas não a elimina. A IA ainda pode sintetizar conexões que não existem no material de origem. E como a wiki parece autoritária (markdown limpo, referências cruzadas, citações), é mais provável que você confie em informações incorretas. Não confie.
O Custo Não é Zero.
Cada ingestão, cada consulta, cada verificação de lint custa tokens. Uma única fonte que toca 10-15 páginas pode custar $2-5 em chamadas de API com modelos de fronteira. 50 fontes são $100-250 só para ingestão. Mais barato que um assistente de pesquisa. Não é grátis.
Não Escala para Empresas.
Karpathy diz que a abordagem de arquivo de índice funciona sem RAG em ~100 artigos. Com 10.000+ fontes, este padrão quebra. O índice cresce demais. A consistência em milhares de páginas se torna impossível. Você precisará da infraestrutura que este sistema foi projetado para evitar. Conheça o teto.
Pontos Cegos de Modelo Único.
Toda a sua wiki é a interpretação de um único modelo de suas fontes. Esse modelo tem vieses e tendências. Para decisões de alto risco, um comentarista do gist sugeriu executar consultas através de 4+ modelos independentemente e depois comparar a concordância. Mais robusto. Também 4x o custo.
O Que Fazer Sobre Isso
→ Acúmulo de erros: Verificações de lint mensais. Verifique afirmações críticas manualmente. Nunca confie cegamente na wiki para decisões de alto risco.
→ Limites de contexto: Mantenha cada wiki focada em um domínio. Múltiplos domínios? Múltiplas bases de conhecimento.
→ Custo: Use modelos de fronteira para ingestão e consultas complexas. Modelos mais baratos para atualizações simples.
→ Alucinação: O esquema acima exige citações de fonte em cada afirmação. Se uma página fizer uma afirmação sem [Fonte: arquivo], a lintagem vai sinalizar.
→ Escala: Aceite que isso é uma ferramenta pessoal, não infraestrutura empresarial. Se você superá-la, esse é um bom problema.
Por Que Ainda Importa
Apesar de tudo acima, este é o sistema de conhecimento pessoal mais prático disponível agora.
A razão é muito simples: humanos abandonam wikis porque a manutenção cresce mais rápido que o valor.
Você começa a organizar, parece ótimo por duas semanas, então o esforço de manutenção mata a motivação e você nunca mais toca no assunto.
LLMs não ficam entediados. Eles não esquecem de atualizar uma referência cruzada. Eles podem tocar 15 arquivos em uma passada sem reclamar.
Lex Fridman confirmou que usa uma configuração similar.
Ele gera visualizações HTML interativas e cria "mini-bases de conhecimento" que carrega no modo de voz para corridas de 7 a 10 milhas.
Elvis Saravia, do DAIR.AI, vem construindo bases de conhecimento LLM para curadoria de pesquisa em IA.
Múltiplas implementações de código aberto apareceram no GitHub em 48 horas após o gist do Karpathy.
Isso não é mais um experimento.
Está se tornando prática padrão para qualquer pessoa que faz pesquisa séria.
Sua Biblioteca de Prompts Completa (Copie Tudo)
Todos os prompts deste artigo, coletados em um só lugar:
ESQUEMA: Copie o template completo de CLAUDE.md da Etapa 2.
INGESTÃO (uma fonte):
1"Leia o esquema em CLAUDE.md. Processe [NOME_DO_ARQUIVO] de raw/. Leia-o completamente, discuta os principais pontos comigo, então: crie página de resumo, atualize índice, atualize todas as páginas relevantes, adicione backlinks, sinalize contradições, registre a ingestão."
INGESTÃO (lote, menos supervisionada):
1"Leia CLAUDE.md. Processe todos os arquivos não processados em raw/ sequencialmente. Para cada um: crie resumo, atualize índice, atualize páginas relevantes, registre a ingestão. Proceda automaticamente."
CONSULTA:
1"Leia wiki/index.md. Responda: [PERGUNTA]. Cite páginas da wiki. Se esta resposta valer a pena ser preservada, ofereça-se para arquivá-la como uma nova página da wiki."
LINT:
1"Execute uma verificação de saúde completa em wiki/ de acordo com o fluxo de lint em CLAUDE.md. Gere a saída em wiki/lint-report-[data].md com gravidade 🔴/🟡/🔵. Sugira 3 artigos para preencher lacunas."
EXPLORE:
1"Leia wiki/index.md e identifique as 5 conexões inexploradas mais interessantes entre tópicos existentes. Para cada uma, explique que insight pode revelar e que fonte ajudaria a confirmá-la."
BRIEFING:
1"Com base em tudo em wiki/, escreva um briefing executivo de 500 palavras sobre [TÓPICO]. Cite fontes. Estruture como: estado atual, tensões principais, questões em aberto, próximos passos recomendados."
Vá Construir
A diferença entre salvar o gist do Karpathy nos favoritos e se beneficiar dele é uma tarde.
Escolha seu tópico. Crie as pastas. Copie o esquema.
Coloque o que você já tem. Execute sua primeira ingestão.
Depois faça de novo amanhã com outra fonte.
E na próxima semana com mais cinco.
A wiki fica mais inteligente a cada vez. Esse é o objetivo.
Três pastas. Um esquema.
Uma IA que faz o trabalho pesado que você nunca faria.
Pare de colecionar favoritos. Comece a compilar conhecimento.
Transforme o Claude em 20+ especialistas diferentes para marketing e negócios.
Instale expertise real, não apenas prompts.
Obtenha meu pacote de skills para Claude 👇





