Guia de IA para Iniciantes: 66 Termos de IA de Alta Frequência Explicados em Linguagem Simples

@AdrianPunk115
CHINÊS30 de ago. de 2026
137K
522
91
18
1.1K

TL;DR

Este artigo detalha 66 termos comuns de IA em uma linguagem simples e cotidiana, ajudando iniciantes a navegar por conceitos como LLMs, Agentes, RAG e MCP com facilidade.

Recentemente, tenho me reunido com ex-colegas e amigos pessoalmente. Sabendo que trabalho com conteúdo de IA, todos ficam muito interessados, e nossas conversas naturalmente giram em torno da IA.

Mas, enquanto conversávamos, notei um problema.

Eu naturalmente mencionava termos como Agent, Skill e MCP, assumindo que todos já tinham ouvido falar. No entanto, a pessoa do outro lado parava e perguntava: "O que é exatamente um Agent?" "O que significa Skill?"

Naquele momento, percebi que havia caído na "maldição do conhecimento". Quando você vê e usa uma palavra demais, esquece que também ficou confuso na primeira vez que a viu.

Há alguns meses, eu também estava sobrecarregado com essas abreviações em inglês. Durante esse período, publiquei "Noções Básicas Diárias de IA para Iniciantes", aprendendo uma palavra por dia durante quase 30 dias, examinando um a um um lote de vocabulário de IA comumente usado.

Com cada vez mais pessoas perguntando ultimamente, decidi tornar isso ainda mais completo.

Compilei 66 termos de IA que considero de alta frequência e os expliquei em linguagem simples. Para cada palavra, vou te contar: o que é, onde você vai encontrá-la e qual cenário da vida real torna mais fácil lembrar.

Você não precisa memorizar tudo de uma vez. Apenas leia uma vez para que, da próxima vez que vir LLM, RAG, Agent, MCP, API ou CLI, você pelo menos saiba aproximadamente onde eles se encaixam no mundo da IA.

Adrian Punk - inline image

I. Entendendo Primeiro a IA e os Modelos Grandes

Este grupo responde a duas perguntas: O que é IA, e o que os Modelos de Linguagem Grandes processam quando falam? Depois de entender este mapa, os termos a seguir serão muito mais fáceis.

IA é fazer com que máquinas realizem tarefas que geralmente exigem compreensão, julgamento, previsão ou criação humana. Desbloqueio facial em celulares, previsão de trânsito em mapas, recomendações de vídeo em plataformas e chatbots respondendo perguntas, tudo isso pertence à IA. É um termo amplo e abrangente; ferramentas de chat são apenas um tipo de aplicação.

Um algoritmo é um conjunto claro de etapas para resolver um problema, muito parecido com uma receita. Uma receita determina cortar os vegetais primeiro, depois aquecer a panela e, finalmente, temperar; um algoritmo determina o que o computador lê primeiro, como ele compara e, finalmente, o que ele produz. Muitos algoritmos tradicionais não conseguem conversar; algoritmos de IA são apenas uma parte da família de algoritmos.

PNL é o campo técnico que permite que computadores processem a linguagem humana. Tradução, resumo, pesquisa, fala para texto e conversas estão todos relacionados a ele. Quando você insere uma pergunta coloquial e a IA entende o significado geral e responde, ela está usando capacidades de processamento de linguagem natural.

Adrian Punk - inline image

LLMs são modelos de linguagem treinados com quantidades massivas de texto e computação, especializados em entender e gerar texto. Modelos ou famílias de modelos comuns incluem o GPT da OpenAI, o Claude da Anthropic, o Gemini do Google, bem como DeepSeek e Qwen. É importante distinguir entre o produto e o modelo: ChatGPT é o produto que você abre e usa, enquanto GPT é a família de modelos que ele pode chamar nos bastidores.

SLMs são modelos de linguagem com tamanhos menores e requisitos computacionais mais baixos. Atualmente, não há um limite de parâmetros globalmente unificado. Exemplos comuns incluem a série Phi da Microsoft e as versões de parâmetros pequenos de famílias de modelos como Gemma e Qwen. Seu alcance de conhecimento pode ser mais restrito, mas para tarefas fixas como resumo, classificação ou assistentes em dispositivos, eles podem ser mais rápidos, mais baratos e mais fáceis de executar em celulares ou computadores padrão.

Adrian Punk - inline image

Tokens são os pequenos blocos que os modelos usam ao ler e escrever texto. Eles não são exatamente iguais a um caractere chinês, uma palavra em inglês ou um sinal de pontuação. O modelo divide uma frase em muitos tokens antes de calcular. A cobrança e a capacidade de contexto também são frequentemente contadas por tokens. Pense neles como os "blocos de construção" que a IA usa para processar texto.

Contexto é toda a informação que a IA pode consultar atualmente, incluindo sua pergunta, diálogo anterior, arquivos enviados, regras do sistema e resultados de ferramentas. Como uma consulta médica, a mesma frase "Não me sinto bem" levará a julgamentos diferentes dependendo se há idade, sintomas e relatórios de exames. Quanto mais claro o contexto fornecido à IA, mais fundamentada será sua resposta.

A janela de contexto é a quantidade máxima de informação que um modelo pode processar de uma vez, geralmente expressa em tokens. É como uma mesa de tamanho limitado: há um limite de quantos documentos podem ser espalhados de uma vez. Quando o conteúdo excede isso, o sistema precisa truncar, resumir, processar em lotes ou deixar que as informações anteriores saiam da janela.

O comprimento do contexto geralmente tem dois significados: os tokens máximos que um modelo permite, ou os tokens reais usados em uma solicitação específica. O primeiro é como a área máxima da mesa; o segundo é como os documentos que você realmente espalhou desta vez. Quando os produtos anunciam "contexto ultralongo", geralmente estão se referindo à capacidade máxima.

Adrian Punk - inline image

MLLMs podem processar informações além de texto, como imagens, áudio ou vídeo. Se você der a ele uma foto de uma geladeira, ele pode ver os ingredientes e recomendar o jantar com base em requisitos de texto; se você enviar uma gravação de reunião, ele pode organizar os pontos-chave após ouvir. "Multimodal" aqui se refere a múltiplas formas de informação.

VLM conecta especificamente visão e linguagem, lidando principalmente com tarefas como "olhar para uma imagem e entender ou responder com texto". Ele pode escrever legendas para fotos, identificar conteúdo de gráficos ou encontrar botões com base em capturas de tela. VLM enfatiza a coordenação de visão e linguagem, e seu escopo geralmente é mais específico do que o termo geral modelo multimodal.

MoE organiza múltiplos conjuntos de "especialistas" dentro do modelo, permitindo que apenas uma parte deles participe dos cálculos de cada vez. É como uma triagem de hospital: problemas de pele vão para a dermatologia, lesões ósseas vão para a ortopedia, em vez de ter todos os médicos consultando ao mesmo tempo. Isso expande a capacidade do modelo enquanto controla a computação necessária para cada execução.

Adrian Punk - inline image

Depois de ler este grupo, você só precisa distinguir: LLM lida principalmente com linguagem, VLM conecta imagens e linguagem, e MLLM pode lidar com múltiplos tipos de informação. Tokens são blocos de texto, e Contexto é o material que o modelo pode consultar desta vez.

II. Termos Mais Comuns ao Conversar com IA

Este grupo é usado todos os dias. Os prompts são responsáveis por atribuir tarefas, o contexto fornece materiais e a IA gera respostas com base nessas informações.

Um prompt é toda a entrada que você dá à IA, que pode ser uma frase, uma pergunta, um documento ou uma imagem. "Resuma este contrato em cinco riscos" é um prompt. Prompts não precisam ser escritos como feitiços mágicos; desde que o objetivo, os materiais, as restrições e os requisitos de saída estejam claros, é mais provável que a IA acerte.

Engenharia de prompt é o método de projetar, testar e melhorar prompts. É muito parecido com atribuir trabalho a um colega: se o primeiro resultado estiver errado, você verifica se a tarefa estava clara, se os materiais estavam completos e se o formato foi especificado, e então ajusta as instruções. Seu valor está em reduzir erros de comunicação e retrabalho.

Um prompt de sistema é um conjunto de regras de alta prioridade definido nos bastidores de uma aplicação de IA para definir identidade, tom, alcance de capacidade e limites de segurança. É como o manual do funcionário de uma empresa; os usuários geralmente não veem tudo. Se sua solicitação entrar em conflito com as regras do sistema, o modelo geralmente priorizará o prompt de sistema.

Um prompt de usuário é o requisito atual inserido pelo usuário — o conteúdo que você envia na caixa de chat. O prompt de sistema é como as regras operacionais da loja, enquanto o prompt de usuário é como "Por favor, me dê uma bebida quente com menos açúcar". Ambos afetam o resultado, e é por isso que a mesma frase em diferentes produtos de IA pode gerar respostas diferentes.

Uma instrução é uma ação clara que você pede para a IA executar dentro de um prompt, como resumir, traduzir, comparar, classificar ou verificar. Um prompt completo também pode incluir informações de contexto e restrições. Por exemplo, "Leia o e-mail abaixo, extraia a data e não adicione informações que não estão no texto original" contém duas instruções.

Adrian Punk - inline image

Markdown é um formato para diagramar texto usando símbolos simples.

  • # pode representar um cabeçalho,
  • - pode representar uma lista,
  • \\texto\\ pode representar negrito.

Muitas saídas de IA parecem claramente estratificadas porque usam Markdown; você o encontrará frequentemente ao escrever artigos, documentos ou descrições de projetos.

JSON é um formato de dados estruturados comumente usado por programas, geralmente consistindo em chaves, nomes de campos e conteúdo correspondente. É como uma planilha eletrônica com campos fixos que os humanos podem ler e os programas podem processar facilmente. Pedir para a IA "gerar em JSON" geralmente é para permitir que outro software use os resultados automaticamente.

Adrian Punk - inline image

Histórico de conversa refere-se às mensagens que apareceram anteriormente no chat atual. A IA pode continuar um tópico de cinco minutos atrás geralmente porque a aplicação reenvia os registros de chat anteriores para o modelo. Depois que um chat fica muito longo, o conteúdo inicial pode ser truncado ou resumido, então a IA às vezes esquece o que você disse no início.

Alucinação é quando a IA gera conteúdo que parece razoável, mas na verdade está errado ou não existe, como inventar títulos de livros, links, dados ou experiências pessoais. É como uma pessoa com ótimas habilidades linguísticas que se recusa a admitir que "não sabe" e preenche as lacunas. Sempre verifique as fontes originais para datas, números, citações e decisões importantes.

Adrian Punk - inline image

As coisas mais importantes para lembrar deste grupo: Prompt determina como você pergunta, Contexto determina o que a IA pode consultar, e Alucinação lembra que as respostas ainda precisam de verificação.

III. Deixando a IA Ler Dados: RAG e Pesquisa

Quando você vê "deixar a IA ler arquivos da empresa" ou "construir uma base de conhecimento pessoal", provavelmente encontrará este grupo de palavras. Todo o caminho é apenas uma frase: primeiro encontre materiais relevantes, depois deixe o modelo responder.

RAG permite que a IA pesquise conteúdo relevante em materiais especificados antes de responder, e então entrega os trechos encontrados ao modelo para organizar a resposta. É como uma prova com consulta: o aluno folheia o livro primeiro, depois responde com base nele. RAG pode reduzir a fabricação, mas também pode pesquisar os materiais errados, então as citações ainda precisam de verificação humana.

Uma base de conhecimento é uma coleção de materiais armazenados centralmente, organizados e disponíveis para consultas do sistema. Os manuais de produtos, documentos de políticas e FAQs de uma empresa juntos podem se tornar uma base de conhecimento de atendimento ao cliente; as anotações, artigos e registros de leitura de uma pessoa também podem formar uma base de conhecimento. Se os materiais são precisos e atualizados afeta diretamente a qualidade da resposta.

Recuperação é encontrar o conteúdo mais relevante de um grande lote de materiais. Um bibliotecário ouvindo sua pergunta e trazendo os três livros mais adequados de dezenas de milhares é recuperação. Em RAG, o modelo geralmente não lê todo o banco de dados primeiro, mas recupera alguns trechos para responder.

Adrian Punk - inline image

Pesquisa por palavra-chave procura principalmente se certas palavras aparecem diretamente. Se você pesquisar "prazo de reembolso", ele priorizará encontrar conteúdo contendo "reembolso" e "prazo". Este método é rápido e bom para verificar números de produtos, nomes e termos fixos; pode perder respostas se o estilo da pergunta e a redação original diferirem significativamente.

Pesquisa semântica foca mais em se o significado de duas passagens está próximo. Se você pesquisar "Não quero mais isso, como devolver", ele também pode encontrar um documento intitulado "Política de Devolução". É adequado para perguntas em linguagem natural, mas a compreensão pode desviar, então cenários importantes geralmente combinam com pesquisa por palavra-chave.

Pesquisa híbrida usa pesquisa por palavra-chave e pesquisa semântica juntas. Números de ID e números de contrato são adequados para correspondência exata; "como solicitar reembolso" precisa de compreensão de significado. Os resultados de ambos são mesclados e classificados, considerando tanto a consistência literal quanto o significado semelhante, um método que muitos sistemas RAG adotam.

Adrian Punk - inline image

IV. Agent, Ferramentas e MCP

Este é o grupo de palavras mais popular e frequentemente mais confuso ultimamente. Agent, Skill e MCP, que mencionei mais ao conversar com amigos, estão todos neste capítulo.

Primeiro, veja o caminho mais curto:

text
1Você propõe um objetivo
2→ Agent decide o próximo passo
3→ Chama ferramentas para ler dados ou executar ações
4→ Continua processando com base nos resultados
5→ Humano verifica as etapas principais

Um chatbot é um software que responde principalmente a perguntas através de diálogo. Chatbots antigos podem responder apenas com base em palavras-chave fixas; agora muitos chatbots se conectam a modelos grandes para respostas mais naturais. Seu foco permanece "você pergunta, ele responde", e geralmente não completa de forma independente uma longa sequência de operações externas.

Um Assistente de IA ou Copiloto é um produto de IA que ajuda pessoas a completar tarefas, como auxiliar na escrita, organizar reuniões, fazer planilhas ou programar. A metáfora do "copiloto" é fácil de lembrar: ele pode observar, lembrar e ajudar, mas o volante ainda está nas mãos do humano, e o resultado final precisa de verificação humana.

Adrian Punk - inline image

Um fluxo de trabalho é um conjunto pré-arranjado de etapas fixas. Após receber uma fatura, identificar o valor primeiro, depois escrevê-lo em uma tabela e, finalmente, notificar o financeiro é um fluxo de trabalho. Cada etapa geralmente é determinada antecipadamente, tornando-o estável e fácil de verificar; ele não decidirá flexivelmente o próximo passo como um Agent ao encontrar situações não planejadas.

Um Agente de IA é um sistema que pode decidir o próximo passo em torno de um objetivo, chamar ferramentas, observar resultados e continuar agindo. Um chat normal te dirá como comprar um ingresso; um Agent pode abrir um serviço de reserva, consultar voos e preencher informações dentro dos limites autorizados. Ele pode agir, então permissões, erros e confirmação humana são muito importantes.

Adrian Punk - inline image

IA Agentic refere-se a uma classe de sistemas ou abordagens de design que enfatizam a capacidade da IA de planejar continuamente, usar ferramentas e executar tarefas de várias etapas. O escopo deste termo é amplo, e diferentes empresas usam nomes diferentes. Quando você vê um produto rotulado como "Agentic", pode continuar perguntando três coisas: que ferramentas ele pode usar, quantas etapas pode realizar sozinho e onde um humano deve confirmar.

Autonomia refere-se ao grau em que um sistema pode decidir e agir por conta própria sem direção humana passo a passo. Organizar automaticamente uma cópia de um arquivo tem baixa autonomia e risco; enviar e-mails automaticamente, fazer pagamentos ou excluir dados aumenta significativamente o risco. Quanto mais importante a tarefa, mais as permissões devem ser restritas e os pontos de confirmação adicionados.

Planejamento é dividir um objetivo em etapas que podem ser executadas em sequência. Como preparar uma viagem, primeiro confirmando as datas, depois verificando o transporte, reservando acomodação e fazendo uma lista de mala. Agents também planejam ao encontrar tarefas complexas; um plano bonito não garante execução bem-sucedida, e cada etapa concluída requer verificação dos resultados reais.

Uma ferramenta é uma capacidade externa que a IA pode chamar, como pesquisa na web, calculadora, banco de dados, calendário e e-mail. O modelo em si é mais como o cérebro responsável pelo julgamento; as ferramentas dão a ele mãos e olhos. Sem ferramentas, o modelo só pode responder com base no contexto existente; após conectar ferramentas, ele tem a chance de consultar e agir.

Chamada de ferramenta é quando o modelo seleciona uma ferramenta de acordo com formatos especificados e preenche os parâmetros necessários, que o programa então executa e retorna o resultado ao modelo. É como um gerente preenchendo uma ordem de serviço para um funcionário operar. O modelo é responsável por julgar "o que chamar", e o código específico é responsável por completar a consulta, cálculo ou escrita.

Adrian Punk - inline image

Um plugin é um pacote de extensão instalado em um software para adicionar funcionalidade. Um navegador pode traduzir páginas da web após instalar um plugin de tradução; uma aplicação de IA pode se conectar a arquivos, calendários ou serviços de terceiros após instalar um plugin. Plugins geralmente dependem de produtos específicos, e o que eles podem fazer depende das interfaces e permissões fornecidas pelo produto.

Uma skill é um conjunto de instruções, scripts e recursos reutilizáveis que ensinam um Agent a completar de forma estável um certo tipo de tarefa. É como um manual operacional padrão para um funcionário: quais materiais ler primeiro, quais etapas seguir e como verificar os resultados estão todos claramente escritos. Um prompt geralmente resolve uma tarefa única, enquanto uma skill é mais adequada para executar repetidamente o mesmo tipo de trabalho.

MCP é um protocolo aberto que permite que aplicações de IA se conectem a dados e ferramentas externas. A melhor metáfora é o USB-C do mundo da IA: no passado, cada ferramenta precisava ser adaptada individualmente; agora elas podem fornecer capacidades de acordo com o mesmo padrão de conexão. Ele resolve "como conectar", mas não decide os objetivos da tarefa para o Agent.

Um Host MCP é a aplicação de IA que o usuário realmente usa, como um assistente de desktop, editor de código ou plataforma de Agent. Ele é responsável por gerenciar usuários, modelos, permissões de segurança e múltiplas conexões. Pense no Host como um computador: é o ambiente de uso completo e onde o Cliente MCP reside.

O Cliente MCP está localizado dentro do Host e é responsável por estabelecer e manter a comunicação com um Servidor MCP específico. Ele descobre quais ferramentas e materiais o Servidor fornece e envia solicitações de chamada. Como um computador conectando-se a uma impressora, um canal de comunicação dedicado é necessário internamente para gerenciar essa conexão.

Um Servidor MCP é um programa que fornece ferramentas, materiais ou modelos de prompt para aplicações de IA de acordo com as especificações MCP. Ter "Servidor" no nome não significa que ele deve estar longe; ele também pode ser executado no seu computador. Por exemplo, um Servidor de arquivos local pode deixar a IA ler arquivos em diretórios autorizados.

Adrian Punk - inline image

Uma Ferramenta MCP é uma ação específica que o Servidor fornece para a IA solicitar execução, como consultar o clima, criar uma agenda, ler um banco de dados ou enviar uma mensagem. Cada Ferramenta especifica quais parâmetros são necessários. Ações de consulta têm menor risco, enquanto enviar, excluir ou pagar devem ter permissões e confirmação claras.

Um Recurso MCP é o conteúdo fornecido através de MCP para a IA ler, como arquivos, registros de banco de dados, estruturas de projeto ou estados de aplicação. É mais como materiais colocados em uma mesa, enquanto uma Ferramenta é mais como um botão que pode ser pressionado. Se um recurso pode ser lido ainda depende das permissões de acesso definidas pelo Host e Servidor.

Um Prompt MCP é um modelo de prompt reutilizável fornecido pelo Servidor para ajudar os usuários a iniciar tarefas de forma fixa. É como um modelo de tabela pré-instalado, organizando os campos e a estrutura da tarefa a serem preenchidos. Ele não executa ações automaticamente; ainda precisa ser selecionado pelo usuário e processado pelo modelo.

Adrian Punk - inline image

Memória é a informação que o sistema salva e reutiliza mais tarde, que pode incluir resumos de chat atuais, preferências do usuário, tarefas de histórico e dados de longo prazo. Quando uma IA "se lembra de você", geralmente significa que essa informação é armazenada e fornecida ao modelo novamente em diálogos subsequentes. A memória afeta a experiência e também requer atenção à privacidade e aos métodos de exclusão.

Adrian Punk - inline image

Humano no loop significa que as etapas principais devem ser verificadas, selecionadas ou aprovadas por uma pessoa. A IA pode organizar uma lista de reembolso e preencher rascunhos, mas a transferência real é confirmada pelo financeiro. Isso utiliza a velocidade da IA enquanto evita consequências irreparáveis causadas por informações incompletas ou julgamento errado.

Adrian Punk - inline image

Multi-agente é deixar vários Agents colaborarem, por exemplo, um recuperando dados, um redigindo um artigo e um verificando citações. É como uma equipe de projeto; quando a divisão de trabalho é razoável, eles podem lidar com tarefas complexas em paralelo. No entanto, mais membros também aumentam a comunicação, o trabalho redundante e a propagação de erros, então mais Agents nem sempre é melhor.

A2A refere-se ao método de comunicação entre Agents para trocar tarefas, status e resultados. MCP foca mais em como Agents se conectam a ferramentas e dados, enquanto A2A foca mais em como um Agent passa uma tarefa para outro. Pense no primeiro como "conectar dispositivos" e no último como "passar o trabalho entre colegas".

Adrian Punk - inline image

Computer Use é deixar a IA operar software observando a tela, movendo o mouse, clicando e digitando. É como um operador remoto que pode usar aplicações web e de desktop sem APIs dedicadas. Mudanças na interface podem fazer com que ele clique no lugar errado; a confirmação humana é obrigatória para pagamentos, exclusões e mensagens de saída.

Uma sandbox é um ambiente isolado que limita o alcance da atividade de um programa. É como um cercado de areia para uma criança brincar; elas podem experimentar coisas, e se algo der errado, não afetará arquivos importantes ou o sistema. Ao deixar um Agent executar código, baixar arquivos ou modificar projetos, uma sandbox reduz o alcance do impacto, mas não substitui todas as verificações de segurança.

Adrian Punk - inline image

Lembre-se apenas de uma frase para este capítulo: Agent é responsável por decidir e agir, Tool fornece capacidades específicas, Skill ensina como fazer, e MCP é responsável por conectar a IA com capacidades externas.

V. Termos de Computador que Você Encontrará em Tutoriais de IA

Estas palavras não foram todas inventadas pelo campo da IA, mas aparecem frequentemente ao aprender sobre Agents, automação e modelos locais. Se você conseguir entendê-las, muitos tutoriais não parecerão uma língua estrangeira.

API é um ponto de entrada para software se comunicar de acordo com um acordo. Você não precisa invadir a cozinha de um restaurante; você apenas pede através de um garçom. API é como o garçom do mundo do software, levando seu pedido para o back-end e trazendo o resultado de volta. Aplicativos de clima, serviços de pagamento e modelos grandes podem ser chamados por outros programas através de APIs.

Uma Chave de API é uma credencial secreta usada quando um programa acessa um serviço, usada para identificar quem está chamando e frequentemente conectada a limites de uso e cobrança. É como o PIN de um cartão bancário; qualquer um que obtê-la pode consumir seu crédito. Não coloque Chaves completas em código público, capturas de tela, tutoriais ou chats em grupo.

SDK é uma coleção de código, instruções, exemplos e ferramentas comumente usados ao desenvolver aplicações para uma plataforma. Enquanto uma API te diz "como pedir", um SDK prepara o menu, os utensílios e os pratos de demonstração, poupando os desenvolvedores de escrever muito código básico. Diferentes linguagens de programação geralmente têm seus próprios SDKs.

Adrian Punk - inline image

CLI é uma interface para operar um computador digitando comandos de texto. Uma interface gráfica permite que você clique em "Nova Pasta", enquanto uma CLI permite que você digite uma linha de comando para fazer o mesmo. Parece uma janela preta, mas na verdade é apenas outra forma de operar; a instalação e execução de ferramentas de IA de código aberto frequentemente usam CLI.

Um terminal é a janela onde comandos são exibidos e inseridos, como o "Terminal" no Mac ou o Windows Terminal. Pense nele como uma janela de chat entre você e o computador, onde os comandos CLI são as mensagens enviadas ao computador. O terminal é a janela, a CLI é o método de operar por texto; os dois geralmente aparecem juntos.

Adrian Punk - inline image

Um repositório, muitas vezes abreviado como Repo, é um local onde os arquivos do projeto e o histórico de modificações são salvos centralizadamente. É como uma pasta de projeto com registros de versão, onde código, instruções, imagens e configurações podem ser colocados. Quando alguém diz "clone o Repo", geralmente significa copiar este projeto e seu histórico para o seu próprio computador.

Git é uma ferramenta para registrar mudanças nas versões de arquivos. Ela pode te dizer qual conteúdo foi modificado e por quem, e pode manter versões de diferentes estágios. É como salvar cada revisão ao escrever um artigo, mas de forma mais sistemática. O Git funciona localmente e não precisa estar online o tempo todo, e não é a mesma coisa que GitHub.

GitHub é um site para hospedar repositórios Git e apoiar a colaboração de várias pessoas. Desenvolvedores publicam código, escrevem instruções, reportam problemas e modificam projetos em conjunto nele. Git é a ferramenta de gerenciamento de versão, e GitHub é a plataforma que fornece hospedagem online e colaboração; ao aprender ferramentas de IA de código aberto, você geralmente começa com um link do GitHub.

Adrian Punk - inline image

Não fique nervoso na primeira vez que vir a CLI. Antes de copiar um comando, verifique se ele vai ler, modificar, deletar ou fazer upload de algo, e pratique com uma cópia quando envolver arquivos importantes.

VI. Termos Comuns para Modelos e Hardware Locais

Você só precisa olhar atentamente para este grupo de palavras quando estiver pronto para rodar modelos no seu próprio computador. Se você geralmente usa produtos de IA online, saber o significado geral é suficiente.

Implantação local é rodar um modelo ou programa no seu próprio computador, celular ou máquina da empresa. Os dados passam por menos serviços externos e podem ser usados offline; no entanto, a instalação, atualizações, desempenho e segurança devem ser tratados por você mesmo. É adequado para quem valoriza o controle dos dados ou precisa de um ambiente fixo, mas não significa que seja naturalmente absolutamente seguro.

Uma API em nuvem é quando o modelo roda no servidor remoto de um provedor de serviços, e os usuários enviam requisições e recebem resultados pela rede. É como ir a um restaurante e pedir; você não precisa comprar o fogão e os ingredientes, facilitando o início; ao mesmo tempo, é afetado pela rede, preço, limites de chamadas, regras da plataforma e políticas de dados.

Código aberto geralmente significa que o código fonte é público sob uma determinada licença, permitindo que outros o visualizem, modifiquem e distribuam dentro do escopo permitido pela licença. Download público não significa que pode ser usado comercialmente à vontade; licenças diferentes têm requisitos muito diferentes. Quando você vê "IA de Código Aberto", ainda precisa ver quais partes do código, dados e pesos estão realmente abertos.

Pesos abertos significa que os parâmetros após o treinamento do modelo podem ser baixados, dando aos usuários a chance de executá-los ou ajustá-los ainda mais em seus próprios dispositivos. Dados de treinamento, código de treinamento completo e direitos comerciais não estão necessariamente abertos ao mesmo tempo. Portanto, pesos abertos e código aberto completo são duas coisas diferentes; como podem ser usados especificamente depende da licença do modelo.

Adrian Punk - inline image

GPUs eram originalmente boas para processar gráficos e também são muito adequadas para completar grandes quantidades de cálculos semelhantes simultaneamente, por isso são amplamente usadas para treinar e rodar modelos de IA. É como um grande grupo de pessoas que podem resolver problemas em paralelo. Ao comprar um computador para rodar modelos locais, o modelo da GPU e o tamanho da memória de vídeo geralmente são mais importantes do que em cenários normais de escritório.

VRAM é a memória de alta velocidade usada pela própria GPU, onde os pesos do modelo e os dados intermediários precisam ser colocados durante a operação. O modelo é como um grande conjunto de blocos de montar, e a VRAM é como a mesa; se a mesa for muito pequena, os blocos não cabem, e o modelo pode falhar ao carregar ou exigir métodos mais lentos e que economizam espaço.

Adrian Punk - inline image

O 7B ou 70B nos nomes dos modelos geralmente representa aproximadamente 7 bilhões ou 70 bilhões de parâmetros. Parâmetros podem ser entendidos como a enorme quantidade de números internos que o modelo aprendeu após o treinamento. Números maiores geralmente significam mais memória e recursos de cálculo; isso não significa diretamente capacidade mais forte, pois a qualidade do treinamento e as tarefas específicas são igualmente importantes.

VII. Se Você Só Lembrar de 10 Palavras

Você não precisa memorizar 66 palavras. Após ler pela primeira vez, lembre-se destas 10 primeiro:

  • IA: Fazer máquinas lidarem com tarefas que exigem compreensão, julgamento, previsão ou criação.
  • LLM: Grandes modelos responsáveis por entender e gerar linguagem.
  • Token: Pequenos pedaços usados pelos modelos ao ler e escrever texto.
  • Contexto: Informação que o modelo pode consultar desta vez.
  • Prompt: Requisitos e materiais que você dá para a IA.
  • Alucinação: IA fazendo conteúdo errado soar muito real.
  • RAG: Recuperar de materiais especificados primeiro, depois organizar a resposta.
  • Agente: Um sistema que pode continuamente decidir e agir em torno de um objetivo.
  • MCP: Um protocolo aberto conectando IA com dados e ferramentas externas.
  • CLI: Uma interface para operar um computador via comandos de texto.

Há alguns meses, eu também comecei entendendo uma palavra por dia. Você não precisa lembrar de todas as 66 palavras hoje; desde que uma imagem geral apareça na sua mente na próxima vez que você vir Agente, Skill ou MCP, este dicionário já cumpriu seu propósito.

No futuro, quando encontrar uma abreviação estranha, você pode primeiro perguntar a qual categoria ela pertence: Modelo, Diálogo, Dados, Agente, Interface ou Hardware? Se você conseguir colocar a palavra de volta nestas seis gavetas, a maioria dos artigos sobre IA ficará muito mais fácil de ler.

Sobre o Autor

Adrian Punk - inline image
Recriar no YouMind

Turn one viral article into a full content workflow

Collect the source, decode the pattern, create assets, draft the story, and distribute from one AI workspace.

Explore YouMind
Para criadores

Transforme seu Markdown em um artigo 𝕏 impecável

Quando você publica seus próprios textos longos, formatar imagens, tabelas e blocos de código para o 𝕏 é uma dor de cabeça. O YouMind transforma um rascunho completo em Markdown em um artigo 𝕏 impecável e pronto para publicar.

Experimente Markdown para 𝕏

Mais padrões para decifrar

Artigos virais recentes

Explorar mais artigos virais