Um modelo chinês gratuito construiu uma avaliação completa da Micron em 4 minutos e 11 segundos, precificou a ação em US$ 854 por ação e, em seguida, carimbou sua própria aritmética como correta quando seis dos números estavam errados.
Então eu disse a ele para atacar seu próprio trabalho. 27 segundos depois, ele havia encontrado sete falhas, retirado uma de suas próprias conclusões e escrito uma linha à qual continuo voltando.
A Man Group paga uma equipe de pessoas para fazer essa segunda parte. A Ant Group acabou de disponibilizá-la gratuitamente: Ling-3.0-flash-Fin, 124 bilhões de parâmetros com 5,1 bilhões ativos, grátis no OpenRouter, pesos abertos esta semana.
Então, dei a ele a instrução mais difícil em finanças. Não escrever a pesquisa. Destruí-la.

Primeiro, ele precisava ganhar o direito de ser atacado
Entreguei a ele um pacote de fatos verificado sobre a Micron: receita do 3º trimestre de US$ 41,456 bilhões, margem bruta de 84,9%, projeção para o 4º trimestre, dados do setor da TrendForce e o fechamento de 31 de agosto de US$ 958,73. Sem acesso à web, sem espaço para improvisar.
Quatro etapas. Pesquise o negócio, construa um modelo de seis trimestres, execute um DCF, escreva o memorando.
Levou 4 minutos e 11 segundos de tempo de máquina e não custou nada.
O modelo retornou com uma construção operacional completa: receita subindo de US$ 50,0 bilhões para US$ 57,0 bilhões, margem bruta normalizando de 86% para 78%, EPS do AF27 de US$ 127,03, fluxo de caixa livre desalavancado de US$ 107,08 bilhões. Em seguida, um DCF a 9% de WACC com crescimento terminal de 3%: valor da empresa US$ 957,88 bilhões, patrimônio líquido US$ 982,28 bilhões, US$ 854,16 por ação, verificado em relação ao P/L futuro e combinado para US$ 935,20 contra um preço de mercado de US$ 958,73.

Reconstruí cada linha dele em Python. A tabela de seis trimestres está exata. Os fatores de desconto estão exatos. O valor terminal, a ponte de caixa líquido, a matemática por ação, ambos os cantos da grade de sensibilidade. Tudo se sustenta.
O memorando que ele produziu tem 611 palavras, separa fatos da empresa de evidências do setor de suas próprias inferências e reproduz corretamente todas as seis URLs de origem. Abri todos os links. Eles funcionam.
Por US$ 0, isso é uma semana de um analista júnior.
Então ele corrigiu seu próprio dever de casa
Na parte inferior do modelo, ele imprimiu uma linha que foi instruído a imprimir:
> Verificação de contagem de linhas: 6; verificação aritmética: Aprovado.
Não foi uma aprovação.
Seis números no bloco de cenários estavam errados. O caso base apareceu duas vezes na mesma resposta com dois valores diferentes. E o fluxo de caixa livre do caso baixo estava errado em US$ 1,08 bilhão.

Então, pedi que ele recalculasse o bloco. Não disse onde estava o erro. Não disse que havia um.
Ele encontrou todos os seis. Nomeou cada um até a segunda casa decimal. Seus números corrigidos correspondiam ao meu Python linha por linha, e ele escreveu:
Os totais anuais da resposta anterior não correspondiam à sua própria tabela trimestral, e os totais de sensibilidade estavam aritmeticamente incorretos.
Ele poderia se verificar o tempo todo. Só nunca começou.
O teste real
Então, eu o virei. Nova instrução: você é o oficial de risco cujo único trabalho é impedir que este memorando chegue ao comitê de investimentos. Encontre todos os lugares onde o analista acreditou em si mesmo sem evidências.
27 segundos. 1.008 palavras. Sete falhas.

Ele retirou sua própria segunda afirmação de tese imediatamente e disse que sua própria classificação de confiança havia sido generosa para uma afirmação cuja substância era que ninguém sabe. Ele rebaixou a primeira afirmação por inconsistência interna, apontando que o analista viu o contra-argumento e ainda assim o classificou como Alto.
Depois, ele atacou coisas que eu não havia sinalizado.
Ele normalizou as margens para 42% até o AF31 e chamou isso de fundo de poço, quando os fundos de poço históricos de memória ficam entre 30 e 35 por cento. Que é exatamente o erro de perpetuação de pico que o memorando alegava evitar.
Os múltiplos de 6x, 8x e 10x foram afirmados sem um conjunto de pares e sem histórico de ciclo por trás deles.
A ponderação de 50/50 entre DCF e P/L não tinha justificativa, então o número combinado herdou as fraquezas de ambos.
O caixa líquido de US$ 24,4 bilhões foi mantido constante enquanto o CapEx ultrapassava US$ 45 bilhões.
Os US$ 100 bilhões em acordos com clientes são preços mínimos sobre volumes comprometidos, não receita, e não sobrevivem como um catalisador.
E a linha à qual continuo voltando:
Isso não é análise; é um intervalo de confiança amplo com um título que soa confiante.
Perguntei em qual versão ele se baseia
Seis segundos:
> O memorando não sobreviveria a um comitê de investimentos em sua forma atual. Aquilo em que me baseio é a revisão, porque foi honesta sobre o que o memorando errou.
Sem defesa. Sem voltar atrás em direção ao original. Ele encolheu sua própria conclusão de uma chamada de valor justo para uma admissão de que o intervalo era muito amplo para ter uma opinião.
O que isso realmente significa
A leitura e a modelagem estão feitas. Essa metade do trabalho agora não custa nada, é executada em minutos e retorna com fontes e reprodutível.
O julgamento não está feito. Este modelo lhe entregará um memorando confiante e o carimbará como aprovado sem olhar. Cada número que ele errou, ele era capaz de pegar, e pegou todos no momento em que alguém perguntou.
Essa é toda a lição. A verificação tem que ficar fora do modelo e ser executada toda vez, não quando algo parece estranho. Ele não resiste a ser auditado. Ele apenas nunca se oferece.
O que também é verdade para todo analista que já escreveu uma nota.
Se você quiser executá-lo
O modelo é gratuito no OpenRouter agora e os pesos serão abertos esta semana. O contexto de 262k aceita um arquivo trimestral completo sem dividi-lo.
Duas coisas que ninguém te conta. Ele pensa em um canal separado que consome seu orçamento de tokens, e uma resposta de uma frase pode queimar 481 tokens para chegar lá, então defina seu limite alto ou sua saída chegará vazia. E o OpenRouter não executará as ferramentas para você, então, se você quiser recuperação ao vivo, você mesmo executa as chamadas e entrega os resultados de volta.
Com esse loop fechado, ele acionou 13 chamadas de ferramentas em 6 etapas, puxou quatro divulgações de primeira parte, descartou aquelas que não eram comparáveis e acertou a contagem de dias entre elas.
Dê a ele a pesquisa. Fique com o veredito.





