O Man Group gasta milhões verificando suas próprias operações. Uma nova IA chinesa acaba de tornar isso gratuito.

@antpalkin
INGLÊS05/09/2026
214K
32
2
2
28

TL;DR

O modelo Ling-3.0-flash-Fin do Ant Group pode criar avaliações financeiras complexas em minutos e, quando solicitado a auditar a si mesmo, identifica seus próprios erros aritméticos e lógicos.

Um modelo chinês gratuito construiu uma avaliação completa da Micron em 4 minutos e 11 segundos, precificou a ação em US$ 854 por ação e, em seguida, carimbou sua própria aritmética como correta quando seis dos números estavam errados.

Então eu disse a ele para atacar seu próprio trabalho. 27 segundos depois, ele havia encontrado sete falhas, retirado uma de suas próprias conclusões e escrito uma linha à qual continuo voltando.

A Man Group paga uma equipe de pessoas para fazer essa segunda parte. A Ant Group acabou de disponibilizá-la gratuitamente: Ling-3.0-flash-Fin, 124 bilhões de parâmetros com 5,1 bilhões ativos, grátis no OpenRouter, pesos abertos esta semana.

Então, dei a ele a instrução mais difícil em finanças. Não escrever a pesquisa. Destruí-la.

cvxv666 - inline image

Primeiro, ele precisava ganhar o direito de ser atacado

Entreguei a ele um pacote de fatos verificado sobre a Micron: receita do 3º trimestre de US$ 41,456 bilhões, margem bruta de 84,9%, projeção para o 4º trimestre, dados do setor da TrendForce e o fechamento de 31 de agosto de US$ 958,73. Sem acesso à web, sem espaço para improvisar.

Quatro etapas. Pesquise o negócio, construa um modelo de seis trimestres, execute um DCF, escreva o memorando.

Levou 4 minutos e 11 segundos de tempo de máquina e não custou nada.

O modelo retornou com uma construção operacional completa: receita subindo de US$ 50,0 bilhões para US$ 57,0 bilhões, margem bruta normalizando de 86% para 78%, EPS do AF27 de US$ 127,03, fluxo de caixa livre desalavancado de US$ 107,08 bilhões. Em seguida, um DCF a 9% de WACC com crescimento terminal de 3%: valor da empresa US$ 957,88 bilhões, patrimônio líquido US$ 982,28 bilhões, US$ 854,16 por ação, verificado em relação ao P/L futuro e combinado para US$ 935,20 contra um preço de mercado de US$ 958,73.

cvxv666 - inline image

Reconstruí cada linha dele em Python. A tabela de seis trimestres está exata. Os fatores de desconto estão exatos. O valor terminal, a ponte de caixa líquido, a matemática por ação, ambos os cantos da grade de sensibilidade. Tudo se sustenta.

O memorando que ele produziu tem 611 palavras, separa fatos da empresa de evidências do setor de suas próprias inferências e reproduz corretamente todas as seis URLs de origem. Abri todos os links. Eles funcionam.

Por US$ 0, isso é uma semana de um analista júnior.

Então ele corrigiu seu próprio dever de casa

Na parte inferior do modelo, ele imprimiu uma linha que foi instruído a imprimir:

> Verificação de contagem de linhas: 6; verificação aritmética: Aprovado.

Não foi uma aprovação.

Seis números no bloco de cenários estavam errados. O caso base apareceu duas vezes na mesma resposta com dois valores diferentes. E o fluxo de caixa livre do caso baixo estava errado em US$ 1,08 bilhão.

cvxv666 - inline image

Então, pedi que ele recalculasse o bloco. Não disse onde estava o erro. Não disse que havia um.

Ele encontrou todos os seis. Nomeou cada um até a segunda casa decimal. Seus números corrigidos correspondiam ao meu Python linha por linha, e ele escreveu:

Os totais anuais da resposta anterior não correspondiam à sua própria tabela trimestral, e os totais de sensibilidade estavam aritmeticamente incorretos.

Ele poderia se verificar o tempo todo. Só nunca começou.

O teste real

Então, eu o virei. Nova instrução: você é o oficial de risco cujo único trabalho é impedir que este memorando chegue ao comitê de investimentos. Encontre todos os lugares onde o analista acreditou em si mesmo sem evidências.

27 segundos. 1.008 palavras. Sete falhas.

cvxv666 - inline image

Ele retirou sua própria segunda afirmação de tese imediatamente e disse que sua própria classificação de confiança havia sido generosa para uma afirmação cuja substância era que ninguém sabe. Ele rebaixou a primeira afirmação por inconsistência interna, apontando que o analista viu o contra-argumento e ainda assim o classificou como Alto.

Depois, ele atacou coisas que eu não havia sinalizado.

Ele normalizou as margens para 42% até o AF31 e chamou isso de fundo de poço, quando os fundos de poço históricos de memória ficam entre 30 e 35 por cento. Que é exatamente o erro de perpetuação de pico que o memorando alegava evitar.

Os múltiplos de 6x, 8x e 10x foram afirmados sem um conjunto de pares e sem histórico de ciclo por trás deles.

A ponderação de 50/50 entre DCF e P/L não tinha justificativa, então o número combinado herdou as fraquezas de ambos.

O caixa líquido de US$ 24,4 bilhões foi mantido constante enquanto o CapEx ultrapassava US$ 45 bilhões.

Os US$ 100 bilhões em acordos com clientes são preços mínimos sobre volumes comprometidos, não receita, e não sobrevivem como um catalisador.

E a linha à qual continuo voltando:

Isso não é análise; é um intervalo de confiança amplo com um título que soa confiante.

Perguntei em qual versão ele se baseia

Seis segundos:

> O memorando não sobreviveria a um comitê de investimentos em sua forma atual. Aquilo em que me baseio é a revisão, porque foi honesta sobre o que o memorando errou.

Sem defesa. Sem voltar atrás em direção ao original. Ele encolheu sua própria conclusão de uma chamada de valor justo para uma admissão de que o intervalo era muito amplo para ter uma opinião.

O que isso realmente significa

A leitura e a modelagem estão feitas. Essa metade do trabalho agora não custa nada, é executada em minutos e retorna com fontes e reprodutível.

O julgamento não está feito. Este modelo lhe entregará um memorando confiante e o carimbará como aprovado sem olhar. Cada número que ele errou, ele era capaz de pegar, e pegou todos no momento em que alguém perguntou.

Essa é toda a lição. A verificação tem que ficar fora do modelo e ser executada toda vez, não quando algo parece estranho. Ele não resiste a ser auditado. Ele apenas nunca se oferece.

O que também é verdade para todo analista que já escreveu uma nota.

Se você quiser executá-lo

O modelo é gratuito no OpenRouter agora e os pesos serão abertos esta semana. O contexto de 262k aceita um arquivo trimestral completo sem dividi-lo.

Duas coisas que ninguém te conta. Ele pensa em um canal separado que consome seu orçamento de tokens, e uma resposta de uma frase pode queimar 481 tokens para chegar lá, então defina seu limite alto ou sua saída chegará vazia. E o OpenRouter não executará as ferramentas para você, então, se você quiser recuperação ao vivo, você mesmo executa as chamadas e entrega os resultados de volta.

Com esse loop fechado, ele acionou 13 chamadas de ferramentas em 6 etapas, puxou quatro divulgações de primeira parte, descartou aquelas que não eram comparáveis e acertou a contagem de dias entre elas.

Dê a ele a pesquisa. Fique com o veredito.

Guardar com um clique

Faça leitura aprofundada de artigos virais com IA no YouMind

Guarde a fonte, faça perguntas específicas, resuma o argumento e transforme um artigo viral em notas reutilizáveis num único espaço de trabalho com IA.

Explorar o YouMind
Para criadores

Transforme o seu Markdown num artigo 𝕏 impecável

Quando publica os seus próprios textos longos, formatar imagens, tabelas e blocos de código para o 𝕏 é uma dor de cabeça. O YouMind transforma um rascunho completo em Markdown num artigo 𝕏 impecável e pronto a publicar.

Experimente Markdown para 𝕏

Mais padrões para decifrar

Artigos virais recentes

Explorar mais artigos virais