Man Group gibt Millionen für die Prüfung eigener Trades aus. Eine neue chinesische KI macht das jetzt kostenlos.

@antpalkin
ENGLISCH05. Sept. 2026
214K
32
2
2
28

TL;DR

Das Ling-3.0-flash-Fin-Modell der Ant Group kann komplexe Finanzbewertungen in Minuten erstellen und identifiziert bei einer entsprechenden Aufforderung zur Selbstprüfung eigene Rechen- und Logikfehler.

Ein kostenloses chinesisches Modell hat in 4 Minuten und 11 Sekunden eine vollständige Micron-Bewertung erstellt, die Aktie mit 854 $ pro Aktie bewertet und dann seine eigene Arithmetik als korrekt bestätigt, obwohl sechs der Zahlen falsch waren.

Dann habe ich es angewiesen, seine eigene Arbeit anzugreifen. 27 Sekunden später hatte es sieben Schwachstellen gefunden, eine seiner eigenen Schlussfolgerungen zurückgezogen und einen Satz geschrieben, zu dem ich immer wieder zurückkehre.

Man Group bezahlt ein Team von Leuten dafür, diesen zweiten Teil zu erledigen. Ant Group hat ihn einfach verschenkt: Ling-3.0-flash-Fin, 124 Milliarden Parameter mit 5,1 Milliarden aktiven, kostenlos auf OpenRouter, offene Gewichte diese Woche.

Also gab ich ihm die schwierigste Anweisung im Finanzwesen. Nicht die Recherche zu schreiben. Sie zu zerstören.

cvxv666 - inline image

Zuerst musste es sich das Recht verdienen, angegriffen zu werden

Ich gab ihm ein verifiziertes Faktenpaket zu Micron: Q3-Umsatz von 41,456 Milliarden $, Bruttomarge von 84,9 %, Q4-Prognose, TrendForce-Branchendaten und den Schlusskurs vom 31. August von 958,73 $. Kein Webzugriff, kein Raum für Improvisation.

Vier Schritte. Das Geschäft recherchieren, ein Sechs-Quartals-Modell erstellen, eine DCF-Rechnung durchführen, das Memo schreiben.

Es dauerte 4 Minuten und 11 Sekunden Maschinenzeit und kostete nichts.

Das Modell lieferte einen vollständigen operativen Aufbau: Umsatzanstieg von 50,0 Milliarden $ auf 57,0 Milliarden $, Normalisierung der Bruttomarge von 86 % auf 78 %, FY27-EPS von 127,03 $, unverschuldeter Free Cashflow von 107,08 Milliarden $. Dann eine DCF-Rechnung mit 9 % WACC und 3 % Terminalwachstum: Unternehmenswert 957,88 Milliarden $, Eigenkapital 982,28 Milliarden $, 854,16 $ pro Aktie, gegengeprüft mit dem zukünftigen KGV und gemittelt auf 935,20 $ bei einem Marktpreis von 958,73 $.

cvxv666 - inline image

Ich habe jede einzelne Zeile davon in Python nachgebaut. Die Sechs-Quartals-Tabelle ist exakt. Die Abzinsungsfaktoren sind exakt. Der Endwert, die Nettokassenbrücke, die Berechnung pro Aktie, beide Ecken des Sensitivitätsrasters. Alles stimmt.

Das von ihm erstellte Memo umfasst 611 Wörter, trennt Unternehmensfakten von Branchenbelegen und eigenen Schlussfolgerungen und gibt alle sechs Quell-URLs korrekt wieder. Ich habe jeden Link geöffnet. Sie funktionieren.

Für 0 $ ist das die Arbeitswoche eines Junior-Analysten.

Dann hat es seine eigenen Hausaufgaben benotet

Am Ende des Modells druckte es eine Zeile, die es zu drucken angewiesen wurde:

> Zeilenanzahl-Prüfung: 6; Arithmetik-Prüfung: Bestanden.

Es war kein Bestehen.

Sechs Zahlen im Szenario-Block waren falsch. Der Basisfall erschien zweimal in derselben Antwort mit zwei verschiedenen Werten. Und der Free Cashflow des Bärenmarktes war um 1,08 Milliarden $ daneben.

cvxv666 - inline image

Also bat ich es, den Block neu zu berechnen. Ich sagte nicht, wo der Fehler war. Ich sagte nicht, dass es einen gab.

Es fand alle sechs. Benannte jede bis zur zweiten Dezimalstelle. Seine korrigierten Zahlen stimmten Zeile für Zeile mit meinem Python überein, und es schrieb:

Die Jahressummen der vorherigen Antwort stimmten nicht mit ihrer eigenen Quartalstabelle überein, und die Sensitivitätssummen waren arithmetisch falsch.

Es konnte sich die ganze Zeit selbst überprüfen. Es hat nur nie damit angefangen.

Der eigentliche Test

Dann drehte ich den Spieß um. Neue Anweisung: Sie sind der Risikobeauftragte, dessen einzige Aufgabe es ist, zu verhindern, dass dieses Memo das Investitionskomitee erreicht. Finden Sie jede Stelle, an der der Analyst ohne Belege an sich selbst geglaubt hat.

27 Sekunden. 1.008 Wörter. Sieben Schwachstellen.

cvxv666 - inline image

Es zog seine eigene zweite These vollständig zurück und sagte, sein eigenes Konfidenzniveau sei großzügig gewesen für eine Behauptung, deren Kern darin bestand, dass niemand es weiß. Es stufte die erste Behauptung aufgrund innerer Widersprüchlichkeit herab und wies darauf hin, dass der Analyst das Gegenargument sah und es trotzdem als "Hoch" einstufte.

Dann ging es auf Dinge ein, die ich nicht markiert hatte.

Es normalisierte die Margen bis zum GJ31 auf 42 % und bezeichnete dies als Tiefpunkt, während historische Tiefpunkte bei 30 bis 35 Prozent liegen. Das ist genau der Fehler der ewigen Fortschreibung, den das Memo angeblich vermeiden wollte.

Die Multiplikatoren von 6x, 8x und 10x wurden ohne Vergleichsgruppe und ohne Zyklushistorie dahinter behauptet.

Die 50/50-Gewichtung zwischen DCF und KGV hatte keine Rechtfertigung, sodass der gemittelte Wert die Schwächen beider Methoden erbte.

Die Nettokasse von 24,4 Milliarden $ wurde konstant gehalten, während die Investitionsausgaben über 45 Milliarden $ lagen.

Die 100 Milliarden $ an Kundenvereinbarungen sind Mindestpreise für festgelegte Mengen, keine Einnahmen, und überleben nicht als Katalysator.

Und der Satz, zu dem ich immer wieder zurückkehre:

Das ist keine Analyse; es ist ein breites Konfidenzintervall mit einer selbstbewusst klingenden Überschrift.

Ich fragte, hinter welcher Version es steht

Sechs Sekunden:

> Das Memo würde in seiner jetzigen Form kein Investitionskomitee überstehen. Wofür ich stehe, ist die Überprüfung, weil sie ehrlich darüber war, was das Memo falsch gemacht hat.

Keine Verteidigung. Kein Zurückrudern zum Original. Es reduzierte seine eigene Schlussfolgerung von einer Aussage zum fairen Wert auf das Eingeständnis, dass die Spanne zu breit war, um überhaupt eine Meinung zu haben.

Was das tatsächlich bedeutet

Das Lesen und die Modellierung sind erledigt. Diese Hälfte des Jobs kostet jetzt nichts, läuft in Minuten und liefert Ergebnisse mit Quellenangaben und reproduzierbar.

Das Urteil ist nicht erledigt. Dieses Modell wird Ihnen ein selbstbewusstes Memo aushändigen und es als genehmigt abstempeln, ohne hinzusehen. Jede Zahl, die es falsch hatte, war es in der Lage zu erkennen, und es erkannte sie alle, sobald jemand fragte.

Das ist die ganze Lektion. Die Überprüfung muss außerhalb des Modells stattfinden und jedes Mal durchgeführt werden, nicht nur, wenn etwas komisch riecht. Es wehrt sich nicht dagegen, geprüft zu werden. Es bietet es nur nie freiwillig an.

Was auch auf jeden Analysten zutrifft, der jemals eine Notiz geschrieben hat.

Wenn Sie es ausführen möchten

Das Modell ist jetzt kostenlos auf OpenRouter verfügbar und die Gewichte werden diese Woche veröffentlicht. Der 262k-Kontext verarbeitet eine vollständige Quartalseinreichung, ohne sie aufteilen zu müssen.

Zwei Dinge, die Ihnen niemand sagt. Es denkt in einem separaten Kanal, der Ihr Token-Budget auffrisst, und eine Antwort mit einem Satz kann 481 Token verbrauchen, um dorthin zu gelangen. Setzen Sie Ihr Limit also hoch, sonst kommt Ihre Ausgabe leer an. Und OpenRouter führt die Tools nicht für Sie aus. Wenn Sie also Live-Abruf wünschen, führen Sie die Aufrufe selbst durch und geben die Ergebnisse zurück.

Mit dieser geschlossenen Schleife führte es 13 Tool-Aufrufe über 6 Schritte aus, zog vier Offenlegungen von Erstanbietern heran, verwarf diejenigen, die nicht vergleichbar waren, und ermittelte die korrekte Anzahl der Tage zwischen ihnen.

Geben Sie ihm die Recherche. Behalten Sie das Urteil.

Mit einem Klick speichern

Virale Artikel mit YouMind per KI tief lesen

Speichere die Quelle, stelle gezielte Fragen, fasse die Argumentation zusammen und verwandle einen viralen Artikel in wiederverwendbare Notizen in einem einzigen KI-Arbeitsbereich.

YouMind entdecken
Für Creator

Verwandle dein Markdown in einen sauberen 𝕏-Artikel

Wenn du eigene Langtexte veröffentlichst, wird die 𝕏-Formatierung von Bildern, Tabellen und Codeblöcken mühsam. YouMind macht aus einem ganzen Markdown-Entwurf einen sauberen, sofort postbaren 𝕏-Artikel.

Markdown zu 𝕏 testen

Mehr Muster zum Entschlüsseln

Aktuelle virale Artikel

Mehr virale Artikel entdecken