Man Group витрачає мільйони на перевірку власних угод. Новий китайський ШІ зробив це безкоштовним.

@antpalkin
АНГЛІЙСЬКА05 вер. 2026 р.
214K
32
2
2
28

Коротко

Модель Ling-3.0-flash-Fin від Ant Group може створювати складні фінансові оцінки за лічені хвилини, а при отриманні запиту на самоаудит — виявляє власні арифметичні та логічні помилки.

Безкоштовна китайська модель побудувала повну оцінку Micron за 4 хвилини та 11 секунд, оцінила акцію в $854 за штуку, а потім підтвердила власні розрахунки як правильні, хоча шість чисел були помилковими.

Потім я сказав їй атакувати власну роботу. Через 27 секунд вона знайшла сім недоліків, відкликала один із власних висновків і написала рядок, до якого я постійно повертаюся.

Man Group платить команді людей, щоб виконувати цю другу частину. Ant Group просто віддав це безкоштовно: Ling-3.0-flash-Fin, 124 мільярди параметрів з 5,1 мільярда активних, безкоштовно на OpenRouter, відкриті ваги цього тижня.

Тому я дав їй найскладнішу інструкцію у фінансах. Не написати дослідження. Знищити його.

cvxv666 - inline image

Спочатку вона мала заслужити право бути атакованою

Я передав їй перевірений набір фактів про Micron: дохід за третій квартал у розмірі $41,456 млрд, валовий прибуток 84,9%, прогноз на четвертий квартал, галузеві дані TrendForce та ціну закриття 31 серпня на рівні $958,73. Без доступу до Інтернету, без можливості імпровізувати.

Чотири кроки. Дослідити бізнес, побудувати модель на шість кварталів, провести DCF, написати меморандум.

Це зайняло 4 хвилини та 11 секунд машинного часу і нічого не коштувало.

Модель повернулася з повною операційною структурою: дохід зростає з $50,0 млрд до $57,0 млрд, валовий прибуток нормалізується з 86% до 78%, прибуток на акцію за 2027 фінансовий рік становить $127,03, вільний грошовий потік без боргового навантаження — $107,08 млрд. Потім DCF з WACC 9% і кінцевим зростанням 3%: вартість підприємства $957,88 млрд, власний капітал $982,28 млрд, $854,16 за акцію, перехресно перевірено за форвардним P/E та зведено до $935,20 проти ринкової ціни $958,73.

cvxv666 - inline image

Я відтворив кожен рядок цього в Python. Таблиця на шість кварталів точна. Коефіцієнти дисконтування точні. Кінцева вартість, міст чистих грошових коштів, розрахунок на акцію, обидва кути сітки чутливості. Все сходиться.

Створений нею меморандум містить 611 слів, відокремлює факти компанії від галузевих доказів та власних висновків і правильно відтворює всі шість вихідних URL-адрес. Я відкрив кожне посилання. Вони працюють.

За $0 це тиждень роботи молодшого аналітика.

Потім вона оцінила власну домашню роботу

Внизу моделі вона надрукувала рядок, який їй було наказано надрукувати:

> Перевірка кількості рядків: 6; перевірка арифметики: Пройдено.

Це не було пройдено.

Шість чисел у блоці сценарію були неправильними. Базовий сценарій з'явився двічі в одній відповіді з двома різними значеннями. А вільний грошовий потік за песимістичним сценарієм був меншим на $1,08 мільярда.

cvxv666 - inline image

Тому я попросив її перерахувати блок. Я не сказав, де помилка. Я не сказав, що вона взагалі є.

Вона знайшла всі шість. Назвала кожну до другого знаку після коми. Її виправлені числа збігалися з моїм Python рядок за рядком, і вона написала:

Річні підсумки попередньої відповіді не збігалися з її власною квартальною таблицею, а підсумки чутливості були арифметично некоректними.

Вона могла перевіряти себе весь час. Вона просто ніколи не починала.

Справжній тест

Потім я розвернув її. Нова інструкція: ви — керівник з ризиків, чиє єдине завдання — не допустити, щоб цей меморандум потрапив до інвестиційного комітету. Знайдіть кожне місце, де аналітик повірив собі без доказів.

27 секунд. 1008 слів. Сім недоліків.

cvxv666 - inline image

Вона повністю відкликала власну другу тезу і заявила, що її власний рівень впевненості був щедрим для твердження, суть якого полягала в тому, що ніхто нічого не знає. Вона знизила перше твердження через внутрішню суперечливість, вказавши, що аналітик бачив контраргумент і все одно оцінив його як Високий.

Потім вона взялася за речі, які я не позначив.

Вона нормалізувала маржу до 42% до 2031 фінансового року і назвала це дном, хоча історичні мінімуми коливаються в межах 30-35 відсотків. Це саме та помилка увічнення піку, якої, як стверджувалося в меморандумі, вдалося уникнути.

Мультиплікатори 6x, 8x та 10x були заявлені без групи аналогів та історії циклу.

Зважування 50/50 між DCF та P/E не мало жодного обґрунтування, тому зведене число успадкувало слабкі обох методів.

Чисті грошові кошти в розмірі $24,4 млрд залишалися незмінними, тоді як капітальні витрати перевищували $45 млрд.

Угоди з клієнтами на $100 млрд — це мінімальні ціни на законтрактовані обсяги, а не дохід, і вони не виступають каталізатором.

І рядок, до якого я постійно повертаюся:

Це не аналіз; це широкий довірчий інтервал із впевненим заголовком.

Я запитав, яку версію вона підтримує

Шість секунд:

> Меморандум не пройшов би інвестиційний комітет у своїй поточній формі. Я підтримую огляд, тому що він був чесним щодо того, що меморандум зробив неправильно.

Жодного захисту. Жодного повернення до оригіналу. Вона звузила власний висновок від оцінки справедливої вартості до визнання того, що діапазон був надто широким, щоб мати якусь думку взагалі.

Що це насправді означає

Читання та моделювання завершено. Ця половина роботи тепер нічого не коштує, виконується за хвилини та повертається з джерелами та можливістю відтворення.

Судження не завершено. Ця модель передасть вам впевнений меморандум і поставить штамп «схвалено», навіть не подивившись. Кожне число, яке вона отримала неправильно, вона була здатна виявити, і вона виявила їх усі, щойно хтось запитав.

У цьому весь урок. Перевірка має знаходитися поза моделлю і запускатися щоразу, а не тільки тоді, коли щось здається підозрілим. Вона не чинить опору аудиту. Вона просто ніколи не пропонує його добровільно.

Що також справедливо для будь-якого аналітика, який коли-небудь писав звіт.

Якщо ви хочете запустити її

Модель зараз безкоштовна на OpenRouter, і ваги стануть відкритими цього тижня. Контекст у 262k вміщує повний квартальний звіт без розбиття.

Дві речі, які вам ніхто не скаже. Вона думає в окремому каналі, який споживає ваш токен-бюджет, і відповідь з одного речення може спалити 481 токен, тому встановіть ліміт високо, інакше ваш вихід буде порожнім. А OpenRouter не запускатиме інструменти за вас, тому якщо вам потрібен живий пошук, ви виконуєте виклики самостійно та передаєте результати назад.

З цим замкненим циклом вона виконала 13 викликів інструментів за 6 кроків, отримала чотири розкриття інформації від першої особи, відкинула ті, що не були порівнянними, і правильно визначила кількість днів між ними.

Дайте їй дослідження. Залиште вердикт за собою.

Збереження в один клік

Використовуйте YouMind для AI-глибокого читання віральних статей

Зберігайте джерела, ставте цілеспрямовані запитання, підсумовуйте аргументи та перетворюйте віральні статті на корисні нотатки в одному AI-робочому просторі.

Дослідити YouMind
Для авторів

Перетворіть свій Markdown на охайну статтю для 𝕏

Коли ви публікуєте власні лонгріди, зображення, таблиці та блоки коду роблять форматування в 𝕏 складним. YouMind перетворює повну чернетку в Markdown на чисту статтю для 𝕏, готову до публікації.

Спробувати Markdown для 𝕏

Більше патернів для аналізу

Останні віральні статті

Переглянути більше віральних статей