루프 엔지니어링을 활용하여 스스로 개선되는 퀀트 트레이딩 시스템을 구축하는 방법

@RohOnChain
영어2026년 6월 22일
1.4M
1.3K
160
41
5.3K

TL;DR

수동 AI 프롬프팅에서 퀀트 트레이딩을 위한 루프 엔지니어링으로 전환하는 방법을 알아보세요. 이 가이드는 스스로 개선되는 자율형 시스템을 구축하기 위한 6단계 아키텍처를 상세히 설명합니다.

자, 이제 전체 퀀트 트레이딩 시스템을 스스로 구동하는 루프를 정확히 어떻게 구축하는지 단계별로 설명하겠습니다.

바로 본론으로 들어가죠.

이 글을 북마크하세요

- 저는 Roan이며, 시스템 설계, HFT 스타일 실행, 퀀트 트레이딩 시스템을 작업하는 백엔드 개발자입니다. 제 작업은 예측 시장이 부하 상황에서 실제로 어떻게 작동하는지에 초점을 맞추고 있습니다. 제안, 진지한 협업, 파트너십 문의는 DM으로 열려 있습니다.

오늘부터 시작할 한 가지.

퀀트 시스템을 구축 중이거나, 곧 시작하려고 하거나, 심지어 생각 중이라면, 지금 작업 중인 내용을 DM으로 보내주시거나 이 글 아래에 댓글을 남겨주세요. 제가 직접 연락드리겠습니다. (현재 아키텍처의 스크린샷만 보내주셔도 좋습니다.)

처음 20개의 설정을 개인적으로 함께 살펴보며, 현재 상태와 실제로 알파를 창출하는 시스템 사이의 차이를 보여드리겠습니다.

대부분의 퀀트는 여전히 Claude에게 프롬프트를 입력합니다. 입력하고, 기다리고, 출력을 읽고, 다시 입력합니다.

지구상에서 가장 뛰어난 빌더들은 더 이상 그렇게 하지 않습니다.

그들은 루프를 작성합니다. 루프가 Claude에게 프롬프트를 보냅니다. 루프가 출력을 검증합니다. 루프가 다음에 무슨 일이 일어날지 결정합니다. 루프는 노트북을 닫은 후에도 계속 실행됩니다.

Anthropic에서 Claude Code를 이끄는 Boris Cherny는 2주 전에 이렇게 분명히 말했습니다. "저는 더 이상 Claude에게 프롬프트를 입력하지 않습니다. Claude에게 프롬프트를 보내고 무엇을 할지 스스로 판단하는 루프를 실행하고 있습니다. 제 일은 루프를 작성하는 것입니다." 이 한 문장은 지구상의 모든 진지한 AI 엔지니어가 구축에 대해 생각하는 방식을 완전히 재구성했습니다. 그리고 이것은 퀀트 트레이딩과 완벽하게 일치합니다.

대부분의 소매 퀀트들은 이것을 읽고 자신에게는 해당되지 않는다고 말할 것입니다. 왜냐하면 그들은 너무 작기 때문입니다. 그들은 틀렸습니다. 자본이 작을수록 이것이 더 중요해집니다. 자체 실행 루프는 개인 빌더가 100명의 박사 학위자를 운영하는 펀드와의 격차를 줄일 수 있는 유일한 방법입니다.

퀀트 트레이딩은 이미 루프이기 때문입니다. 데이터를 가져옵니다. 신호를 생성합니다. 백테스트합니다. 실행합니다. 리스크를 모니터링합니다. 반복합니다.

월스트리트의 모든 펀드는 정확히 이 사이클을 운영합니다. Renaissance는 1988년부터 이렇게 해왔습니다. Citadel은 엔지니어 팀이 모든 단계를 모니터링하며 운영합니다. Two Sigma, Jane Street도 모두 마찬가지입니다.

유일한 차이점은 그들은 루프 안에 수백 명의 사람이 필요하다는 것입니다. 여러분은 그렇지 않습니다.

저는 이미 이 루프를 직접 구축했습니다. 예약된 일정에 따라 시장 데이터를 가져옵니다. 알파 리서치를 실행합니다. 모든 신호를 별도의 에이전트를 통해 검증합니다. 검증을 통과한 것만 실행합니다. 모든 교훈을 메모리에 다시 기록합니다.

이 글은 제가 루프 엔지니어링에 대해 배운 모든 것과 이를 완전한 자율 트레이딩 시스템에 연결하는 방법입니다.

이 글을 마치면 다음을 알게 될 것입니다:

에이전트에 프롬프트를 입력하는 것과 루프를 엔지니어링하는 것의 정확한 차이점.

프로덕션에서 작동하는 모든 루프를 구성하는 여섯 가지 요소.

이 여섯 가지 요소를 처음부터 스스로 개선하는 퀀트 트레이딩 시스템에 연결하는 방법.

이제 시작하겠습니다.

파트 1: 프롬프팅과 루프 엔지니어링의 차이점

지난 2년 동안 AI 작업은 이렇게 이루어졌습니다.

프롬프트를 입력했습니다. 결과를 읽었습니다. 본 결과를 바탕으로 다음 프롬프트를 입력했습니다.

여러분이 루프였습니다.

에이전트는 도구였습니다. 여러분이 항상 그것을 쥐고 있었습니다. 모든 움직임은 여러분이 키보드 앞에 앉아 다음에 무엇을 할지 결정하는 것이었습니다.

루프 엔지니어링은 그것을 끝냅니다.

여러분은 더 이상 루프 안에 있는 존재가 아닙니다. 루프를 설계하는 아키텍트가 됩니다.

루프는 재귀적인 목표입니다. 목적을 정의합니다. 에이전트는 그 목표를 향해 반복합니다. 실제 정지 조건이 충족될 때까지 루프는 계속 실행됩니다.

에이전트는 실행 사이에 잊어버립니다. 루프는 잊지 않습니다.

이 한 가지 사실이 전체 아키텍처입니다.

Boris가 자신의 일은 루프를 작성하는 것이라고 말했을 때, 이것이 의미하는 바입니다. 그는 더 이상 한 번에 하나씩 지시를 입력하지 않았습니다. 그를 대신해 지시를 보내고, 결과를 읽고, 다음에 무슨 일이 일어날지 결정하는 시스템을 구축했습니다.

코딩의 경우, 이것은 소프트웨어가 출시되는 방식을 바꿉니다.

트레이딩의 경우, 이것은 모든 것을 바꿉니다.

한 번의 프롬프트를 입력하고 그냥 걸어 나가서 돈을 번 퀀트는 없었기 때문입니다. 엣지는 동일한 사이클을 수천 번 실행하고, 매 반복마다 1%씩 개선되며, 결코 잠들지 않는 데서 나옵니다.

이것이 바로 루프가 하는 일입니다.

여전히 Claude에게 프롬프트를 한 번에 하나씩 입력하고 있다면, Boris가 2년 전에 그만둔 일을 하고 있는 것입니다. 레버리지 포인트가 한 층 위로 올라갔습니다. 더 이상 더 나은 프롬프트를 작성하는 것이 아닙니다. 프롬프트를 작성하는 시스템을 작성하는 것입니다.

Roan - inline image

프롬프팅과 루프 엔지니어링의 차이점

파트 2: 모든 작동하는 루프를 구성하는 여섯 가지 요소

작동하는 루프는 여섯 부분으로 구성됩니다. 하나라도 빠지면 루프는 조용히 깨집니다.

1. 자동화.

이것은 심장박동입니다. cron 일정, 웹훅, /loop 명령어, 또는 여러분이 입력하지 않아도 실행되는 Claude Code 내부의 훅입니다.

알아둘 가치가 있는 두 가지 유형이 있습니다. /loop는 상태와 관계없이 주기적으로 재실행됩니다. /goal은 여러분이 작성한 검증 가능한 조건이 실제로 참이 될 때까지 계속 실행되며, 별도의 작은 모델이 작업 완료 여부를 평가합니다.

트레이딩에서 /loop는 매분 데이터를 가져오는 작업입니다. /goal은 "백테스트 Sharpe가 1.5 이상이 될 때까지 이 신호를 계속 반복 개선"하는 것입니다.

2. 스킬.

스킬은 매 세션마다 처음부터 다시 가르치는 대신 에이전트가 읽는 절차 매뉴얼입니다.

SKILL.md 파일에 저장됩니다. 여러분의 규칙, 관례, "그 사건 때문에 이렇게 하지 않는다"와 같은 내용이 담겨 있습니다.

스킬이 없으면, 모든 루프 실행은 제로에서 시작됩니다. 스킬이 있으면, 의도가 축적됩니다.

3. 상태 파일.

마크다운 파일입니다. 보통 STATE.md 또는 PROGRESS.md라고 불립니다.

실행 사이에도 유지됩니다. 에이전트는 잊어버립니다. 파일은 잊지 않습니다.

에이전트는 매 실행 시작 시 이 파일을 읽습니다. 종료 시 무슨 일이 일어났는지 다시 씁니다.

너무 단순해서 중요해 보이지 않을 수 있습니다. 하지만 실제로 모든 작동하는 루프의 중추입니다.

4. 검증기.

코드를 작성한 에이전트는 코드가 올바른지 판단하는 최악의 평가자입니다.

이것을 트레이딩에 적용해 보세요. 신호를 생성한 에이전트는 그 신호가 진짜 알파인지 노이즈인지 판단하는 최악의 평가자입니다.

다른 지침, 이상적으로는 다른 모델을 가진, 오직 작업을 검증하는 역할만 담당하는 별도의 에이전트가 필요합니다.

이것이 메이커-체커 패턴입니다. 월스트리트의 모든 프로프 숍은 내부적으로 이렇게 구조화되어 있습니다. Jane Street에서 거래를 제안하는 트레이더는 거래를 승인하지 않습니다. Citadel에서 모델을 구축하는 연구원은 모델을 검증하지 않습니다.

5. 워크트리.

둘 이상의 에이전트가 동일한 파일에 대해 작업을 시작하는 순간, 충돌이 발생하기 시작합니다.

Git 워크트리는 각 에이전트에게 자체 브랜치를 가리키는 독립적인 작업 디렉토리를 제공합니다.

트레이딩에서 이를 통해 신호 연구, 백테스팅, 리스크 모니터링을 서로 간섭 없이 병렬로 실행할 수 있습니다.

6. 커넥터.

파일만 읽을 수 있는 루프는 아주 작은 루프입니다.

Model Context Protocol 기반으로 구축된 커넥터는 루프가 브로커 API에 접근하고, 데이터베이스를 쿼리하고, Slack에 게시하고, 거래소에 주문을 보낼 수 있게 합니다.

이것이 거래를 제안하는 루프와 실제로 거래를 실행하는 루프의 차이점입니다.

이 여섯 가지 요소는 보편적입니다. Claude Code에서 나타납니다. Codex에서 나타납니다. 지구상의 모든 작동하는 에이전트 시스템에서 나타납니다.

이제 이것들을 어떻게 함께 연결하여 완전한 트레이딩 시스템을 구축하는지 보여드리겠습니다.

파트 3: 스스로 개선하는 퀀트 트레이딩 루프 구축 방법

퀀트 트레이딩 루프는 다섯 단계로 구성됩니다. 각 단계는 자체적인 하위 루프이며, 자체 스킬, 자체 상태 파일, 자체 검증기를 가지고 있습니다.

1단계. 데이터 수집.

자산군에 따라 매분, 매시간, 또는 매일 자동화가 실행됩니다.

python
1@loop(interval="1h")
2def ingest_data():
3 data = fetch_market_data(symbols=universe, lookback="30d")
4 state.write("latest_data.parquet", data)

데이터는 다음 단계가 읽는 공유 상태 파일로 들어갑니다.

2단계. 신호 생성.

여기서 알파 리서치가 이루어집니다.

python
1@loop(trigger="data_updated")
2def generate_signal():
3 data = state.read("latest_data.parquet")
4 signal = claude.run_skill("alpha_research", data)
5 state.write("pending_signal.json", signal)

신호 생성 에이전트는 알파 리서치 규칙이 담긴 SKILL.md 파일을 읽습니다.

markdown
1# alpha_research_skill.md
2
3## 목표
4지난 30일간의 가격 및 거래량 데이터에 대해
5선형 회귀를 사용하여 신호를 생성합니다.
6
7## 규칙
8- 최근 5번의 백테스트 중 3번에서 Sharpe 비율이 1.5 이상이어야 함
9- 신호당 포지션 크기는 자본의 2%로 제한
10- FOMC 발표일에는 신호 건너뛰기
11- 실적 발표 48시간 전에는 신호 건너뛰기
12
13## 학습된 교훈
14- 2026-02-14: 실적 주간 동안 4.2% 손실 발생.
15 새로운 규칙: 실적 발표 48시간 전 신호는 모두 건너뛴다.
16- 2026-03-08: 섹터 익스포저 위반으로 6% 하락 발생.
17 새로운 규칙: 섹터 익스포저를 30%로 제한한다.
18- 2026-04-22: FOMC 날 모멘텀 신호 폭발.
19 새로운 규칙: FOMC 날에는 모든 모멘텀 신호를 중단한다.

스킬은 시간이 지남에 따라 성장합니다. 모든 손실은 새로운 교훈을 다시 기록합니다. 모든 교훈은 다음 실행을 위한 새로운 규칙이 됩니다.

이것이 시스템을 스스로 개선하게 만드는 요소입니다.

3단계. 검증.

신호는 완전히 별도의 에이전트로 전송됩니다. 다른 모델. 다른 지침. 원래 신호가 어떻게 추론되었는지에 대한 정보는 없습니다.

python
1@checker
2def verify_signal(signal):
3 result = claude.invoke(
4 skill="backtest_verification_skill.md",
5 signal=signal,
6 rules=[
7 "Sharpe 비율 1.5 이상",
8 "최대 하락폭 10% 미만",
9 "Newey-West t-통계량 2.0 이상",
10 "최소 2년 이상의 표본 외 기간"
11 ]
12 )
13 return result.verdict

검증에 실패하면 신호는 폐기됩니다. 통과하면 실행 단계로 넘어갑니다.

검증기는 메이커가 추론한 내용을 절대 보지 않습니다. 이 분리가 전체 엣지입니다.

메이커보다 체커에 더 강력한 모델을 사용할 수도 있습니다. 검증에는 Claude Opus, 생성에는 Claude Sonnet을 사용합니다. 다른 모델 아키텍처는 다른 종류의 오류를 잡아냅니다. 이것은 머신러닝에서 앙상블 방법이 사용하는 것과 동일한 논리입니다.

Roan - inline image

메이커-체커 분리

4단계. 실행.

검증된 신호만 이 단계에 도달합니다.

python
1@auto_mode
2def execute(signal):
3 if verify_signal(signal):
4 broker.send_orders(signal, max_position=0.02)
5 state.write("active_trades", signal)

MCP 커넥터가 브로커 API를 처리합니다. 루프는 결코 허가를 요청하지 않습니다. 자동 모드를 사용하면 개입 없이 실행됩니다.

5단계. 리스크 모니터링.

항상 병렬 워크트리에서 실행됩니다.

python
1@loop(interval="1m")
2def monitor_risk():
3 positions = broker.get_positions()
4 if drawdown(positions) > 0.05:
5 broker.close_all()
6 state.append("STATE.md", "하락폭 트리거 도달. 모든 포지션 청산.")

이것이 킬 스위치입니다. 협상 없이 규칙을 집행합니다.

이 다섯 개의 하위 루프는 함께 하나의 자체 실행 시스템을 형성합니다.

데이터가 유입됩니다. 신호가 생성됩니다. 신호가 검증됩니다. 검증된 신호가 실행됩니다. 리스크가 모니터링됩니다. 교훈이 메모리에 다시 기록됩니다.

그런 다음 다시 시작됩니다.

Roan - inline image

루프가 어떻게 축적되는가

저는 이것을 한 번 설계했습니다. 그 이후로 이 단계들 중 어느 것에도 프롬프트를 입력하지 않았습니다.

이것이 루프 엔지니어링입니다. 이것이 Boris가 자신의 일은 루프를 작성하는 것이라고 말했을 때 의미한 바입니다.

한 가지 경고합니다. 실제 정지 조건이 없는 루프는 조용히 실패합니다. 에이전트는 절반만 완료된 작업이 완료되었다고 믿으며 완료 신호를 보냅니다. 루프가 종료됩니다. 나쁜 거래가 그대로 열려 있습니다.

정지 조건은 에이전트 자신의 주장 이외의 다른 것에 의해 확인 가능해야 합니다. "지난 30건의 거래 동안 Sharpe 1.5 이상." "하락폭 5% 미만." "테스트 스위트 통과." "에이전트가 완료되었다고 말함"은 절대 안 됩니다.

제 게임 이론 글에서 모든 거래가 불완전한 정보를 가진 멀티 플레이어 게임에서의 전략적 움직임임을 설명했습니다. 놓치셨다면, 이 글을 읽고 꼭 확인해보세요:

https://x.com/RohOnChain/status/2066178991892119820

루프는 여러분이 지치지 않고 그 테이블에 영원히 앉아 있을 수 있게 해줍니다.

요약

퀀트 트레이딩은 이미 루프입니다. 월스트리트의 모든 펀드가 그것을 운영합니다. 그들은 단지 수백 명의 사람이 그 안에 앉아 있을 필요가 있습니다.

루프 엔지니어링은 사람을 제거합니다.

여섯 가지 요소가 모든 작동하는 루프를 만듭니다. 자동화가 심장박동을 제공합니다. 스킬이 프로젝트 지식을 보유합니다. 상태 파일이 메모리를 보유합니다. 검증기가 출력을 평가합니다. 워크트리가 병렬 작업을 분리합니다. 커넥터가 루프에 현실 세계에서의 손과 발을 제공합니다.

이것들을 5단계 트레이딩 사이클 주위에 연결하면 알파 리서치를 실행하고, 신호를 검증하고, 거래를 실행하고, 리스크를 자체적으로 모니터링하는 스스로 개선하는 시스템을 갖게 됩니다.

시스템은 매 사이클마다 더 똑똑해집니다. 모든 손실은 새로운 교훈을 기록합니다. 모든 교훈은 새로운 규칙이 됩니다. 100번의 거래 후에는 스킬 파일이 살아있는 문서가 됩니다. 1000번의 거래 후에는 어떤 한 사람이 기억할 수 있는 것보다 제도적 지식에 가까워집니다.

이것을 먼저 구축하는 펀드는 앞으로 10년 동안 복리 효과를 누릴 것입니다. 여전히 프롬프트를 입력하는 펀드는 뒤쳐질 것입니다.

자, 함께 생각해볼 질문입니다.

루프 엔지니어링이 프롬프팅 다음의 추상화 수준이고, 퀀트 트레이딩이 세상에서 가장 높은 이해관계를 가진 루프라면, 여러분은 여전히 한 번에 하나씩 프롬프트를 입력하는 사람입니까, 아니면 여러분이 잠자는 동안에도 여러분을 대신해 거래하는 루프를 설계한 아키텍트입니까?

틀린 대답은 없지만, 아주 많은 것을 드러내는 대답은 있습니다.

원클릭 저장

YouMind로 바이럴 글을 AI 심층 읽기

소스를 저장하고, 핵심 질문을 던지고, 주장을 요약해 바이럴 글을 다시 활용할 수 있는 노트로 바꾸세요. 하나의 AI 워크스페이스에서 모두 할 수 있습니다.

YouMind 둘러보기
크리에이터를 위해

당신의 Markdown을 깔끔한 𝕏 글로

직접 쓴 장문을 올릴 때 이미지, 표, 코드 블록을 𝕏에 맞게 정리하는 일은 번거롭습니다. YouMind는 전체 Markdown 초안을 깔끔하고 바로 게시할 수 있는 𝕏 글로 바꿔 줍니다.

Markdown → 𝕏 사용해 보기

분석할 패턴 더 보기

최근 바이럴 아티클

더 많은 바이럴 아티클 보기