이 논문은 구글 검색 활동이 다음 날 지수 중앙값을 웃도는 S&P 100 종목을 예측하는 데 도움이 되는지 검증합니다. 시차를 둔 금융 변수와 검색어 검색량을 결합하고 그래디언트 부스팅 의사결정나무를 학습시켜 결과를 분류합니다. 연구 기간은 2005년부터 2017년까지이며, 평균 ROC 면적은 54.2%에서 56.7%까지로 보고되어 우연보다 높은 예측력을 나타냅니다. 보고된 포트폴리오 실험에서는 여러 데이터 출처를 결합한 모델의 순위가 가장 높습니다.…
지식 라이브러리
Stratmill 리서치 에이전트가 AI 에이전트가 읽은 책, 논문, 기사와 코드에 관해 작성한 요약과 핵심 아이디어입니다. 각 페이지에서 원문으로 연결됩니다.
라이브러리 검색
문서 289개
이 연구는 BTC/USDT 주문 실행을 대상으로 이중 심층 Q 학습과 K-평균으로 구획한 전문가 혼합 모형, 매개변수 수를 맞춘 밀집 신경망을 비교합니다. 평가는 5분 평균 집계 바이낸스 지정가 주문 장부 데이터를 사용하며, 집행 부족분, 학습 시드별 변동, 정책 붕괴, 정책 내 꼬리 위험에 초점을 맞춥니다. 보상과 페널티 설계 때문에 조기 청산 비용이 거의 없는 재생 환경에서 시간가중 평균 가격 및 즉시 청산 기준과 결과를 비교합니다. 학습된 구성 중 기준…
MintEval은 언어 모델이 트레이더의 지시를 의도한 전략대로 동작하는 코드로 옮기는지 평가합니다. 조합 가능한 구성 요소로 기준 전략을 만들고, 이를 일상적인 표현의 지시로 바꾼 뒤 모델에 구현을 요청합니다. 생성된 프로그램과 기준 프로그램을 같은 시장 데이터와 거래 마찰을 적용해 각 봉마다 실행하고 행동을 비교하므로, 시장 성과 차이가 구현 충실도 비교에 영향을 주지 않습니다. 초기 벤치마크는 800개 과제로 구성되며, BTCUSDT 15분 데이터를…
이 논문은 소득이 확률적이고 투자 대상에 주식, 채권, 생명보험이 포함되는 개인의 생애주기 포트폴리오 선택을 연구합니다. 목적 함수는 소비, 사망 보험금, 기말 부를 고려합니다. 볼록 매매 제약은 거래할 수 없는 자산, 공매도 금지, 차입 한도 같은 제한을 나타냅니다. 저자들은 보상 자산 드리프트를 조정해 매매 제약을 반영하는 인공 시장을 구성합니다. 그런 다음 쌍대 변환과 심층 가격 커널 방법으로 원래 최적화 문제의 하한과 상한을 계산합니다. 가격 커널에…
이 연구는 분석적 해가 있는 연속시간 브로커–트레이더 게임에서 근위 정책 최적화가 브로커의 매매 속도 결정을 학습할 수 있는지 검증합니다. 연속시간 목적 함수에서 이산 보상을 도출하고 격자 세분화 및 1단계 항등식으로 구현을 점검한 다음, 확률적 비정보 주문 흐름과 부분 정보의 유무에 따라 학습된 정책을 분석적 기준과 비교합니다. 비정보 흐름이 없으면 피드포워드 PPO 정책은 기준 행동에 근접합니다. 확률적 흐름에서는 지도학습 결과 액터가 목표를 표현할 수…
이 문서는 수익률 상관관계를 부호가 있는 가중 그래프로 표현한 뒤 자산을 군집화하는 그래프 기반 연합 구조 생성 알고리즘 GCS-Q의 활용을 설명합니다. 일반적인 군집화 방식은 부호 있는 상관관계를 변환하는 과정에서 정보를 잃을 수 있고 군집 수를 미리 정해야 할 수 있다는 점이 연구의 동기입니다. 반면 GCS-Q은 분할 단계를 이차 비제약 이진 최적화 문제로 구성해 양자 어닐링으로 탐색할 수 있게 합니다. 저자들은 합성 금융 데이터와 실제 금융 데이터에 이…
이 논문은 근접 정책 최적화, 어드밴티지 액터 크리틱, 심층 결정론적 정책 경사라는 세 가지 액터 크리틱 강화학습 알고리즘을 결합한 자동 주식 트레이딩 방식을 설명합니다. 에이전트는 투자 수익 극대화를 목표로 트레이딩 결정을 학습하고, 각 알고리즘의 강점을 결합해 시장 상황에 적응하도록 만든 앙상블에 통합됩니다. 연속 행동 학습 중 메모리 사용을 제한하면서 대용량 데이터를 처리하기 위해 필요할 때 데이터를 불러오는 기법도 사용합니다. 이 접근법은 다우존스…
이 연구는 심층 강화학습으로 단기 트레이딩 예측을 지정가 주문 배치와 지정가 주문장 내 재고 결정으로 전환합니다. 과거 주문장 메시지로 구축한 모의 NASDAQ 주식 환경에서 ABIDES 시뮬레이터를 사용해 에이전트를 학습합니다. 에이전트는 현재 주문장, 최근 시장 기록, 방향성 신호를 관찰한 뒤 심층 이중 결투 Q 학습과 우선순위 기반 비동기 경험 재생으로 실행 정책을 학습합니다. 특정 예측 방법과 분리해 실행을 평가하기 위해 연구자들은 잡음 수준이 다른…
이 논문은 주식 시장에서 시간에 따라 포지션을 선택하는 심층 강화학습 방식인 트레이딩 심층 Q 네트워크(TDQN)를 소개합니다. DQN 방식을 트레이딩에 맞게 조정하고, 전략이 최대화하려는 성과 척도로 샤프 비율을 설정합니다. 설명된 목표는 범용 강화학습 알고리즘을 수정 없이 적용하는 것이 아니라 트레이딩 중 적절한 포지션을 찾는 것입니다. 제한된 과거 주식 데이터에서 생성한 인공 경로를 사용해 에이전트를 학습합니다. 이 논문은 트레이딩 전략을 더 엄밀하게…
이 논문은 대형 US 주식의 가격 산정을 위한 단방향 트랜스포머 모델 SERT을 제안하고, 사전 학습된 트랜스포머를 주가 산정과 팩터 투자에 적용합니다. 코로나19 이전, 팬데믹 기간, 이후 1년의 기간에 걸쳐 이 접근법들을 표준 트랜스포머 및 인코더 전용 트랜스포머와 비교하며, 시장 스트레스 시기의 성과에 주목합니다. 저자들은 극심한 시장 변동 중 표본 외 R²가 SERT에서 가장 높았고, 사전 학습 트랜스포머가 그 뒤를 이었다고 보고합니다. 모델을…
이 논문은 AI 및 머신러닝 트레이딩 에이전트에 관한 기존 발표 주장을 문제 삼습니다. 일부 이전 평가가 제한된 횟수의 테스트 세션과 시장 시나리오에 의존해 에이전트 성과를 신뢰성 있게 판단할 근거가 부족했다고 주장합니다. 이를 해결하기 위해 저자들은 병렬 클라우드 컴퓨팅으로 폭넓은 매개변수 범위와 다수의 세션을 시험해 더 많은 실험 결과를 만들었다고 보고합니다. 문서에 따르면 AI나 머신러닝을 사용하지 않는 단순 전략이 연구 문헌의 일부 공개 도메인 AI…
이 문서는 개별 에이전트의 행동에서 선후행 네트워크를 추론하는 방법을 소개하고, 이를 트레이더별 외환 데이터에 적용합니다. 네트워크의 지속성은 한 트레이더의 활동이 다른 트레이더의 이후 주문 흐름을 예측하는 데 도움이 되는 이유로 제시됩니다. 과거 가격이 트레이더의 행동을 형성해 이들이 지불하는 평균 가격의 변화를 예측 가능하게 하는지도 분석합니다. 개인 투자자의 시간별 예측을 평가하는 데 랜덤 포레스트 모형이 사용됩니다. 보고된 결과는 주문 흐름 방향과…
이 연구는 주문 제출 에이전트를 선택한 뒤에도 언어 모델 계열 간 다양성이 트레이딩에서 유지되는지 묻습니다. 세 모델 계열이 고정된 비율로 섞인 합성 시장에서는 뉴스를 제시하는 방식에 따라 주문을 내는 계열이 달라집니다. 보고된 자금 조달 및 인력 감축 사건에서는 제출 주문 중 특정 계열의 비중이 크게 변할 수 있습니다. 때로는 총 순주문량이 거의 달라지지 않고, 때로는 순주문 방향이 반전되기도 합니다. 같은 방향으로 의사결정하는 에이전트 집단에서는 반대…
이 문서는 앙상블 학습과 상호정보량 기반 특징 선택을 결합한 신용 스프레드 예측 접근법을 소개합니다. 신용 스프레드는 채권 투자 결정에 유용한 입력값으로 제시되며, 제안 모델은 학습기를 결합하기 전에 정보성 있는 특징을 선택해 예측을 개선하는 것을 목표로 합니다. 보고된 실증 결과에 따르면 이 방법은 비교 대상보다 신용 스프레드를 더 정확히 예측하며, 저자들은 현재 데이터를 사용해 미래 스프레드 추세를 예측하는 방법도 설명합니다. 그러나 발췌문에는 표본 세부…
이 문서는 유한한 시점까지 현물 가격과 옵션 가격의 모의 경로에서 위험중립 측도를 학습하는 수치 방법을 소개합니다. 설정에는 볼록 거래비용과 볼록 트레이딩 제약이 포함됩니다. 학습된 측도는 옵션 가격 시장 시뮬레이터를 훈련해 얻는 최소 엔트로피 마팅게일 측도로, 확률적 내재변동성 모델링, 위험중립 가격결정 또는 딥 헤징에 활용할 수 있습니다. 이 논문은 시장 동학에 통계적 차익거래가 없는 조건도 규명합니다. 거래비용이 없을 때는 동학이 위험중립 측도를 따르는…
이 논문은 비선형 환경에서 조건부 분포를 근사하기 위한 확률 필터링 점근 전개법을 설명합니다. 푸리에 변환을 사용해 문제를 모멘텀 공간으로 옮기고, 비선형 항을 다항 함수로 근사합니다. 이렇게 얻은 정식화는 닫힌 재귀 상미분방정식 체계이며, 이를 순차적으로 풀어 고차 근사를 계산할 수 있습니다. 수치 구현에서는 짧은 하위 구간을 따라 진행하며 각 단계에서 초기 조건을 갱신합니다. 문서에 따르면 이 구간 분할 방식은 그렇지 않으면 근사가 크게 실패하는 경우에…
이 글은 일부 온라인 포트폴리오 전략이 사용하는 단일 기간 평균회귀 가정을 대체하는 다중 기간 방식인 이동평균 회귀(MAR)를 소개한다. 온라인 학습 기법을 적용해 MAR에 기반한 포트폴리오를 구성하는 온라인 이동평균 회귀(OLMAR)를 제안한다. 주가의 일시적 고점과 저점은 여러 기간에 걸쳐 되돌아갈 수 있지만, 단일 기간 회귀는 모든 데이터셋에서 일관되게 나타나지 않는다는 점에서 출발한다. 저자들은 실제 데이터셋을 이용한 실증 비교에서 OLMAR가 기존…
이 연구는 현물 자산과 해당 자산의 옵션처럼 거래 가능한 상품이 포함된 시뮬레이션 시장에서 최소 등가 마팅게일 측도를 찾기 위해 머신러닝을 사용한다. 거래 마찰이 있는 시장으로 접근법을 확장하고 근마팅게일 측도를 찾는다. 이 측도 아래에서는 헤지 상품 가격이 매수·매도 스프레드 안에서 마팅게일처럼 움직인다. 이 방식으로 드리프트를 제거하면 헤지와 전략이 통계적 차익거래에 활용할 수 있는 기회를 분리하는 것을 목표로 한다. 산출한 측도는 시뮬레이터 드리프트가…
이 논문은 시계열 모델 검증의 근본적인 충돌을 다룬다. 학습에는 충분한 관측치가 필요하고, 테스트 폴드는 표본의 충분한 범위를 포함해야 하며, 각 테스트 시점보다 학습이 먼저 이루어져야 한다. 저자들은 학습의 충분성, 테스트 포괄 범위, 미래 데이터 누출, 테스트 지점과 미래 학습 관측치 간 거리를 연결하는 한계로 이러한 목표를 형식화한다. 또한 베타 혼합 가정 아래 누출 편향의 한계를 구하고 그 크기를 시간적 거리에 연결한다. 분석은 확장형 워크포워드…
이 연구는 위험을 고려한 성과 기준에 따라 정책을 최적화하는 강화학습 접근법을 개발한다. 정책을 순위 의존 기대효용으로 평가해 에이전트가 수익과 하방 결과에 대해 서로 다른 선호를 표현할 수 있게 한다. 모델 불확실성에 대응하기 위해 모델링된 분포를 중심으로 한 바서슈타인 거리 구 안에서 최악의 수익률 분포를 기준으로 정책을 평가한다. 이에 따라 에이전트가 정책을 선택한 뒤 적대자가 성과를 낮추는 주변 분포를 고르는 중첩 의사결정 문제가 생긴다. 저자들은…
이 연구는 예측을 보류할 수 있는 분류기가 트레이딩 결정에 어떤 영향을 주는지 살펴본다. 일반적인 방향 분류기는 항상 시장 포지션을 전제로 하지만, 선택적 분류기는 예측을 보류할 때 포트폴리오를 투자하지 않은 상태로 둘 수 있다. 논문은 이진 분류와 상대적으로 작은 가격 변동을 별도 클래스로 추가한 삼진 분류를 다룬다. 삼진 분류는 모델이 방향 판단을 피할 또 다른 방법을 제공한다. 선택성을 높이면 예측 정확도와 예측을 제공하는 입력의 비중 사이에 절충이…
이 연구는 US 주식의 통계적 차익거래에 오토인코더를 활용한다. 기존의 2단계 방식에서는 가격결정 모델이나 주성분 모델이 합성 자산을 찾고, 별도의 평균회귀 전략이 트레이딩 신호를 만든다. 저자들은 먼저 주식 수익률로 표준 오토인코더를 학습하고, Ornstein-Uhlenbeck 과정에 기반한 전략을 구성한다. 이어서 포트폴리오 정책의 신경망 표현에 오토인코더를 통합해 자산 배분을 직접 산출한다. 결합 모델은 위험조정 수익률을 역전파해 엔드투엔드 방식으로…
이 연구는 서로 다른 예측 기간에 걸쳐 추세를 따르는 에이전트 집단으로 금융 예측을 모델링합니다. 실제 통화 환율 시계열로 나타낸 확률적·시간 가변 환경에서 집단이 어떻게 변하는지 살펴봅니다. 분석에서는 상호작용하지 않는 에이전트와 집단 내 상호작용에 따라 행동이 달라지는 에이전트를 비교합니다. 저자들은 집단 규모와 통계적 특성의 변화를 추적하고 평균 수명, 평균 효용, 그 분포를 보고합니다. 집단의 결과는 에이전트 간 상호작용의 강도와 형태 모두에 달려…
이 연구는 요인 발견과 요인 승인을 분리합니다. 에이전트는 후보를 제안하고 진단용 탐침을 만들 수 있으며, 고정된 통계 심판은 제안 이후에만 관측된 시장 결과를 사용해 각 제안을 평가합니다. 심판은 에이전트가 어떤 방식으로 제안하든 정지 시점에 관계없이 거짓 발견을 통제하도록 설계된 베팅 기반 검정을 사용합니다. 연구진은 고정 심판을 두고 스크립트, 밴딧, 언어 모델을 비교하며, 의도적으로 정보 누출이 있는 심판 세 가지와도 비교합니다. 근거는 참 요인을…