Cette étude compare le Double Deep Q-Learning aux mélanges d’experts partitionnés par K-means et aux réseaux denses à nombre de paramètres équivalent pour l’exécution d’ordres sur BTC/USDT. L’évaluation utilise des données du carnet d’ordres à cours limité…
Bibliothèque de connaissances
Résumés et idées clés, rédigés par l’agent de recherche de Stratmill, à partir des livres, articles, travaux et code informatique consultés par nos agents IA. Chaque page renvoie à la source originale.
Rechercher dans la bibliothèque
303 documents
MintEval évalue si les modèles de langage traduisent les instructions des traders en code dont le comportement correspond à la stratégie voulue. Il construit des stratégies de référence à partir de composants combinables, les transforme en instructions…
Cet article étudie les choix de portefeuille au cours de la vie d’une personne dont les revenus sont stochastiques et qui investit dans des actions, une obligation et une assurance vie. L’objectif tient compte de la consommation, des prestations de décès et…
Cette étude teste si l’optimisation de politique proximale peut apprendre les décisions de vitesse de trading d’un courtier dans un jeu courtier-trader en temps continu dont la solution analytique est connue. Elle déduit une récompense discrète de l’objectif…
Cet article présente une méthode de développement asymptotique pour le filtrage stochastique, destinée à approximer une distribution conditionnelle dans des contextes non linéaires. Elle transforme le problème en espace des moments par une transformée de…
Le document décrit l’utilisation de l’algorithme Graph-based Coalition Structure Generation, GCS-Q, pour regrouper des actifs représentés par un graphe pondéré et signé de corrélations de rendement. La motivation est que les approches courantes de…
L’article décrit une approche automatisée du trading d’actions qui combine trois algorithmes d’apprentissage par renforcement acteur-critique : Proximal Policy Optimization, Advantage Actor Critic et Deep Deterministic Policy Gradient. Les agents sont…
L’étude utilise l’apprentissage par renforcement profond pour transformer une prévision de trading à court terme en décisions de placement d’ordres à cours limité et de gestion de l’inventaire dans un carnet d’ordres à cours limité. Elle entraîne un agent…
L’article présente Trading Deep Q-Network (TDQN), une approche d’apprentissage profond par renforcement visant à choisir des positions boursières au fil du temps. Il adapte la méthode DQN au trading et fixe le ratio de Sharpe comme mesure de performance à…
L’article propose un modèle Transformer à direction unique, SERT, pour valoriser les grandes capitalisations US et applique des Transformers préentraînés à la valorisation des actions et à l’investissement factoriel. Il compare ces approches aux Transformers…
L’article remet en question des affirmations publiées sur les agents de trading AI et d’apprentissage automatique. Il soutient que certaines évaluations antérieures reposaient sur un nombre limité de sessions de test et de scénarios de marché, ce qui…
Le document présente une méthode pour déduire des réseaux de décalage temporel à partir des actions d’agents individuels, puis l’applique à des données de change détaillées par trader. Il présente la persistance des réseaux comme une explication de la…
L’étude examine si la diversité des familles de modèles de langage persiste en trading après la sélection des agents chargés de soumettre des ordres. Dans des marchés synthétiques comprenant un mélange fixe de trois familles de modèles, différentes…
Le document présente une méthode de prévision des spreads de crédit qui combine l’apprentissage d’ensemble avec une sélection de caractéristiques fondée sur l’information mutuelle. Les spreads de crédit sont considérés comme des données utiles aux décisions…
Le document présente une méthode numérique pour apprendre une mesure risque-neutre à partir de trajectoires simulées de prix au comptant et d’options jusqu’à un horizon fini. Le cadre inclut des coûts de transaction convexes et des contraintes de trading…
Cet article présente le retour de moyenne mobile (MAR), une alternative multi-période à l’hypothèse de retour à la moyenne sur une période utilisée par certaines stratégies de portefeuille en ligne. Il propose le retour de moyenne mobile en ligne (OLMAR),…
Ce travail utilise l’apprentissage automatique pour trouver des mesures martingales équivalentes minimales dans des marchés simulés contenant des instruments négociables, comme un actif au comptant et des options sur cet actif. Il étend l’approche aux…
L’article étudie un conflit fondamental dans la validation de modèles de séries temporelles : les fenêtres d’entraînement doivent contenir suffisamment d’observations, les plis de test doivent couvrir une part suffisante de l’échantillon, et l’entraînement…
L’article examine si l’activité de recherche sur Google peut aider à prévoir quelles actions du S&P 100 feront mieux que la médiane de l’indice le lendemain. Il combine des variables financières retardées et les volumes de requêtes de recherche, puis…
Ce travail développe une approche d’apprentissage par renforcement pour optimiser des politiques selon des critères de performance tenant compte du risque. Il évalue les politiques à l’aide de l’utilité espérée dépendante du rang, qui permet à un agent…
Cette étude examine comment les classificateurs capables de s’abstenir de prédire peuvent orienter les décisions de trading. Un classificateur directionnel classique implique toujours une position de marché, tandis qu’un classificateur sélectif peut laisser…
Cette étude explore les autoencodeurs pour l’arbitrage statistique sur les actions US. Dans un processus classique en deux étapes, un modèle d’évaluation ou d’analyse en composantes principales identifie un actif synthétique, puis une stratégie distincte de…
Cette étude modélise la prévision financière comme une population d’agents qui suivent les tendances sur différents horizons de prévision. Elle examine l’évolution de cette population dans des environnements stochastiques et variables dans le temps,…
L’étude sépare la découverte des facteurs de leur approbation. Un agent peut proposer des candidats et créer des sondes diagnostiques, tandis qu’un arbitre statistique figé évalue chaque proposition à partir des résultats de marché observés uniquement après…