फ़्यूचर्स ट्रेडिंग के लिए डीप रीइन्फोर्समेंट लर्निंग रणनीतियाँ
सारांश
यह अध्ययन निरंतर फ़्यूचर्स ट्रेडिंग में डीप रीइन्फोर्समेंट लर्निंग लागू करता है और असतत तथा निरंतर, दोनों प्रकार के एक्शन स्पेस की जाँच करता है। यह पुरस्कार फ़ंक्शनों में अस्थिरता स्केलिंग शामिल करता है, ताकि पोज़िशन आकार बाज़ार की अस्थिरता के अनुसार बदलें। एल्गोरिदम का मूल्यांकन 2011 से 2019 तक 50 सबसे तरल फ़्यूचर्स अनुबंधों पर किया गया है; इनमें कमोडिटी, इक्विटी सूचकांक, निश्चित आय और विदेशी मुद्रा शामिल हैं।
रिपोर्ट किए गए प्रयोग सीखी गई रणनीतियों की तुलना टाइम-सीरीज़ मोमेंटम आधारों से करते हैं और पाते हैं कि रीइन्फोर्समेंट-लर्निंग विधियाँ भारी लेन-देन लागत के बाद भी बेहतर प्रदर्शन करती हैं। लेखक ऐसी रणनीतियों का वर्णन करते हैं जो बड़े रुझानों के दौरान स्थितियाँ बनाए रख सकती हैं और समेकन के दौरान जोखिम घटा सकती हैं या प्रतीक्षा कर सकती हैं। दस्तावेज़ सटीक एल्गोरिदम, अनुबंध निर्माण, सत्यापन डिज़ाइन या विस्तृत प्रदर्शन माप निर्दिष्ट नहीं करता; इसलिए निष्कर्षों को बताए गए डेटासेट और तुलना ढाँचे के संदर्भ में समझें, भविष्य के परिणामों की गारंटी के रूप में नहीं।
मुख्य विचार
- अध्ययन असतत और निरंतर, दोनों ट्रेडिंग कार्रवाइयों के साथ रीइन्फोर्समेंट-लर्निंग रणनीतियाँ प्रशिक्षित करता है।
- अस्थिरता-स्केल किए गए पुरस्कार बदलती बाज़ार अस्थिरता के अनुसार पोज़िशन जोखिम समायोजित करते हैं।
- मूल्यांकन में बताई गई ऐतिहासिक अवधि के दौरान कई परिसंपत्ति वर्गों के तरल फ़्यूचर्स शामिल हैं।
- विधियों की तुलना शास्त्रीय टाइम-सीरीज़ मोमेंटम से की गई है और बताया गया है कि वे लेन-देन लागत के बाद भी बेहतर रहीं।
- सारांश में सत्यापन विकल्पों या प्रदर्शन मापों का आकलन करने के लिए पर्याप्त विवरण नहीं है।
टैग
पूरा पाठ
# Deep Reinforcement Learning for Trading # Deep Reinforcement Learning for Trading We adopt Deep Reinforcement Learning algorithms to design trading strategies for continuous futures contracts. Both discrete and continuous action spaces are considered and volatility scaling is incorporated to create reward functions which scale trade positions based on market volatility. We test our algorithms on the 50 most liquid futures contracts from 2011 to 2019, and investigate how performance varies across different asset classes including commodities, equity indices, fixed income and FX markets. We compare our algorithms against classical time series momentum strategies, and show that our method outperforms such baseline models, delivering positive profits despite heavy transaction costs. The experiments show that the proposed algorithms can follow large market trends without changing positions and can also scale down, or hold, through consolidation periods.
स्रोत के लाइसेंस के तहत श्रेय सहित पूरा पाठ दिखाया गया है। लाइसेंस: abstract CC0
यह सारांश मूल स्रोत के आधार पर Stratmill के शोध एजेंट ने लिखा है; यह स्रोत की प्रति नहीं है।