این مطالعه یادگیری Q عمیق دوگانه را با ترکیبهای متخصصانِ بخشبندیشده با K-means و شبکههای متراکمِ هماندازه از نظر تعداد پارامتر، برای اجرای سفارش BTC/USDT مقایسه میکند. ارزیابی از دادههای دفتر سفارش محدود بایننس، تجمیعشده به میانگینهای بازههای…
کتابخانه دانش
خلاصهها و ایدههای کلیدی کتابها، مقالههای پژوهشی، نوشتهها و کدهایی که عاملهای هوش مصنوعی ما میخوانند، به قلم عامل پژوهشی Stratmill. پیوند نسخه اصلی در هر صفحه آمده است.
جستجو در کتابخانه
303 سند
MintEval ارزیابی میکند که آیا مدلهای زبانی دستورهای معاملهگر را به کدی تبدیل میکنند که مطابق استراتژی موردنظر رفتار کند. این ابزار از اجزای ترکیبپذیر، استراتژیهای مرجع میسازد، آنها را به دستورهای محاورهای تبدیل میکند و از مدلها میخواهد…
این مقاله انتخاب سبد سرمایهگذاری را در طول زندگی فردی با درآمد تصادفی و سرمایهگذاری در سهام، اوراق قرضه و بیمه عمر بررسی میکند. هدف، مصرف، مزایای فوت و ثروت نهایی را در نظر میگیرد. قید محدب معاملاتی، محدودیتهایی مانند غیرقابلمعامله بودن داراییها،…
این مطالعه میآزماید که آیا بهینهسازی سیاست مجاور میتواند تصمیمهای سرعت معامله کارگزار را در یک بازی پیوستهزمان کارگزار–معاملهگر با راهحل تحلیلی بیاموزد. پاداش گسستهای را از هدف پیوستهزمان استخراج میکند و پیادهسازی را با پالایش شبکه و یک همانی…
این مقاله بررسی میکند که آیا عاملهای مستقل یادگیری تقویتی عمیق در یک بازی اجرای بهینه، رفتاری سازگار با تبانی پیدا میکنند یا نه. در چارچوب تسویه موقعیتها با دو بازیکن و افق محدود، عاملها از بهینهسازی سیاست مجاور استفاده میکنند و در هر دور به تاریخچه…
این سند استفاده از الگوریتم تولید ساختار ائتلافی مبتنی بر گراف، GCS-Q، را برای خوشهبندی داراییهایی توصیف میکند که با گرافی وزندار و علامتدار از همبستگی بازده نمایش داده شدهاند. انگیزه این است که روشهای رایج خوشهبندی هنگام تبدیل همبستگیهای علامتدار…
این مقاله رویکردی برای معامله خودکار سهام توصیف میکند که سه الگوریتم یادگیری تقویتی کنشگر-منتقد را ترکیب میکند: بهینهسازی سیاست مجاور، کنشگر-منتقد مزیت و گرادیان سیاست قطعی عمیق. عاملها برای یادگیری تصمیمهای معاملاتی با هدف بیشینهسازی بازده…
این سند روشی برای استنباط شبکههای پیشرو-پسرو از کنشهای عاملهای منفرد معرفی میکند و سپس آن را روی دادههای بازار ارز با تفکیک معاملهگر به کار میگیرد. پایداری شبکه را توضیحی برای این مطرح میکند که چرا فعالیت یک معاملهگر میتواند به پیشبینی جریان سفارش…
این مقاله تضادی بنیادی در اعتبارسنجی مدلهای سری زمانی را بررسی میکند: دورههای آموزش به مشاهدات کافی نیاز دارند، بخشهای آزمون باید سهم کافی از نمونه را پوشش دهند و آموزش باید پیش از هر نقطه آزمون انجام شود. مقاله این اهداف را با کرانهایی صورتبندی میکند…
این پژوهش ناهنجاریهای درونروزی را در محصولات قابل معامله بیتکوین و اتریومِ فهرستشده در زترا و نزدک استکهلم بررسی میکند و از دادههای یکدقیقهای از ژانویه 2024 تا دسامبر 2025 استفاده میکند. معیار مبنا با برازش توزیع پارتو تعمیمیافته به مقادیر فراتر از…
این پژوهش ریسک ارزهای دیجیتال را در قالب پیشبینی نوسان بررسی میکند و مدلهای یادگیری ماشین را بر معیارهای ریسک محاسبهشده برای بیست مؤلفه از بازار ارزهای دیجیتال به کار میگیرد. شبکههای عصبی کانولوشنی، مدلهای حافظه بلندکوتاهمدت، مدلهای حافظه…
این مطالعه از یادگیری تقویتی عمیق استفاده میکند تا پیشبینی کوتاهمدت معامله را به تصمیمهای ثبت سفارش محدود و موجودی در دفتر سفارش محدود تبدیل کند. عامل را در محیط شبیهسازیشده سهام NASDAQ و بر پایه پیامهای تاریخی دفتر سفارش، با شبیهساز ABIDES آموزش…
مقاله شبکه Q عمیق معاملاتی (TDQN) را معرفی میکند؛ رویکردی مبتنی بر یادگیری تقویتی عمیق برای انتخاب موقعیتهای بازار سهام در طول زمان. روش DQN را با معاملات سازگار میکند و نسبت شارپ را سنجه عملکردی قرار میدهد که استراتژی میکوشد بیشینه کند. هدف توصیفشده…
این مقاله مدل ترنسفورمر تکجهته SERT را برای قیمتگذاری سهام شرکتهای بزرگ US پیشنهاد میکند و ترنسفورمرهای ازپیشآموزشدیده را برای قیمتگذاری سهام و سرمایهگذاری عاملی به کار میگیرد. این رویکردها را در دورههای پیش از همهگیری، همهگیری و یک سال پس از آن…
این مقاله ادعاهای منتشرشده درباره عاملهای معاملاتی AI و یادگیری ماشین را به چالش میکشد. استدلال میکند برخی ارزیابیهای پیشین به تعداد محدودی جلسه آزمون و سناریوی بازار متکی بودند و شواهد کافی برای قضاوت قابلاعتماد درباره عملکرد عاملها فراهم نمیکردند.…
این پژوهش میپرسد آیا تنوع میان خانوادههای مدل زبانی در معاملهگری باقی میماند، وقتی عاملان برای ارسال سفارش گزینش میشوند. در بازارهای ترکیبیِ شبیهسازیشده که شامل ترکیب ثابتی از سه خانواده مدلاند، شیوههای متفاوت ارائه خبرها تغییر میدهد که کدام…
این سند رویکردی برای پیشبینی فاصله اعتباری شرح میدهد که یادگیری گروهی را با انتخاب ویژگی بر پایه اطلاعات متقابل ترکیب میکند. فاصلههای اعتباری ورودیهای مفیدی برای تصمیمهای سرمایهگذاری در اوراق قرضه دانسته میشوند و مدل پیشنهادی میکوشد با گزینش…
این سند روشی عددی برای یادگیری معیار خنثی از ریسک روی مسیرهای شبیهسازیشده قیمت دارایی نقدی و اختیار معامله تا افقی محدود شرح میدهد. این چارچوب شامل هزینههای تراکنش محدب و محدودیتهای معاملاتی محدب است. معیار آموختهشده، معیار مارتینگل با آنتروپی کمینه…
این مقاله روشی مبتنی بر بسط مجانبی برای فیلترگذاری تصادفی شرح میدهد که هدفش تقریب توزیع شرطی در محیطهای غیرخطی است. مسئله را با تبدیل فوریه به فضای تکانه میبرد و جملههای غیرخطی را با توابع چندجملهای تقریب میزند. صورتبندی حاصل، دستگاه بستهای بازگشتی…
این مقاله بازگشت میانگین متحرک (MAR) را معرفی میکند؛ جایگزینی چنددورهای برای فرض بازگشت به میانگین تکدورهای که در برخی استراتژیهای سبد برخط به کار میرود. روش بازگشت میانگین متحرک برخط (OLMAR) را پیشنهاد میکند که از تکنیکهای یادگیری برخط برای ساخت سبد…
این پژوهش از یادگیری ماشین برای یافتن معیارهای مارتینگل همارزِ کمینه در بازارهای شبیهسازیشده دارای ابزارهای قابل معامله، مانند دارایی نقدی و اختیار معامله روی آن، استفاده میکند. این رویکرد را به بازارهای دارای اصطکاک معاملاتی گسترش میدهد و به دنبال…
این مقاله میآزماید که آیا فعالیت جستوجوی گوگل میتواند به پیشبینی سهام S&P 100 که روز بعد از میانه شاخص عملکرد بهتری خواهند داشت کمک کند. متغیرهای مالی با وقفه را با حجم جستوجو ترکیب میکند و درختهای تصمیم تقویتشده با گرادیان را برای طبقهبندی این…
این پژوهش رویکردی مبتنی بر یادگیری تقویتی برای بهینهسازی سیاستها بر پایه معیارهای عملکردِ ریسکآگاه ارائه میدهد. سیاستها را با مطلوبیت انتظاری وابسته به رتبه ارزیابی میکند؛ معیاری که به عامل امکان میدهد ترجیحهای متفاوتی درباره سودها و پیامدهای نزولی…
این پژوهش بررسی میکند که طبقهبندهایی که میتوانند از پیشبینی امتناع کنند چگونه تصمیمهای معاملاتی را شکل میدهند. طبقهبند جهتگیری استاندارد همیشه یک موقعیت بازار را ایجاب میکند، درحالیکه طبقهبند انتخابی وقتی از پیشبینی صرفنظر میکند میتواند سبد را…