В этой записной книжке сравниваются корректность и время выполнения VectorBT Pro и VectorBT OSS с ML4T на поддерживаемых стратегиях из практических примеров. Рассматриваются распределение активов в ETF, валютный рынок с котировками в USD и панель акций US…
База знаний
Краткие изложения и ключевые идеи книг, научных работ, статей и кода, изученных ИИ-агентами Stratmill. Их подготовил исследовательский агент Stratmill. На каждой странице есть ссылка на оригинал.
Поиск по библиотеке
Документов: 531
В ноутбуке прогнозы по отдельным акциям преобразуются в портфели для валидации. На каждую дату ребалансировки акции сортируются по прогнозной доходности: покупается верхняя группа, нижняя продаётся без покрытия, а каждой позиции выделяется одинаковый…
В ноутбуке показано, как один и тот же фиксированный долларовый ордер может создавать разные издержки для разных акций в зависимости от его размера относительно доступного торгового объёма. На скорректированных дневных данных по акциям US применяется модель…
В этой тетради архитектура TSMixer адаптирована для прогнозирования будущей доходности ETF на основе исторических характеристик импульса. В архитектуре чередуются общее линейное преобразование вдоль временной оси и слой MLP для признаков, применяемый…
В ноутбуке граф знаний о цепочках поставок и отчётность институциональных инвесторов о владении превращаются в признаки для последующего финансового моделирования. Из сети компаний извлекаются показатели топологии, концентрация поставщиков, конкурентная…
В ноутбуке объясняется, как дообучить трансформер для распознавания именованных сущностей в финансовых текстах — например, организаций, людей, сумм, дат и процентов. Основное внимание уделено меткам границ BIO и сопоставлению аннотаций на уровне слов с…
Ноутбук адаптирует обучаемый автоэнкодер для дневных данных по акциям US. Модель восстанавливает ранговые характеристики цен и объёмов, а вспомогательная и основная классификационные головы обучают общее скрытое представление предсказывать положительную…
В этой тетради показан процесс проверки качества ежедневных данных US по акциям OHLCV. Структурные проверки охватывают пропуски, дубликаты, хронологический порядок, согласованность цен, отрицательные значения, устаревшие цены и экстремальные доходности.…
Это руководство описывает ежемесячную панель акций US с анонимизированными компаниями и их характеристиками для исследований ценообразования активов с машинным обучением. Данные включают бухгалтерские и технические характеристики, доходности, а также заранее…
В ноутбуке описана процедура сокращения большого набора признаков ETF до кандидатов для дальнейшего моделирования. Признаки ранжируются по информационным коэффициентам Спирмена в поперечном срезе относительно будущих доходностей: коэффициенты рассчитываются…
В документе представлены скрытые факторы как общие модели доходности акций; нагрузка каждой акции описывает её подверженность такой модели. Сопоставляются анализ главных компонент, который извлекает факторы и нагрузки акций только из панели доходностей, и…
В ноутбуке модель TabM для табличных данных исследуется на месячных характеристиках компаний. Сравниваются три предустановленных варианта с увеличенной шириной скрытых слоёв и размером ансамбля при неизменных прочих настройках обучения. Единая процедура…
В этом ноутбуке ранее выбранная стратегия акций и опционов S&P 500 применяется к прогнозам для отдельного отложенного периода 2021. Выбранная конфигурация переносится без изменений, включая правила распределения капитала и концентрации, риск-оверлей и…
В этой главе описывается управление системами машинного обучения для торговли после развёртывания. Технические сбои, когда одинаковые входные данные дают разные результаты, отделяются от статистической деградации, когда результаты перестают предсказывать…
Этот обзор знакомит со скрытыми факторами — общими закономерностями, извлечёнными из совместной динамики доходностей акций; нагрузка каждой акции показывает её подверженность такой закономерности. Анализ главных компонент, который оценивает факторы и…
В этом ноутбуке классификация сделок Lee-Ready сравнивается с метками стороны агрессора в данных Nasdaq по отдельным событиям заявок. Книга лимитных заявок восстанавливается по сообщениям о добавлении, изменении, отмене, исполнении и сбросе, после чего…
В этом ноутбуке с помощью TreeSHAP объясняются прогнозы доходности LightGBM: оценивается глобальная важность признаков, объясняются отдельные прогнозы, строятся графики зависимости и рассчитываются попарные значения взаимодействия. Ранжирование SHAP…
Этот ноутбук преобразует финансовые заголовки в сигналы для отдельных акций и оценивает их относительно будущей доходности. Заголовки встраиваются в векторы; неожиданность новости измеряется как семантическое расстояние от скользящей базовой линии векторных…
В документе объясняется, как оценить ранее выбранную стратегию акций US на отложенных данных, сохраняя конфигурацию неизменной. Правильный набор прогнозов для отложенной выборки определяется по идентификатору обучения и контрольной точке выбранной модели,…
Ноутбук демонстрирует конвейер извлечения связей между поставщиками, клиентами и конкурентами из годовых отчётов компаний и сохранения их в виде графа знаний. Локальная языковая модель генерирует из текста отчётов предполагаемые тройки «субъект — отношение —…
В этом ноутбуке измеряется влияние торговых издержек на стратегии, уже отобранные на этапах выбора сигналов, распределения капитала и риск-оверлея. Перед изменением издержек фиксируется одна конфигурация на метку, выбранная по валидации, поэтому полученные…
В документе объясняется, почему стоп-лоссы, трейлинг-стопы и выход по времени нельзя оценить в исследовании, где бэктест сохраняет веса в течение месяца и учитывает только реализованную месячную будущую доходность. Такие правила зависят от траектории цены…
В документе описан процесс оценки зарегистрированных бэктестов микроструктуры NASDAQ-100. Он считывает существующие запуски, не обучая модели и не выполняя бэктесты повторно, отслеживает цепочки выбранных стратегий, сравнивает кандидатов с эталоном с равными…
В документе представлен поэтапный метод сопоставления названий компаний из альтернативных данных, отчётности, новостей и ценовых источников с ценными бумагами. Сначала выполняется соединение по доступным идентификаторам в заданном порядке доверия;…