Đánh giá năng lực tự tiến hóa trong nghiên cứu alpha dài hạn
Tóm tắt
EverMine là khuôn khổ để kiểm tra liệu các tác nhân nghiên cứu có cải thiện khi tích lũy kỹ năng, công cụ và quy tắc có thể tái sử dụng trong quá trình khám phá alpha dài hạn hay không. Khuôn khổ biểu diễn trạng thái nghiên cứu bằng lịch sử nghiên cứu, danh mục nhân tố hiện tại và năng lực tích lũy. Các lượt chạy với nguồn lực tương ứng so sánh năng lực cố định và năng lực phát triển; những thử nghiệm nhánh bổ sung hoán đổi năng lực trong khi giữ nguyên lịch sử và trạng thái danh mục. Phương pháp phát lại trạng thái lịch sử được dùng để khảo sát cách lựa chọn ứng viên dựa trên kinh nghiệm ảnh hưởng đến kết quả danh mục.
Trong 18 quỹ đạo, năng lực phát triển không cho thấy mức cải thiện nhất quán từ đầu đến cuối; trong 48 nhánh tiếp diễn, năng lực tích lũy cũng không liên tục vượt trội so với tập hợp ban đầu. Việc tinh chỉnh cấu trúc nhân tố hiện có vẫn có thể hữu ích. Trong một lần phát lại thăm dò hai đợt sàng lọc từ một lượt chạy phát triển, các ứng viên bị loại dù có triển vọng riêng lẻ làm giảm nhẹ hệ số thông tin cuối cùng của danh mục khi được thêm lần lượt. Kết quả nhấn mạnh giá trị ứng viên phụ thuộc vào trạng thái danh mục và thứ tự gửi vào, nhưng bằng chứng phát lại còn hạn chế và không cho thấy mọi phương pháp tiến hóa năng lực đều sẽ có kết quả giống nhau.
Ý chính
- Khuôn khổ tách biệt lịch sử nghiên cứu, danh mục nhân tố hiện tại và năng lực có thể tái sử dụng.
- Các lượt chạy với nguồn lực tương ứng và phép hoán đổi năng lực có kiểm soát trạng thái ước tính giá trị năng lực từ những góc nhìn khác nhau.
- Tiến hóa năng lực không tạo ra mức cải thiện nhất quán trong các quỹ đạo hoặc nhánh tiếp diễn được báo cáo.
- Giá trị cận biên của ứng viên phụ thuộc vào danh mục hiện tại và thứ tự thêm ứng viên.
- Việc phát lại ứng viên đã sàng lọc chỉ mang tính thăm dò và xuất phát từ một quỹ đạo phát triển duy nhất.
Thẻ
Toàn văn
# EverMine: Dissecting the Self-Evolution of Research Capabilities in Long-Horizon Alpha Research # EverMine: Dissecting the Self-Evolution of Research Capabilities in Long-Horizon Alpha Research Self-evolving agents aim to turn research feedback into reusable skills, tools, and research rules. Whether these accumulated capabilities continue to improve later research requires controlled evaluation. Long-horizon alpha discovery provides a state-dependent setting: once a new factor enters the portfolio, the predictive information already covered changes, so the value of the same candidate or experience may change over time. We introduce EverMine, an empirical framework for studying self-evolving research capabilities in long-horizon alpha discovery. EverMine decomposes the research state into history (Hist), the current factor portfolio (Frontier), and reusable capabilities (Cap). Under matched resource limits, we compare complete runs with fixed or evolving Cap, and replace Cap while holding Hist and Frontier fixed to estimate the conditional value of accumulated capabilities. We also combine full trajectories with historical-state replay to examine how experience-based decisions affect candidate selection and portfolio outcomes. Across 18 long-horizon trajectories, end-to-end comparisons show no consistent gain from Cap evolution. Across 48 continuation branches from shared Hist and Frontier states, accumulated Cap also does not consistently outperform the initial Cap. Parameter tuning of existing factor structures can still improve the portfolio. In an exploratory replay of two screening batches from one Evolving trajectory, some screened-out candidates have positive marginal value at the original state, yet submitting all screened-out candidates sequentially slightly lowers final portfolio IC in both batches. These results show that candidate value depends on the evolving portfolio and submission order, and motivate evaluating self-evolving research capabilities through end-to-end outcomes, conditional capability value, and the consequences of experience-based decisions.
Hiển thị toàn văn kèm ghi nguồn theo giấy phép của tài liệu gốc. Giấy phép: abstract CC0
Bản tóm tắt này do tác nhân nghiên cứu của Stratmill biên soạn từ tài liệu gốc; đây không phải bản sao của tài liệu.