一句话:把上千个候选「打分公式」(因子)放进统一考场,用历史数据批量模拟买卖股票、逐一出成绩单,筛出真正能预测涨跌的好因子,再做深度复赛、导出归档。整个过程像一条自动化流水线。
不亲自干重活,负责组织整场考试:点名候选人、划定考场、布置试卷、按成绩定名次。
它和旧版系统长得一模一样,可以直接替换使用——这是设计上的刻意兼容。
所有考生共用的「标准答案」提前备好,全体共享,绝不重复劳动。
同时开 200 个工人,每人认领一个因子、独立完成全部工序,互不交接、互不排队。
这是整套引擎的心脏。它和上一代的最大区别:上一代是「读数据的人」和「计算的人」分成两组,中间有个交接瓶颈;这一代让每个工人从头包到尾,瓶颈消失。
一个因子进来,先体检、再变化出几十个「变体」、逐个预检、原始回测、洗去行业风格后再回测。
每个变体最终交出 4 张成绩单:持有 1 天 / 5 天 × 洗前 / 洗后。第 5 关是这套引擎的招牌——它回答的问题最有价值:「去掉人人皆知的因素之后,这个因子还有没有独门预测力?」
按成绩排出尖子生:四张榜单合并、剔除「长得太像」的、限量录取。
入选的尖子生还要参加「深度复赛」,最后导出成通用格式并自动生成文档。