状态 → 计算过程:盘前定参数族 / 盘内查偏移 / 验证闭环

盘 前(跨日,可预生成)
params 文件(每日 KB 级, 二进制 slot, 原子 rename)
⤷ θ_family 因子族级离散参数
⤷ 跨日 60d PCA + k=4 聚类 + 阈值基准
⤷ 时间戳 ≤ t−1(无前视由构造保证)
worker(8 进程 × 50 线程 / per-date 独立)
第一遍 · 全市场直方图
当日截面分位 top1%/top10% + 4 状态标量 + 卖压三档 → DailyState(内存常驻,不落盘跨日)
第二遍 · per-stock per 高峰
高峰阈值缩放 / 窗口档位 / 特征启用集 —— 参数 = θ_family 查表 + DailyState 查 δ 偏移(离散档位,无连续搜索)
改造:首遍聚合固化为 DailyState;第 3 遍(探索版)被“逐字段查内存表”消除 → 退回两遍读
后处理层(现有,线性校正)
乘数 / 符号 / 17 黑名单 / 中性化门控
⤷ 只改值不改构造
⤷ 同一条状态若已进计算层 → 此处乘数置 1
计算层 = 事件集合 / 特征构造(高峰定义、窗口、选层) │ 后处理层 = 数值缩放 / 门控 │ 同一条状态只订约一层(防双重计数)
① 参数版本载体(可比性)
P0(推荐):sidecar params/ 目录,回测按 date join → 不改 idx 因子名 / 不触 IDX magic
P1:新增因子族不替换,参数窗口前置进名字 f_s0_lowvol_x08
P2:idx 头扩展 version 区(schema 破坏,历史读不进)——除非逐日自动选版才用
纪律:参数平滑滞后一档 / 连续参数量化到离散网格 / 输出 params_daily.csv 供 regime 分层
② 逐值对账(验收线)
锚定列 = 常态日全部 983 因子,必须与基线逐值相等(<1e-6)
新增只允许出现在 新因子族,禁止修旧列
新增族 w/ block bootstrap CI(按日整段抽)→ CI 下限 > 基线该族 CI 上限 才算显著
防前视断言:参数字段时间戳≤t / 禁止当日连续搜索 / params↔colblk 日期对齐
③ 参数敏感性 & 过拟合
k/θ/W 固定小网格,报告必列敏感性表
族级收敛线(AIC/IC)即停,族因子数先验固定
新增 m 族 → Bonferroni α/m 校正族级 p 阈值
regime 整段分层留出(非随机日留出)