JY · 量化研究工作台
GRU V3 · PRE-REGISTERED EXPERIMENTS

GRU V3受控实验审计报告

在不可变V1基线之上,按预注册矩阵分别检验M1–M5模型假设与P1组合执行假设。页面只呈现输入事实,不按事后最高收益自动选择升级版本。

不可变基线已核对M1–M5 · 模型层P1 · 组合与执行层未观察未来仍是最终边界

执行结论

通过历史门槛不等于正式升级;失败与未运行不会被隐藏
当前判断:M1–M5均未同时通过全部预注册门槛;不因年化收益较高而升格,正式V1不变。
未观察未来:2026-08-20起的数据未参与训练、验证、候选定义或历史门槛判断。
通过1
失败5
未运行0
运行中0

不可变基线哈希

报告只登记并核对输入哈希,不覆盖基线文件
工件路径SHA-256核对登记日
formal_v1/metrics.jsonC:\Users\admin\Documents\ChatGPT\量化\outputs\gru_v1_多折_截至20260819\metrics.json0e28d6b4dbdf7ee7c633de8e776d193bb0f0d3b7f62aa02e382d640798a1bcb6已核对2026-08-24
formal_v1/run_config.tomlC:\Users\admin\Documents\ChatGPT\量化\outputs\gru_v1_多折_截至20260819\run_config.toml62146abd821b42a64388a6b7c9f52552419397643dda28f2ec147513918719d6已核对2026-08-24
formal_v1/backtest.csvC:\Users\admin\Documents\ChatGPT\量化\outputs\gru_v1_多折_截至20260819\backtest.csva828c4ddb0968e07acce29539cfc5a85c2316efb3a1a253b0eba3dcd6c0b2c4e已核对2026-08-24
formal_v1/gru_fold_0.ptC:\Users\admin\Documents\ChatGPT\量化\outputs\gru_v1_多折_截至20260819\gru_fold_0.pt4f170a76a5de3dc6d2a2eb93c303ececdeb71dbdaabfe1864f0ace443c27012a已核对2026-08-24
formal_v1/gru_fold_1.ptC:\Users\admin\Documents\ChatGPT\量化\outputs\gru_v1_多折_截至20260819\gru_fold_1.pt77ddfa03a5be4bef9f6554d15a28b7ffa78b427afd9bb0012b3d2a9712baa3e5已核对2026-08-24
formal_v1/gru_fold_2.ptC:\Users\admin\Documents\ChatGPT\量化\outputs\gru_v1_多折_截至20260819\gru_fold_2.ptcb0911038b1c0e9a6dd6fcafdc265636f3d3161b363e17cf5a1a84aa42ae8716已核对2026-08-24
formal_v1/gru_fold_3.ptC:\Users\admin\Documents\ChatGPT\量化\outputs\gru_v1_多折_截至20260819\gru_fold_3.pt86c791f2aad388de5d72cce12047153b38a99196ecf5925e90ba2e658663273c已核对2026-08-24
strict_v2_control/baseline_metrics.jsonC:\Users\admin\Documents\ChatGPT\量化\outputs\gru_v2_受控优化_seed42_20260821\baseline_metrics.json0e28d6b4dbdf7ee7c633de8e776d193bb0f0d3b7f62aa02e382d640798a1bcb6已核对2026-08-24
strict_v2_control/candidate_summary.csvC:\Users\admin\Documents\ChatGPT\量化\outputs\gru_v2_受控优化_seed42_20260821\candidate_summary.csv2d431dcbd43ce417e3dff4584dd9c6849ceb77c0ab1df9580bd165a49298ec65已核对2026-08-24
strict_v2_control/cost_sensitivity.csvC:\Users\admin\Documents\ChatGPT\量化\outputs\gru_v2_受控优化_seed42_20260821\cost_sensitivity.csved2961bc4dffeb52cf90c7849c469408df398def8e689d80a689118db5539fc2已核对2026-08-24
strict_v2_control/fold_consistency.csvC:\Users\admin\Documents\ChatGPT\量化\outputs\gru_v2_受控优化_seed42_20260821\fold_consistency.csv5b9379df292a3ffb75f2dce096c159df3edcc62ea2e7c5a0afdfe85449b4ef43已核对2026-08-24
strict_v2_control/report_metadata.jsonC:\Users\admin\Documents\ChatGPT\量化\outputs\gru_v2_受控优化_seed42_20260821\report_metadata.json441c0d70aa63d72faaf6da447addf9039fc8f5fb0380b3442b0bd4fd3bb0ebe6已核对2026-08-24
strict_v2_control/run_config.tomlC:\Users\admin\Documents\ChatGPT\量化\outputs\gru_v2_受控优化_seed42_20260821\run_config.tomlaead0cbb0f310184ed0d6d97a113a9a40f3039d8dc4b876a67e459e050bcb67f已核对2026-08-24
strict_v2_control/candidates/v1_baseline_1x64/metrics.jsonC:\Users\admin\Documents\ChatGPT\量化\outputs\gru_v2_受控优化_seed42_20260821\candidates\v1_baseline_1x64\metrics.json05eb6cf5f026f7c39a89ee5c888d958f0f043192ba77a6d1f91f740ba221a347已核对2026-08-24
strict_v2_control/candidates/v1_baseline_1x64/backtest.csvC:\Users\admin\Documents\ChatGPT\量化\outputs\gru_v2_受控优化_seed42_20260821\candidates\v1_baseline_1x64\backtest.csv393f25d7cab9d4ae8b441af7d4126833f6b36781c0bf13d3db675d3e981e26a2已核对2026-08-24
strict_v2_control/candidates/v1_baseline_1x64/predictions.csvC:\Users\admin\Documents\ChatGPT\量化\outputs\gru_v2_受控优化_seed42_20260821\candidates\v1_baseline_1x64\predictions.csv583621f0d61523f63577f15731a064aafafc06ff90ee6919f1e1add6449dfe66已核对2026-08-24
strict_v2_control/weights/v1_baseline_1x64_fold_0.ptC:\Users\admin\Documents\ChatGPT\量化\outputs\gru_v2_受控优化_seed42_20260821\weights\v1_baseline_1x64_fold_0.pt40a8f2689837e1abcc44de2341b0896eb95ea49c405e1f83ca988b94cb781f4e已核对2026-08-24
strict_v2_control/weights/v1_baseline_1x64_fold_1.ptC:\Users\admin\Documents\ChatGPT\量化\outputs\gru_v2_受控优化_seed42_20260821\weights\v1_baseline_1x64_fold_1.pt7b5361a50b828f55674661a8aa97a53345bf78d33c36f94e4cbcc4d6cb9218d4已核对2026-08-24
strict_v2_control/weights/v1_baseline_1x64_fold_2.ptC:\Users\admin\Documents\ChatGPT\量化\outputs\gru_v2_受控优化_seed42_20260821\weights\v1_baseline_1x64_fold_2.pt23b3c1e0f825391b5f2e9b7c80dd8d5943fcbd04c7e6d2efbfc502a243f7dd25已核对2026-08-24
strict_v2_control/weights/v1_baseline_1x64_fold_3.ptC:\Users\admin\Documents\ChatGPT\量化\outputs\gru_v2_受控优化_seed42_20260821\weights\v1_baseline_1x64_fold_3.pt1ccf9d2da21ed264bf9acee4f96cdd0cbf7b901b428b46753773e82274368a78已核对2026-08-24

模型层 · M1–M5

每个实验只验证一个主要假设;组合规则保持共同控制口径
M1失败

GRU-LGBM固定50/50融合

两类模型的同折OOS排名包含互补信息,固定50/50可提高稳定性。

固定定义
固定Top50;四折滚动OOS;1/5/10 bp每边成本
参数规模
资源预算
seed42初筛;仅门槛通过者追加seed7/2024
预注册门槛
IC或ICIR、3/4折、5bp收益/回撤、换手、市值暴露全部满足
当前结果
rank_ic_gate;fold_gate;five_bps_relative_gate;turnover_gate
M2失败

基础24加四项长期状态的28特征

在基础24特征上只增加四项长期状态,可保留有效慢变量而不过度扩张特征空间。

固定定义
固定Top50;四折滚动OOS;1/5/10 bp每边成本
参数规模
18241.0
资源预算
seed42初筛;仅门槛通过者追加seed7/2024
预注册门槛
IC或ICIR、3/4折、5bp收益/回撤、换手、市值暴露全部满足
当前结果
rank_ic_gate;fold_gate;five_bps_relative_gate;five_bps_drawdown_gate
M3失败

20日主目标加5日辅助目标多任务

5日辅助目标能改善20日主目标的共享序列表征。

固定定义
固定Top50;四折滚动OOS;1/5/10 bp每边成本
参数规模
17538.0
资源预算
seed42初筛;仅门槛通过者追加seed7/2024
预注册门槛
IC或ICIR、3/4折、5bp收益/回撤、换手、市值暴露全部满足
当前结果
rank_ic_gate;fold_gate;five_bps_relative_gate;five_bps_drawdown_gate;latest_size_gate
M4失败

参数匹配因果TCN

在参数量与训练预算匹配时,因果TCN可能比GRU更稳定地提取多尺度时序依赖。

固定定义
固定Top50;四折滚动OOS;1/5/10 bp每边成本
参数规模
16953.0
资源预算
seed42初筛;仅门槛通过者追加seed7/2024
预注册门槛
IC或ICIR、3/4折、5bp收益/回撤、换手、市值暴露全部满足
当前结果
rank_ic_gate;fold_gate;five_bps_drawdown_gate;turnover_gate;latest_size_gate
M5失败

3/5/10日因果CNN-GRU

3、5、10日因果卷积的局部形态提取与GRU中期状态建模具有互补性。

固定定义
固定Top50;四折滚动OOS;1/5/10 bp每边成本
参数规模
17920.0
资源预算
seed42初筛;仅门槛通过者追加seed7/2024
预注册门槛
IC或ICIR、3/4折、5bp收益/回撤、换手、市值暴露全部满足
当前结果
rank_ic_gate;fold_gate;five_bps_relative_gate

研究依据与本项目落地映射

原论文与出版社页面核验于2026-08-24;文献用于提出假设,不替代本项目滚动OOS证据
阅读口径:下列研究覆盖机器翻译、通用序列、时间序列分类和不同金融样本。它们只能说明某类结构“值得受控检验”,不能证明在A股截面选股中必然增厚收益。最终判断仍以共同数据、共同四折、共同成本和预注册门槛为准。
GRU · 结构底座

门控记忆是合理底座,不是公认的万能赢家

研究能支持:Cho等人在RNN Encoder–Decoder中提出带更新门与重置门的门控循环单元;后续受控序列实验显示GRU与LSTM表现可比,且二者优于传统tanh循环单元。

项目映射:V1/V2与M2、M3、M5沿用GRU作为共同底座或后端,从而把新增变量尽量限制在特征、目标或局部卷积结构。

边界:原任务是机器翻译、语音与音乐序列,不是股票收益;“可比LSTM”也不等于GRU在本样本最优。

M1 · 模型融合

组合预测依赖误差互补,而不是模型名字不同

研究能支持:Bates与Granger给出了基于预测误差性质组合多个预测的经典框架,说明当误差并非完全同向时,组合可能优于单一预测。

项目映射:M1只在相同折、相同日期上把GRU与LGBM的截面百分位秩固定50/50融合;权重不从测试集调参,并单独披露两模型秩相关。

边界:经典框架不直接推出“等权秩融合必然最优”;若两模型高度同质或一方噪声更大,融合也会变差,必须由本项目OOS门槛否决或保留。

M2 · 长周期特征

丰富特征的价值来自可重复的非线性交互

研究能支持:Gu、Kelly与Xiu在经验资产定价中发现,树模型与神经网络的增益与非线性预测变量交互有关,并识别出动量、流动性和波动率等重要信号族。

项目映射:M2没有无上限堆因子,而是在基础24项上预先固定四项长期状态,检验慢变量是否提供与短中期特征不同的信息。

边界:该研究不验证本项目这四个具体字段、60日序列或A股样本;“更多特征”也可能只增加共线性和过拟合,所以M2仍必须看逐折OOS与成本后结果。

M3 · 多任务学习

辅助目标只有在共享信息真实存在时才有用

研究能支持:Caruana把多任务学习表述为利用相关任务训练信号进行归纳迁移;Ma与Tan则给出了把多任务方法用于股票排序的金融场景先例。

项目映射:M3固定20日主目标与5日辅助目标,共享同一GRU表征,Huber损失权重固定为0.7/0.3;选模和最终预测只以20日主目标为主,不把辅助任务结果冒充主任务提升。

边界:任务不相关或梯度冲突会产生负迁移;股票排序论文也不等同于本项目的数据、标签和交易成本,因而只能作为结构先例。

M4 · 因果TCN

卷积序列模型是GRU之外的可比基准

研究能支持:Bai、Kolter与Koltun在多类标准序列任务的系统比较中发现,简单卷积架构可优于典型循环网络,并表现出更长的有效记忆。

项目映射:M4使用因果卷积、扩张率1/2/4/8和61步感受野,并把参数量与训练预算匹配到GRU附近,检验架构差异而非算力差异。

边界:论文结论来自通用基准,不是金融截面回归,也不是“TCN普遍优于GRU”的定理;本项目只接受共同四折下的增量证据。

M5 · 多尺度CNN–GRU

并行卷积可表达不同局部尺度,但仍需因果化

研究能支持:InceptionTime展示了并行多长度卷积和深层残差CNN在大规模时间序列分类中的准确性与可扩展性,为多尺度局部模式提取提供了直接架构依据。

项目映射:M5把3/5/10日卷积全部改为因果形式,再接GRU建模中期状态;卷积通道数固定为5,使参数量约1.79万并与控制组接近。

边界:InceptionTime是时间序列分类与模型集成,不是因果CNN–GRU、收益回归或A股交易;这里只借用“多尺度卷积”思想,不移植其性能结论。

组合与执行层 · P1

冻结模型预测后检验缓冲、可卖性和现实成本;不反向证明模型更好
审计提醒:P1若来自看过历史结果后的Top100缓冲选择,只能称为事后组合诊断,绝不能标记为新增OOS;正式证据必须来自预注册后的未来影子样本。
P1通过

Top50/Top100真实执行

Top50买入、Top100持有缓冲在真实卖出约束下仍能降低换手且保留收益。

固定定义
冻结V1预测;Top50新买、Top100持有缓冲;受阻仓位继续持有
参数规模
资源预算
事后执行诊断,不新增预测OOS
预注册门槛
Top50/Top100与1/5/10 bp工件完整,且明确new_predictive_oos=false
当前结果
posthoc_execution_diagnostic_not_new_oos

候选总体指标

模型层与组合层不在同一排行中竞争
实验候选状态参数量Rank ICICIR年化相对年化Sharpe最大回撤换手通过折数
V1不可变正式GRU V1通过0.08510.49119.59%15.56%0.758-44.18%73.19%—/—
V2V1架构+Top50严格切分控制组通过17,4730.10470.66821.56%17.48%0.759-43.20%74.38%4.0/4.0
M1M1 GRU-LGBM固定50/50融合失败0.09850.64816.64%12.72%0.651-40.86%81.11%2.0/4.0
M2M2 基础24+四项长期状态失败18,2410.08820.51619.12%15.11%0.681-49.89%69.02%1.0/4.0
M3M3 20日主任务+5日辅助任务失败17,5380.08420.51514.52%10.67%0.584-43.66%73.53%1.0/4.0
M4M4 参数匹配因果TCN失败16,9530.08900.55820.14%16.10%0.703-44.34%86.12%1.0/4.0
M5M5 3/5/10日因果CNN-GRU失败17,9200.09500.60515.62%11.73%0.611-39.65%72.88%1.0/4.0
P1P1现实执行Top50基准通过0.08510.49119.66%15.64%0.759-44.18%73.14%—/—
P1P1现实执行Top50/Top100缓冲通过0.08510.49120.27%16.23%0.777-42.89%60.79%—/—

4折一致性

Checkpoint验证IC只用于选权重;门槛判断使用其后的测试OOS IC,二者不得混写
实验Checkpoint验证区间验证IC最佳Epoch测试OOS区间测试OOS IC控制组OOS IC相对收益最大回撤换手逐折OOS门槛
M11——————0.07720.1111-0.38%-15.94%76.69%失败
M12——————0.09700.0821-12.37%-36.12%76.88%通过
M13——————0.12610.149060.64%-12.10%85.75%失败
M14——————0.09400.07641.71%-22.81%84.96%通过
M212021-07-28—2022-06-290.115272022-07-28—2023-07-270.11160.11111.01%-20.40%63.84%通过
M222022-07-28—2023-06-290.154032023-07-28—2024-07-270.06570.0821-3.97%-41.82%66.71%失败
M232023-07-28—2024-06-280.097142024-07-28—2025-07-270.13390.149066.77%-12.42%67.92%失败
M242024-07-28—2025-06-270.099512025-07-28—2026-07-200.04100.0764-0.55%-26.78%77.00%失败
M312021-07-28—2022-06-290.102512022-07-28—2023-07-270.09800.1111-5.34%-14.97%70.57%失败
M322022-07-28—2023-06-290.077362023-07-28—2024-07-270.06680.0821-4.52%-36.24%69.25%失败
M332023-07-28—2024-06-280.070142024-07-28—2025-07-270.07430.149034.87%-14.35%69.67%失败
M342024-07-28—2025-06-270.152312025-07-28—2026-07-200.09730.07646.19%-23.74%84.00%通过
M412021-07-28—2022-06-290.1179122022-07-28—2023-07-270.08430.111116.81%-16.57%81.96%失败
M422022-07-28—2023-06-290.112352023-07-28—2024-07-270.07480.0821-6.46%-39.25%85.12%失败
M432023-07-28—2024-06-280.056992024-07-28—2025-07-270.12030.149064.21%-16.78%89.71%失败
M442024-07-28—2025-06-270.100632025-07-28—2026-07-200.07680.0764-14.31%-27.03%88.21%通过
M512021-07-28—2022-06-290.101212022-07-28—2023-07-270.08900.1111-2.19%-15.36%60.65%失败
M522022-07-28—2023-06-290.072432023-07-28—2024-07-270.09480.08217.52%-35.88%69.62%通过
M532023-07-28—2024-06-280.073412024-07-28—2025-07-270.13670.149044.16%-16.30%82.88%失败
M542024-07-28—2025-06-270.125312025-07-28—2026-07-200.05970.0764-6.87%-28.22%79.67%失败

M1折内融合诊断

只能使用相同折定义与共同日期;融合权重不得从测试集选择
折/区间秩相关GRU ICLGBM IC融合IC权重状态
00.1580.11110.02520.0772固定50/50失败
10.4650.08210.09460.0970固定50/50失败
20.4970.14900.07370.1261固定50/50失败
30.4180.07640.08130.0940固定50/50失败

P1现实执行诊断

旧持仓卖不出时必须继续持有并记录
情景执行规则买入Top退出Top换手相对年化回撤受阻卖出状态
P1现实执行Top50基准新买需可买、退出需可卖;固定1/50槽位505073.14%15.64%-44.18%3通过
P1现实执行Top50/Top100缓冲新买需可买、退出需可卖;固定1/50槽位5010060.79%16.23%-42.89%4通过

分年度收益

检查收益是否集中于单一年份
实验年份策略基准相对
M12022-7.38%-5.57%-1.92%
M12023-4.41%-16.02%13.81%
M120243.51%14.43%-9.54%
M1202582.79%26.82%44.13%
M120268.62%-0.75%9.44%
M220225.29%-5.57%11.50%
M22023-7.42%-16.02%10.24%
M220243.24%14.43%-9.78%
M2202590.13%26.82%49.92%
M220263.19%-0.75%3.96%
M32022-2.84%-5.57%2.89%
M32023-13.19%-16.02%3.37%
M3202419.91%14.43%4.79%
M3202543.22%26.82%12.93%
M3202616.96%-0.75%17.84%
M420222.15%-5.57%8.18%
M420230.77%-16.02%19.98%
M4202421.98%14.43%6.60%
M4202552.86%26.82%20.53%
M420266.36%-0.75%7.16%
M52022-7.05%-5.57%-1.57%
M52023-5.44%-16.02%12.59%
M5202426.56%14.43%10.60%
M5202554.59%26.82%21.89%
M520262.24%-0.75%3.01%
P12022-6.14%-5.57%-0.60%
P12023-16.31%-16.02%-0.35%
P1202428.85%14.43%12.60%
P1202575.38%26.82%38.29%
P1202613.24%-0.75%14.09%
P12022-3.66%-5.57%2.03%
P12023-16.02%-16.02%-0.01%
P1202424.60%14.43%8.89%
P1202576.07%26.82%38.83%
P1202615.50%-0.75%16.37%

成本敏感性

成本不会改变模型IC,但会改变可实施收益
实验成本年化相对年化Sharpe最大回撤
M11.0 bp/边16.64%12.72%0.651-40.86%
M15.0 bp/边12.91%9.11%0.546-43.37%
M110.0 bp/边8.40%4.76%0.416-46.36%
M21.0 bp/边19.12%15.11%0.681-49.89%
M25.0 bp/边15.87%11.97%0.600-51.07%
M210.0 bp/边11.93%8.17%0.499-52.51%
M31.0 bp/边14.52%10.67%0.584-43.66%
M35.0 bp/边11.19%7.45%0.490-45.74%
M310.0 bp/边7.16%3.56%0.373-48.39%
M41.0 bp/边20.14%16.10%0.703-44.34%
M45.0 bp/边16.06%12.16%0.603-46.06%
M410.0 bp/边11.16%7.42%0.479-48.14%
M51.0 bp/边15.62%11.73%0.611-39.65%
M55.0 bp/边12.29%8.51%0.520-41.83%
M510.0 bp/边8.26%4.62%0.406-44.44%
P11.0 bp/边19.66%15.64%0.759-44.18%
P15.0 bp/边16.21%12.30%0.659-46.24%
P110.0 bp/边12.03%8.26%0.535-48.72%
P11.0 bp/边20.27%16.23%0.777-42.89%
P15.0 bp/边17.38%13.44%0.694-44.54%
P110.0 bp/边13.87%10.04%0.590-46.54%

多随机种子

只给历史初筛通过者追加固定配置种子;完成运行不等于各seed另行过门槛,也不选最好seed
实验Seed/统计Rank ICICIR相对年化最大回撤
尚无多随机种子结果;不得把单一seed称为稳健。

市值暴露

最小10%/20%/30%为嵌套分组,不可相加
实验区间最小10%最小20%最小30%平均市值分位
M1all8.97%18.05%26.74%0.581
M12026-08-1010.00%22.00%32.00%0.437
M2all14.13%26.58%35.90%0.506
M22026-08-108.00%26.00%34.00%0.391
M3all11.03%19.52%27.27%0.594
M32026-08-1014.00%32.00%42.00%0.357
M4all12.45%21.70%29.13%0.565
M42026-08-1020.00%36.00%48.00%0.432
M5all9.73%17.65%25.48%0.590
M52026-08-102.00%4.00%8.00%0.583