网格搜索调策略参数是暴力枚举,参数一多组合数指数爆炸;随机搜索省了枚举却盲目乱撞。贝叶斯优化换个脑子:每跑一次回测都是一次昂贵采样,它用高斯过程(GP)在已跑过的点上拟合一个『代理曲面』连同不确定度,再用采集函数(EI)权衡『去已知的好区域深挖』和『去没探过的区域碰运气』,把下一次回测的算力花在最值得试的参数上。本文从零手写 GP 代理 + EI 采集,在一个多峰目标上对比贝叶斯优化 vs 随机 vs 网格的收敛速度——同样逼近全局最优,贝叶斯优化用的回测次数是网格的零头。最后拆穿最致命的坑:在验证集上优化超参本身就是一种过拟合,优化得越狠样本外亏得越惨(中阶)。