【自动调参】年化29.3%，最大回撤18.5%：lightGBM的参数优化

研报复现继续：【研报复现】年化27.1%，人工智能多因子大类资产配置策略之benchmark

昨天调了一版参数，主要是lambda_l1, lambda_l2，防止过拟合的，有明显的效果：年化29.3%，最大回撤18.5%，还有继续优化的空间。

def train(df_train, df_val, feature_cols, label_col='label'):
    model = LGBMRegressor(boosting='gbdt',  # gbdt \ dart
                          n_estimators=600,  # 迭代次数
                          learning_rate=0.1,  # 步长
                          max_depth=10,  # 树的最大深度
                          seed=42,  # 指定随机种子，为了复现结果
                          num_leaves=250,
                          # min_split_gain=0.01,
                          lambda_l1=2,
                          lambda_l2=2000
                          )

目前使用的是GridCV网格参数搜索：

ef adj_params(X_train, y_train):
    """模型调参"""
    params = {
        # 'n_estimators': [100, 200, 300, 400,500,600,700,800],
        # 'learning_rate': [0.01, 0.03, 0.05, 0.1],
        'max_depth': range(10, 64, 2),
        # 'lambda_l1': range(0,3),
        # 'lambda_l2':[200,400,800,1000,1200,1400,1600,2000]
    }

    other_params = {'learning_rate': 0.1, 'seed': 42, 'lambda_l1': 2, 'lambda_l2': 2000}
    model_adj = LGBMRegressor(**other_params)

    # sklearn提供的调参工具，训练集k折交叉验证(消除数据切分产生数据分布不均匀的影响)
    optimized_param = GridSearchCV(estimator=model_adj, param_grid=params, scoring='r2', cv=5, verbose=1)
    # 模型训练
    optimized_param.fit(X_train, y_train)

    # 对应参数的k折交叉验证平均得分
    means = optimized_param.cv_results_['mean_test_score']
    params = optimized_param.cv_results_['params']
    for mean, param in zip(means, params):
        print("mean_score: %f,  params: %r" % (mean, param))
    # 最佳模型参数
    print('参数的最佳取值：{0}'.format(optimized_param.best_params_))
    # 最佳参数模型得分
    print('最佳模型得分:{0}'.format(optimized_param.best_score_))