【数据挖掘】阿里云天池-数据挖掘入门-二手车价格预测

九筒-

已于 2022-03-15 18:59:30 修改

阅读量2.6k

点赞数 1

CC 4.0 BY-SA版权

分类专栏：数据挖掘文章标签：机器学习人工智能数据分析数据挖掘阿里云天池

于 2021-06-13 14:56:51 首次发布

本文链接：https://blog.youkuaiyun.com/weixin_44343282/article/details/117875807

本文介绍了参与阿里云天池数据挖掘竞赛的二手车价格预测任务，包括数据预处理（如缺失值处理、异常值处理、归一化）、特征工程和建模过程。重点讨论了在数据挖掘中如何处理缺失值，异常值的处理策略，以及在特征工程中创建新特征的重要性。建模阶段提到了集成学习方法，如随机森林和LightGBM，并解释了Stacking模型融合的概念。

摘要生成于 C知道，由 DeepSeek-R1 满血版支持，前往体验 >

题目

赛题以预测二手车的交易价格为任务，数据集报名后可见并可下载，该数据来自某交易平台的二手车交易记录，总数据量超过40w，包含31列变量信息，其中15列为匿名变量。为了保证比赛的公平性，将会从中抽取15万条作为训练集，5万条作为测试集A，5万条作为测试集B，同时会对name、model、brand和regionCode等信息进行脱敏。
题目链接
 代码链接