如何进行数据的归一化处理

问问题描述

如何进行数据的归一化处理,这个怎么解决啊?快急疯了?

答精选答案

最佳答案

第一个问题,测试集的归一化的均值和标准偏差应该来源于训练集。如果你熟悉Python的sklearn的话,你就应该知道应该先对训练集数据fit,得到包含均值和标准偏差的scaler,然后再分别对训练集和验证集transform。这个问题其实很好,很多人不注意,最容易犯的错误就是先归一化,再划分训练测试集。

第二个问题,是均值方差归一化,最大最小归一化等不同归一化的选择问题。归一化的目的无非调整各个字段之间的数量级差异。均值方差归一化可能更适合你不知道数据的边界在哪里,最大最小归一化相当于整合到01之间,这相当于你是知道这个字段的边界在哪里。所以我个人更倾向于均值方差归一化。这个问题我只是经验之谈,不一定对。

本文来自作者[珠宝饰品]投稿,不代表公众科技网立场,如若转载,请注明出处:https://www.cpst.net.cn/changshijingxuan/202609/669367.html

赞 (0)

发表回复

本站作者后才能评论

评论列表(4条)

  • 珠宝饰品
    珠宝饰品 2026年09月30日

    我是公众科技网的签约作者“珠宝饰品”!

  • 珠宝饰品
    珠宝饰品 2026年09月30日

    希望本篇文章《如何进行数据的归一化处理》能对你有所帮助!

  • 珠宝饰品
    珠宝饰品 2026年09月30日

    本站[公众科技网]内容主要涵盖:教育咨询,知识百科

  • 珠宝饰品
    珠宝饰品 2026年09月30日

    本文概览:第一个问题,测试集的归一化的均值和标准偏差应该来源于训练集。如果你熟悉Python的sklearn的话,你就应该知道应该先对训练集数据fit,得到包含均值和标准偏差的scaler,然后再分别对训练集和验证集transform。这个问题其实很好,很多人不注意,最容易犯的错误就是先归一化,再划分训练测试集。第二个问题,是均值方差归一化,最大最小归一化等不同归一化的选择问题。归一化的目的无非调整各个字段之间的数量级差异。均值方差归一化可能更适合你不知道数据的边界在哪里,最大最小归一化相当于整合到01之间,这相当

联系我们

联系:143 0457 151

工作时间:周一至周五,9:30-18:30,节假日休息

关注我们