什么是winsorize 处理

 我来答
Xiaewell
2019-10-18 · TA获得超过2873个赞
知道答主
回答量:59
采纳率:0%
帮助的人:4.2万
展开全部

winsorize处理是用相应分位数的值替代分位数之外的值,而不是删掉,这样可以最大限度的保存数据信息另外,这个跟数据多少没关系。

主要是根据已有文献来的,如果别人用winsorize你也要用,否则你的结论和别人的没有可比性。至少在金融领域,使用winsorize比较普遍,删除异常值的做法越来越少的被使用了。

扩展资料

Winsorize变换其实挺简单的,对于给定分位数界限(比如5%),对于超出上下界的部分用分位数代替,这样可以减少极端值对于分布的影响。算法挺简单的,用Excel都能完成。

上下1%极端值处理,如果一个样本某变量的值大于该变量的99分位数,则该样本的值被强制指定为99分位数的值。

类似的,如果一个样本某变量的值小于该变量的1分位数,则该样本该变量的值被强制指定为1分位数。

百度网友1e9fe85
2015-03-28 · TA获得超过256个赞
知道答主
回答量:104
采纳率:0%
帮助的人:39.9万
展开全部
上下1%极端值处理
如果一个样本某变量的值大于该变量的99分位数,则该样本的值被强制指定为99分位数的值;类似的,如果一个样本某变量的值小于该变量的1分位数,则该样本该变量的值被强制指定为1分位数
已赞过 已踩过<
你对这个回答的评价是?
评论 收起
推荐律师服务: 若未解决您的问题,请您详细描述您的问题,通过百度律临进行免费专业咨询

为你推荐:

下载百度知道APP,抢鲜体验
使用百度知道APP,立即抢鲜体验。你的手机镜头里或许有别人想知道的答案。
扫描二维码下载
×

类别

我们会通过消息、邮箱等方式尽快将举报结果通知您。

说明

0/200

提交
取消

辅 助

模 式