数据预处理中常见的哑编码/独热编码(One-Hot Encoding)详解(一看就懂)

通常需要处理的数值都是稀疏而又散乱地分布在空间中,然而,我们并不需要存储这些大数值,这时可以用独热编码。 例如:我们需要处理4维向量空间,当给一个特征向量的第n个特征进行编码时,编码器会遍历每个特征向量的第n个特征,然后进行非重复计数。若第n个特征的最大值为K,则就把这个特征转换为只有一个值为1而其他值都是0的K+1维向量。 encoder=OneHotEncoder(sparse=False) 
相关文章
相关标签/搜索