为什么选用one-hot？_为什么引入onehot

作者：小小林熬夜学编程 | 2024-04-01 23:13:00

踩

为什么引入onehot

为什么选取one-hot？

普通标签编码：标签编码的问题是它假定类别值越高，该类别更好。根据标签编码的类别值，我们的迷你数据集中VW > Acura > Honda。比方说，假设模型内部计算平均值（神经网络中有大量加权平均运算），那么1 + 3 = 4，4 / 2 = 2. 这意味着：VW和Honda平均一下是Acura。毫无疑问，这是一个糟糕的方案。该模型的预测会有大量误差。

使用one-hot的直接原因是现在多分类cnn网络的输出通常是softmax层，而它的输出是一个概率分布，从而要求输入的标签也以概率分布的形式出现，进而计算交叉熵之类。one-hot其实就是给出了真实样本的真实概率分布，其中一个样本数据概率为1，其他全为0.。计算损失交叉熵时，直接用1*log（1/概率），就直接算出了交叉熵，作为损失。

声明：本文内容由网友自发贡献，不代表【wpsshop博客】立场，版权归原作者所有，本站不承担相应法律责任。如您发现有侵权的内容，请联系我们。转载请注明出处：https://www.wpsshop.cn/w/小小林熬夜学编程/article/detail/350367