基于MSELoss()与CrossEntropyLoss()的区别详解-侯体宗的博客

基于MSELoss()与CrossEntropyLoss()的区别详解
Python / 管理员发布于 6年前 1225

基于pytorch来讲

MSELoss（）多用于回归问题，也可以用于one_hotted编码形式，

CrossEntropyLoss()名字为交叉熵损失函数，不用于one_hotted编码形式

MSELoss（）要求batch_x与batch_y的tensor都是FloatTensor类型

CrossEntropyLoss（）要求batch_x为Float，batch_y为LongTensor类型

（1）CrossEntropyLoss（）举例说明：

比如二分类问题，最后一层输出的为2个值，比如下面的代码：

class CNN (nn.Module ) :  def __init__ ( self , hidden_size1 , output_size , dropout_p) :    super ( CNN , self ).__init__ ( )    self.hidden_size1 = hidden_size1    self.output_size = output_size    self.dropout_p = dropout_p        self.conv1 = nn.Conv1d ( 1,8,3,padding =1)     self.fc1 = nn.Linear (8*500, self.hidden_size1 )    self.out = nn.Linear (self.hidden_size1,self.output_size )      def forward ( self , encoder_outputs ) :    cnn_out = F.max_pool1d ( F.relu (self.conv1(encoder_outputs)),2)     cnn_out = F.dropout ( cnn_out ,self.dropout_p) #加一个dropout    cnn_out = cnn_out.view (-1,8*500)     output_1 = torch.tanh ( self.fc1 ( cnn_out ) )    output = self.out ( ouput_1)    return output

最后的输出结果为：

上面一个tensor为output结果，下面为target，没有使用one_hotted编码。

训练过程如下：

cnn_optimizer = torch.optim.SGD(cnn.parameters(),learning_rate,momentum=0.9,\  weight_decay=1e-5)criterion = nn.CrossEntropyLoss() def train ( input_variable , target_variable , cnn , cnn_optimizer , criterion ) :  cnn_output = cnn( input_variable )  print(cnn_output)  print(target_variable)  loss = criterion ( cnn_output , target_variable)  cnn_optimizer.zero_grad ()  loss.backward( )  cnn_optimizer.step( )  #print('loss: ',loss.item())  return loss.item() #返回损失

说明CrossEntropyLoss()是output两位为one_hotted编码形式，但target不是one_hotted编码形式。

（2）MSELoss（）举例说明：

网络结构不变，但是标签是one_hotted编码形式。下面的图仅做说明，网络结构不太对，出来的预测也不太对。

如果target不是one_hotted编码形式会报错，报的错误如下。

目前自己理解的两者的区别，就是这样的，至于多分类问题是不是也是样的有待考察。

以上这篇基于MSELoss()与CrossEntropyLoss()的区别详解就是小编分享给大家的全部内容了，希望能给大家一个参考，也希望大家多多支持。

上一条：
pytorch绘制并显示loss曲线和acc曲线，LeNet5识别图像准确率
下一条：
pytorch 实现cross entropy损失函数计算方式

0条评论 (评论内容有缓存机制,请悉知!)

最新最热

近期评论
test1 在
opencode + Oh-my-openagent,我的第一个免费的ai编程智能体管家:Sisyphus中评论 test..
122 在
学历：一种延缓就业设计，生活需求下的权衡之选中评论工作几年后，报名考研了，到现在还没认真学习备考，迷茫中。作为一名北漂互联网打工人..
Zita 在
Google AI Studio升级全栈 vibe coding体验，可直接构建带登录和数据库的应用中评论 111222..
123 在
Clash for Windows作者删库跑路了，github已404中评论按理说只要你在国内，所有的流量进出都在监控范围内，不管你怎么隐藏也没用，想搞你分..
原梓番博客在
在Laravel框架中使用模型Model分表最简单的方法中评论好久好久都没看友情链接申请了，今天刚看，已经添加。..

Top