Pytorch训练模型得到输出后计算F1-Score 和AUC的操作

更新时间：2021年05月14日 08:40:23 作者：烟雨人长安

这篇文章主要介绍了Pytorch训练模型得到输出后计算F1-Score 和AUC的操作，具有很好的参考价值，希望对大家有所帮助。如有错误或未考虑完全的地方，望不吝赐教

1、计算F1-Score

对于二分类来说，假设batch size 大小为64的话，那么模型一个batch的输出应该是torch.size([64,2])，所以首先做的是得到这个二维矩阵的每一行的最大索引值，然后添加到一个列表中，同时把标签也添加到一个列表中，最后使用sklearn中计算F1的工具包进行计算，代码如下

import numpy as np
import sklearn.metrics import f1_score
prob_all = []
lable_all = []
for i, (data,label) in tqdm(train_data_loader):
    prob = model(data) #表示模型的预测输出
    prob = prob.cpu().numpy() #先把prob转到CPU上，然后再转成numpy，如果本身在CPU上训练的话就不用先转成CPU了
    prob_all.extend(np.argmax(prob,axis=1)) #求每一行的最大值索引
    label_all.extend(label)
print("F1-Score:{:.4f}".format(f1_score(label_all,prob_all)))

2、计算AUC

计算AUC的时候，本次使用的是sklearn中的roc_auc_score () 方法

输入参数：

y_true：真实的标签。形状 (n_samples，) 或 (n_samples, n_classes)。二分类的形状 (n_samples，1)，而多标签情况的形状 (n_samples, n_classes)。

y_score：目标分数。形状 (n_samples，) 或 (n_samples, n_classes)。二分类情况形状 (n_samples，1)，“分数必须是具有较大标签的类的分数”，通俗点理解：模型打分的第二列。举个例子：模型输入的得分是一个数组 [0.98361117 0.01638886]，索引是其类别，这里 “较大标签类的分数”，指的是索引为 1 的分数：0.01638886，也就是正例的预测得分。

average='macro'：二分类时，该参数可以忽略。用于多分类，' micro '：将标签指标矩阵的每个元素看作一个标签，计算全局的指标。' macro '：计算每个标签的指标，并找到它们的未加权平均值。这并没有考虑标签的不平衡。' weighted '：计算每个标签的指标，并找到它们的平均值，根据支持度 (每个标签的真实实例的数量) 进行加权。

sample_weight=None：样本权重。形状 (n_samples，)，默认 = 无。

max_fpr=None：

multi_class='raise'：(多分类的问题在下一篇文章中解释)

labels=None：

输出：

auc：是一个 float 的值。

import numpy as np
import sklearn.metrics import roc_auc_score
prob_all = []
lable_all = []
for i, (data,label) in tqdm(train_data_loader):
    prob = model(data) #表示模型的预测输出
    prob_all.extend(prob[:,1].cpu().numpy()) #prob[:,1]返回每一行第二列的数，根据该函数的参数可知，y_score表示的较大标签类的分数，因此就是最大索引对应的那个值，而不是最大索引值
    label_all.extend(label)
print("AUC:{:.4f}".format(roc_auc_score(label_all,prob_all)))

补充：pytorch训练模型的一些坑

1. 图像读取

opencv的python和c++读取的图像结果不一致，是因为python和c++采用的opencv版本不一样，从而使用的解码库不同，导致读取的结果不同。

2. 图像变换

PIL和pytorch的图像resize操作，与opencv的resize结果不一样，这样会导致训练采用PIL，预测时采用opencv，结果差别很大，尤其是在检测和分割任务中比较明显。

3. 数值计算

pytorch的torch.exp与c++的exp计算，10e-6的数值时候会有10e-3的误差，对于高精度计算需要特别注意，比如

两个输入5.601597， 5.601601，经过exp计算后变成270.85862343143174， 270.85970686809225

以上为个人经验，希望能给大家一个参考，也希望大家多多支持脚本之家。

您可能感兴趣的文章:

python中threading开启关闭线程操作
这篇文章主要介绍了python中threading开启关闭线程操作，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧
2020-05-05
django执行原生SQL查询的实现
本文主要介绍了django执行原生SQL查询的实现，主要有两种方法实现，文中通过示例代码介绍的非常详细，具有一定的参考价值，感兴趣的小伙伴们可以参考一下
2021-08-08
opencv中cv2.minAreaRect函数输出角度问题详解
minAreaRect返回的数据包括了矩形的中心点，宽、高，和旋转角度,下面这篇文章主要给大家介绍了关于opencv中cv2.minAreaRect函数输出角度问题的相关资料,需要的朋友可以参考下
2022-11-11
tensorflow 大于某个值为1,小于为0的实例
这篇文章主要介绍了tensorflow 大于某个值为1,小于为0的实例，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧
2020-06-06
Python subprocess模块详细解读
这篇文章主要介绍了Python subprocess模块详细解读，分享了相关代码示例，小编觉得还是挺不错的，具有一定借鉴价值，需要的朋友可以参考下
2018-01-01
Python爬虫403错误的终极解决方案
爬虫在爬取数据时,常常会遇到"HTTP Error 403: Forbidden"的提示,其实它只是一个HTTP状态码,表示你在请求一个资源文件但是nginx不允许你查看,下面这篇文章主要给大家介绍了关于Python爬虫403错误的终极解决方案,需要的朋友可以参考下
2023-05-05
3个 Python 编程技巧
这篇文章主要介绍 Python 编程技巧,我们知道，字典的本质是哈希表，本身是无法排序的，但 Python 3.6 之后，字典是可以按照插入的顺序进行遍历的，这就是有序字典，其中的原理，可以阅读为什么 Python3.6 之后字典是有序的。本文也会介绍该内容,需要的朋友可以参考一下
2021-10-10
Python设计模式之原型模式实例详解
这篇文章主要介绍了Python设计模式之原型模式,结合实例形式较为详细的分析了Python原型模式的概念、原理、用法及相关操作注意事项,需要的朋友可以参考下
2019-01-01
python实现植物大战僵尸游戏实例代码
这篇文章主要给大家介绍了关于python实现植物大战僵尸游戏的相关资料，文中通过示例代码介绍的非常详细，对大家学习或者使用python具有一定的参考学习价值，需要的朋友们下面来一起学习学习吧
2019-06-06
Python中的__SLOTS__属性使用示例
这篇文章主要介绍了Python中的__SLOTS__属性使用示例,本文直接给出代码示例,需要的朋友可以参考下
2015-02-02