文章详情

短信预约-IT技能 免费直播动态提醒

请输入下面的图形验证码

提交验证

短信预约提醒成功

Python如何用鸢尾花数据绘制ROC和AUC曲线

2023-07-05 03:26

关注

这篇“Python如何用鸢尾花数据绘制ROC和AUC曲线”文章的知识点大部分人都不太理解,所以小编给大家总结了以下内容,内容详细,步骤清晰,具有一定的借鉴价值,希望大家阅读完这篇文章能有所收获,下面我们一起来看看这篇“Python如何用鸢尾花数据绘制ROC和AUC曲线”文章吧。

一、ROC与AUC

很多学习器是为了测试样本产生的一个实值或概率预测,然后将这个预测值与一个分类阈值(threshold)进行比较,若大于阈值则分为正类,否则为反类。主要看需要建立的模型侧重于想用在测试数据的泛华性能的好坏。排序本身的质量好坏体系了综合考虑学习去在不同任务下的“期望泛化性能”的好坏。ROC曲线则是从这个角度出发来研究学习器泛化性能。

1.ROC

ROC的全称是“受试者工作特征”曲线,与P-R曲线相似。与P-R曲线使用查准率、查全率为纵、横坐标不同,ROC曲线的纵轴是“真正例率”{简称TPR),横轴是“假正例率”(简称FPR)二者分别定义为:

Python如何用鸢尾花数据绘制ROC和AUC曲线

ROC曲线图以真正例率为Y轴,假正例率为X轴。

2.AUC

进行检验判定ROC曲线性能的合理判据是比较ROC曲线下的面积,即AUC。从定义知AUC可通过对ROC曲线下各部分的面积求和而得,AUC可估算为:

Python如何用鸢尾花数据绘制ROC和AUC曲线

从形式化看,AUC考虑的是样本预测的排序质量,因此它与排序误差有紧密联系。因此存在排序损失。

二、代码实现

形式基本和P-R曲线差不多,只是几个数值要改一下。

代码如下(示例):

from sklearn import svm, datasetsfrom sklearn.model_selection import train_test_splitfrom sklearn.metrics import roc_curve, aucfrom itertools import cyclefrom sklearn.preprocessing import label_binarize #标签二值化LabelBinarizer,可以把yes和no转化为0和1,或是把incident和normal转化为0和1。import numpy as npfrom sklearn.multiclass import OneVsRestClassifieriris = datasets.load_iris()# 鸢尾花数据导入X = iris.data#每一列代表了萼片或花瓣的长宽,一共4列,每一列代表某个被测量的鸢尾植物,iris.shape=(150,4)y = iris.target#target是一个数组,存储了data中每条记录属于哪一类鸢尾植物,所以数组的长度是150,所有不同值只有三个random_state = np.random.RandomState(0)#给定状态为0的随机数组y = label_binarize(y, classes=[0, 1, 2])n_classes = y.shape[1]n_samples, n_features = X.shapeX  = np.c_[X, random_state.randn(n_samples, 200 * n_features)]#添加合并生成特征测试数据集X_train, X_test, y_train, y_test = train_test_split(X, y,                                                    test_size=0.25,                                                    random_state=0)#根据此模型训练简单数据分类器classifier = OneVsRestClassifier(svm.SVC(kernel='linear', probability=True,                                 random_state=random_state))#线性分类支持向量机y_score = classifier.fit(X_train, y_train).decision_function(X_test)#用一个分类器对应一个类别, 每个分类器都把其他全部的类别作为相反类别看待。fpr = dict()tpr = dict()roc_auc = dict()for i in range(n_classes):    fpr[i], tpr[i], _ = roc_curve(y_test[:, i], y_score[:, i])    #计算ROC曲线面积    roc_auc[i] = auc(fpr[i], tpr[i])fpr["micro"], tpr["micro"], _ = roc_curve(y_test.ravel(), y_score.ravel())roc_auc["micro"] = auc(fpr["micro"], tpr["micro"])import matplotlib.pyplot as pltplt.figure()lw = 2plt.plot(fpr[2], tpr[2], color='darkorange',         lw=lw, label='ROC curve (area = %0.2f)' % roc_auc[2])plt.plot([0, 1], [0, 1], color='navy', lw=lw, linestyle='--')plt.xlabel('FPR')plt.ylabel('TPR')plt.ylim([0.0, 1.0])plt.xlim([0.0, 1.0])plt.legend(loc="lower right")plt.title("Precision-Recall")plt.show()

效果

Python如何用鸢尾花数据绘制ROC和AUC曲线

以上就是关于“Python如何用鸢尾花数据绘制ROC和AUC曲线”这篇文章的内容,相信大家都有了一定的了解,希望小编分享的内容对大家有帮助,若想了解更多相关的知识内容,请关注编程网行业资讯频道。

阅读原文内容投诉

免责声明:

① 本站未注明“稿件来源”的信息均来自网络整理。其文字、图片和音视频稿件的所属权归原作者所有。本站收集整理出于非商业性的教育和科研之目的,并不意味着本站赞同其观点或证实其内容的真实性。仅作为临时的测试数据,供内部测试之用。本站并未授权任何人以任何方式主动获取本站任何信息。

② 本站未注明“稿件来源”的临时测试数据将在测试完成后最终做删除处理。有问题或投稿请发送至: 邮箱/279061341@qq.com QQ/279061341

软考中级精品资料免费领

  • 历年真题答案解析
  • 备考技巧名师总结
  • 高频考点精准押题
  • 2024年上半年信息系统项目管理师第二批次真题及答案解析(完整版)

    难度     813人已做
    查看
  • 【考后总结】2024年5月26日信息系统项目管理师第2批次考情分析

    难度     354人已做
    查看
  • 【考后总结】2024年5月25日信息系统项目管理师第1批次考情分析

    难度     318人已做
    查看
  • 2024年上半年软考高项第一、二批次真题考点汇总(完整版)

    难度     435人已做
    查看
  • 2024年上半年系统架构设计师考试综合知识真题

    难度     224人已做
    查看

相关文章

发现更多好内容

猜你喜欢

AI推送时光机
位置:首页-资讯-后端开发
咦!没有更多了?去看看其它编程学习网 内容吧
首页课程
资料下载
问答资讯