python评价指标_详解分类评价指标和回归评价指标以及Python代码实现--688IT编程网

python评价指标_详解分类评价指标和回归评价指标以及

Python代码实现

这篇⽂章介绍的内容是详解分类评价指标和回归评价指标以及Python代码实现，有着⼀定的参考价值，现在分享给⼤家，有需要的朋友可以参考⼀下。

1、概念

性能度量(评价)指标，主分为两⼤类：

1)分类评价指标(classification)，主要分析，离散的，整数的。其具体指标包括accuracy(准确率)，precision(精确率)，recall(召回率)，F值，P-R曲线，ROC曲线和AUC。

2)回归评价指标(regression)，主要分析整数和实数之间的关系。其具体指标包括可释⽅差得分(explianed_variance_score)，平均绝对误差MAE(mean_absolute_error)，均⽅误差MSE(mean-squared_error)，均⽅根差RMSE，交叉熵lloss(Log loss，cross-entropy loss)，R⽅值(确定系数，r2_score)。

1.1、前提假设只有两类-正类(positive)和负类(negative)，通常以关注的类为正类，其他类为负类(故多类问题亦可归纳为两类)

混淆矩阵(Confusion matrix)如下实际类别预测类别

正负总结

正TPFNP(实际为正)

负FPTNN(实际为负)表中AB模式：第⼀个表⽰预测结果的对错，第⼆个表⽰预测的类别。如TP表⽰，True Positive，即正确的预测为正类；FN表⽰，False Negative，即错误的预测为了负类。

2、评价指标(性能度量)

2.1、分类评价指标2.1.1 值指标-Accuracy、Precision、Recall、F值度量Accuracy(准确率)Precision(精确率)Recall(召回率)F值

定义正确分类的样本数与总样本数之⽐(预测为垃圾短信中真正的垃圾短信的⽐例)判定为正例中真正正例数与判定为正例数之⽐(所有真的垃圾短信被分类求正确出来的⽐例)被正确判定为正例数与总正例数之⽐准确率与召回率的调和平均F-score

表⽰accuracy=precision=recall=F - score =1.precision也常称为查准率，recall称为查全率

2.⽐较常⽤的是F1，

python3.6代码实现：#调⽤sklearn库中的指标求解from sklearn import ics import

precision_recall_ics import average_precision_ics import accuracy_score#给出分类结果y_pred = [0, 1, 0, 0]

y_true = [0, 1, 1, 1]

print("accuracy_score:", accuracy_score(y_true, y_pred))

print("precision_score:", metrics.precision_score(y_true, y_pred))

print("recall_score:", all_score(y_true, y_pred))

print("f1_score:", metrics.f1_score(y_true, y_pred))

print("f0.5_score:", metrics.fbeta_score(y_true, y_pred, beta=0.5))

print("f2_score:", metrics.fbeta_score(y_true, y_pred, beta=2.0))2.1.2 相关曲线-P-R曲线、ROC曲线及AUC值

1)P-R曲线

步骤：

1、从⾼到低将”score”值排序并依次作为阈值threshold；

2、对于每个阈值，”score”值⼤于或等于这个threshold的测试样本被认为正例，其他为负例。从⽽形成⼀组预测数。

eg.

将0.9作为阈值，则第1个测试样本为正例，2、3、4、5为负例

python新手代码及作用

得到预测为正例预测为负例总计

正例(score⼤于阈值)0.90.11

负例(score⼩于阈值)0.2+0.3+0.3+0.35 = 1.150.8+0.7+0.7+0.65 = 2.854

precision=

recall=在阈值以下的部分，当作负例，则预测为负例的取值情况是正确预测值，即如果本⾝是正例，则取TP；如果本⾝是负例，则取TN，其都为预测分值。

python实现伪代码#precision和recall的求法如上

#主要介绍⼀下python画图的库

import matplotlib.pyplot ad plt

#主要⽤于矩阵运算的库

import numpy as np#导⼊iris数据及训练见前⼀博⽂

...

#加⼊800个噪声特征，增加图像的复杂度

#将150*800的噪声特征矩阵与150*4的鸢尾花数据集列合并

X = np.c_[X, np.random.RandomState(0).randn(n_samples, 200*n_features)]

#计算precision，recall得到数组

for i in range(n_classes):

#计算三类鸢尾花的评价指标， _作为临时的名称使⽤

precision[i], recall[i], _ = precision_recall_curve(y_test[:, i], y_score[:,i])#plot作图plt.clf()

for i in range(n_classes):

plt.plot(recall[i], precision[i])

plt.xlim([0.0, 1.0])

plt.ylim([0.0, 1.05])

plt.xlabel("Recall")

plt.ylabel("Precision")

plt.show()

将上述代码补充完整后得到鸢尾花数据集的P-R曲线

2)ROC曲线

横轴：假正例率 fp rate = FP / N

纵轴：真正例率 tp rate = TP / N

步骤：

1、从⾼到低将”score”值排序并依次作为阈值threshold；

2、对于每个阈值，”score”值⼤于或等于这个threshold的测试样本被认为正例，其他为负例。从⽽形成⼀组预测数。同P-R曲线计算类似，不再赘述

鸢尾花数据集的ROC图像为

AUC(Area Under Curve)定义为ROC曲线下的⾯积

AUC值提供了分类器的⼀个整体数值。通常AUC越⼤，分类器更好，取值为[0, 1]

2.2、回归评价指标

1)可释⽅差得分

2)平均绝对误差 MAE (Mean absolute error)

3)均⽅差 MSE (Mean squared error)

4)logistics回归损失

5)⼀致性评价 - pearson相关系数法

python代码实现ics import log_loss

log_loss(y_true, y_pred)from scipy.stats import pearsonr

pearsonr(rater1, rater2)ics import cohen_kappa_score

cohen_kappa_score(rater1, rater2)

688IT编程网

python评价指标_详解分类评价指标和回归评价指标以及Python代码实现

发表评论

推荐文章

java正则表达式选择题

一种基于正则表达式的DBC文件解析及报文分析方法[发明专利]

工龄小数点提取

非零金额正则表达式

提取文本中数字的函数

热门文章

利用正则表达式实现文本数据提取与处理

正则表达式零宽断言详解

文本匹配规则

excel中使用正则

1-31正则表达式

anki之高级筛选

BUAA_OO_2021_第一单元总结

insert语句递增写法

sublime text 3在行前插入递增数字序号的方法

字符串只允许数字和英文的正则

powerbuilder 正则表达式

Shell脚本编写的高级技巧利用正则表达式进行字符串匹配

JAVA正则表达式的三种模式:贪婪,勉强和占有的讨论

go regexp匹配规则

oracle regexp_substr 实现原理

基本的元字符回溯引用和前后查匹配模式

elasticsearch query dsl正则

oracle sql正则表达式

GA-设置目标

仅匹配全角片假名的正则表达式

最新文章

java正则表达式选择题

工龄小数点提取

非零金额正则表达式

提取文本中数字的函数

vue数字相加小数点变长-概述说明以及解释

vue validate 正则验证小数长度

标签列表

688IT编程网

python评价指标_详解分类评价指标和回归评价指标以及Python代码实现

发表评论

推荐文章

java正则表达式 选择题

一种基于正则表达式的DBC文件解析及报文分析方法[发明专利]

工龄小数点提取

非零金额 正则表达式

提取文本中数字的函数

热门文章

利用正则表达式实现文本数据提取与处理

正则表达式零宽断言详解

文本匹配规则

excel中使用正则

1-31正则表达式

anki之高级筛选

BUAA_OO_2021_第一单元总结

insert语句递增写法

sublime text 3在行前插入递增数字序号的方法

字符串只允许数字和英文的正则

powerbuilder 正则表达式

Shell脚本编写的高级技巧利用正则表达式进行字符串匹配

JAVA正则表达式的三种模式:贪婪,勉强和占有的讨论

go regexp匹配规则

oracle regexp_substr 实现原理

基本的元字符 回溯引用和前后查 匹配模式

elasticsearch query dsl正则

oracle sql正则表达式

GA-设置目标

仅匹配全角片假名的正则表达式

最新文章

java正则表达式 选择题

工龄小数点提取

非零金额 正则表达式

提取文本中数字的函数

vue数字相加小数点变长-概述说明以及解释

vue validate 正则验证小数长度

标签列表

java正则表达式选择题

非零金额正则表达式

基本的元字符回溯引用和前后查匹配模式

java正则表达式选择题

非零金额正则表达式