最新博客
  • Positive-unlabeled learning 摘要: 概要:半监督学习(semi-supervised learning)七夕节到了,你是不是遇到了这样一个难题,该送什么礼物给女朋友呢?假设你已经知道一堆她喜欢的物品列表(从她的购物车中得知),土豪朋友当然就是全买买买。但是对于新时代女性来说,这样的行为一点新意也没有,虽然你买的东西都是她故意让你看到。作为一个有...       发表于 2020-04-27 16:17 阅读(3297) 评论(0)

  • 如何理解召回率与精确率? 摘要: 实际上非常简单,精确率是针对我们预测结果而言的,它表示的是预测为正的样本中有多少是真正的正样本。那么预测为正就有两种可能了,一种就是把正类预测为正类(TP),另一种就是把负类预测为正类(FP),也就是而召回率是针对我们原来的样本而言的,它表示的是样本中的正例有多少被预测正确了。那也有两种可能,一种是把原来的正... 发表于 2020-04-26 19:35 阅读(2691) 评论(0)

  • 数据挖掘机器学习中相关概念 摘要: (1)决策树模型中用到的算法有ID3, C4.5和C5.0来生成树,ID3使用信息增益选择属性特征,C4.5选择信息增益率选择属性特征,CART选择GINI系数作为选择特征的方法。(一)ID3算法熵:表示随机变量的不确定性。条件熵:在一个条件下,随机变量的不确定性。信息增益:熵 - 条件熵在一个条件下,信息不...    发表于 2020-04-16 22:30 阅读(1500) 评论(0)

Powered by IMZHANGJIE.CN Copyright © 2015-2025 粤ICP备14056181号