张杰部落格
最新博客
  • 大数据 摘要: 1、 NAMENODE职责(1)负责客户端请求的响应(2)元数据的管理(查询,修改)2、元数据的存储机制A、内存中有一份完整的元数据(内存metadata)B、磁盘有一个“准完整”的元数据镜像(fsimage)文件(在namenode的工作目录中)C、用于衔接内存metadata和持久化元数据镜像fsimag...          发表于 2020-06-20 21:12 阅读(80) 评论(0)

  • Java 摘要: 1、List 与set 的区别?老掉牙的问题了,还在这里老生常谈:List特点:元素有放入顺序,元素可重复 ,Set特点:元素无放入顺序,元素不可重复。2、数据库的三大范式?原子性、一致性、唯一性3、对象与引用对象的区别4、谈谈你对反射机制的理解及其用途?Java反射机制是一个非常强大的功能,在很多大型项目比... 1592919778926033671.jpg    TIM截图20180701114213    尾插法    发表于 2020-06-20 21:11 阅读(69) 评论(0)

  • Positive-unlabeled learning 摘要: 概要:半监督学习(semi-supervised learning)七夕节到了,你是不是遇到了这样一个难题,该送什么礼物给女朋友呢?假设你已经知道一堆她喜欢的物品列表(从她的购物车中得知),土豪朋友当然就是全买买买。但是对于新时代女性来说,这样的行为一点新意也没有,虽然你买的东西都是她故意让你看到。作为一个有...       发表于 2020-04-27 16:17 阅读(135) 评论(0)

  • 如何理解召回率与精确率? 摘要: 实际上非常简单,精确率是针对我们预测结果而言的,它表示的是预测为正的样本中有多少是真正的正样本。那么预测为正就有两种可能了,一种就是把正类预测为正类(TP),另一种就是把负类预测为正类(FP),也就是而召回率是针对我们原来的样本而言的,它表示的是样本中的正例有多少被预测正确了。那也有两种可能,一种是把原来的正... 发表于 2020-04-26 19:35 阅读(109) 评论(0)

  • 数据挖掘机器学习中相关概念 摘要: (1)决策树模型中用到的算法有ID3, C4.5和C5.0来生成树,ID3使用信息增益选择属性特征,C4.5选择信息增益率选择属性特征,CART选择GINI系数作为选择特征的方法。(一)ID3算法熵:表示随机变量的不确定性。条件熵:在一个条件下,随机变量的不确定性。信息增益:熵 - 条件熵在一个条件下,信息不...    发表于 2020-04-16 22:30 阅读(104) 评论(0)

  • spark为什么比hadoop要快? 摘要: 1、消除了冗余的HDFS读写Hadoop每次shuffle操作后,必须写到磁盘,而Spark在shuffle后不一定落盘,可以cache到内存中,以便迭代时使用。如果操作复杂,很多的shufle操作,那么Hadoop的读写IO时间会大大增加。2、消除了冗余的MapReduce阶段Hadoop的shuffle操... 发表于 2020-03-06 14:52 阅读(156) 评论(0)

  • linux下Mysql导出数据到文件的方法 摘要: linux下Mysql导出数据到文件的方法 mysql -h host -u user -P port -p -e 'select xxx from xxx where xx = x' > /xxx/xxx/xxx/sss.txt导出到文件,如果有多个字段的话,可以使用concat函数来连接再导出。... 发表于 2020-03-03 15:23 阅读(136) 评论(0)

  • Hive通过正则获取匹配的内容 摘要: 1、使用举例:regexp_extract(field,'(1[0-9]{10})',0) 获取手机号部分。field字段中含有手机号,'(1[0-9]{10})'是手机号的正则,0表示第一个满足的字符串;2、使用正则作为过滤条件:mobile regexp '^1[0-9]{10}'。... 发表于 2020-03-02 16:31 阅读(160) 评论(0)

  • nginx 启动报错:Job for nginx.service failed because the control process exited with error code 摘要: nginx启动报错:Job for nginx.service failed because the control process exited with error code. See "systemctl status nginx.service" and "journalctl -xe" for de... 发表于 2020-02-26 12:40 阅读(246) 评论(0)

  • centos 7 没有nginx源的问题解决 摘要: 在centos 7上安装nginx,使用命令yum install nginx -y,报错如下:[root@tomcat data]# yum install nginx -y已加载插件:fastestmirrorLoading mirror speeds from cached hostfile * bas... 发表于 2020-02-26 11:47 阅读(177) 评论(0)

Powered by IMZHANGJIE.CN Copyright © 2015-2020 粤ICP备14056181号