张杰部落格
最新博客
  • windows 10 hyper-v 挂载物理磁盘 摘要: (本文是面向初次使用hyper-v新手所写)实验环境:1. 物理机系统win10 64位2. Hyper-v安装的windows server standard 2008 sp23. 无法使用增强会话功能实验目的:将物理机上的一块磁盘挂载到(虚拟机)windows server standard 2008 s... 发表于 2020-09-20 14:57 阅读(57) 评论(0)

  • Hbase开启GZIP压缩 摘要: 由于本人在阿里云存储的是一些文章,文章的访问频次一般,所以平时使用CPU的时间不算密集,且对于在阿里云上使用nas来说,存储越小花费就越小,所以就准备开启GZIP压缩。另外也是因为当时搭建hadoop集群的时候没有snappy的编译库。以下是Google几年前发布的一组测试数据(数据有些老了,有人近期做过测试... 发表于 2020-08-29 11:09 阅读(51) 评论(0)

  • hbase 主动做major_compact减少存储 摘要: #当修改数据,发现hbase占用空间过大时,可以手动触发major_compacthbase shellmajor_compact 'itdaan:post'... 发表于 2020-08-29 10:46 阅读(67) 评论(0)

  • solrcloud相关备忘 摘要: SOLRCloud相关操作:启动:bin/solr restart -e cloud先在zookeeper上上传configName/root/soft/solr-5.5.4/server/scripts/cloud-scripts/zkcli.sh -zkhost hadoop1:2181 -cmd upc... 发表于 2020-08-23 12:51 阅读(43) 评论(0)

  • 彻底解决 linux 下 buff/cache 占用过高的问题 摘要: 执行:0 4 * * * sync && echo 3 > /proc/sys/vm/drop_caches在crontab中定时清除:0 4 * * * sync && echo 3 > /proc/sys/vm/drop_caches... 发表于 2020-08-23 11:50 阅读(122) 评论(0)

  • 大数据 摘要: 1、 NAMENODE职责(1)负责客户端请求的响应(2)元数据的管理(查询,修改)2、元数据的存储机制A、内存中有一份完整的元数据(内存metadata)B、磁盘有一个“准完整”的元数据镜像(fsimage)文件(在namenode的工作目录中)C、用于衔接内存metadata和持久化元数据镜像fsimag...          发表于 2020-06-20 21:12 阅读(137) 评论(0)

  • Java 摘要: 1、List 与set 的区别?老掉牙的问题了,还在这里老生常谈:List特点:元素有放入顺序,元素可重复 ,Set特点:元素无放入顺序,元素不可重复。2、数据库的三大范式?原子性、一致性、唯一性3、对象与引用对象的区别4、谈谈你对反射机制的理解及其用途?Java反射机制是一个非常强大的功能,在很多大型项目比... 1592919778926033671.jpg    TIM截图20180701114213    尾插法    发表于 2020-06-20 21:11 阅读(136) 评论(0)

  • Positive-unlabeled learning 摘要: 概要:半监督学习(semi-supervised learning)七夕节到了,你是不是遇到了这样一个难题,该送什么礼物给女朋友呢?假设你已经知道一堆她喜欢的物品列表(从她的购物车中得知),土豪朋友当然就是全买买买。但是对于新时代女性来说,这样的行为一点新意也没有,虽然你买的东西都是她故意让你看到。作为一个有...       发表于 2020-04-27 16:17 阅读(278) 评论(0)

  • 如何理解召回率与精确率? 摘要: 实际上非常简单,精确率是针对我们预测结果而言的,它表示的是预测为正的样本中有多少是真正的正样本。那么预测为正就有两种可能了,一种就是把正类预测为正类(TP),另一种就是把负类预测为正类(FP),也就是而召回率是针对我们原来的样本而言的,它表示的是样本中的正例有多少被预测正确了。那也有两种可能,一种是把原来的正... 发表于 2020-04-26 19:35 阅读(157) 评论(0)

  • 数据挖掘机器学习中相关概念 摘要: (1)决策树模型中用到的算法有ID3, C4.5和C5.0来生成树,ID3使用信息增益选择属性特征,C4.5选择信息增益率选择属性特征,CART选择GINI系数作为选择特征的方法。(一)ID3算法熵:表示随机变量的不确定性。条件熵:在一个条件下,随机变量的不确定性。信息增益:熵 - 条件熵在一个条件下,信息不...    发表于 2020-04-16 22:30 阅读(145) 评论(0)

Powered by IMZHANGJIE.CN Copyright © 2015-2020 粤ICP备14056181号