1、将下载的solr解压至D:\solr,拷贝d:\solr\solr-4.10.2\example\webapps\solr.war到Tomcat的webapps\目录中。直接解压solr.war或者启动Tomcat解压solr.war2、新建D:\solr\data目录,拷贝d:\solr\solr-4.10.2\example\solr文件夹到D:\solr\data3、修改D:\solr\data\solr\collection1\conf\sol
系统 2019-08-12 01:33:30 2579
需求:对已经发布的的网站进行升级,前提是:客户不能后上外网,数据库有做修改。想法:想通过安装包的形式对客户的网站进行升级,但是很多的软件不能够满足WEB端的安装(我没有找到)使用WinRAR自解压的方式过程:NO.1选中全部文件夹及问价右键添加到“XX.Rar”生成压缩包(PS:为了不产生累赘文件夹在web如下图不是选中RUICKY这个最外侧的文件夹而是RUICKY里面的)NO.2双击生成的压缩包,点击右上角的“自解压格式”,选择“高级自解压选项”如下图N
系统 2019-08-12 01:33:00 2579
2011年的计划到现在还没有做出来,最主要的原因是10年的方向并不清楚。趁着过年在家闲着的这段时间,把《我也能做CTO-程序员职业规划》这本书看一看,希望能对年度计划有所帮助。截止今日,已全部读完,以下是读书笔记。最后一章,由于离目前的我还较远,所以并没有做详细的记录。一些其它的想法/收获:《我也能做CTO-程序员职业规划》读书笔记
系统 2019-08-12 01:32:53 2579
原文:《BI那点儿事》数据流转换——条件性拆分根据条件分割数据是一个在数据流中添加复杂逻辑的方法,它允许根据条件将数据输出到其他不同的路径中。例如,可以将TotalSugar<27.4406的输出到一个路径,TotalSugar>=27.4406的输出到另一个路径。如图。可以从上面的属性结构中拖放一个列或者代码段,然后根据逻辑重命名而不是使用默认值Case1,还可以编辑输出列的名字。《BI那点儿事》数据流转换——条件性拆分
系统 2019-08-12 01:32:16 2579
原文:mysql支持的数据类型及其测试1.基础知识1.1如何来查看mysql的帮助手册?intHelpfloat;1.2创建表的规则CREATETABLE[IFNOTEXISTS]tbl_name(字段名字段类型[完整性的约束条件]);1.3如何向表中插入数据INSERT[INTO]tab_name[(字段名称……)]VALUES(值……)1.4Mysql数据类型1.数值型整数类型TINYINT:范围0~255;-128~127占用1字节SMALLINT;
系统 2019-08-12 01:32:09 2579
之前在公司做一个项目,项目需求是按照标签分类,去不同网站上爬取文章的内容,标题等。然后我就一个网站一个网站的去配xpath,可是网站特别多的时候,领导就会对我提出一个需求能不能,写一种程序然后用来解析所有的网站,也就是智能化解析。这对我一个刚刚做爬虫不久的新手就是很头疼了。于是各种网上找资料,于是发现了DIFFBOT这个东西。官网https://www.diffbot.com,注册后会有15天的免费使用的时间。注册后会发邮件给你一个token,通过toke
系统 2019-09-27 17:57:24 2578
下面就是今天下午的研究成果。发布系统需要响应用户的中断请求,需要在GET方法中杀掉由subprocess派生的子进程,刚开始直接用os.kill发现子进程的子进程无法kill,谷歌了一些,发现kill可以干掉进程组,于是测试,但是默认情况下,subprocess派生的进程组和主程序,也就是我的web.py进程是在一个进程组里的,这要是kill了,那就调的了。继续翻google,看subprocess的document时发现这个变量:subprocess.C
系统 2019-09-27 17:56:58 2578
最后一次更新于2019/07/10ICMPPing目的此任务是重新创建第3讲(延迟,丢失和吞吐量)中讨论的ping客户端。Ping是一个用于在计算机网络中测量延迟和丢失的工具。在实际应用中,我们可以通过ping命令分析判断网络失败的原因。当然,这类信息也可用于帮助我们选择性能更佳的IP地址作为代理服务器。原理Ping通常使用Internet控制消息协议(ICMP)报文来测量网络中的延迟和丢失:本机在ICMP包中发送回响请求(ICMP类型代码为8)给另一个主
系统 2019-09-27 17:56:16 2578
#-*-coding:utf-8-*-importsysreload(sys)sys.setdefaultencoding('utf-8')importosfromseleniumimportwebdriverfromselenium.webdriver.common.keysimportKeysfromselenium.webdriver.chrome.optionsimportOptionsimporttimechrome_options=Option
系统 2019-09-27 17:54:58 2578
我们都知道,爬虫获取页面的响应之后,最关键的就是如何从繁杂的网页中把我们需要的数据提取出来,python从网页中提取数据的包很多,常用的解析模块有下面的几个:BeautifulSoupAPI简单但解析速度慢,不推荐使用lxml由C语言编写的xml解析库(libxm2),解析速度快但是API复杂Scrapy综合以上两者优势实现了自己的数据提取机制,被称为Selector选择器。它是由lxml库构建的,并简化了API,先通过XPath或者CSS选择器选中要提取
系统 2019-09-27 17:54:28 2578