Python
上海菁数信息——实时数字智能
大数据 数据挖掘 机器学习
展开
专栏收录文章
- 默认排序
- 最新发布
- 最早发布
- 最多阅读
- 最少阅读
-
Pycharm 新手一进去全是小波浪的非重要报错(PEP8)
原因是很多都不符合PEP8规范,比如你的项目有自己的规范。 直接说解决方案 1. 在问题处, ALT+ENTER 选择 ignore 2. 在设置选项的 Editor--Inspections 中找到 PEP8 的两项添加忽略项 或者 直接勾掉两项原创 2015-11-13 16:24:42 · 5766 阅读 · 0 评论 -
python字典中没有输入的键key 返回一定的错误信息或者提示状态
推荐使用 'key' in dict 返回布尔值的方法 python3之后直接去除了下面的has_key()方法,但是如果你的程序需要兼容2.2或之前的版本程序就只能使用较早的方法了。 Python 字典(Dictionary) has_key()方法 描述 Python 字典(Dictionary) has_key() 函数用于判断键是否存在于字典中,如果键在字原创 2015-11-20 10:05:36 · 10095 阅读 · 0 评论 -
scrapyd的安装
我使用的环境是Ubuntu 14.04 LTS scrapy的环境安装和scrapy的安装在这里不再赘述 一、安装scrapyd pip install scrapyd 二、安装 scrapyd-client wget https://github.com/scrapy/scrapyd-client/archive/master.zip unzip ma原创 2016-04-07 09:54:57 · 1936 阅读 · 0 评论 -
基于scrapy的挖掘系统所需环境汇总
基于scrapy的挖掘系统所需环境汇总 传送门会慢慢编辑,由于分布式部署前期使用Ubuntu 14.04 LTS desktop 作为开发的桌面级操作系统, 有一些基础系统自带类库将不在该汇总中。持续更新中。。。 一、相关软件 jdkmysql php pythonpipeasy installdocker 二、挖掘系统软件 scrapy scrapyd selen原创 2016-04-15 09:52:09 · 599 阅读 · 0 评论 -
scrapy的redis安装和配置
在定向爬虫的制作过程中,使用分布式爬取技术可以显著提高爬取效率。而 Redis 配合 Scrapy 是实现分布式爬取的基础。 Redis 是一个高性能的 Key-Value 数据库,它把数据保存在内存里。因此可以有非常快的数据读写速度。 scrapy-redis 的安装 pip install scrapy-redis easy_install scrapy-redis 下载 ht原创 2016-04-19 09:39:12 · 4412 阅读 · 1 评论 -
Scrapy 中的 MongoDB 安装、使用、可视化入门
MongoDB 的安装 https://www.mongodb.org/downloads mkdir data mongod --dbpath ./data MongoDB 的可视化插件安装 https://www.mongovue.com/ pymongo 的安装 pip install pymongo 或 easy_install pymongo 在程序中使用的代码骗原创 2016-04-19 10:03:32 · 1565 阅读 · 0 评论 -
在Mac上快速安装Scrapy,一键安装工具(不分别安装scrapy和twisted)
新配置了iMac 27,准备以它为主要的工作平台并控制分布式爬虫 总是在不同的设备上配置scrapy,于是需要一些较为快捷的方案 1.安装conda工具 Anaconda for OS X python 2.7 64-bit 如果使用的是别的操作系统(Windows或者Linux)请进入官网下载页面选择想对应的系统位数以及版本进行下载 我使用的是Python 2.7: b原创 2016-04-11 09:52:37 · 2651 阅读 · 0 评论 -
从网络上收集的爬虫工具,推荐基于python的工具
爬虫,即网络爬虫,是一种自动获取网页内容的程序。是搜索引擎的重要组成部分,因此搜索引擎优化很大程度上就是针对爬虫而做出的优化。 网络爬虫是一个自动提取网页的程序,它为搜索引擎从万维网上下载网页,是搜索引擎的重要组成。传统爬虫从一个或若干初始网页的URL开始,获得初始网页上的URL,在抓取网页的过程中,不断从当前页面上抽取新的URL放入队列,直到满足系统的一定停止条件。聚焦爬虫的工作流程较转载 2016-05-20 10:44:20 · 7609 阅读 · 0 评论 -
Django中model使用迁移(migrate)部分数据库会遇到的坑
Django中model使用迁移(migrate)部分数据库会遇到的坑原创 2016-06-15 08:50:26 · 9506 阅读 · 0 评论 -
sqlalchemy从零单排第一局----从何开始,官方文档怎么看
官方文档链接是 http://docs.sqlalchemy.org/en/latest/index.html 分为了2个部分, ORM 和 Core Core是用来调用原生的sql语句的,无太大意义,不如直接用相关的数据库连接, such as Mysqldb等等 只看ORM部分即可,网上很多教程时间很久远,坑大爬不起,看了好几天提升甚少,在此再次感慨二手知识毁人原创 2016-08-18 15:30:50 · 497 阅读 · 0 评论 -
python 调用不同目录里的 包package 或者 模块module
对于模块和自己写的程序不在同一个目录下,可以把模块的路径通过sys.path.append(路径)添加到程序中。 在程序开头加上: import sys sys.path.append(’引用模块的地址') 仍然不能用,解释器报错说找不到你要的模块 No Module Named '自己的模块' 例子如下 : 在 /usr/local/sp_sys原创 2016-09-09 10:22:23 · 6161 阅读 · 0 评论 -
python 把py文件编译为pyc文件 商业用途
python -m py_compile file.py python -m py_compile /root/src/{file1,file2}.py 编译成pyc文件。 也可以写份脚本来做这事: Code: import py_compile py_compile.compile('path') //path是包括.py文件名的路径 py转载 2016-09-12 14:09:10 · 2075 阅读 · 0 评论 -
django 2.0 创建新应用 app 要做什么 怎么做 速记
比较新的版本老版本用户可以参考其他人的博客 大部分命令都是在项目我的项目名字叫bigprotect的根目录下,即和manage.py同一级别的目录 1. 创建一个新的app example python manage.py startapp example 2. 在bigprotect下的settings的INSTADLLED_APPS中添加,即是把这个应用插到djan原创 2017-11-02 13:59:16 · 1793 阅读 · 0 评论 -
mac 安装neo4j之后输入默认密码neo4j后仍然 The client is unauthorized due to authentication
这里写自定义目录标题待解决问题解决方法 待解决问题 mac 安装neo4j之后输入默认密码neo4j后仍然 The client is unauthorized due to authentication 解决方法 打开neo4j desktop 点击Manage进入管理界面 选择settings 修改dbms.security.auth_enabled=false apply应用生效 重新...原创 2019-03-28 15:00:51 · 4163 阅读 · 1 评论
分享