更多>>关于我们
西安鲲之鹏网络信息技术有限公司从2010年开始专注于Web(网站)数据抓取领域。致力于为广大中国客户提供准确、快捷的数据采集相关服务。我们采用分布式系统架构,日采集网页数千万。我们拥有海量稳定高匿HTTP代理IP地址池,可以有效获取互联网任何公开可见信息。
您只需告诉我们您想抓取的网站是什么,您感兴趣的字段有哪些,你需要的数据是哪种格式,我们将为您做所有的工作,最后把数据(或程序)交付给你。
数据的格式可以是CSV、JSON、XML、ACCESS、SQLITE、MSSQL、MYSQL等等。
更多>>技术文章
-
西安鲲之鹏
发布时间:2016-10-13 15:11:03
转发两篇讲”SSH隧道应用(本地端口转发和远程端口转发)"非常赞(清晰、通俗)的文章:
1. SSH Tunnel - Local and Remote Port Forwarding Explained With Examples >>> http://t.cn/RwqSpqk
2. SSH port forwarding visualized >>> http://t.cn/RwYtXZ3
特别要赞一下第二篇的配图。
-
西安鲲之鹏
发布时间:2016-10-13 09:47:33
-
西安鲲之鹏
发布时间:2016-10-13 09:29:10
Run a shell script as another user that has no password(如何用其它用户身份运行一个程序):
sudo -H -u otheruser bash -c 'echo "I am $USER, with uid $UID"'
>>> http://t.cn/RVtXWrY
-
西安鲲之鹏
发布时间:2016-10-12 15:23:41
用Python脚本打造Squid权限认证后端程序以及Squid3.5 auth_param key_extras新特性介绍 >>> http://t.cn/RV5zS9q
-
西安鲲之鹏
发布时间:2016-09-30 11:40:33
360前端库(fonts.useso.com)罢工,导致数据超市(http://t.cn/Rzc0P1q使用Wordpress系统)页面加载缓慢。
1)搜索所有使用fonts.useso.com的文件:find ./ -type f -name "*.php" | xargs grep "fonts.useso.com"。
2)替换fonts.useso.com为fonts.googleapis.com。
问题解决。
-
西安鲲之鹏
发布时间:2016-09-26 08:47:18
-
西安鲲之鹏
发布时间:2016-09-22 12:16:47
-
西安鲲之鹏
发布时间:2016-09-18 14:19:14
最新预定抢购苹果很火,那么各位施主你们知道如何测试代理IP是否被苹果给封了吗?
且听我说:用代理访问网址:http://t.cn/R7Z1Grj。如果返回正常页面那么这个代理就是OK的(没有被封),如果跳转到了一个不存在的页面(http://t.cn/Rc9WXLa),那么说明这个代理已经被封了。下图是用curl做的实验(图1是正常的,图2的代理被封了)。
-
西安鲲之鹏
发布时间:2016-09-18 13:02:28
【小试mitmproxy】按照官方说明安装mitmproxy(http://t.cn/Rc9KrEN),结果还少了一堆Python依赖库,费了不少时间终于搞定了。
PS1:mitmproxy是一款命令行下的HTTP抓包分析工具,工作原理和Fiddler2类似。
PS2:现在扫代理IP的人真是多啊!!!刚启动没多久就被人扫描到了(被拿来注册QQ号用)。
-
西安鲲之鹏
发布时间:2016-09-10 11:13:09