数据说明:
国内知名本地生活信息平台(你懂的)全国3648万商户(所有分类)数据2017年07月份更新。
PS:仅商户数据,不含评论列表数据。
有图有真相:
更新说明:
- 删除mall_id字段(网站改版,已无该信息);
- 删除history字段(网站改版,已无该信息);
- navigation字段更名为breadcrumb;
详细字段说明:
“mall_id"(商户所述商场的shop_id)(网站改版,已无该信息)
- "product_rating"(口味/产品评分)
- "environment_rating"(环境评分)
- "recommended_dishes"(推荐菜)
- "recommended_products"(推荐产品)
- "latest_comment_date"(最新评论日期)
"history"(历史时间点:加入时间、更新时间、最后评论时间三类信息分号分隔)(网站改版,已无该信息)
示例数据:
- 你可以联系我们在线客服获取你想要的部分示例数据,例如某个城市某个分类的示例数据。也可以查询验证某个条件对应的商户数量。
联系客服:
客服QQ:312602670 或 1649677458
客服电话:13389148466 或 13571845363
关于本数据的FAQ:
- 答:一个月左右。我们每次都是全量采集,本次下载页面量超过1.5亿。
- 你们采集到的数据量为什么这么大,我自己采集为什么只能采集到几百万?
- 答:网站的列表页有页数限制。我们采用递归子分类和子区域,结合遍历shop_id的方式,最大程度上保证了数据的完整性。
- 我发现你们的数据缺失了某个店铺,是什么原因造成的?
- 答:这很正常,在采集开始到采集完成这一个月内又会新增很多的店铺,而这些店铺的数据肯定会漏掉。
- 答:在数据购买半个月内,如果该Bug的影响范围大于10%,我们将立即处理,并免费提供一份处理后的数据。如果该Bug的影响范围小于10%,我们不能立即处理,但会在下一个版本中进行修复。由于网站的模板种类很多,要兼顾各种特殊情况,我们也在不断的修复数据中存在的历史问题。
- 答:抱歉不行,购买现成的数据不提供任何修改支持。如果你想自定义字段,建议申请定制采集服务(费用会远高于购买现成数据)。
- 答:ZIP文件约4.3GB左右,解压后CSV文件约21GB左右。通过百度网盘共享(有提取密码)。
- 答:抱歉,你需要自己完成导入的过程。可以参考我们的导入教程:
- 答:是的,任意公开网站的非隐私数据我们都可以采集,这里有部分我们之前采集的示例数据 >>> 点击进入数据超市。PS:我们不采集任何非法网站(例如,博彩、色情)的数据、也不会采用非法手段窃取后台数据。
特别说明:本文旨在技术交流,请勿将涉及的技术用于非法用途,否则一切后果自负。如果您觉得我们侵犯了您的合法权益,请联系我们予以处理。