python爬取饿了么


本文摘自php中文网,作者步履不停,侵删。

在学数据可视化,缺少点数据进行实操,就想着从饿了么上面爬点外卖店信息。

主要是获取数据,所以代码比较简陋,直接上代码:

1

2

3

4

5

6

7

8

9

10

11

12

13

14

15

16

17

18

19

20

21

22

23

24

25

26

27

28

29

30

31

32

33

34

35

import requests

import json

import csv

def crawler_ele(page=0):

def get_page(page):

url = 'https://h5.ele.me/restapi/shopping/v3/restaurants?latitude=xxxx&longitude=xxxx&offset={page}&limit=8&terminal=h5'.format(page=page*8)

headers = {

    "user-agent": "Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/71.0.3578.80 Safari/537.36",

    'cookie': r'xxxx'

}

re = json.loads(requests.get(url,headers=headers).text)

return re

re = get_page(page)

if re.get('items'):

with open('data.csv','a',newline='') as f:

writer = csv.DictWriter(f,fieldnames=['名称', '月销售量','配送费', '起送价', '风味','评分', '配送时长', '评分统计', '距离', '地址'])

writer.writeheader()

for item in re.get('items'):

info = dict()

restaurant = item.get('restaurant')

info['地址'] = restaurant.get('address')

info['配送费'] = restaurant.get('float_delivery_fee')

info['名称'] = restaurant.get('name')

info['配送时长'] = restaurant.get('order_lead_time')

info['距离'] = restaurant.get('distance')

info['起送价'] = restaurant.get('float_minimum_order_amount')

info['评分'] = restaurant.get('rating')

info['月销售量'] = restaurant.get('recent_order_num')

info['评分统计'] = restaurant.get('rating_count')

info['风味'] = restaurant.get('flavors')[0].get('name')

writer.writerow(info)

# print(info)

if re.get('has_next') == True:

crawler_page(page+1)

crawler_ele(0)

在这里简单注释几句:

url 中的经纬度去掉了,可以自行查询添加需要爬取地点的经纬度,也可以通过调用地图api获取经纬度;

headers 需要加 Cookies ,不然会有登录权限限制爬取页数;

最后调用的是递归不是循环,所以保存结果的 csv 文件里面会有多个重复表头,可以用 Excel 打开删除重复值就可以了。

相关教程推荐:Python视频教程

以上就是python爬取饿了么的详细内容,更多文章请关注木庄网络博客!!

相关阅读 >>

Python并发处理asyncio包如何使用

Python3.6.4如何安装到树莓派3代

Python如何保留2位小数

Python能做什么的

Python怎么去掉字符串所有空格

Python pycurl验证basic和digest认证的方法

Python基础学习总结(四)

Python中如何求列表list的平均数

怎么获得一个字符串的子串

window下编写Python脚本在linux下运行出错 usr/bin/Python^m: bad interpreter: no such file or directory

更多相关阅读请进入《Python》频道 >>




打赏

取消

感谢您的支持,我会继续努力的!

扫码支持
扫码打赏,您说多少就多少

打开支付宝扫一扫,即可进行扫码打赏哦

分享从这里开始,精彩与您同在

评论

管理员已关闭评论功能...