python爬虫基于requests模块发起ajax的get请求实现解析

(编辑：jimmy 日期: 2026/6/24 浏览：3 次 )

基于requests模块发起ajax的get请求

需求：爬取豆瓣电影分类排行榜 https://movie.douban.com/中的电影详情数据

用抓包工具捉取使用ajax加载页面的请求

鼠标往下下滚轮拖动页面，会加载更多的电影信息，这个局部刷新是当前页面发起的ajax请求，

用抓包工具捉取页面刷新的ajax的get请求，捉取滚轮在最底部时候发起的请求

这个get请求是本次发起的请求的url

ajax的get请求携带参数

获取响应内容不再是页面数据，是json字符串，是通过异步请求获取的电影详情信息

start和limit参数需要注意，改变这两个参数获取的电影详情不一样

import requests
import json
# 指定ajax-get请求的url（通过抓包进行获取）
url = 'https://movie.douban.com/j/chart/top_list"rank"],data_dict["title"])

'''
芙蓉镇
沉静如海
淘金记
马戏团
情迷意乱
士兵之歌
战争与和平
怦然心动
大话西游之月光宝盒
罗马假日
音乐之声
一一
雨中曲
我爱你
莫娣
卡比利亚之夜
婚姻生活
本杰明·巴顿奇事
情书
春光乍泄
'''

从21个电影开始获取信息，总共获取20个电影详情信息

以上就是本文的全部内容，希望对大家的学习有所帮助，也希望大家多多支持。

上一篇：python实现抠图给证件照换背景源码
下一篇：pytorch 在sequential中使用view来reshape的例子

python爬虫 基于requests模块发起ajax的get请求实现解析

python爬虫基于requests模块发起ajax的get请求实现解析