分享好友 最新动态首页 最新动态分类 切换频道
app ios 读取资源 读取app数据
2024-12-26 14:26


App 的爬取相比 Web 端爬取更加容易,反爬虫能力没有那么强,而且数据大多是以 JSON形式传 输的,解析更加简单。在 Web 端,我们可以通过浏览器的开发者工具监听到各个网络请求和响应过程, 在 App 端如果想要查看这些内容就需要借助抓包软件。常用的抓包软件有 WireShark、Filddler、Charles、 mitmproxy、 AnyProxy 等,它们的原理基本是相同的。 我们可以通过设置代理的方式将手机处于抓包 软件的监昕之下,这样便可以看到 App 在运行过程中发生的所有请求和响应了,相当于分析 Ajax 一 样。 如果这些请求的 URL、参数等都是有规律的,那么总结出规律直接用程序模拟爬取即可,如果它 们没有规律,那么我们可以利用另一个工具 mitmdump 对接 Python 脚本直接处理 Response。 另外, App 的爬取肯定不能由人来完成,也需要做到自动化,所以我们还要对 App 进行向动化控制, 这里用 到的库是 Appium。 

Charles 是一个网络抓包工具,我们可以用它来做 App 的抓包分析,得到 App 运行过程中发生的 所有网络请求和响应内容,这就和 Web 端浏览器的开发者工具 Network 部分看到的结果一致。 相比 Fiddler来说, Charles 的功能更强大,而且跨平台支持更好。 所以我们选用 Charles作为主要 的移动端抓包工具,用于分析移动 App 的数据包,辅助完成 App 数据抓取工作。

本节我们以京东 App 为例,通过 Charles 抓取 App 运行过程中的网络数据包,然后查看具体的 Request 和 Response 内容,以此来了解 Charles 的用法。请确保已经正确安装 Charles 并开启了代理服务手机和 Charles 处于同一个局域网下Charles 代理和 CharlesCA 证书设置好。

原理

肯先 Charles 运行在自己的 PC 上, Charles 运行的时候会在 PC 的 8888 端口开启一个代理服务, 这个服务实际上是一个 HTTP/HTTP 的代理。
确保手机和 PC 在同一个局域网内,我们可以使用于机模拟器通过虚拟网络连接,也可以使用手 机点机和 PC 通过无线网络连接。 设置手机代理为 Charles 的代理地址这样手机访问互联网的数据包就会流经 Charles, Charles 再 转发这些数据包到真实的服务器,服务器返回的数据包再由 Charles 转发回手机, Charles 就起到中间 人的作用,所有流量包都可以捕捉到,因此所有 HTTP 请求和响应都可以捕获到。 同时 Charles 还有 仅力对请求和响应进行修改。

抓包 

初始状态下 Charles 的运行界面如图

Charles 会一直监听 PC 和手机发生的网络数据包,捕获到的数据包就会显示在左侧,随着时间的 推移,捕获的数据包越来越多, 左侧列表的内容也会越来越多。
可以看到,图中左侧显示了 Charles 抓取到的请求站点,我们点击任意一个条目便可以查看对应 请求的详细信息,其中包括 Request、 Response 等内容。 接下来清空 Charles 的抓取结果, 点击左侧的扫帚按钮即可清空当前捕获到的所有请求。 然后点 占第二个监听按钮,确保监昕按钮是打开的,这表示 Charles 正在监听 App 的网络数据流。

 这时打开手机京东,注意一定要提前设置好 Charles 的代理并配置好 CA 证书,否则没有效果。 打开任意一个商品,如 iPhone,然后打开它的商品评论页面,

 

 不断上拉加载评论,可以看到 Charles 捕获到这个过程中京东 App 内发生的所有网络请求,如图 

左侧列表会出现一个api.m.jd.com的链接,而且不停的山东,很有可能就是当前app发出的获取评论数据的请求被Charles捕获到了。我们点击将其展开,继续上拉刷新评论。随着上拉的进行,此处又会出现一个个的网络请求,这时新出现的数据包请求确定就是获取评论数据的请求。

为了验证确定性,我们点击查看其中一个条目的详情信息。切换到contents选项卡,这时我们发现一些JSON数据,核对一下结果,其中有commentdata的字段,其内容和我们在App中看到的评论内容一致。

分析

现在分析这个请求的和响应的详细信息。首先可以回到Overview选项卡上,上方显示了请求的URL,接着是响应状态码,请求方式等,如图

这个结果和原本在WEB浏览器开发者工具内捕获到的结果形式是一致的

接着点击content选项卡,查看请求和响应的详细信息

上半部分是Request的信息,先半部分是Response的信息。比如针对Request我们切换到Headers选项卡即可看到Request的Headers的信息。针对Response的,我们切换到JSON TEXT的选项卡,即可看到Response的Body信息,并且该内容已经被格式化。

由于这个请求是 POST请求,我们还需要关心 POST 的表单信息, 切换到 Form选项卡即可查看, 如图 

 

这样我们就成功抓取App 中的评论接口 的请求和响应,并且可以查看Response返回的 JSON数据。
至于其他 App,我们同样可以使用这样的方式来分析。 如果我们可以直接分析得到请求的 URL 和参数的规律,直接用程序模拟即可批量抓取。

重发
Charles 还有一个强大功能,它可以将捕获到的请求加以修改并发送修改后的请求。 点击上方的修 改按钮,左侧列表就多了一个以编辑图标为开头的链接, 这就代表此链接对应的请求正在被我们修改, 如图

 

我们可以将Form中的某个字段进行删除,比如这里将partner字段进行删除,然后点击Remove,这时我们已经对原来请求携带的FormData做了修改,然后点击下方的Execute按钮即可执行修改后的请求,如图

左侧列表再次出现了接口的请求结果,内容仍然不变

可以看出删除某些字段,并没有带来什么影响,所以这个字段是无关紧要的。

有了这个功能,我们可以方便的使用Charles来做调试,可以通过修改参数、接口等来测试不同请求的响应状态,就可以知道哪些参数是必要的,那些是不必要的,以及参数分别有什么规律,最后可以得到一个最简单的接口和参数形式以供程序模拟调用使用

结语

 

以上内容便是通过 Charles 抓包分析 App 请求的过程。 通过 Charles,我们成功抓取 App 中流经的 网络数据包,捕获原始的数据,还可以修改原始请求和重新发起修改后的请求进行接口测试。 知道了请求和响应的具体信息,如果我们可以分析得到请求的 URL 和参数的规律, 直接用程序 模拟即可批量抓取,这当然最好不过了。 但是随着技术的发展, App 接口往往会带有密钥,我们并不能直接找到这些规律,那么怎么办呢?我们将了解利用 Charles 和 mitmdump 直接对接 Python 脚本实时处理抓取到的 Response 的 过程。

 

最新文章
AI绘画神器:一键生成你的完美美女写真!
在这个数字化飞速发展的时代,AI技术的创新与应用正在不断改变我们的生活。最近,我在网上看到一则有趣的帖子,一个朋友分享了她用AI工具生成的超逼真美女写真,简直令人惊艳!我不禁想,现代科技真的可以帮助我们实现梦想中的完美女神吗?
2024常州五一周边旅游最佳去处(附游玩景点推荐+优惠购票)
五一假期马上就要到了,有没有安排好要去哪里呢?由于疫情原因,可能不能去太远的地方。但是我们可以在周边找一些好玩的地方来玩啊~不要只把目光放向远方,也要看看身边的美景。你会发现,其实美好生活就在身边。小编来介绍一些常州五一周边
2024年新奥开奖结果|全面数据应用分析
  2024年新奥开奖已经画上了圆满的句号,本次赛事汇聚了来自世界各地众多优秀选手,为所有人带来了一场视觉与体感的盛宴。本文将对新奥赛的开奖结果进行详细分析,旨在通过全面的数据应用分析,为运动赛事爱好者提供一个深入了解赛果的窗
2024官方保利锦上(黄埔·保利锦上)官方网站_百度百科_房天下
广州·黄埔·保利锦上广州·黄埔·保利锦上售楼处电话:400-990-8525转555【已认证】广州·黄埔·保利锦上营销中心电话:400-990-8525转555【已认证】广州·黄埔·保利锦上展示中心电话:400-990-8525转555【已认证】▼温馨提示:本项目采用预
2017高颜值手机排行榜前十
2017高颜值手机排行榜前十   如今的智能手机市场是一个广泛的市场,手机大多能满足日常使用所需,不过在外观设计,软件优化这些细节方面却有着一些差别,一起来看看2017高颜值手机排行榜吧。   1、华为Mate 9 Pro   Mate9 Pro是华为M
AIPPT一款半年多就做到了几百万月收入的AI+PPT应用
1、创始人:赵充。是爱设计AiPPT的创始人兼CEO,他是一位连续创业者,在广告流量运营和创意设计工具这两个2B领域积累了丰富的经验 。赵充曾在新浪和搜狐工作,负责国内最早的自媒体广告平台产品的商业化 。他毕业
2024年腾讯云双十二大促最后几天,云服务器抢购热潮不减!
​​2024年腾讯云双十二大促最后几天,云服务器抢购热潮不减!双十二大促最后几天,都知道云产品每年都涨价,错过优惠不再有!腾讯云有优惠活动吗?2024年末腾讯云双十二大促活动,云服务器价格多少钱?2024年腾讯云12月轻量服务器多少钱一
# 规则引擎说明
平台中内置了规则引擎,,均由规则引擎执行. 名词说明: RuleModel(规则模型):由多个,组成 RuleNode(规则节点): 规则节点描述具体执行的逻辑 RuleLink(规则连线): 用于将多个节点连接起来,将上一个节点的输出结果作为下一个节点的输入结果. In
flask框架的八六三在线考核平台毕设源码+论文
本系统(程序+源码+数据库+调试部署+开发环境)带论文文档1万字以上,文末可获取,系统界面在最后面。 关于在线考核平台的研究,现有研究主要以通用性在线考试系统为主,专门针对八六
相关文章
推荐文章
发表评论
0评