0

0

一次线上 Node.js 业务流量异常增长问题定位过程

看不見的法師

看不見的法師

发布时间:2025-07-13 09:32:16

|

727人浏览过

|

来源于php中文网

原创

线上 node.js 业务流量异常增长问题定位

问题现象

某天,通过我们自建的监控系统,发现部门下属所有业务的 notFound 页面性能上报量出现了显著的异常增长,进而影响了单一页面以及整体性能指标。

问题分析

面对流量突然激增的情况,我们从两个角度进行分析:业务自身的正常增长和来自爬虫的异常增长。

从正常增长的角度来看:

增长的流量全部来自于没有实际内容的 notFound 页面。与业务方沟通后,无法找到合法的流量来源,这些流量不带 referrer 以及合法用户的 cookie。通过以上三点,我们基本可以确定异常流量来源于爬虫。

定位爬虫

要解决爬虫问题,首先需要定位爬虫的特征,比如相同的 UA、相似的 IP段等。

我们在服务端日志中进行分析,发现 IP 和 UA 特征并不明显。这是由于业务特性导致的。我们业务的 notFound 页面一直承担部分爬虫流量的职责,因此整体服务调用量一直较高。在大量服务日志中,爬虫的部分 IP 并不特别显眼。

我们换个角度,从前端性能日志进行分析。虽然 notFound 页面服务调用量较高,但由于大部分请求都是直接爬取页面,没有在浏览器中进行渲染,所以前端性能上报量一直比较稳定,可以作为突破口。

北极象沉浸式AI翻译
北极象沉浸式AI翻译

免费的北极象沉浸式AI翻译 - 带您走进沉浸式AI的双语对照体验

下载

在分析前端性能日志时,我们借助了集团内部共建的 TAM 平台的多维度分析视图来进一步定位。

一次线上 node.js 业务流量异常增长问题定位过程如图所示,在 ISP 分析视图中,来自阿里巴巴的流量占比接近70%,这是一个非常明显的异常聚集。

根据这一特征,我们在前端性能上报的原始日志中进行过滤,发现阿里巴巴的请求 IP 都在一个网段中,再使用 awk 拆解日志进行聚合分析,来自阿里巴巴的网段在头部呈现聚集态势,如图:

一次线上 node.js 业务流量异常增长问题定位过程一次线上 node.js 业务流量异常增长问题定位过程现在我们可以得出结论:异常增长的流量来自于阿里巴巴神马搜索的爬虫。

问题解决

能够定位到爬虫的特征,我们就可以根据具体的特征施加不同维度的封禁手段。

问题总结

通过本次异常流量问题的定位和解决,我们应该学会:

通过 UA、IP段、运营商等多个维度来定位爬虫特征,并学会借助平台功能熟悉整个服务端请求链条,遇到问题应该从整个链条逐步细化定位环节。前端性能日志与服务端日志结合分析能更快地定位问题。熟练使用 awk / sort / uniq 等 Linux 文本分析工具

相关专题

更多
sort排序函数用法
sort排序函数用法

sort排序函数的用法:1、对列表进行排序,默认情况下,sort函数按升序排序,因此最终输出的结果是按从小到大的顺序排列的;2、对元组进行排序,默认情况下,sort函数按元素的大小进行排序,因此最终输出的结果是按从小到大的顺序排列的;3、对字典进行排序,由于字典是无序的,因此排序后的结果仍然是原来的字典,使用一个lambda表达式作为key参数的值,用于指定排序的依据。

386

2023.09.04

cookie
cookie

Cookie 是一种在用户计算机上存储小型文本文件的技术,用于在用户与网站进行交互时收集和存储有关用户的信息。当用户访问一个网站时,网站会将一个包含特定信息的 Cookie 文件发送到用户的浏览器,浏览器会将该 Cookie 存储在用户的计算机上。之后,当用户再次访问该网站时,浏览器会向服务器发送 Cookie,服务器可以根据 Cookie 中的信息来识别用户、跟踪用户行为等。

6419

2023.06.30

document.cookie获取不到怎么解决
document.cookie获取不到怎么解决

document.cookie获取不到的解决办法:1、浏览器的隐私设置;2、Same-origin policy;3、HTTPOnly Cookie;4、JavaScript代码错误;5、Cookie不存在或过期等等。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

344

2023.11.23

阻止所有cookie什么意思
阻止所有cookie什么意思

阻止所有cookie意味着在浏览器中禁止接受和存储网站发送的cookie。阻止所有cookie可能会影响许多网站的使用体验,因为许多网站使用cookie来提供个性化服务、存储用户信息或跟踪用户行为。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

410

2024.02.23

cookie与session的区别
cookie与session的区别

本专题整合了cookie与session的区别和使用方法等相关内容,阅读专题下面的文章了解更详细的内容。

88

2025.08.19

js正则表达式
js正则表达式

php中文网为大家提供各种js正则表达式语法大全以及各种js正则表达式使用的方法,还有更多js正则表达式的相关文章、相关下载、相关课程,供大家免费下载体验。

510

2023.06.20

js获取当前时间
js获取当前时间

JS全称JavaScript,是一种具有函数优先的轻量级,解释型或即时编译型的编程语言;它是一种属于网络的高级脚本语言,主要用于Web,常用来为网页添加各式各样的动态功能。js怎么获取当前时间呢?php中文网给大家带来了相关的教程以及文章,欢迎大家前来学习阅读。

244

2023.07.28

js 字符串转数组
js 字符串转数组

js字符串转数组的方法:1、使用“split()”方法;2、使用“Array.from()”方法;3、使用for循环遍历;4、使用“Array.split()”方法。本专题为大家提供js字符串转数组的相关的文章、下载、课程内容,供大家免费下载体验。

258

2023.08.03

PHP WebSocket 实时通信开发
PHP WebSocket 实时通信开发

本专题系统讲解 PHP 在实时通信与长连接场景中的应用实践,涵盖 WebSocket 协议原理、服务端连接管理、消息推送机制、心跳检测、断线重连以及与前端的实时交互实现。通过聊天系统、实时通知等案例,帮助开发者掌握 使用 PHP 构建实时通信与推送服务的完整开发流程,适用于即时消息与高互动性应用场景。

3

2026.01.19

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号