(AD)《魔兽世界》游戏玩家请加我QQ:1589845586
(AD)玩游戏,上wanbbs.com
(AD)玩游戏的手机卡流量卡免费送
以下横幅图片为中国游戏论坛商业广告展示区
查看: 3207|回复: 1

泉州900g防御高防游戏论坛租赁与托管服务

  [复制链接]
论坛等级

等級:游戏高中生

活跃状态

99

主题

5

回帖

7

金币

时间轨迹
注册时间
2022-2-24
最后登录
2024-10-6

联系方式

荣誉勋章

发表于 2022-3-7 10:11:04 | 显示全部楼层 |阅读模式
高防游戏论坛咨询QQ:63505267
网络干扰排除宕机分析中,较多误报是由于网络问题干扰,无法准确判断出物理机是否宕机,有可能是网络问题。排除上联网络设备异常导致的误报,包括机房断网演练,小面积网络故障,上联网络故障,如通过探测丢包情况,使用一些逻辑初步判断网络问题。游戏论坛本身未丢包的误报,除了需要过滤出网络问题,还要通过丢包数据分析,过滤掉SA误报问题, SA异常会上报心跳异常,被误理解为宕机。 icmp及tcp丢包分析,icmp采集频率为固定数秒,tcp采集频率固定数秒,包括多个不同大小包(16,32,64,128,256等)的丢包情况,根据分析时间窗内两项数据的丢包情况特殊情况干扰排除个别机房有时候会出现大面积风暴式的无故心跳异常,同时网络ping包异常,但上联网络设备ping包正常,这种误报,一般根据具体case具体进行针对性的分析。如根据监控每个机房的上报频率,排除干扰。进一步识别误报至此,大部分干扰已经过滤掉,但仍有一部分误报隐藏其中。比如心跳异常,ping异常,都合乎宕机判断的逻辑,会导致误判成宕机,如导致网卡被打爆,或者重试率高,这种是业务原因导致网络异常,但业务认为不是异常,需要排除掉。再例如游戏论坛并没有挂掉,但是IO延时和资源占用率各项指标都不正常等场景。针对以上等情况,增加uptime判断以及带外日志分析排查。宕机时间点探测uptime确定是否发生重启。进一步通过分析日志是否连续,判断是否发生重启。日志重启特征值匹配,确认是否发生重启。如果还不能确定,使用uptime的时间窗技术进行重启。仍不能确定的待处理,进入长尾处理名单。长尾再次处理未确认的待处理的,会加入到长尾列表中,像这种分钟级的心跳异常,ping异常,但串口日志一直正常输出的情况,一般就是某种死机,死到连网络都不通的场景。会观察一段时间,一个固定时间窗内仍未恢复或重启的话,就暂时报宕机。后期会把这种死机单独找划分归类。


回复

使用道具 举报

论坛等级

等級:游戏高中生

活跃状态

1

主题

126

回帖

0

金币

时间轨迹
注册时间
2021-7-29
最后登录
2024-9-26

联系方式

荣誉勋章

最佳新人

发表于 2022-3-10 00:55:39 | 显示全部楼层
好歹顶一下!
回复 支持 反对

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

违规信息处理|玩家游戏论坛|中国游戏论坛 ( 鄂ICP备2024045400号 )|网站地图

GMT+8, 2025-6-18 08:27

Powered by Youxibbs.cn X3.5

© 2015-2025 Youxibbs.cn-Youxi BBS

快速回复 返回顶部 返回列表