移动应用 · 进阶

应用的崩溃与错误监控

一句话: 没有自动崩溃上报,你就只能从商店评价里得知问题——也就是太晚了。

第一天就要装的

一个带符号映射、能让报告可读的崩溃上报工具,以及一套基础的事件机制,用来重建通向崩溃的路径。两者都有现成服务,不是一个项目。

度量什么

无崩溃启动的比例是主指标;把目标定在「崩溃是个例外事件,而不是背景噪音」的水平上。旁边还有:长时间卡死、按路径分的网络错误,以及用户中途放弃的事件。

按版本和机型分组。几乎总会发现问题集中在某一处。

拿到报告之后做什么

定一条规则:影响超过百分之一用户的崩溃立刻进入处理。并在每份报告里保留版本号和构建号——没有它们,一半的排查是在猜。

深入一层

在长流程的关键节点加上面包屑日志:同步开始、结束、失败、重试。相当一部分投诉不是崩溃,而是卡住的流程,而这些对崩溃工具是不可见的。