Monitorización de fallos y errores en una app
Qué instalar el primer día
Una herramienta de reporte de fallos con mapeo de símbolos para que los informes sean legibles, y un mecanismo básico de eventos que permita reconstruir el camino que llevó a un fallo. Ambos existen como servicio y no son un proyecto.
Qué medir
El porcentaje de arranques sin fallo es la métrica principal; apunta a un nivel en que un fallo sea un evento excepcional y no ruido de fondo. A su lado: congelaciones prolongadas, errores de red por ruta, y eventos que el usuario abandonó a la mitad.
Desglosa por versión y por modelo. Casi siempre resulta que el problema se concentra en un sitio.
Qué hacer con un informe
Fija una regla: un fallo que toca a más del uno por ciento de los usuarios entra en trabajo de inmediato. Y guarda un número de versión y de compilación en cada informe; sin ellos, media investigación es adivinar.
En profundidad
Añade un registro de migas en los puntos clave de procesos largos: inicio de sincronización, fin, fallo, reintento. Buena parte de las quejas no son fallos sino procesos que se quedaron atascados, y esos son invisibles para las herramientas de fallos.