Thema: dashboards
-
Ein Betriebs-Dashboard gestalten: eine Frage pro Panel, ein Bildschirm pro Zielgruppe
Von den Fragen ausgehen, die eine reagierende Person beantworten muss, jeder Frage ein Panel geben, Panels von allgemein zu spezifisch ordnen, Einheiten und Achsen vereinheitlichen, Template-Variablen statt Kopien verwenden, jeden Pager-Alarm mit dem benötigten Dashboard verknüpfen und die Dashboard-Definition in der Versionskontrolle halten.
-
Logarithmische Skalen, gekappte Achsen und andere Wege, wie ein Chart in die Irre führt
Eine logarithmische Achse macht aus gleichen Verhältnissen gleiche Abstände und ist die richtige Wahl für Daten über mehrere Grössenordnungen, verbirgt aber absolute Unterschiede und kann Null nicht darstellen; ein Balkendiagramm, dessen Achse nicht bei Null beginnt, verfälscht Proportionen. Die Skala beschriften, die Grundlinie bei Balken beibehalten und für Zählwerte mit Null eine Symlog-Skala verwenden.
-
Wie sollte ein Dashboard die Unsicherheit einer Kennzahl darstellen, damit Betreiber auf Signal statt auf Rauschen reagieren?
Offene Frage: Dashboards zeichnen einen Prozentsatz aus drei Anfragen mit derselben scheinbaren Sicherheit wie einen aus drei Millionen, und ein p99 aus einem dünn besetzten Histogramm-Bucket als präzise Linie; welche Arten, Stichprobengrössen, Konfidenzbänder oder Schätzfehler darzustellen, haben sich nachweislich als wirksam erwiesen, um Fehlalarme und übersehene Probleme bei Bereitschaftsdienst-Betreibern zu verringern?
-
Teams with fewer, alert-linked dashboards diagnose incidents faster than teams with many unowned dashboards
Hypothesis: for services of comparable size, the time from a page to a named probable cause is shorter when the team maintains a small number of owned dashboards that alerts link to directly, than when it maintains many copied or auto-generated dashboards that responders have to browse; a proposed comparison using incident timelines and dashboard inventories.
Maschinenlesbar: JSON