Thema: reporting
-
Messunsicherheit und signifikante Stellen in technischen Berichten
Ein Messwert ohne Unsicherheit ist unvollständig: die Messung wiederholen, den Mittelwert mit der Standardabweichung des Mittelwerts und der Anzahl Durchläufe angeben, die Unsicherheit auf eine oder zwei signifikante Stellen runden und den Wert auf dieselbe Stelle, und angeben, was das Intervall bedeutet; Stellen jenseits der Unsicherheit sind Rauschen.
-
p-Werte: was sie messen und was nicht
Ein p-Wert ist die unter dem gesamten statistischen Modell einschliesslich der Nullhypothese berechnete Wahrscheinlichkeit für eine Teststatistik, die mindestens so extrem ist wie die beobachtete. Er ist nicht die Wahrscheinlichkeit, dass die Nullhypothese wahr ist, nicht die Wahrscheinlichkeit, dass der Zufall das Ergebnis hervorgebracht hat, kein Mass für die Effektgrösse, und 0,05 ist eine Konvention und keine Grenze zwischen Wahrheit und Rauschen.
-
Logarithmische Skalen, gekappte Achsen und andere Wege, wie ein Chart in die Irre führt
Eine logarithmische Achse macht aus gleichen Verhältnissen gleiche Abstände und ist die richtige Wahl für Daten über mehrere Grössenordnungen, verbirgt aber absolute Unterschiede und kann Null nicht darstellen; ein Balkendiagramm, dessen Achse nicht bei Null beginnt, verfälscht Proportionen. Die Skala beschriften, die Grundlinie bei Balken beibehalten und für Zählwerte mit Null eine Symlog-Skala verwenden.
-
Konfidenzintervalle im Überblick: Was das Intervall aussagt und was nicht
Ein 95%-Konfidenzintervall stammt aus einem Verfahren, das bei wiederholten Stichproben in 95% der Fälle den wahren Wert einschliesst; ein bestimmtes Intervall enthält ihn entweder oder nicht. Seine Breite schrumpft mit der Wurzel aus dem Stichprobenumfang und wächst mit der Streuung. Es als den Bereich der mit den Daten verträglichen Werte lesen, es neben jeder Schätzung angeben und beim Vergleichen das Intervall einer Differenz berechnen.
-
Variance, standard deviation, MAD and IQR: reporting the spread
A location without a spread is half a number. The standard deviation describes spread well for roughly normal data and is dominated by the tails otherwise; the interquartile range and the median absolute deviation describe the bulk. Name the measure, give the sample size, use the n−1 form for estimates from samples, and never label an error bar with a bare ±.
-
Mean, median and mode: choosing a summary statistic that does not mislead
The arithmetic mean is pulled by skew and outliers, the median ignores how far the extremes go, and the mode only makes sense for categorical or clearly peaked data. Choose by the shape of the distribution and by the question asked, print the count next to every summary, and never average ratios or percentiles.
-
Simpson's paradox and base-rate neglect in reports
Two arithmetic effects make a correct table support a wrong sentence: an association can reverse when a population is split into groups that were mixed in different proportions, and a signal's accuracy says little about what a positive signal means until the base rate is known. Ask how groups were mixed and keep denominators visible.
Maschinenlesbar: JSON