Prejsť na obsah
Domov

Štatistická významnosť: význam, interpretácia a obmedzenia

Prehľad pojmu štatistická významnosť, p-hodnota, hladina α, historický kontext Fishera a Neymana–Pearsona, typy chýb, praktické dôsledky a alternatívy.

Prehľad

Štatistická významnosť je pojem v inferenčnej štatistike, ktorý opisuje, do akej miery sú pozorované údaje v rozpore s predpokladaním, že neexistuje žiadny efekt alebo rozdiel. V praxi sa často testuje tzv. nulová hypotéza a výsledok sa označí za štatisticky významný, ak miera nepravdepodobnosti takého alebo extrémnejšieho výsledku za predpokladu platnosti nulovej hypotézy klesne pod vopred stanovenú hranicu.

Definícia a základné pojmy

Jadro konceptu tvorí p-hodnota, teda pravdepodobnosť pozorovať výsledok aspoň tak extrémny ako má skúmaný, ak by nulová hypotéza bola pravdivá. Ak je p-hodnota menšia než zvolená hladina významnosti (α), výsledok sa považuje za štatisticky významný. Hladina α predstavuje tolerovanú pravdepodobnosť chyby typu I (zámenné zamietnutie nulovej hypotézy). Naopak chyba typu II vzniká, keď neodhalíme skutočný efekt; súvisí s pojmom výkonu testu (power) a parametrom β, pričom výkon = 1−β.

Historický kontext

Princípy testovania významnosti položil v 20. storočí Ronald Fisher, ktorý zaviedol p-hodnotu ako meradlo dôkazov. V nasledujúcich rokoch Jerzy Neyman a Egon Pearson rozvinuli formálny rámec rozhodovania, kde sa odporúčalo stanoviť hladinu 0,05 alebo inú hodnotu pre α ešte pred zberom dát a pracovať v kontexte kompromisu medzi chybou I a II. Tieto dva prístupy – Fisherov dôkazný štýl a Neyman–Pearsonova rozhodovacia teória – sa historicky dopĺňajú, no neraz vedú k zmätkom pri interpretácii výsledkov.

Použitie a praktické príklady

  • V klinickom skúšaní sa testuje, či liek zlepšuje stav oproti placebu; výsledok s p < α sa zvykne považovať za dôkaz účinnosti, avšak posúdenie veľkosti efektu a klinickej významnosti zostáva nevyhnutné.
  • Pri prieskumoch a experimentálnych štúdiách sa používajú bežné testy ako t-test, chí-kvadrát test alebo ANOVA na vyhodnotenie rozdielov medzi skupinami.
  • Pre malé vzorky alebo netypické rozdelenia je dôležité overiť predpoklady testov alebo použiť neparametrické metódy.

Bežné omyly a obmedzenia

Štatistická významnosť nie je totožná s praktickou alebo klinickou významnosťou. Malá p-hodnota iba naznačuje nízku pravdepodobnosť pozorovaného výsledku za nulovej hypotézy, nezaručuje veľký alebo dôležitý efekt. Časté problémy zahŕňajú viacnásobné porovnávania bez korekcie, p-hacking (výber analýz podľa výsledkov) a publikovanie len „pozitívnych“ výsledkov. Preto sa odporúča pred registračným plánom určiť analýzu a hladinu α, čo vedci často dokumentujú v protokoloch a registriách.

Alternatívy a doplnky

Pre vyvážené hodnotenie výsledkov sa odporúča kombinovať p-hodnoty s odhadmi veľkosti efektu, intervalmi spoľahlivosti a pri vhodnosti so Bayesianovskými metódami. Prehľadnosť zvyšuje aj prezentácia všetkých vykonaných testov a korekcia za viacnásobné porovnávania. Viac informácií o variantoch testov a metodike nájdete v literatúre o testy štatistických hypotéz a v úvodných textoch o premenných a pravdepodobnosti.

Otázky a odpovede

Otázka: Čo je to štatisticky významná premenná?

Odpoveď: Premenná je štatisticky významná, ak za určitého predpokladu zachovania stavu je pravdepodobnosť získania jej výsledku (alebo extrémnejšieho výsledku) menšia ako daná hodnota.

Otázka: Na čo sa používa štatistická významnosť?

Odpoveď: Štatistická významnosť sa používa na určenie nepravdepodobnosti výsledku experimentu, ak sa predpokladá, že určitý predpoklad status quo je pravdivý.

Otázka: Na čo sa používajú testy štatistických hypotéz?

Odpoveď: Testy štatistických hypotéz sa používajú na overenie významnosti.

Otázka: Kto vytvoril pojem štatistickej významnosti?

Odpoveď: Koncept štatistickej významnosti vytvoril Ronald Fisher vo svojej publikácii Statistical Methods for Research Workers (Štatistické metódy pre výskumných pracovníkov) z roku 1925, keď vypracoval testovanie štatistických hypotéz.

Otázka: Akú hraničnú úroveň navrhol Fisher na zamietnutie nulovej hypotézy?

Odpoveď: Fisher navrhol pravdepodobnosť jedna ku dvadsiatim (0,05 alebo 5 %) - ako vhodnú hraničnú úroveň na zamietnutie nulovej hypotézy.

Otázka: Kto odporúčal, aby sa hladina významnosti stanovila pred akýmkoľvek zberom údajov?

Odpoveď: Jerzy Neyman a Egon Pearson odporúčali, aby sa hladina významnosti (napríklad 0,05), ktorú nazvali α, stanovila pred akýmkoľvek zberom údajov.

Otázka: Mal Fisher v úmysle stanoviť hraničnú hodnotu 0,05?

Odpoveď: Nie, Fisher nemal v úmysle, aby táto hraničná hodnota bola pevne stanovená. Vo svojej publikácii Statistical methods and scientific inference z roku 1956 odporúčal, aby sa signifikantné hladiny stanovovali podľa konkrétnych okolností.

Súvisiace články

Autor

AlegsaOnline.com Štatistická významnosť: význam, interpretácia a obmedzenia

URL: https://sk.alegsaonline.com/art/93559

Zdieľať

Zdroje