Y n = I[X i > m 0 ],
|
|
- Kryštof Růžička
- před 5 lety
- Počet zobrazení:
Transkript
1 Neparametrické jednovýběrové testy a párové testy Úvodní nastavení. Z internetové stránky si můžete si stáhnout zdrojový kód k dnešnímu cvičení cviceni10.r. Otevřete si program R Studio, změňte si pracovní adresář a vyčistěte pracoviště setwd("h:/nmsa331") rm(list=ls()) Načtěte si data Hosi.txt a ujistěte se, že se Vám data dobře načetla. Do proměnné alpha is uložte testovací hladinu Budeme nejprve pracovat pouze s (náhodným) podvýběrem o rozsahu n = 100 pozorování. Hosi0 = Hosi set.seed( ) Hosi = Hosi0[sample(nrow(Hosi0), 100),] hmot <- Hosi$por.hmot Jednovýběrový znaménkový test 1. Minule jsme se zabývali otázkou, zda je průměrná porodní hmotnost chlapců rovna 3,3 kg. Zopakujte tuto analýzu (pomocí t-testu) na dnešní data. Připomeňte si pravděpodobnostní model, který jsme uvažovali a nulovou i alternativní hypotézu. Zformulujte závěr. 2. Nyní se budeme snažit zodpovědět tutéž otázku pomocí znaménkového testu. Připomeňte si předpoklady tohoto testu (tj. uvažovaný model pro naše data). Formulujte nulovou a alternativní hypotézu. Testová statistika má tvar n Y n = I[X i > m 0 ], i=1 kde m 0 je námi testovaná hodnota 3300 g. Jaké má přesné a jaké asymptotické rozdělení? Provedemeasymptotickouvariantuznaménkovéhotestunejprve manuálně.nejprvemusíme vyřadit pozorování, která jsou přesně rovna 3300, a budeme pracovat jen se zbylými daty. sum(hmot == 3300) (nless <- sum(hmot < 3300)) (nmore <- sum(hmot > 3300)) (N <- nless + nmore) 1
2 Naše analýza tedy bude založena na N počtu pozorování, v proměnné nmore je hodnota testovéstatistikyy n.proprovedeníasymptotickéhotestusijipříslušněznormujeme.následně ji porovnáme s kvantilem normálního rozdělení, nebo spočítáme přímo p-hodnotu: (Z = (nmore - N/2) / sqrt(n*1/4)) qnorm(1-alpha/2) # p- hodnota (dve moznosti, jak spocitat): 2*(1-pnorm(abs(Z))) 2*pnorm(-abs(Z)) K jakému závěru jsme došli? 3. Celý výpočet můžeme provést rychleji pomocí funkce prop.test, která slouží k testování pravděpodobnosti (proporce) v alternativním rozdělení. prop.test(x=nmore, n=n,p=1/2,correct=false) Všimněte si, že jsme dostali opravdu stejnou p-hodnotu. Testová statistika je ale jiná. Najdete souvislost s naším výsledkem uloženým v Z? Jaké asymptotické rozdělení má tedy testová statistika funkce prop.test? Nastavení correct=false zakazuje tzv. korekci pro spojitost, která je jinak defaultně zapnutá. Více v samostatném cvičení č Vyzkoušejte, co by se stalo, kdybychom celý výpočet prováděli s nless namísto nmore. 5. Jelikož znaménkový test převádí naše naměřená data na binární, podíváme se na to, jak vizualizovat kategoriální veličinu: Y <- hmot[hmot!= 3300]; # vybereme hmotnosti ruzne od 3300 Y <- factor(y > 3300) # udelame z nich 0-1 veliciny a chapeme je jako "faktor" levels(y) <- c("< 3300", "> 3300") # pojmenujeme kategorie summary(y) # kontrola s nless a nmore plot(y,col=2:3); # totez jako: barplot(table(y),col=2:3) # nebo barplot(c(nless, nmore), col=2:3,legend=c("< 3300", "> 3300")) #proporcionalne: pie(table(y),col=2:3) # nebo barplot(prop.table(as.matrix(c(nless, nmore))), col=2:3, legend=c("< 3300", "> 3300")) Jednovýběrový Wilcoxonův test 6. Stále se budeme zabývat otázkou, zda je průměrná porodní hmotnost chlapců rovna 3,3 kg. Nyní k testu použijeme Wilcoxonův test 2
3 (a) Jaký model předpokládáme pro naše data nyní? (b) Jak budeme ted formulovat testované hypotézy? Porovnejte předpoklady Wilcoxonova testu s předpoklady přesného t-testu a s předpoklady asymptotického t-testu. Porovnejte, kdy jsou testované hypotézy ekvivalentní a kdy naopak nejsou. Uved te příklad situace, pro kterou můžeme použít Wilcoxonův test a t-test by nebyl vhodný, a situace opačné. (c) Připomeňte si testovou statistiku tohoto testu: Je-li Z i = X i δ 0, kde δ 0 je pro nás 3300, pak W = R i, i I kde R i jsou pořadí Z i a I je množina indexů i takových, že Z i > 0. Test můžeme provést jak přesný (pro rozumně malé n; viz samostatné cvičení č. 4.) nebo asymptotický založený na tom, že W n(n+1) 4 n(n+1)(2n+1) 24 má asymptoticky N(0, 1). Pro provedení testu musíme opět nejprve odstranit pozorování rovné přímo δ 0. V případě výskytu shod je potřeba jmenovatel zmenšit o tzv. korekci rozptylu (viz přednáška, str. 82). V R se toto děje defaultně. Navíc se uvažuje ještě korekce pro spojitost, kdy se čitatel snižuje o 1/2 podobně jako u znaménkového testu (viz samostatné cvičení č.3.). Toto lze vypnout pomocí correct=false. (d) Provedeme test wilcox.test(hmot, mu = 3300,correct=FALSE) Jaký je náš závěr? 7. Ověříme, že uvedená testová statistika je skutečně W uvedené výše x <- hmot x <- x[x!= 0] ### nebudeme pouzivat porodni hmotnosti 3300 (R <- rank(abs(x))) (Sign <- -1*(x < 0) + 1*(x > 0)) (Splus <- sum(r[x > 0])) 8. Vypočítáme p-hodnotu pro test bez korekce i s korekcí pro spojitost. Vzorec pro korekci byl na přednášce, viz str. 82. ESplus <- N*(N+1)/4 varsplus_noties <- N * (N + 1) * (2 * N + 1) / 24 #vypocet korekce: (tx <- table(r)) # Pocet jednotlivych hodnot varcorrectwithties <- sum(tx^3 - tx) / 48 # Korekce v pripade shod varsplus <- varsplus_noties - varcorrectwithties 3
4 (U <- (Splus - ESplus) / sqrt(varsplus)) (U.corr <- (Splus - ESplus - 0.5) / sqrt(varsplus)) ### P-hodnoty (P <- 2*pnorm(-abs(U))) (P.corr <- 2*pnorm(-abs(U.corr))) Což můžeme srovnat s p-hodnotami: wilcox.test(hmot, mu = 3300, correct = FALSE)$p.val wilcox.test(hmot, mu = 3300)$p.val Výsledné p-hodnoty zkuste sami porovnat s p-hodnotou, kterou bychom dostali bez korekce jmenovatele. 9. Porovnáme sílu t-testu, znaménkového testu a Wilcoxonova testu pro normální rozdělení. opak=1000 n=100 p.t=numeric(opak) p.z=numeric(opak) p.w=numeric(opak) for(i in 1:opak){ x=rnorm(n,mean=0.2,sd=1) p.t[i]=t.test(x,mu=0)$p.val p.w[i]=wilcox.test(x,mu=0)$p.val p.z[i]=prop.test(sum(x>0),n,p=1/2)$p.val } mean(p.t<=0.05) mean(p.w<=0.05) mean(p.z<=0.05) Zkuste změnit velikost rozsahu n nebo alternativu, za které simulujeme, a sledujte, jak se mění síla. Lze udělat nějaký obecný závěr? Párový problém 10. Některé zdroje uvádějí, že chlapci v průběhu prvního roku života přiberou v průmětu alespoň 6,5 kg. Máme za úkol ověřit, zda jsou naše data v souladu s tímto tvrzením. (a) Jsou porodní hmotnost a hmotnost v jednom roce nezávislé veličiny? Uved te další možné příklady párového problému. (b) Spočítáme si váhový přírůstek během prvního roku: hmot<- Hosi$por.hmot hmot1 <- Hosi$hmotnost rozdil=hmot1-hmot 4
5 (c) Nejprve použijeme t-test. Jaký model předpokládáme (uvažte pomocí vhodných grafů) a jak zní nulová a alternativní hypotéza? Proved te test a interpretujte výsledek. (d) Nyní na stejný problém použijeme znaménkový test. Co nyní předpokládáme? A co testujeme? Je obecně nějaká souvislost mezi testovanou kvantitou a charakteristikami původních párových veličin (porodní hmotnosti a hmotnost v 1 roce)? Provedeme test n.more=sum(rozdil>6500) n=sum(rozdil!=6500) prop.test(n.more, n, alternative = "greater") Jaká je náš závěr? (e) Nakonec si na tomto problému vyzkoušíme ještě i Wilcoxonův test. Co nyní předpokládáme? Co předpokládáme navíc proti jednovýběrovému Wilcoxonovu testu? Jaké testujeme hypotézy? Proved te test. 11. Zajímá nás věkový rozdíl mezi rodiči chlapců. Konkrétně bychom rádí vědeli, zda jsou otcové v průměru o více než 2 roky starší než matky. (a) Nejprve si prohlédněte vhodné popisné statistiky a grafy, které ilustrují rozdělení věkového rozdílu. (b) Zvolte test, který Vám příjde pro tato data nejvhodnější a proved te jej. Uvědomte si, jaký uvažujete model, jaké testujete hypotézy a jak budeme interpretovat závěr. Samostatná práce 1. V rámci tohoto cvičení jsme pro test hypotézy, zda je porodní hmotnost chlapců rovna 3,3 kg, použili několik rozličných testů, které v praxi mohou vést k různým p-hodnotám a různým závěrům. Kterému výsledku tedy máme věřit? 2. Pomocí znaménkového testu proved te test hypotézy, zda je porodní hmotnost nižší než 3,5 kg. Zformulujte řádně nulovou a alternativní hypotézu a proved te test. 3. Vyzkoušejte si znaménkový test se zapnutou korekcí pro spojitost. Ověřte, že v tomto případě se počítá testová statistika Z C = Y n n sgn(y n n 2 ) n 4 (resp. její druhá mocnina). Použijte postup analogický tomu v bodě 2. Korekce pro spojitost zde vychází z toho, že Y n má diskrétní rozdělení a P(Y n y) = P(Y n < y+1).tudížpřipřechodukasymptotickéaproximacispojitýmnormálnímrozdělením s distribuční funkcí F lze P(Y n y) aproximovat jako F(y +ε) pro všechna ε [0,1). Jako určitý kompromis tedy vezmeme F(y +1/2). 4. Pro Wilcoxonův test můžeme použít i přesný test, založený na přesném rozdělení W. Je však nutné, aby v datech nebyly shody a žádné pozorování nebylo rovno přesně testované hodnotě. 5
6 Pro vyšší n může být ale výpočet časově náročný. Vyzkoušejte si to na simulovaných datech z rovnoměrného rozdělení: x=runif(10000,0,1) wilcox.test(x[1:100],mu=1/2,exact=true) Postupně zvyšujte počet použitých dat ze 100 na 200, 500, Porovnejte sílu jednovýběrových testů pro rovnoměrné rozdělení (stejně jako v 9.). Například simulujte data z R[0, 1.2] a testujte, zda je střední hodnota (medián) rovna 1/2. 6
Matematická statistika Zimní semestr
Neparametrické jednovýběrové testy a párové testy 4.12.2018 Úvodní nastavení. Z internetové stránky www.karlin.mff.cuni.cz/~hudecova/education/ si můžete si stáhnout zdrojový kód k dnešnímu cvičení cviceni10.r.
Pohlédněte si základní charakteristiky polohy jednotlivých veličin pomocí funkce summary.
Dvouvýběrové testy 11.12.2017 Úvodní nastavení. Z internetové stránky www.karlin.mff.cuni.cz/~hudecova/education/ si stáhněte data Iq2.txt a zdrojové kódy cviceni11.r a figks.r. Otevřete si program R Studio,
Matematická statistika Zimní semestr
Dvouvýběrové testy 11.12.2018 Úvodní nastavení. Z internetové stránky www.karlin.mff.cuni.cz/~hudecova/education/ si stáhněte data Iq2.txt a zdrojové kódy cviceni11.r a figks.r, případně i cviceni11-obrazky.r.
Testy o proporci a testy v multinomickém rozdělení
Testy o proporci a testy v multinomickém rozdělení 18.12.2017 Úvodní nastavení. Z internetové stránky www.karlin.mff.cuni.cz/~hudecova/education/ si můžete stáhnout zdrojový kód cviceni12.r. Otevřete si
Jednovýběrové testy: t-test, Kolmogorovův-Smirnovův test
Jednovýběrové testy: t-test, Kolmogorovův-Smirnovův test 30.11.2017 Úvodní nastavení. Z internetové stránky www.karlin.mff.cuni.cz/~hudecova/education/ si stáhněte data Iq.txt a můžete si stáhnout i zdrojový
Jednovýběrové testy: t-test, Kolmogorovův-Smirnovův test
Jednovýběrové testy: t-test, Kolmogorovův-Smirnovův test 27.11.2018 Úvodní nastavení. Z internetové stránky www.karlin.mff.cuni.cz/~hudecova/education/ si stáhněte data Iq.txt a můžete si stáhnout i zdrojový
Matematická statistika Zimní semestr Testy o proporci
Testy o proporci 18.12.2018 Jednovýběrový problém pro binární data. V roce 2008 se v České republice živě narodilo 119 570 dětí, z toho 58 244 dívek a 61 326 chlapců (zdroj ČSÚ). Zajímá nás, zda je pravděpodobnost
Matematická statistika Zimní semestr
Analýza rozptylu (jednoduché třídění) 11.1.2018 Úvodní nastavení. Z internetové stránky www.karlin.mff.cuni.cz/~hudecova/education/ si stáhněte data Med.txt. Otevřete si program R Studio a načtěte si výše
Základní popisné statistiky a grafy
Základní popisné statistiky a grafy 3.11.017 Úvodní nastavení. Ve svém domovském adresáři si založte speciální adresář nmsa331 na toto cvičení. Z internetové stránky www.karlin.mff.cuni.cz/~hudecova/education/
Kontingenční tabulky, testy dobré shody a analýza rozptylu (ANOVA)
Kontingenční tabulky, testy dobré shody a analýza rozptylu (ANOVA) 8.1.2018 Testy dobré shody se známými parametry. Mezi 891 studenty pražských vysokých škol byl na podzim 2017 proveden průzkum týkající
PRAVDĚPODOBNOST A STATISTIKA. Neparametrické testy hypotéz čast 1
PRAVDĚPODOBNOST A STATISTIKA Neparametrické testy hypotéz čast 1 Neparametrické testy hypotéz - úvod Neparametrické testy statistických hypotéz se používají v případech, kdy neznáme rozdělení pozorované
Rozhodnutí / Skutečnost platí neplatí Nezamítáme správně chyba 2. druhu Zamítáme chyba 1. druhu správně
Testování hypotéz Nechť,, je náhodný výběr z nějakého rozdělení s neznámými parametry. Máme dvě navzájem si odporující hypotézy o parametrech daného rozdělení: Nulová hypotéza parametry (případně jediný
4ST201 STATISTIKA CVIČENÍ Č. 7
4ST201 STATISTIKA CVIČENÍ Č. 7 testování hypotéz parametrické testy test hypotézy o střední hodnotě test hypotézy o relativní četnosti test o shodě středních hodnot testování hypotéz v MS Excel neparametrické
Neparametrické metody
Neparametrické metody Dosud jsme se zabývali statistickými metodami, které zahrnovaly předpoklady o rozdělení dat. Zpravidla jsme předpokládali normální rozdělení. Např. Grubbsův test odlehlých hodnot
RNDr. Eva Janoušová doc. RNDr. Ladislav Dušek, Dr.
Analýza dat pro Neurovědy RNDr. Eva Janoušová doc. RNDr. Ladislav Dušek, Dr. Jaro 2014 Institut biostatistiky Janoušová, a analýz Dušek: Analýza dat pro neurovědy Blok 3 Jak a kdy použít parametrické a
676 + 4 + 100 + 196 + 0 + 484 + 196 + 324 + 64 + 324 = = 2368
Příklad 1 Je třeba prověřit, zda lze na 5% hladině významnosti pokládat za prokázanou hypotézu, že střední doba výroby výlisku je 30 sekund. Přitom 10 náhodně vybraných výlisků bylo vyráběno celkem 540
Základní popisné statistiky a grafy
Základní popisné statistiky a grafy 20.11.2018 Úvodní nastavení. Ve svém domovském adresáři si založte speciální adresář nmsa331 na toto cvičení. Z internetové stránky www.karlin.mff.cuni.cz/~hudecova/education/
Kontingenční tabulky a testy shody
Kontingenční tabulky a testy shody 4.1.2018 Kontingenční tabulky 1. Tabulka 1 shrnuje osudy pasažérů lodě Titanic, která tragicky ztroskotala v roce 1912. Zajímá nás, zda existuje nějaká souvislost mezi
Opakování. Neparametrické testy. Pořadí. Jednovýběrový Wilcoxonův test. t-testy: hypotézy o populačním průměru (střední hodnoty) předpoklad normality
Opakování Opakování: Testy o střední hodnotě normálního rozdělení 1 jednovýběrový t-test 2 párový t-test 3 dvouvýběrový t-test jednovýběrový Wilcoxonův test párový Wilcoxonův test dvouvýběrový Wilcoxonův
DVOUVÝBĚROVÉ A PÁROVÉ TESTY Komentované řešení pomocí programu Statistica
DVOUVÝBĚROVÉ A PÁROVÉ TESTY Komentované řešení pomocí programu Statistica Úloha A) koncentrace glukózy v krvi V této části posoudíme pomocí párového testu, zda nový lék prokazatelně snižuje koncentraci
VYBRANÉ DVOUVÝBĚROVÉ TESTY. Martina Litschmannová
VYBRANÉ DVOUVÝBĚROVÉ TESTY Martina Litschmannová Obsah přednášky Vybrané dvouvýběrové testy par. hypotéz test o shodě rozptylů (F-test), testy o shodě středních hodnot (t-test, Aspinové-Welchův test),
Intervalové odhady. Interval spolehlivosti pro střední hodnotu v N(µ, σ 2 ) Interpretace intervalu spolehlivosti. Interval spolehlivosti ilustrace
Intervalové odhady Interval spolehlivosti pro střední hodnotu v Nµ, σ 2 ) Situace: X 1,..., X n náhodný výběr z Nµ, σ 2 ), kde σ 2 > 0 známe měli jsme: bodové odhady odhadem charakteristiky je číslo) nevyjadřuje
Intervalové odhady. Interval spolehlivosti pro střední hodnotu v N(µ, σ 2 ) Interpretace intervalu spolehlivosti. Interval spolehlivosti ilustrace
Intervalové odhady Interval spolehlivosti pro střední hodnotu v Nµ, σ 2 ) Situace: X 1,..., X n náhodný výběr z Nµ, σ 2 ), kde σ 2 > 0 známe měli jsme: bodové odhady odhadem charakteristiky je číslo) nevyjadřuje
ANALÝZA DAT V R 5. ZÁKLADNÍ STATISTICKÉ TESTY. Mgr. Markéta Pavlíková Katedra pravděpodobnosti a matematické statistiky MFF UK.
ANALÝZA DAT V R 5. ZÁKLADNÍ STATISTICKÉ TESTY Mgr. Markéta Pavlíková Katedra pravděpodobnosti a matematické statistiky MFF UK www.biostatisticka.cz PRINCIPY STATISTICKÉ INFERENCE identifikace závisle proměnné
ANALÝZA DAT V R 7. KONTINGENČNÍ TABULKA. Mgr. Markéta Pavlíková Katedra pravděpodobnosti a matematické statistiky MFF UK.
ANALÝZA DAT V R 7. KONTINGENČNÍ TABULKA Mgr. Markéta Pavlíková Katedra pravděpodobnosti a matematické statistiky MFF UK www.biostatisticka.cz PŘEHLED TESTŮ rozdělení normální spojité alternativní / diskrétní
12. cvičení z PST. 20. prosince 2017
1 cvičení z PST 0 prosince 017 11 test rozptylu normálního rozdělení Do laboratoře bylo odesláno n = 5 stejných vzorků krve ke stanovení obsahu alkoholu X v promilích alkoholu Výsledkem byla realizace
Matematická statistika. Testy v. v binomickém. Test pravděpodobnosti. Test homogenity dvou. Neparametrické testy. statistika. Testy v.
Opakování Opakování: y o střední hodnotě normálního 1 jednovýběrový t-test 2 párový t-test 3 výběrový t-test Šárka Hudecová Katedra a matematické statistiky Matematicko-fyzikální fakulta Univerzity Karlovy
11. cvičení z PSI prosince hodnota pozorovaná četnost n i p X (i) = q i (1 q), i N 0.
11 cvičení z PSI 12-16 prosince 2016 111 (Test dobré shody - geometrické rozdělení Realizací náhodné veličiny X jsme dostali následující četnosti výsledků: hodnota 0 1 2 3 4 5 6 pozorovaná četnost 29 15
Lékařská biofyzika, výpočetní technika I. Biostatistika Josef Tvrdík (doc. Ing. CSc.)
Lékařská biofyzika, výpočetní technika I Biostatistika Josef Tvrdík (doc. Ing. CSc.) Přírodovědecká fakulta, katedra informatiky josef.tvrdik@osu.cz konzultace úterý 4. až 5.4 hod. http://www.osu.cz/~tvrdik
NEPARAMETRICKÉ TESTY
NEPARAMETRICKÉ TESTY Neparametrický jednovýběrový Jeden výběr jehož medián srovnáváme s nějakou hodnotou Wilcoxonův jednovýběrový test 1) Máme data z družice Hipparcos pro deklinaci (obdoba zeměpisné šířky)
MATEMATICKÁ STATISTIKA 1 ( )
MATEMATICKÁ STATISTIKA 1 (2014 15) Zápočtové domácí úkoly (společné pro obě paralelky) Obecné pokyny q q Úlohy se odevzdávají vždy na začátku Vašeho cvičení (Vašemu cvičícímu, případně jeho záskoku). Úlohy
Vzorová prezentace do předmětu Statistika
Vzorová prezentace do předmětu Statistika Popis situace: U 3 náhodně vybraných osob byly zjišťovány hodnoty těchto proměnných: SEX - muž, žena PUVOD Skandinávie, Středomoří, 3 západní Evropa IQ hodnota
KORELACE. Komentované řešení pomocí programu Statistica
KORELACE Komentované řešení pomocí programu Statistica Vstupní data I Data umístěná v excelovském souboru překopírujeme do tabulky ve Statistice a pojmenujeme proměnné, viz prezentace k tématu Popisná
Testování hypotéz. testujeme (většinou) tvrzení o parametru populace. tvrzení je nutno předem zformulovat
Testování hypotéz testujeme (většinou) tvrzení o parametru populace tvrzení je nutno předem zformulovat najít odpovídající test, podle kterého se na základě informace z výběrového souboru rozhodneme, zda
Matematická statistika Zimní semestr
Kontingenční tabulky, testy shody, jednoduché třídění 8.1.2018 Kontingenční tabulky 1. Tabulka 1 shrnuje osudy pasažérů lodě Titanic, která tragicky ztroskotala v roce 1912. Zajímá nás, zda existuje nějaká
12. cvičení z PSI prosince (Test střední hodnoty dvou normálních rozdělení se stejným neznámým rozptylem)
cvičení z PSI 0-4 prosince 06 Test střední hodnoty dvou normálních rozdělení se stejným neznámým rozptylem) Z realizací náhodných veličin X a Y s normálním rozdělením) jsme z výběrů daného rozsahu obdrželi
Mann-Whitney U-test. Znaménkový test. Vytvořil Institut biostatistiky a analýz, Masarykova univerzita J. Jarkovský, L. Dušek
10. Neparametrické y Mann-Whitney U- Wilcoxonův Znaménkový Shrnutí statistických ů Typ srovnání Nulová hypotéza Parametrický Neparametrický 1 skupina dat vs. etalon Střední hodnota je rovna hodnotě etalonu.
Normální (Gaussovo) rozdělení
Normální (Gaussovo) rozdělení f x = 1 2 exp x 2 2 2 f(x) je funkce hustoty pravděpodobnosti, symetrická vůči poloze maxima x = μ μ střední hodnota σ směrodatná odchylka (tzv. pološířka křivky mezi inflexními
t-test, Studentův párový test Ing. Michael Rost, Ph.D.
Testování hypotéz: dvouvýběrový t-test, Studentův párový test Ing. Michael Rost, Ph.D. Úvod do problému... Již známe jednovýběrový t-test, při kterém jsme měli k dispozici pouze jeden výběr. Můžeme se
PARAMETRICKÉ TESTY. 1) Měření Etalonu. Dataset - mereni_etalonu.sta - 9 měření etalonu srovnáváme s PŘEDPOKLÁDANOU HODNOTOU 10.
PARAMETRICKÉ TESTY Testujeme rovnost průměru - předpokladem normální rozdělení I) Jednovýběrový t-test 1) Měření Etalonu. Dataset - mereni_etalonu.sta - 9 měření etalonu srovnáváme s PŘEDPOKLÁDANOU HODNOTOU
15. T e s t o v á n í h y p o t é z
15. T e s t o v á n í h y p o t é z Na základě hodnot náhodného výběru činíme rozhodnutí o platnosti hypotézy o hodnotách parametrů rozdělení nebo o jeho vlastnostech. Rozeznáváme dva základní typy testů:
letní semestr 2012 Katedra pravděpodobnosti a matematické statistiky Matematicko-fyzikální fakulta Univerzity Karlovy Matematická statistika
Šárka Hudecová Katedra pravděpodobnosti a matematické statistiky Matematicko-fyzikální fakulta Univerzity Karlovy letní semestr 2012 Opakování t- vs. neparametrické Wilcoxonův jednovýběrový test Opakování
Testování hypotéz. Testování hypotéz o rozdílu průměrů t-test pro nezávislé výběry t-test pro závislé výběry
Testování hypotéz Testování hypotéz o rozdílu průměrů t-test pro nezávislé výběry t-test pro závislé výběry Testování hypotéz Obecný postup 1. Určení statistické hypotézy 2. Určení hladiny chyby 3. Výpočet
Normální (Gaussovo) rozdělení
Normální (Gaussovo) rozdělení Normální (Gaussovo) rozdělení popisuje vlastnosti náhodné spojité veličiny, která vzniká složením různých náhodných vlivů, které jsou navzájem nezávislé, kterých je velký
Jednostranné intervaly spolehlivosti
Jednostranné intervaly spolehlivosti hledáme jen jednu z obou mezí Princip: dle zadání úlohy hledáme jen dolní či jen horní mez podle oboustranného vzorce s tou změnou, že výraz 1-α/2 ve vzorci nahradíme
2 ) 4, Φ 1 (1 0,005)
Příklad 1 Ze zásilky velkého rozsahu byl náhodně vybrán soubor obsahující 1000 kusů. V tomto souboru bylo zjištěno 26 kusů nekvalitních. Rozhodněte, zda je možné s 99% jistotou tvrdit, že zásilka obsahuje
Testování statistických hypotéz
Testování statistických hypotéz Na základě náhodného výběru, který je reprezentativním vzorkem základního souboru (který přesně neznáme, k němuž se ale daná statistická hypotéza váže), potřebujeme ověřit,
Stručný úvod do testování statistických hypotéz
Stručný úvod do testování statistických hypotéz 1. Formulujeme hypotézu (předpokládáme, že pozorovaný jev je pouze náhodný). 2. Zvolíme hladinu významnosti testu a, tj. riziko, s nímž jsme ochotni se smířit.
5. Závislost dvou náhodných veličin různých typů (kategoriální a metrická veličina)
5. Závislost dvou náhodných veličin různých typů (kategoriální a metrická veličina) Cílem tématu je správné posouzení a výběr vhodného testu v závislosti na povaze metrické a kategoriální veličiny. V následující
Úvod do analýzy rozptylu
Úvod do analýzy rozptylu Párovým t-testem se podařilo prokázat, že úprava režimu stravování a fyzické aktivity ve vybrané škole měla vliv na zlepšené hodnoty HDLcholesterolu u školáků. Pro otestování jsme
JEDNOVÝBĚROVÉ TESTY. Komentované řešení pomocí programu Statistica
JEDNOVÝBĚROVÉ TESTY Komentované řešení pomocí programu Statistica Vstupní data Data umístěná v excelovském souboru překopírujeme do tabulky ve Statistice a pojmenujeme proměnné, viz prezentace k tématu
UNIVERZITA OBRANY Fakulta ekonomiky a managementu. Aplikace STAT1. Výsledek řešení projektu PRO HORR2011 a PRO GRAM2011 3. 11.
UNIVERZITA OBRANY Fakulta ekonomiky a managementu Aplikace STAT1 Výsledek řešení projektu PRO HORR2011 a PRO GRAM2011 Jiří Neubauer, Marek Sedlačík, Oldřich Kříž 3. 11. 2012 Popis a návod k použití aplikace
Jednovýběrový Wilcoxonův test a jeho asymptotická varianta (neparametrická obdoba jednovýběrového t-testu)
Jednovýběrový Wilcoxonův test a jeho asymptotická varianta (neparametrická obdoba jednovýběrového t-testu) Frank Wilcoxon (1892 1965): Americký statistik a chemik Nechť X 1,..., X n je náhodný výběr ze
Základy počtu pravděpodobnosti a metod matematické statistiky
Errata ke skriptu Základy počtu pravděpodobnosti a metod matematické statistiky K. Hron a P. Kunderová Autoři prosí čtenáře uvedeného studijního textu, aby případné další odhalené chyby nad rámec tohoto
Testy dobré shody Máme dvě veličiny, u kterých bychom chtěli prokázat závislost, TESTY DOBRÉ SHODY (angl. goodness-of-fit tests)
Testy dobré shody Máme dvě veličiny, u kterých bychom chtěli prokázat závislost, např. hmotnost a pohlaví narozených dětí. Běžný statistický postup pro ověření závislosti dvou veličin je zamítnutí jejich
PRAVDĚPODOBNOST A STATISTIKA
PRAVDĚPODOBNOST A STATISTIKA Testování hypotéz Nechť X je náhodná proměnná, která má distribuční funkci F(x, ϑ). Předpokládejme, že známe tvar distribuční funkce (víme jaké má rozdělení) a neznáme parametr
Statistika. Testování hypotéz statistická indukce Neparametrické testy. Roman Biskup
Statistika Testování hypotéz statistická indukce Neparametrické testy Roman Biskup (zapálený) statistik ve výslužbě, aktuálně analytik v praxi ;-) roman.biskup(at)email.cz 21. února 2012 Statistika by
z Matematické statistiky 1 1 Konvergence posloupnosti náhodných veličin
Příklady k procvičení z Matematické statistiky Poslední úprava. listopadu 207. Konvergence posloupnosti náhodných veličin. Necht X, X 2... jsou nezávislé veličiny s rovnoměrným rozdělením na [0, ]. Definujme
PSY117/454 Statistická analýza dat v psychologii seminář 9. Statistické testování hypotéz
PSY117/454 Statistická analýza dat v psychologii seminář 9 Statistické testování hypotéz Základní výzkumné otázky/hypotézy 1. Stanovení hodnoty parametru =stanovení intervalu spolehlivosti na μ, σ, ρ,
STATISTICKÉ TESTY VÝZNAMNOSTI
STATISTICKÉ TESTY VÝZNAMNOSTI jsou statistické postupy, pomocí nichž ověřujeme, zda mezi proměnnými existuje vztah (závislost, rozdíl). Pokud je výsledek šetření statisticky významný (signifikantní), znamená
Mannův-Whitneyův(Wilcoxonův) test pořadová obdoba dvouvýběrového t-testu. Statistika (MD360P03Z, MD360P03U) ak. rok 2007/2008
Statistika (MD30P03Z, MD30P03U) ak. rok 007/008 Karel Zvára karel.zvara@mff.cuni.cz http://www.karlin.mff.cuni.cz/ zvara (naposledy upraveno. listopadu 007) 1(4) Mann-Whitney párový Wilcoxon párový znaménkový
15. T e s t o v á n í h y p o t é z
15. T e s t o v á n í h y p o t é z Na základě hodnot náhodného výběru činíme rozhodnutí o platnosti hypotézy o hodnotách parametrů rozdělení nebo o jeho vlastnostech. Rozeznáváme dva základní typy testů:
Návod na vypracování semestrálního projektu
Návod na vypracování semestrálního projektu Následující dokument má charakter doporučení. Není závazný, je pouze návodem pro studenty, kteří si nejsou jisti výběrem dat, volbou metod a formou zpracování
STATISTIKA A INFORMATIKA - bc studium OZW, 1.roč. (zkušební otázky)
STATISTIKA A INFORMATIKA - bc studium OZW, 1.roč. (zkušební otázky) 1) Význam a využití statistiky v biologických vědách a veterinárním lékařství ) Rozdělení znaků (veličin) ve statistice 3) Základní a
Příklad 1. Řešení 1 ŘEŠENÉ PŘÍKLADY Z MV2 ČÁST 11
Příklad 1 Vyhláška Ministerstva zdravotnictví předpokládala, že doba dojezdu k pacientovi od nahlášení požadavku nepřekročí 17 minut. Hodnoty deseti náhodně vybraných dob příjezdu sanitky k nemocnému byly:
RNDr. Eva Janoušová doc. RNDr. Ladislav Dušek, Dr.
Analýza dat pro Neurovědy RNDr. Eva Janoušová doc. RNDr. Ladislav Dušek, Dr. Jaro 2014 Institut biostatistiky Janoušová, a analýz Dušek: Analýza dat pro neurovědy Blok 4 Jak a kdy použít parametrické a
Pravděpodobnost a matematická statistika
Pravděpodobnost a matematická statistika Příklady k přijímacím zkouškám na doktorské studium 1 Popisná statistika Určete aritmetický průměr dat, zadaných tabulkou hodnot x i a četností n i x i 1 2 3 n
Testy statistických hypotéz
Testy statistických hypotéz Statistická hypotéza je jakýkoliv předpoklad o rozdělení pravděpodobnosti jedné nebo několika náhodných veličin. Na základě náhodného výběru, který je reprezentativním vzorkem
Testování statistických hypotéz
Testování statistických hypotéz 1 Testování statistických hypotéz 1 Statistická hypotéza a její test V praxi jsme nuceni rozhodnout, zda nějaké tvrzeni o parametrech náhodných veličin nebo o veličině samotné
Protokol č. 1. Tloušťková struktura. Zadání:
Protokol č. 1 Tloušťková struktura Zadání: Pro zadané výčetní tloušťky (v cm) vypočítejte statistické charakteristiky a slovně interpretujte základní statistické vlastnosti tohoto souboru tloušťek. Dále
KONTINGENČNÍ TABULKY Komentované řešení pomocí programu Statistica
KONTINGENČNÍ TABULKY Komentované řešení pomocí programu Statistica Vstupní data transformace před vložením Než data vložíme do tabulky ve Statistice, musíme si je předpřipravit. Označme si P Prahu, S Šumperk
Řešení: máme diskrétní N.V. vzdělání bez maturity, s maturitou, vysokoškoláci, PhD.
Cvičení 13 Opakování 1 Příklad χ 2 test dobré shody Průzkumem bylo zjištěno, že v roce 2005 bylo ve městě 18% lidí bez maturity, 56% s maturitou, 22% absolventů vysokoškolského studia, zbytek tvořili absolventi
Pravděpodobnost a matematická statistika Doc. RNDr. Gejza Dohnal, CSc.
Pravděpodobnost a matematická statistika Doc. RNDr. Gejza Dohnal, CSc. dohnal@nipax.cz Pravděpodobnost a matematická statistika 2010 1.týden (20.09.-24.09. ) Data, typy dat, variabilita, frekvenční analýza
Testování hypotéz. 1 Jednovýběrové testy. 90/2 odhad času
Testování hypotéz 1 Jednovýběrové testy 90/ odhad času V podmínkách naprostého odloučení má voák prokázat schopnost orientace v čase. Úkolem voáka e provést odhad časového intervalu 1 hodiny bez hodinek
STATISTICKÉ TESTY VÝZNAMNOSTI
STATISTICKÉ TESTY VÝZNAMNOSTI jsou statistické postupy, pomocí nichž ověřujeme, zda mezi proměnnými existuje vztah (závislost, rozdíl). Pokud je výsledek šetření statisticky významný (signifikantní), znamená
Statistické metody v ekonomii. Ing. Michael Rost, Ph.D.
Statistické metody v ekonomii Ing. Michael Rost, Ph.D. Jihočeská univerzita v Českých Budějovicích Test χ 2 v kontingenční tabulce typu 2 2 Jde vlastně o speciální případ χ 2 testu pro čtyřpolní tabulku.
Testování hypotéz. Analýza dat z dotazníkových šetření. Kuranova Pavlina
Testování hypotéz Analýza dat z dotazníkových šetření Kuranova Pavlina Statistická hypotéza Možné cíle výzkumu Srovnání účinnosti různých metod Srovnání výsledků různých skupin Tzn. prokázání rozdílů mezi
AKM CVIČENÍ. Opakování maticové algebry. Mějme matice A, B regulární, potom : ( AB) = B A
AKM - 1-2 CVIČENÍ Opakování maticové algebry Mějme matice A, B regulární, potom : ( AB) = B A 1 1 ( A ) = ( A ) ( A ) = A ( A + B) = A + B 1 1 1 ( AB) = B A, kde A je řádu mxn a B nxk Čtvercová matice
Pravděpodobnost a matematická statistika Doc. RNDr. Gejza Dohnal, CSc. dohnal@nipax.cz
Pravděpodobnost a matematická statistika Doc. RNDr. Gejza Dohnal, CSc. dohnal@nipax.cz Pravděpodobnost a matematická statistika Doc. RNDr. Gejza Dohnal, CSc. dohnal@nipax.cz Pravděpodobnost a matematická
Testování hypotéz. Testování hypotéz o rozdílu průměrů t-test pro nezávislé výběry t-test pro závislé výběry
Testování hypotéz Testování hypotéz o rozdílu průměrů t-test pro nezávislé výběry t-test pro závislé výběry Testování hypotéz Obecný postup 1. Určení statistické hypotézy 2. Určení hladiny chyby 3. Výpočet
Test dobré shody v KONTINGENČNÍCH TABULKÁCH
Test dobré shody v KONTINGENČNÍCH TABULKÁCH Opakování: Mějme náhodné veličiny X a Y uspořádané do kontingenční tabulky. Řekli jsme, že nulovou hypotézu H 0 : veličiny X, Y jsou nezávislé zamítneme, když
Neparametrické testy
Neparametrické testy Dosud jsme se zabývali statistickými metodami, které zahrnovaly předpoklady o rozdělení dat. Zpravidla jsme předpokládali normální (Gaussovo) rozdělení. Například: Grubbsův test odlehlých
Cvičení 9: Neparametrické úlohy o mediánech
Cvičení 9: Neparametrické úlohy o mediánech Úkol 1.: Párový znaménkový test a párový Wilcoxonův test Při zjišťování kvality jedné složky půdy se používají dvě metody označené A a B. Výsledky: Vzorek 1
Základní statistické modely Statistické vyhodnocování exp. dat M. Čada ~ cada
Základní statistické modely 1 Statistika Matematická statistika se zabývá interpretací získaných náhodných dat. Snažíme se přiřadit statistickému souboru vhodnou distribuční funkci a najít základní číselné
KGG/STG Statistika pro geografy
KGG/STG Statistika pro geografy 7. Testování statistických hypotéz Mgr. David Fiedor 30. března 2015 Osnova 1 2 3 Dělení testů parametrické - o parametrech rozdělení základního souboru (průměr, rozptyl,
Tomáš Karel LS 2012/2013
Tomáš Karel LS 2012/2013 Doplňkový materiál ke cvičení z předmětu 4ST201. Na případné faktické chyby v této presentaci mě prosím upozorněte. Děkuji. Tyto slidy berte pouze jako doplňkový materiál není
5. T e s t o v á n í h y p o t é z
5. T e s t o v á n í h y p o t é z Na základě hodnot náhodného výběru činíme rozhodnutí o platnosti hypotézy o hodnotách parametrů rozdělení nebo o jeho vlastnostech. Rozeznáváme dva základní typy testů:
Pravděpodobnost a matematická statistika Doc. RNDr. Gejza Dohnal, CSc.
Pravděpodobnost a matematická statistika Doc. RNDr. Gejza Dohnal, CSc. dohnal@nipax.cz Pravděpodobnost a matematická statistika 010 1.týden (0.09.-4.09. ) Data, typy dat, variabilita, frekvenční analýza
Náhodný vektor. Náhodný vektor. Hustota náhodného vektoru. Hustota náhodného vektoru. Náhodný vektor je dvojice náhodných veličin (X, Y ) T = ( X
Náhodný vektor Náhodný vektor zatím jsme sledovali jednu náhodnou veličinu, její rozdělení a charakteristiky často potřebujeme vyšetřovat vzájemný vztah několika náhodných veličin musíme sledovat jejich
Poznámky k předmětu Aplikovaná statistika, 9.téma
Poznámky k předmětu Aplikovaná statistika, 9téma Princip testování hypotéz, jednovýběrové testy V minulé hodině jsme si ukázali, jak sestavit intervalové odhady pro některé číselné charakteristiky normálního
MSI LS 2006/2007 Ing. Pavla Hošková, Ph.D., 2. test
c 2007 Kompost 1 MSI LS 2006/2007 Ing. Pavla Hošková, Ph.D., 2. test Jestliže při testování výsledek (hodnota testového kritéria) padne do kritického oboru: a) musíme nově formulovat nulovou hypotézu,
Vybraná rozdělení náhodné veličiny
3.3 Vybraná rozdělení náhodné veličiny 0,16 0,14 0,12 0,1 0,08 0,06 0,04 0,02 0 Rozdělení Z 3 4 5 6 7 8 9 10 11 12 13 14 15 Život je umění vytvářet uspokojivé závěry na základě nedostatečných předpokladů.
Tomáš Karel LS 2012/2013
Tomáš Karel LS 2012/2013 Doplňkový materiál ke cvičení z předmětu 4ST201. Na případné faktické chyby v této presentaci mě prosím upozorněte. Děkuji. Tyto slidy berte pouze jako doplňkový materiál není
Aproximace binomického rozdělení normálním
Aproximace binomického rozdělení normálním Aproximace binomického rozdělení normálním Příklad Sybilla a Kassandra tvrdí, že mají telepatické schopnosti, a chtějí to dokázat následujícím pokusem: V jedné
Jednofaktorová analýza rozptylu
Jednofaktorová analýza rozptylu David Hampel Ústav statistiky a operačního výzkumu, Mendelova univerzita v Brně Kurz pokročilých statistických metod Global Change Research Centre AS CR, 5 7 8 2015 Tato
ANALÝZA DAT V R 3. POPISNÉ STATISTIKY, NÁHODNÁ VELIČINA. Mgr. Markéta Pavlíková Katedra pravděpodobnosti a matematické statistiky MFF UK
ANALÝZA DAT V R 3. POPISNÉ STATISTIKY, NÁHODNÁ VELIČINA Mgr. Markéta Pavlíková Katedra pravděpodobnosti a matematické statistiky MFF UK www.biostatisticka.cz POPISNÉ STATISTIKY - OPAKOVÁNÍ jedna kvalitativní
Statistické metody v ekonomii. Ing. Michael Rost, Ph.D.
Statistické metody v ekonomii Ing. Michael Rost, Ph.D. Jihočeská univerzita v Českých Budějovicích Proč neparametrické testy? Pokud provádíte formální analýzu či testování hypotéz (zejména provádíte-li
Ing. Michael Rost, Ph.D.
Úvod do testování hypotéz, jednovýběrový t-test Ing. Michael Rost, Ph.D. Testovaná hypotéza Pokud nás zajímá zda platí, či neplatí tvrzení o určitém parametru, např. o parametru Θ, pak takovéto tvrzení