Testy o proporci a testy v multinomickém rozdělení
|
|
- Sabina Sedláčková
- před 6 lety
- Počet zobrazení:
Transkript
1 Testy o proporci a testy v multinomickém rozdělení Úvodní nastavení. Z internetové stránky si můžete stáhnout zdrojový kód cviceni12.r. Otevřete si program R Studio a proved te úvodní nastavení jako vždy: setwd("h:/nmsa331") rm(list=ls()) alpha=0.05 Jednovýběrový problém pro binární data 1. Načtěte si data Hosi.txt. Z nich nás opět bude zajímat porodní hmotnost, a to konkrétně náhodný podvýběr o rozsahu 200: Hosi = read.table("hosi.txt",header=t) set.seed( ) hmot=sample(hosi$por.hmot,200) 2. Novorozenec s váhou nižší než 2500 g bývá označován za novorozence s nízkou porodní hmotností. Na stránce wikiskripta.eu se uvádí, že v roce 2009 mělo nízkou porodní hmotnost 7.8 % dětí. Naším úkolem je zjistit, zda jsou naše data v souladu s touto informací. Zavedeme si novou proměnnou NPH, která může nabývat dvou hodnot: nph pro chlapce s nízkou porodní hmotností a ok pro ostatní. NPH=factor(ifelse(hmot<2500,"nph","ok")) sum(nph=="nph") (tabulka=table(nph)) (Ptabulka=prop.table(table(NPH))) # relativni cetnosti round(ptabulka*100,2) Takto jsme si nechali vypsat tabulku četností a tabulku relativních četností. Rovnou jsme si je i uložili, protože se nám budou pro další práci hodit. Ještě si vše znázorníme graficky: pie(tabulka) pie(tabulka, labels=c("nizka hmotnost","normalni hmotnost")) barplot(tabulka, ylab = "Cetnost") barplot(tabulka,ylab="cetnost",names=c("nizka hmotnost","normalni hmotnost")) barplot(ptabulka,ylab="relativni cetnost",names=c("nizka hmotnost", "Normalni hmotnost")) 1
2 3. Co odhadují relativní četnosti a v jakém modelu? Uložíme si tento odhad do proměnné phat: (phat =Ptabulka[1]) # totez jako: Ptabulka["nph"] 4. Přistoupíme k testu výše uvedené domněnky o výskytu dětí s nízkou porodní hmotností. Jaký předpokládáme model a jak budeme formulovat hypotézy? Nejprve budeme uvažovat asymptotický Wilsonův test, který je založený na testové statistice W = p n p 0 n p0 (1 p 0 ), která má asymptoticky normální rozdělení. Test provedeme: p0 < (Xn <- tabulka["nph"]) n <- length(nph) prop.test(x = Xn, n = n, p = p0, correct = FALSE) # nebo primo prop.test(tabulka,p=p0,correct=false) Jaký je náš závěr? Jsou naše data v souladu s uváděným procentuálním výskytem novorozenců s nízkou hmotností? Jakou testovou statistiku nám zde uvádí prop.test? A jaké má asymptotické rozdělení? Ověříme vše manuálním výpočtem: W <- (phat - p0)/sqrt(p0*(1-p0)/n) W^2 # p-hodnota 2*pnorm(-abs(W)) 1 - pchisq(w^2, df=1) Jak se spočítá uvedený interval spolehlivosti? Spočtěte tento interval ručně, a porovnejte s intervalem z funkce prop.test. 5. Nyní provedeme test téže hypotézy pomocí přesného testu: binom.test(x = Xn, n = n, p = p0) Jaký je nyní náš závěr? Připomeňte si, že přesný test je založen na binomickém rozdělení a že nulovou hypotézu zamítáme pro velmi malé a velmi velké hodnoty. Tedy, zamítáme, pokud X n < C 1 nebo X n > C 2, kde (C1 <- qbinom(alpha/2, size=n, prob=p0)) (C2 <- qbinom(1-alpha/2, size=n, prob=p0) - 1) 2
3 Odpovídá to výsledku funkce binom.test? 6. Jelikož alternativní rozdělení splňuje předpoklady centrální limitní věty, můžeme použít i asymptotický t-test. K jeho provedení musíme nejprve převést naši proměnnou NPH na 0-1 veličinu: NPH2=abs(as.numeric(NPH)-2) t.test(nph2,mean=p0) 7. Podle zprávy Hospodářských novin ze dne (zpráva Na českých vysokých školách přibývá studentů z bývalého Sovětského svazu a pomalu vytlačují Slováky) na českých vysokých školách studuje 14 % cizinců. Na základě dat z jednoho cvičení otestujte domněnku, že na Matfyzu je to statisticky významně více. Na toto cvičení chodí 20 studentů, z nichž 6 je ze Slovenska (tj. jsou cizinci). Jaký model předpokládáme? Jak vypadají hypotézy? Je vhodnější použít přesnou variantu testu nebo asymptotickou verzi? Dvouvýběrový problém pro binární data 8. Bude nás zajímat, zda je pravděpodobnost narození dítěte s nízkou porodní hmotností stejná proženypod35letaženy,kterémajíalespoň35let.prozkoumánítohotoproblémupoužijeme všechna dostupná data. Nejprve provedeme přípravu dat, tj. zavedeme novou veličinu, která nám bude kategorizovat matky na mlade a stare podle toho, zda je jejich věk menší než 35 let nebo nikoliv. Fmatka=factor(ifelse(Hosi$vek.matky>=35,"stara","mlada")) NPH=factor(ifelse(Hosi$por.hmot<2500,"nph","ok")) Podíváme se na počty případů v jednotlivých kategoriích a další vhodné charakteristiky: tapply(nph, Fmatka,summary) table(nph, Fmatka) table(fmatka,nph) prop.table(table(fmatka,nph),mar=1) ## margin = 2 --> podminuj sloupecky ## margin = 1 --> podminuj radky Vše si můžeme i graficky znázornit: plot(nph~fmatka) barplot(table(nph,fmatka),beside=t,legend=t) barplot(prop.table(table(nph,fmatka)),beside=t,legend=t) par(mfrow=c(1,2)) pie(table(nph,fmatka)[,1],main="mlade matky",col=2:3) pie(table(nph,fmatka)[,2],main="stare matky",col=2:3) par(mfrow=c(1,1)) 3
4 Co si myslíte o zkoumaném problému na základě těchto údajů a grafů? Závisí pravděpodobnost nízké porodní váhy na věku matky? 9. Provedeme dvouvýběrový test o proporci založený na rozdílu pravděpodobností. Jaký předpokládáme model? Jak zní testované hypotézy? Provedení testu pomocí R funkce: (tabulka=table(nph,fmatka)) (pocty.nph=tabulka["nph",]) (pocty.n=table(fmatka)) # nebo: pocty.n=margin.table(tabulka,2) prop.test(x = pocty.nph, n = pocty.n, correct = FALSE) # nebo jine zadani: prop.test(t(tabulka),correct=f) Jaký učiníme závěr na základě tohoto testu? 10. Manuální výpočet testové statistiky: prumer.m=pocty.nph[1]/pocty.n[1] prumer.s=pocty.nph[2]/pocty.n[2] prumer.all=sum(pocty.nph)/sum(pocty.n) var1=prumer.all*(1-prumer.all)*(1/pocty.n[1]+1/pocty.n[2]) (T1=(prumer.S-prumer.M)/sqrt(var1)) T1^2 #porovname s prop.test(t(tabulka),correct=f)$stat 2*pnorm(-abs(T1)) prop.test(t(tabulka),correct=f)$p.val Alternativně bychom mohli odhadnout rozptyl v každém výběru zvlášt : var2=prumer.m*(1-prumer.m)/pocty.n[1]+prumer.s*(1-prumer.s)/pocty.n[2] (T2=(prumer.S-prumer.M)/sqrt(var2)) 2*pnorm(-abs(T2)) 11. Pro danou situaci bychom mohli použít i dvouvýběrový asymptotický t-test NPH2=abs(as.numeric(NPH)-2) t.test(nph2~fmatka) Porovnejte p-hodnotu a interval spolehlivosti s předchozím výsledkem funkce prop.test. 12. Poznámka pro uživatele L A TEXu: Tabulku z R snadno převedeme do L A TEXu pomocí funkce xtable z knihovny xtable. Vyzkoušejte 4
5 library(xtable) xtable(tabulka) Testy dobré shody pro multinomické rozdělení se známými parametry 13. V rámci přednášky pro studenty chemie PřF MFF UK v letech bylo zjišt ováno mimo jiné, v jakém měsíci slaví narozeniny. Naměřena byla následující data: Měsíc Počet studentů Na základě těchto dat ověřte, zda se lidé rodí rovnoměrně během roku, nebo dochází k nějakému systematickému porušení této rovnoměrnosti. (a) Jaký model budeme předpokládat a jak budeme formulovat nulovou hypotézu? (b) Nejprve si musíme spočítat teoretické pravděpodobnosti narození v jednotlivých měsících, které jsou za nulové hypotézy rovny relativnímu počtu dní v daném měsíci vzhledem k celkovému počtu dní v roce. Pro jednoduchost zanedbáme přestupné roky a budeme brát 365 dní v roce a pro únor 28 dní. Dále si do vektoru x uložíme příslušné počty z tabulky výše: tf=c(31,28,31,30,31,30,31,31,30,31,30,31)/365 x=c(29, 20, 23, 28, 35, 25, 31, 33, 31, 26, 23, 24) chisq.test(x,p=tf,correct=false) Jaký je náš závěr ohledně rozložení data narození v průběhu roku? 14. Studenti dále uváděli počet svých sourozenců. Z 328 studentů 50 uvedlo, že nemá žádného sourozence, 183 má jednoho a zbytek má dva a více sourozenců. Otestujte domněnku, že (a) jedináčci se vyskytují v poměru k osobám s jedním sourozencem a osobám s více než dvěma sourozenci v poměru 1:3:1. (b) jedináčci se vyskytují v poměru k osobám s jedním sourozencem v poměru 1:3. Samostatná práce 1. Mezi 325 studenty chemie bylo jen 21 cizinců. Otestujte, zda jsou tato data v souladu s dříve uvedeným tvrzením, že na českých vysokých školách studuje 14 % cizinců. 2. Ve skriptech máte kromě Wilsonova intervalu spolehlivosti a přesného intervalu spolehlivosti pro proporci uvedený také interval spolehlivosti založený na logitu a klasické asymptotické metodě (dále Waldův interval). Stáhněte si z internetu a načtěte si soubor pokryti.r, který obsahuje předem připravenou funkci, která počítá pro všechny čtyři metody skutečné pokrytí pro různé hodnoty parametru p a pro zadaný rozsah výběru n. Výsledkem je tedy graf skutečného pokrytí v závislosti na p a tabulka délky jednotlivých intervalů pro několik různých p. Vyzkoušejte tuto funkci pro několik různých voleb n: 5
6 source("pokryti.r") pokryti(n=20) pokryti(n=50) pokryti(n=200) Jak je to se skutečným pokrytím přesného intervalu spolehlivosti? Který z intervalů spolehlivosti Vám připadá nejlepší? 3. Odhadněte relativní riziko (tj. poměr rizik) pro narození chlapce s nízkou porodní hmotností pro matky pod 35 let a nad 35 let včetně. Pro sestrojení intervalového odhadu využijte vzorec ze skript na str Na datech z příkladu 7. ověřte, že R ve funkci binom.test nepočítá p-hodnotu podle vzorce na str Podle této definice bychom p-hodnotu spočetli následovně: Xn=6;n=20;p0=0.14 2*min(pbinom(Xn, size = n, p = p0), 1-pbinom(Xn-1, size = n, p = p0)) binom.test(xn,n,p=p0) To ale neodpovídá p-hodnotě ve funkci binom.test. R považuje za hodnoty, které stejně nebo ještě více svědčí proti H 0, ty hodnoty, jejichž pravděpodobnost napozorování za nulové hypotézy je stejná nebo menší, než co jsme napozorovali ve skutečnosti: qq <- as.logical(dbinom(0:n, size = n, p = p0) <= dbinom(xn, size=n, p=p0)); # p-hodnota sum(dbinom(0:n, size = n, p = p0)[qq]) 5. Porovnání hladiny testu a síly statistik T d a T d pro dvouvýběrový problém: opak=1000 n1=50 n2=80 p.t1=numeric(n) p.t2=numeric(n) for(i in 1:1000){ x=rbinom(1,size=n1,prob=1/4) y=rbinom(1,size=n2,prob=1/4) p.t1[i]=prop.test(c(x,y),c(n1,n2),correct=f)$p.val } var2=(x/n1)*(1-x/n1)/n1+(y/n2)*(1-y/n2)/n2 T2=(y/n2- x/n1)/sqrt(var2) p.t2[i]=2*pnorm(-abs(t2)) 6
7 mean(p.t1<=0.05) mean(p.t2<=0.05) Takto sledujeme hladiny testu. Když změníme 1/4 v předpisu pro generování jednoho z výběrů, tak dostaneme odhad síly testu. 7
Matematická statistika Zimní semestr Testy o proporci
Testy o proporci 18.12.2018 Jednovýběrový problém pro binární data. V roce 2008 se v České republice živě narodilo 119 570 dětí, z toho 58 244 dívek a 61 326 chlapců (zdroj ČSÚ). Zajímá nás, zda je pravděpodobnost
Y n = I[X i > m 0 ],
Neparametrické jednovýběrové testy a párové testy 4.12.2017 Úvodní nastavení. Z internetové stránky www.karlin.mff.cuni.cz/~hudecova/education/ si můžete si stáhnout zdrojový kód k dnešnímu cvičení cviceni10.r.
Matematická statistika Zimní semestr
Neparametrické jednovýběrové testy a párové testy 4.12.2018 Úvodní nastavení. Z internetové stránky www.karlin.mff.cuni.cz/~hudecova/education/ si můžete si stáhnout zdrojový kód k dnešnímu cvičení cviceni10.r.
Matematická statistika Zimní semestr
Analýza rozptylu (jednoduché třídění) 11.1.2018 Úvodní nastavení. Z internetové stránky www.karlin.mff.cuni.cz/~hudecova/education/ si stáhněte data Med.txt. Otevřete si program R Studio a načtěte si výše
Pohlédněte si základní charakteristiky polohy jednotlivých veličin pomocí funkce summary.
Dvouvýběrové testy 11.12.2017 Úvodní nastavení. Z internetové stránky www.karlin.mff.cuni.cz/~hudecova/education/ si stáhněte data Iq2.txt a zdrojové kódy cviceni11.r a figks.r. Otevřete si program R Studio,
Kontingenční tabulky a testy shody
Kontingenční tabulky a testy shody 4.1.2018 Kontingenční tabulky 1. Tabulka 1 shrnuje osudy pasažérů lodě Titanic, která tragicky ztroskotala v roce 1912. Zajímá nás, zda existuje nějaká souvislost mezi
Kontingenční tabulky, testy dobré shody a analýza rozptylu (ANOVA)
Kontingenční tabulky, testy dobré shody a analýza rozptylu (ANOVA) 8.1.2018 Testy dobré shody se známými parametry. Mezi 891 studenty pražských vysokých škol byl na podzim 2017 proveden průzkum týkající
Jednovýběrové testy: t-test, Kolmogorovův-Smirnovův test
Jednovýběrové testy: t-test, Kolmogorovův-Smirnovův test 27.11.2018 Úvodní nastavení. Z internetové stránky www.karlin.mff.cuni.cz/~hudecova/education/ si stáhněte data Iq.txt a můžete si stáhnout i zdrojový
Jednovýběrové testy: t-test, Kolmogorovův-Smirnovův test
Jednovýběrové testy: t-test, Kolmogorovův-Smirnovův test 30.11.2017 Úvodní nastavení. Z internetové stránky www.karlin.mff.cuni.cz/~hudecova/education/ si stáhněte data Iq.txt a můžete si stáhnout i zdrojový
Matematická statistika Zimní semestr
Dvouvýběrové testy 11.12.2018 Úvodní nastavení. Z internetové stránky www.karlin.mff.cuni.cz/~hudecova/education/ si stáhněte data Iq2.txt a zdrojové kódy cviceni11.r a figks.r, případně i cviceni11-obrazky.r.
Matematická statistika Zimní semestr
Kontingenční tabulky, testy shody, jednoduché třídění 8.1.2018 Kontingenční tabulky 1. Tabulka 1 shrnuje osudy pasažérů lodě Titanic, která tragicky ztroskotala v roce 1912. Zajímá nás, zda existuje nějaká
Testování hypotéz. Analýza dat z dotazníkových šetření. Kuranova Pavlina
Testování hypotéz Analýza dat z dotazníkových šetření Kuranova Pavlina Statistická hypotéza Možné cíle výzkumu Srovnání účinnosti různých metod Srovnání výsledků různých skupin Tzn. prokázání rozdílů mezi
4ST201 STATISTIKA CVIČENÍ Č. 7
4ST201 STATISTIKA CVIČENÍ Č. 7 testování hypotéz parametrické testy test hypotézy o střední hodnotě test hypotézy o relativní četnosti test o shodě středních hodnot testování hypotéz v MS Excel neparametrické
Intervalové odhady. Interval spolehlivosti pro střední hodnotu v N(µ, σ 2 ) Interpretace intervalu spolehlivosti. Interval spolehlivosti ilustrace
Intervalové odhady Interval spolehlivosti pro střední hodnotu v Nµ, σ 2 ) Situace: X 1,..., X n náhodný výběr z Nµ, σ 2 ), kde σ 2 > 0 známe měli jsme: bodové odhady odhadem charakteristiky je číslo) nevyjadřuje
Intervalové odhady. Interval spolehlivosti pro střední hodnotu v N(µ, σ 2 ) Interpretace intervalu spolehlivosti. Interval spolehlivosti ilustrace
Intervalové odhady Interval spolehlivosti pro střední hodnotu v Nµ, σ 2 ) Situace: X 1,..., X n náhodný výběr z Nµ, σ 2 ), kde σ 2 > 0 známe měli jsme: bodové odhady odhadem charakteristiky je číslo) nevyjadřuje
Rozhodnutí / Skutečnost platí neplatí Nezamítáme správně chyba 2. druhu Zamítáme chyba 1. druhu správně
Testování hypotéz Nechť,, je náhodný výběr z nějakého rozdělení s neznámými parametry. Máme dvě navzájem si odporující hypotézy o parametrech daného rozdělení: Nulová hypotéza parametry (případně jediný
Jednostranné intervaly spolehlivosti
Jednostranné intervaly spolehlivosti hledáme jen jednu z obou mezí Princip: dle zadání úlohy hledáme jen dolní či jen horní mez podle oboustranného vzorce s tou změnou, že výraz 1-α/2 ve vzorci nahradíme
676 + 4 + 100 + 196 + 0 + 484 + 196 + 324 + 64 + 324 = = 2368
Příklad 1 Je třeba prověřit, zda lze na 5% hladině významnosti pokládat za prokázanou hypotézu, že střední doba výroby výlisku je 30 sekund. Přitom 10 náhodně vybraných výlisků bylo vyráběno celkem 540
ANALÝZA DAT V R 7. KONTINGENČNÍ TABULKA. Mgr. Markéta Pavlíková Katedra pravděpodobnosti a matematické statistiky MFF UK.
ANALÝZA DAT V R 7. KONTINGENČNÍ TABULKA Mgr. Markéta Pavlíková Katedra pravděpodobnosti a matematické statistiky MFF UK www.biostatisticka.cz PŘEHLED TESTŮ rozdělení normální spojité alternativní / diskrétní
PRAVDĚPODOBNOST A STATISTIKA. Neparametrické testy hypotéz čast 1
PRAVDĚPODOBNOST A STATISTIKA Neparametrické testy hypotéz čast 1 Neparametrické testy hypotéz - úvod Neparametrické testy statistických hypotéz se používají v případech, kdy neznáme rozdělení pozorované
TECHNICKÁ UNIVERZITA V LIBERCI. Statistický rozbor dat z dotazníkového šetření
TECHNICKÁ UNIVERZITA V LIBERCI Ekonomická fakulta Semestrální práce Statistický rozbor dat z dotazníkového šetření Analýza výsledků dotazníkového šetření - fakultní dotazník Vypracovaly: Klára Habrová,
PRAVDĚPODOBNOST A STATISTIKA
PRAVDĚPODOBNOST A STATISTIKA Testování hypotéz Nechť X je náhodná proměnná, která má distribuční funkci F(x, ϑ). Předpokládejme, že známe tvar distribuční funkce (víme jaké má rozdělení) a neznáme parametr
Tomáš Karel LS 2012/2013
Tomáš Karel LS 2012/2013 Doplňkový materiál ke cvičení z předmětu 4ST201. Na případné faktické chyby v této presentaci mě prosím upozorněte. Děkuji. Tyto slidy berte pouze jako doplňkový materiál není
Základní popisné statistiky a grafy
Základní popisné statistiky a grafy 3.11.017 Úvodní nastavení. Ve svém domovském adresáři si založte speciální adresář nmsa331 na toto cvičení. Z internetové stránky www.karlin.mff.cuni.cz/~hudecova/education/
Testování statistických hypotéz. Ing. Michal Dorda, Ph.D. 1
Testování statistických hypotéz Ing. Michal Dorda, Ph.D. 1 Úvodní poznámky Statistickou hypotézou rozumíme hypotézu o populaci (základním souboru) např.: Střední hodnota základního souboru je rovna 100.
Základní popisné statistiky a grafy
Základní popisné statistiky a grafy 20.11.2018 Úvodní nastavení. Ve svém domovském adresáři si založte speciální adresář nmsa331 na toto cvičení. Z internetové stránky www.karlin.mff.cuni.cz/~hudecova/education/
JEDNOVÝBĚROVÉ TESTY. Komentované řešení pomocí programu Statistica
JEDNOVÝBĚROVÉ TESTY Komentované řešení pomocí programu Statistica Vstupní data Data umístěná v excelovském souboru překopírujeme do tabulky ve Statistice a pojmenujeme proměnné, viz prezentace k tématu
Test dobré shody v KONTINGENČNÍCH TABULKÁCH
Test dobré shody v KONTINGENČNÍCH TABULKÁCH Opakování: Mějme náhodné veličiny X a Y uspořádané do kontingenční tabulky. Řekli jsme, že nulovou hypotézu H 0 : veličiny X, Y jsou nezávislé zamítneme, když
11. cvičení z PSI prosince hodnota pozorovaná četnost n i p X (i) = q i (1 q), i N 0.
11 cvičení z PSI 12-16 prosince 2016 111 (Test dobré shody - geometrické rozdělení Realizací náhodné veličiny X jsme dostali následující četnosti výsledků: hodnota 0 1 2 3 4 5 6 pozorovaná četnost 29 15
DVOUVÝBĚROVÉ A PÁROVÉ TESTY Komentované řešení pomocí programu Statistica
DVOUVÝBĚROVÉ A PÁROVÉ TESTY Komentované řešení pomocí programu Statistica Úloha A) koncentrace glukózy v krvi V této části posoudíme pomocí párového testu, zda nový lék prokazatelně snižuje koncentraci
Pravděpodobnost a matematická statistika Doc. RNDr. Gejza Dohnal, CSc. dohnal@nipax.cz
Pravděpodobnost a matematická statistika Doc. RNDr. Gejza Dohnal, CSc. dohnal@nipax.cz Pravděpodobnost a matematická statistika Doc. RNDr. Gejza Dohnal, CSc. dohnal@nipax.cz Pravděpodobnost a matematická
ANALÝZA DAT V R 3. POPISNÉ STATISTIKY, NÁHODNÁ VELIČINA. Mgr. Markéta Pavlíková Katedra pravděpodobnosti a matematické statistiky MFF UK
ANALÝZA DAT V R 3. POPISNÉ STATISTIKY, NÁHODNÁ VELIČINA Mgr. Markéta Pavlíková Katedra pravděpodobnosti a matematické statistiky MFF UK www.biostatisticka.cz POPISNÉ STATISTIKY - OPAKOVÁNÍ jedna kvalitativní
Název testu Předpoklady testu Testová statistika Nulové rozdělení. ( ) (p počet odhadovaných parametrů)
VYBRANÉ TESTY NEPARAMETRICKÝCH HYPOTÉZ TESTY DOBRÉ SHODY Název testu Předpoklady testu Testová statistika Nulové rozdělení test dobré shody Očekávané četnosti, alespoň 80% očekávaných četností >5 ( ) (p
Pravděpodobnost a aplikovaná statistika
Pravděpodobnost a aplikovaná statistika MGR. JANA SEKNIČKOVÁ, PH.D. 8. KAPITOLA STATISTICKÉ TESTOVÁNÍ HYPOTÉZ 22.11.2016 Opakování: CLV příklad 1 Zadání: Před volbami je v populaci státu 52 % příznivců
Testování hypotéz. 1 Jednovýběrové testy. 90/2 odhad času
Testování hypotéz 1 Jednovýběrové testy 90/ odhad času V podmínkách naprostého odloučení má voák prokázat schopnost orientace v čase. Úkolem voáka e provést odhad časového intervalu 1 hodiny bez hodinek
MATEMATICKÁ STATISTIKA 1 ( )
MATEMATICKÁ STATISTIKA 1 (2014 15) Zápočtové domácí úkoly (společné pro obě paralelky) Obecné pokyny q q Úlohy se odevzdávají vždy na začátku Vašeho cvičení (Vašemu cvičícímu, případně jeho záskoku). Úlohy
Mann-Whitney U-test. Znaménkový test. Vytvořil Institut biostatistiky a analýz, Masarykova univerzita J. Jarkovský, L. Dušek
10. Neparametrické y Mann-Whitney U- Wilcoxonův Znaménkový Shrnutí statistických ů Typ srovnání Nulová hypotéza Parametrický Neparametrický 1 skupina dat vs. etalon Střední hodnota je rovna hodnotě etalonu.
Vzorová prezentace do předmětu Statistika
Vzorová prezentace do předmětu Statistika Popis situace: U 3 náhodně vybraných osob byly zjišťovány hodnoty těchto proměnných: SEX - muž, žena PUVOD Skandinávie, Středomoří, 3 západní Evropa IQ hodnota
You created this PDF from an application that is not licensed to print to novapdf printer (http://www.novapdf.com)
Testování statistických hypotéz Testování statistických hypotéz Princip: Ověřování určitého předpokladu zjišťujeme, zda zkoumaný výběr pochází ze základního souboru, který má určité rozdělení zjišťujeme,
UNIVERZITA OBRANY Fakulta ekonomiky a managementu. Aplikace STAT1. Výsledek řešení projektu PRO HORR2011 a PRO GRAM2011 3. 11.
UNIVERZITA OBRANY Fakulta ekonomiky a managementu Aplikace STAT1 Výsledek řešení projektu PRO HORR2011 a PRO GRAM2011 Jiří Neubauer, Marek Sedlačík, Oldřich Kříž 3. 11. 2012 Popis a návod k použití aplikace
Statistické metody v ekonomii. Ing. Michael Rost, Ph.D.
Statistické metody v ekonomii Ing. Michael Rost, Ph.D. Jihočeská univerzita v Českých Budějovicích Test χ 2 v kontingenční tabulce typu 2 2 Jde vlastně o speciální případ χ 2 testu pro čtyřpolní tabulku.
Cvičení 12: Binární logistická regrese
Cvičení 12: Binární logistická regrese Příklad: V roce 2014 konalo státní závěrečné zkoušky bakalářského studia na jisté fakultě 167 studentů. U každého studenta bylo zaznamenáno jeho pohlaví (0 žena,
Cvičení ze statistiky - 8. Filip Děchtěrenko
Cvičení ze statistiky - 8 Filip Děchtěrenko Minule bylo.. Dobrali jsme normální rozdělení Tyhle termíny by měly být známé: Centrální limitní věta Laplaceho věta (+ korekce na spojitost) Konfidenční intervaly
z Matematické statistiky 1 1 Konvergence posloupnosti náhodných veličin
Příklady k procvičení z Matematické statistiky Poslední úprava. listopadu 207. Konvergence posloupnosti náhodných veličin. Necht X, X 2... jsou nezávislé veličiny s rovnoměrným rozdělením na [0, ]. Definujme
VYBRANÉ DVOUVÝBĚROVÉ TESTY. Martina Litschmannová
VYBRANÉ DVOUVÝBĚROVÉ TESTY Martina Litschmannová Obsah přednášky Vybrané dvouvýběrové testy par. hypotéz test o shodě rozptylů (F-test), testy o shodě středních hodnot (t-test, Aspinové-Welchův test),
5 Vícerozměrná data - kontingenční tabulky, testy nezávislosti, regresní analýza
5 Vícerozměrná data - kontingenční tabulky, testy nezávislosti, regresní analýza 5.1 Vícerozměrná data a vícerozměrná rozdělení Při zpracování vícerozměrných dat se hledají souvislosti mezi dvěma, případně
Pravděpodobnost a statistika, Biostatistika pro kombinované studium. Tutoriál č. 5: Bodové a intervalové odhady, testování hypotéz.
Pravděpodobnost a statistika, Biostatistika pro kombinované studium Letní semestr 2015/2016 Tutoriál č. 5: Bodové a intervalové odhady, testování hypotéz Jan Kracík jan.kracik@vsb.cz Obsah: Výběrová rozdělení
Testování hypotéz. 1. vymezení základních pojmů 2. testování hypotéz o rozdílu průměrů 3. jednovýběrový t-test
Testování hypotéz 1. vymezení základních pojmů 2. testování hypotéz o rozdílu průměrů 3. jednovýběrový t-test Testování hypotéz proces, kterým rozhodujeme, zda přijmeme nebo zamítneme nulovou hypotézu
Příklad 1. Korelační pole. Řešení 1 ŘEŠENÉ PŘÍKLADY Z MV2 ČÁST 13
Příklad 1 Máme k dispozici výsledky prvního a druhého testu deseti sportovců. Na hladině významnosti 0,05 prověřte, zda jsou výsledky testů kladně korelované. 1.test : 7, 8, 10, 4, 14, 9, 6, 2, 13, 5 2.test
Jednovýběrový Wilcoxonův test a jeho asymptotická varianta (neparametrická obdoba jednovýběrového t-testu)
Jednovýběrový Wilcoxonův test a jeho asymptotická varianta (neparametrická obdoba jednovýběrového t-testu) Frank Wilcoxon (1892 1965): Americký statistik a chemik Nechť X 1,..., X n je náhodný výběr ze
Test z teorie VÝBĚROVÉ CHARAKTERISTIKY A INTERVALOVÉ ODHADY
VÝBĚROVÉ CHARAKTERISTIKY A INTERVALOVÉ ODHADY Test z teorie 1. Střední hodnota pevně zvolené náhodné veličiny je a) náhodná veličina, b) konstanta, c) náhodný jev, d) výběrová charakteristika. 2. Výběrový
Pravděpodobnost a matematická statistika Doc. RNDr. Gejza Dohnal, CSc.
Pravděpodobnost a matematická statistika Doc. RNDr. Gejza Dohnal, CSc. dohnal@nipax.cz Pravděpodobnost a matematická statistika 2010 1.týden (20.09.-24.09. ) Data, typy dat, variabilita, frekvenční analýza
Základy biostatistiky II. Veřejné zdravotnictví 3.LF UK - II
Základy biostatistiky II Veřejné zdravotnictví 3.LF UK - II Teoretické rozložení-matematické modely rozložení Naměřená data Výběrové rozložení Teoretické rozložení 1 e 2 x 2 Teoretické rozložení-matematické
populace soubor jednotek, o jejichž vlastnostech bychom chtěli vypovídat letní semestr Definice subjektech.
Populace a Šárka Hudecová Katedra pravděpodobnosti a matematické statistiky Matematicko-fyzikální fakulta Univerzity Karlovy letní semestr 2012 1 populace soubor jednotek, o jejichž vlastnostech bychom
Test z teorie VÝBĚROVÉ CHARAKTERISTIKY A INTERVALOVÉ ODHADY
VÝBĚROVÉ CHARAKTERISTIKY A INTERVALOVÉ ODHADY Test z teorie 1. Střední hodnota pevně zvolené náhodné veličiny je a) náhodná veličina, b) konstanta, c) náhodný jev, d) výběrová charakteristika. 2. Výběrový
Testování statistických hypotéz
Testování statistických hypotéz Michal Fusek Ústav matematiky FEKT VUT, fusekmi@feec.vutbr.cz 11. přednáška z ESMAT Michal Fusek (fusekmi@feec.vutbr.cz) 1 / 27 Obsah 1 Testování statistických hypotéz 2
NEPARAMETRICKÉ TESTY
NEPARAMETRICKÉ TESTY Neparametrický jednovýběrový Jeden výběr jehož medián srovnáváme s nějakou hodnotou Wilcoxonův jednovýběrový test 1) Máme data z družice Hipparcos pro deklinaci (obdoba zeměpisné šířky)
Testování statistických hypotéz. Ing. Michal Dorda, Ph.D.
Testování statistických hypotéz Ing. Michal Dorda, Ph.D. Testování normality Př. : Při simulaci provozu na křižovatce byla získána data o mezerách mezi přijíždějícími vozidly v [s]. Otestujte na hladině
Přednáška 9. Testy dobré shody. Grafická analýza pro ověření shody empirického a teoretického rozdělení
Přednáška 9 Testy dobré shody Grafická analýza pro ověření shody empirického a teoretického rozdělení χ 2 test dobré shody ověření, zda jsou relativní četnosti jednotlivých variant rovny číslům π 01 ;
Pearsonůvχ 2 test dobré shody. Ing. Michal Dorda, Ph.D.
Ing. Michal Dorda, Ph.D. Př. : Ve vjezdové skupině kolejí byly sledovány počty přijíždějících vlaků za hodinu. Za 5 dní (tedy 360 hodin) přijelo celkem 87 vlaků. Výsledky sledování jsou uvedeny v tabulce.
MATEMATICKO STATISTICKÉ PARAMETRY ANALYTICKÝCH VÝSLEDKŮ
MATEMATICKO STATISTICKÉ PARAMETRY ANALYTICKÝCH VÝSLEDKŮ Má-li analytický výsledek objektivně vypovídat o chemickém složení vzorku, musí splňovat určitá kriteria: Mezinárodní metrologický slovník (VIM 3),
Pravděpodobnost a matematická statistika Doc. RNDr. Gejza Dohnal, CSc.
Pravděpodobnost a matematická statistika Doc. RNDr. Gejza Dohnal, CSc. dohnal@nipax.cz Pravděpodobnost a matematická statistika 010 1.týden (0.09.-4.09. ) Data, typy dat, variabilita, frekvenční analýza
Pravděpodobnost a matematická statistika
Pravděpodobnost a matematická statistika Příklady k přijímacím zkouškám na doktorské studium 1 Popisná statistika Určete aritmetický průměr dat, zadaných tabulkou hodnot x i a četností n i x i 1 2 3 n
Parametrické testy hypotéz o středních hodnotách spojitých náhodných veličin
Parametrické testy hypotéz o středních hodnotách spojitých náhodných veličin EuroMISE Centrum I. ÚVOD vv této přednášce budeme hovořit o jednovýběrových a dvouvýběrových testech týkajících se střední hodnoty
Protokol č. 1. Tloušťková struktura. Zadání:
Protokol č. 1 Tloušťková struktura Zadání: Pro zadané výčetní tloušťky (v cm) vypočítejte statistické charakteristiky a slovně interpretujte základní statistické vlastnosti tohoto souboru tloušťek. Dále
12. cvičení z PST. 20. prosince 2017
1 cvičení z PST 0 prosince 017 11 test rozptylu normálního rozdělení Do laboratoře bylo odesláno n = 5 stejných vzorků krve ke stanovení obsahu alkoholu X v promilích alkoholu Výsledkem byla realizace
Aproximace binomického rozdělení normálním
Aproximace binomického rozdělení normálním Aproximace binomického rozdělení normálním Příklad Sybilla a Kassandra tvrdí, že mají telepatické schopnosti, a chtějí to dokázat následujícím pokusem: V jedné
PSY117/454 Statistická analýza dat v psychologii přednáška 8. Statistické usuzování, odhady
PSY117/454 Statistická analýza dat v psychologii přednáška 8 Statistické usuzování, odhady Výběr od deskripce k indukci Deskripce dat, odhad parametrů Usuzování = inference = indukce Počítá se s náhodným
2 ) 4, Φ 1 (1 0,005)
Příklad 1 Ze zásilky velkého rozsahu byl náhodně vybrán soubor obsahující 1000 kusů. V tomto souboru bylo zjištěno 26 kusů nekvalitních. Rozhodněte, zda je možné s 99% jistotou tvrdit, že zásilka obsahuje
Katedra matematické analýzy a aplikací matematiky, Přírodovědecká fakulta, UP v Olomouci
Zpracování dat v edukačních vědách - Testování hypotéz Kamila Fačevicová Katedra matematické analýzy a aplikací matematiky, Přírodovědecká fakulta, UP v Olomouci Obsah seminářů 5.11. Úvod do matematické
4EK211 Základy ekonometrie
4EK211 Základy ekonometrie LS 2014/15 Cvičení 7: Autokorelace LENKA FIŘTOVÁ KATEDRA EKONOMETRIE, FAKULTA INFORMATIKY A STATISTIKY VYSOKÁ ŠKOLA EKONOMICKÁ V PRAZE 1. Autokorelace - teorie Zopakujte si G-M
Vybraná rozdělení náhodné veličiny
3.3 Vybraná rozdělení náhodné veličiny 0,16 0,14 0,12 0,1 0,08 0,06 0,04 0,02 0 Rozdělení Z 3 4 5 6 7 8 9 10 11 12 13 14 15 Život je umění vytvářet uspokojivé závěry na základě nedostatečných předpokladů.
Pravděpodobnost a matematická statistika Doc. RNDr. Gejza Dohnal, CSc.
Pravděpodobnost a matematická statistika Doc. RNDr. Gejza Dohnal, CSc. dohnal@nipax.cz Pravděpodobnost a matematická statistika 2010 1.týden (20.09.-24.09. ) Data, typy dat, variabilita, frekvenční analýza
KONTINGENČNÍ TABULKY Komentované řešení pomocí programu Statistica
KONTINGENČNÍ TABULKY Komentované řešení pomocí programu Statistica Vstupní data transformace před vložením Než data vložíme do tabulky ve Statistice, musíme si je předpřipravit. Označme si P Prahu, S Šumperk
Zpracování náhodného vektoru. Ing. Michal Dorda, Ph.D.
Ing. Michal Dorda, Ph.D. 1 Př. 1: Cestující na vybraném spoji linky MHD byli dotazováni za účelem zjištění spokojenosti s kvalitou MHD. Legenda 1 Velmi spokojen Spokojen 3 Nespokojen 4 Velmi nespokojen
Parametrické testy hypotéz o středních hodnotách spojitých náhodných veličin
Parametrické testy hypotéz o středních hodnotách spojitých náhodných veličin EuroMISE Centrum Kontakt: Literatura: Obecné informace Zvárová, J.: Základy statistiky pro biomedicínskéobory I. Vydavatelství
10. cvičení z PST. 5. prosince T = (n 1) S2 X. (n 1) s2 x σ 2 q χ 2 (n 1) (1 α 2 ). q χ 2 (n 1) 2. 2 x. (n 1) s. x = 1 6. x i = 457.
0 cvičení z PST 5 prosince 208 0 (intervalový odhad pro rozptyl) Soubor (70, 84, 89, 70, 74, 70) je náhodným výběrem z normálního rozdělení N(µ, σ 2 ) Určete oboustranný symetrický 95% interval spolehlivosti
KGG/STG Statistika pro geografy
KGG/STG Statistika pro geografy 4. Teoretická rozdělení Mgr. David Fiedor 9. března 2015 Osnova Úvod 1 Úvod 2 3 4 5 Vybraná rozdělení náhodných proměnných normální rozdělení normované normální rozdělení
Biostatistika Cvičení 7
TEST Z TEORIE 1. Střední hodnota pevně zvolené náhodné veličiny je a) náhodná veličina, b) konstanta, c) náhodný jev, d) výběrová charakteristika. 2. Výběrový průměr je a) náhodná veličina, b) konstanta,
4EK211 Základy ekonometrie
4EK11 Základy ekonometrie Autokorelace Cvičení 5 Zuzana Dlouhá Gauss-Markovy předpoklady Náhodná složka: Gauss-Markovy předpoklady 1. E(u) = náhodné vlivy se vzájemně vynulují. E(uu T ) = σ I n konečný
Náhodné veličiny, náhodné chyby
Náhodné veličiny, náhodné chyby Máme náhodnou veličinu X, jejíž vlastnosti zkoumáme. Pokud známe její rozložení (např. z nějaké dřívější studie) nebo alespoň předpokládáme znalost rozložení, můžeme ji
PRAVDĚPODOBNOST A STATISTIKA
PRAVDĚPODOBNOST A STATISTIKA Náhodný výběr Nechť X je náhodná proměnná, která má distribuční funkci F(x, ϑ). Předpokládejme, že známe tvar distribuční funkce (víme jaké má rozdělení) a neznáme parametr
Příklad 1. Řešení 1 ŘEŠENÉ PŘÍKLADY Z MV2 ČÁST 11
Příklad 1 Vyhláška Ministerstva zdravotnictví předpokládala, že doba dojezdu k pacientovi od nahlášení požadavku nepřekročí 17 minut. Hodnoty deseti náhodně vybraných dob příjezdu sanitky k nemocnému byly:
Bakalářské studium na MFF UK v Praze Obecná matematika Zaměření: Stochastika. 1 Úvodní poznámky. Verze: 13. června 2013
Bakalářské studium na MFF UK v Praze Obecná matematika Zaměření: Stochastika Podrobnější rozpis okruhů otázek pro třetí část SZZ Verze: 13. června 2013 1 Úvodní poznámky 6 Smyslem SZZ by nemělo být toliko
STATISTICA Téma 6. Testy na základě jednoho a dvou výběrů
STATISTICA Téma 6. Testy na základě jednoho a dvou výběrů 1) Test na velikost rozptylu Test na velikost rozptylu STATISTICA nemá. 2) Test na velikost střední hodnoty V menu Statistika zvolíme nabídku Základní
t-test, Studentův párový test Ing. Michael Rost, Ph.D.
Testování hypotéz: dvouvýběrový t-test, Studentův párový test Ing. Michael Rost, Ph.D. Úvod do problému... Již známe jednovýběrový t-test, při kterém jsme měli k dispozici pouze jeden výběr. Můžeme se
15. T e s t o v á n í h y p o t é z
15. T e s t o v á n í h y p o t é z Na základě hodnot náhodného výběru činíme rozhodnutí o platnosti hypotézy o hodnotách parametrů rozdělení nebo o jeho vlastnostech. Rozeznáváme dva základní typy testů:
Fisherův exaktní test
Katedra pravděpodobnosti a matematické statistiky Karel Kozmík Fisherův exaktní test 4. prosince 2017 Motivace Máme kontingenční tabulku 2x2 a předpokládáme, že četnosti vznikly z pozorování s multinomickým
Příklady na testy hypotéz o parametrech normálního rozdělení
Příklady na testy hypotéz o parametrech normálního rozdělení. O životnosti 75W žárovky (v hodinách) je známo, že má normální rozdělení s = 5h. Pro náhodný výběr 0 žárovek byla stanovena průměrná životnost
Statistické metody - nástroj poznání a rozhodování anebo zdroj omylů a lží
Statistické metody - nástroj poznání a rozhodování anebo zdroj omylů a lží Zdeněk Karpíšek Jsou tři druhy lží: lži, odsouzeníhodné lži a statistiky. Statistika je logická a přesná metoda, jak nepřesně
Přednáška 9. Testy dobré shody. Grafická analýza pro ověření shody empirického a teoretického rozdělení
Přednáška 9 Testy dobré shody Grafická analýza pro ověření shody empirického a teoretického rozdělení χ 2 test dobré shody ověření, zda jsou relativní četnosti jednotlivých variant rovny číslům π 01 ;
Vysoká škola báňská technická univerzita Ostrava. Fakulta elektrotechniky a informatiky
Vysoká škola báňská technická univerzita Ostrava Fakulta elektrotechniky a informatiky Bankovní účty (semestrální projekt statistika) Tomáš Hejret (hej124) 18.5.2013 Úvod Cílem tohoto projektu, zadaného
Tématické okruhy pro státní závěrečné zkoušky. bakalářské studium. studijní obor "Management jakosti"
Tématické okruhy pro státní závěrečné zkoušky bakalářské studium studijní obor "Management jakosti" školní rok 2013/2014 Management jakosti A 1. Pojem jakosti a význam managementu jakosti v současném období.
Dvouvýběrové a párové testy. Komentované řešení pomocí MS Excel
Dvouvýběrové a párové testy Komentované řešení pomocí MS Excel Úloha A) koncentrace glukózy v krvi V této části posoudíme pomocí párového testu, zda nový lék prokazatelně snižuje koncentraci glukózy v
Základy počtu pravděpodobnosti a metod matematické statistiky
Errata ke skriptu Základy počtu pravděpodobnosti a metod matematické statistiky K. Hron a P. Kunderová Autoři prosí čtenáře uvedeného studijního textu, aby případné další odhalené chyby nad rámec tohoto
Tématické okruhy pro státní závěrečné zkoušky. bakalářské studium. studijní obor "Management jakosti"
Tématické okruhy pro státní závěrečné zkoušky bakalářské studium studijní obor "Management jakosti" školní rok 2010/2011 Management jakosti A 1. Pojem jakosti a význam managementu jakosti v současném období.
Cvičení 9: Neparametrické úlohy o mediánech
Cvičení 9: Neparametrické úlohy o mediánech Úkol 1.: Párový znaménkový test a párový Wilcoxonův test Při zjišťování kvality jedné složky půdy se používají dvě metody označené A a B. Výsledky: Vzorek 1
Určujeme neznámé hodnoty parametru základního souboru. Pomocí výběrové charakteristiky vypočtené z náhodného výběru.
1 Statistické odhady Určujeme neznámé hodnoty parametru základního souboru. Pomocí výběrové charakteristiky vypočtené z náhodného výběru. Odhad lze provést jako: Bodový odhad o Jedna číselná hodnota Intervalový
ANALÝZA DAT V R 9. VÝPOČET VELIKOSTI SOUBORU. Mgr. Markéta Pavlíková Katedra pravděpodobnosti a matematické statistiky MFF UK.
ANALÝZA DAT V R 9. VÝPOČET VELIKOSTI SOUBORU Mgr. Markéta Pavlíková Katedra pravděpodobnosti a matematické statistiky MFF UK www.biostatisticka.cz DATA, VÝZKUM, ANALÝZY ve výzkumu se střídají fáze prozkoumávací
STATISTICKÉ HYPOTÉZY
STATISTICKÉ HYPOTÉZY ZÁKLADNÍ POJMY Bodové/intervalové odhady Maruška řešila hodnoty parametrů (průměr, rozptyl atd.) Zde bude Maruška dělat hypotézy (předpoklady) ohledně parametrů Z.S. Výsledek nebude