Strojové učení Marta Vomlelová

Save this PDF as:
 WORD  PNG  TXT  JPG

Rozměr: px
Začít zobrazení ze stránky:

Download "Strojové učení Marta Vomlelová"

Transkript

1 Strojové učení Marta Vomlelová KTIML, S303

2 Literatura 1.T. Hastie, R. Tishirani, and J. Friedman. The Elements of Statistical Learning, Data Mining, Inference and Prediction. Springer Series in Statistics. Springer, (2003 a další, web). 2.I.H.Witten and E.Frank. Data Mining - Practical machine learning tools and techniques with Java implementation. Accademic Press Pub., USA, 1999.

3 Doplňující literatura P. Berka.Dobývání znalostí z databází. Academia, T. Mitchell. Machine Learning. McGraw Hill, New York, S. Russel and P. Norwig. Artificial Intelligence: A Modern Approach. Prentice Hall, 2003.

4 Příklady statistického učení Vytořit z dat model, který dokáže: Určit polohu robota z minulé pozice a senzorů. U pacienta hospitalizovaného s infarktem predikovat riziko dalšího infarktu. Predikci lze založit na demografických, stravovacích a klinických datech o pacientovi. Rozpoznání spamu od u. Predikovat cenu akcií za 6 měsíců z aktuální výkonnosti společnosti a ekonomických dat.

5 Typický scénář zadání Máme danou cílovou veličinu kvantivativní Y cena akcií, nebo kategoriální G infarkt ano/ne. Chceme její hodnotu predikovat na základě příznaků (features) X klinická měření, stravování. Máme množinu trénovacích dat, u kterých známe i příznaky, i hodnotu cílové veličiny. f, ĝ Na základě těchto dat tvoříme model. Dobrý model predikuje cíl s malou chybou.

6 Učení s učitelem / bez učitele Předchozí slajd se týká učení s učitelem (supervized learning). Při učení bez učitele nemáme žádnou cílovou veličinu, úkolem je popsat data např. klastrováním či určením závislostí. (unsupervised learning)

7 Příklad: Klasifikace u. Data obsahují 4601 příkladů, snažíme se rozlišit spam a žádaný . Známe cílovou třídu spam/ a frekvence 57 nejčastějších slov či znaků. Příklad modelu: V tomto příkladu je nestejná cena chyby.

8 Příklad: rakovina prostaty Cílem je predikovat logaritmus prostate specific antigen (lpsa) z množiny příznaků. Predikujeme spojitou veličinu. Bodový graf, XY graf (scatter plot)

9 Obsah Chapter 2: Úvod do učení s učitelem Chapter 3. a 4. Lineární metody pro regresi a klasifikaci Chapter 5. Splajny Chapter 6. Jádrové (kernal) metody a lokální regrese Chapter 7. Ohodnocení a volba modelů Chapter 8. Kombinace modelů, EM algoritmus,.. Chapter 9: Rozhodovací stromy Chapter 10: Boosting Chapter 11: Neuronové sítě Chapter 12: Support vector machines Chapter 13: Nejbližší sousedé Chapter 14: Učení bez učitele

10 Typické otázky u zkoušky Vysvětlete pojem: přeučení, prokletí dimenzionality, bayesovsky optimální predikce, maximálně věrohodný odhad, optimální separující nadrovina,... Napište algoritmus: AdaBoost, Rozhodovací stromy včetně prořezávání, EM, SVM,... Dolňující otázky pro ujasnění, nakolik pojmům/algoritmům rozumíte na jedničku či pokud jste někde hodně nevěděli. Mnohé ze slajdů se nezkouší, z přednášky možná vytušíte co ;-)

11 Přehled základních pojmů vstupní veličiny (=features), cílová veličina numerické, kategoriální, uspořádané veličiny regrese (=predikce numerické veličiny) klasifikace (=predikce kategoriální veličiny) binární veličiny kódujeme 0/1 nebo -1/1 uspořádané často pomocí dummy variables (pomocné proměnné) vstupní veličiny značíme X, výstup Y resp. G. X je matice Nxp, predikce značíme střechou.

12 Lineární regrese p p p p

13 Lin. regrese 2 p

14 Lin. regrese - výsledek Není-li invertibilní, ubereme závislé sloupce, nebo se pokusíme překódovat nebo přefiltrovat data tak, aby invertibilní byla.

15

16

17

18 Maskování U lineární regrese pro víc tříd může dojít k maskování: modrá třída není nikdy predikovaná.

19

20

21

22

23 Lin. regrese vs. nejbližší sousedé Lineární regrese je hladká, stabilní výrazně závisí na předpokladu linearity hranice má malý rozptyl, potenciálně velké vychýlení (bias). k-nn se přizpůsobí libovolné (spojité..) hranici predikce záleží na pozici a hodnotách pár okolních bodů, proto je nestabilní velký rozptyl, malé vychýlení (bias).

24 Přeučení (overfitting) Přeučením se nazývá přílišná závislost modelu na trénovacích datech, která zvyšuje chybu na testovacích datech. Tj. růst oranžové křivky při klesající modré vpravo v grafu.

25 Optimální bayeskovská hranice Pokud víme, jakým procesem jsou data generována, můžeme v každém bodě predikovat nejčastější hodnotu (při stejné ceně chyby). Tento postup vytvoří optimální bayesovskou hranici (kde jsou obě hodnoty stejně časté).

26 Prokletí dimenzionality Nejbližší sousedé jsou při velké dimenzi hodně daleko.

27 Proč vadí vzdálený nejbližší soused

28 Druhý příklad

29 Weka nástroj pro Data mining, umožňuje učit mnoho modelů.

Lineární diskriminační funkce. Perceptronový algoritmus.

Lineární diskriminační funkce. Perceptronový algoritmus. Lineární. Perceptronový algoritmus. Petr Pošík Czech Technical University in Prague Faculty of Electrical Engineering Dept. of Cybernetics P. Pošík c 2012 Artificial Intelligence 1 / 12 Binární klasifikace

Více

StatSoft Úvod do neuronových sítí

StatSoft Úvod do neuronových sítí StatSoft Úvod do neuronových sítí Vzhledem k vzrůstající popularitě neuronových sítí jsme se rozhodli Vám je v tomto článku představit a říci si něco o jejich využití. Co si tedy představit pod pojmem

Více

Pravděpodobnost v závislosti na proměnné x je zde modelován pomocí logistického modelu. exp x. x x x. log 1

Pravděpodobnost v závislosti na proměnné x je zde modelován pomocí logistického modelu. exp x. x x x. log 1 Logistická regrese Menu: QCExpert Regrese Logistická Modul Logistická regrese umožňuje analýzu dat, kdy odezva je binární, nebo frekvenční veličina vyjádřená hodnotami 0 nebo 1, případně poměry v intervalu

Více

ZÍSKÁVÁNÍ ZNALOSTÍ Z DATABÁZÍ

ZÍSKÁVÁNÍ ZNALOSTÍ Z DATABÁZÍ metodický list č. 1 Dobývání znalostí z databází Cílem tohoto tematického celku je vysvětlení základních pojmů z oblasti dobývání znalostí z databází i východisek dobývání znalostí z databází inspirovaných

Více

Dobývání a vizualizace znalostí

Dobývání a vizualizace znalostí Dobývání a vizualizace znalostí Olga Štěpánková et al. 1 Osnova předmětu 1. Dobývání znalostí - popis a metodika procesu a objasnění základních pojmů 2. Nástroje pro modelování klasifikovaných dat a jejich

Více

Dobývání znalostí. Doc. RNDr. Iveta Mrázová, CSc. Katedra teoretické informatiky Matematicko-fyzikální fakulta Univerzity Karlovy v Praze

Dobývání znalostí. Doc. RNDr. Iveta Mrázová, CSc. Katedra teoretické informatiky Matematicko-fyzikální fakulta Univerzity Karlovy v Praze Dobývání znalostí Doc. RNDr. Iveta Mrázová, CSc. Katedra teoretické informatiky Matematicko-fyzikální fakulta Univerzity Karlovy v Praze Dobývání znalostí Rozhodovací stromy Doc. RNDr. Iveta Mrázová, CSc.

Více

NÁVRH A REALIZACE TRADING STRATEGIÍ NA BÁZI STROJOVÉHO UČENÍ S POMOCÍ MATLABU

NÁVRH A REALIZACE TRADING STRATEGIÍ NA BÁZI STROJOVÉHO UČENÍ S POMOCÍ MATLABU NÁVRH A REALIZACE TRADING STRATEGIÍ NA BÁZI STROJOVÉHO UČENÍ S POMOCÍ MATLABU RNDr. Miroslav Pavelka, PhD m.pavelka@sh.cvut.cz Ing. Jan Hovad jan@hovad.cz OBSAH Obchodování a strojové učení Specifika prediktivního

Více

IBM SPSS Modeler Professional

IBM SPSS Modeler Professional IBM SPSS Modeler Professional 16 IBM SPSS Software IBM SPSS Modeler Professional Včasné rozhodnutí díky přesným informacím Metodami data miningu získáte detailní přehled o svém současném stavu i jasnější

Více

Neuronové časové řady (ANN-TS)

Neuronové časové řady (ANN-TS) Neuronové časové řady (ANN-TS) Menu: QCExpert Prediktivní metody Neuronové časové řady Tento modul (Artificial Neural Network Time Series ANN-TS) využívá modelovacího potenciálu neuronové sítě k predikci

Více

5 Vícerozměrná data - kontingenční tabulky, testy nezávislosti, regresní analýza

5 Vícerozměrná data - kontingenční tabulky, testy nezávislosti, regresní analýza 5 Vícerozměrná data - kontingenční tabulky, testy nezávislosti, regresní analýza 5.1 Vícerozměrná data a vícerozměrná rozdělení Při zpracování vícerozměrných dat se hledají souvislosti mezi dvěma, případně

Více

Univerzita Hradec Králové Fakulta informatiky a managementu Katedra informačních technologií

Univerzita Hradec Králové Fakulta informatiky a managementu Katedra informačních technologií Univerzita Hradec Králové Fakulta informatiky a managementu Katedra informačních technologií Aplikace strojového učení v oblasti e-komerce Diplomová práce Autor: Pavel Vraný Studijní obor: aplikovaná informatika

Více

Využití strojového učení k identifikaci protein-ligand aktivních míst

Využití strojového učení k identifikaci protein-ligand aktivních míst Využití strojového učení k identifikaci protein-ligand aktivních míst David Hoksza, Radoslav Krivák SIRET Research Group Katedra softwarového inženýrství, Matematicko-fyzikální fakulta Karlova Univerzita

Více

6. Lineární regresní modely

6. Lineární regresní modely 6. Lineární regresní modely 6.1 Jednoduchá regrese a validace 6.2 Testy hypotéz v lineární regresi 6.3 Kritika dat v regresním tripletu 6.4 Multikolinearita a polynomy 6.5 Kritika modelu v regresním tripletu

Více

StatSoft Úvod do data miningu

StatSoft Úvod do data miningu StatSoft Úvod do data miningu Tento článek je úvodním povídáním o data miningu, jeho vzniku, účelu a využití. Historie data miningu Rozvoj počítačů, výpočetní techniky a zavedení elektronického sběru dat

Více

5.1 Rozhodovací stromy

5.1 Rozhodovací stromy 5.1 Rozhodovací stromy 5.1.1 Základní algoritmus Způsob reprezentování znalostí v podobě rozhodovacích stromů je dobře znám z řady oblastí. Vzpomeňme jen nejrůznějších klíčů k určování různých živočichů

Více

Propenzitní modelování. Veronika Počerová 10. 4. 2015

Propenzitní modelování. Veronika Počerová 10. 4. 2015 Propenzitní modelování Veronika Počerová 10. 4. 2015 motivace 2 definice Prediktivní analytika je disciplína, která využívá metod Data Miningu k tomu, aby na základě historického chování sledovaného jevu

Více

Úvodem Dříve les než stromy 3 Operace s maticemi

Úvodem Dříve les než stromy 3 Operace s maticemi Obsah 1 Úvodem 13 2 Dříve les než stromy 17 2.1 Nejednoznačnost terminologie 17 2.2 Volba metody analýzy dat 23 2.3 Přehled vybraných vícerozměrných metod 25 2.3.1 Metoda hlavních komponent 26 2.3.2 Faktorová

Více

vzorek1 0.0033390 0.0047277 0.0062653 0.0077811 0.0090141... vzorek 30 0.0056775 0.0058778 0.0066916 0.0076192 0.0087291

vzorek1 0.0033390 0.0047277 0.0062653 0.0077811 0.0090141... vzorek 30 0.0056775 0.0058778 0.0066916 0.0076192 0.0087291 Vzorová úloha 4.16 Postup vícerozměrné kalibrace Postup vícerozměrné kalibrace ukážeme na úloze C4.10 Vícerozměrný kalibrační model kvality bezolovnatého benzinu. Dle následujících kroků na základě naměřených

Více

Pojem a úkoly statistiky

Pojem a úkoly statistiky Katedra ekonometrie FVL UO Brno kancelář 69a, tel. 973 442029 email:jiri.neubauer@unob.cz Pojem a úkoly statistiky Statistika je věda, která se zabývá získáváním, zpracováním a analýzou dat pro potřeby

Více

Obr. 1 Biologický neuron

Obr. 1 Biologický neuron 5.4 Neuronové sítě Lidský mozek je složen asi z 10 10 nervových buněk (neuronů) které jsou mezi sebou navzájem propojeny ještě řádově vyšším počtem vazeb [Novák a kol.,1992]. Začněme tedy nejdříve jedním

Více

Credit scoring. Libor Vajbar Analytik řízení rizik. 18. dubna 2013. Brno

Credit scoring. Libor Vajbar Analytik řízení rizik. 18. dubna 2013. Brno Credit scoring Libor Vajbar Analytik řízení rizik 18. dubna 2013 Brno 1 PROFIL SPOLEČNOSTI Home Credit a.s. přední poskytovatel spotřebitelského financování Úvěrové produkty nákup na splátky u obchodních

Více

MODELOVÁNÍ BONITY OBCÍ POMOCÍ KOHONENOVÝCH SAMOORGANIZUJÍCÍCH SE MAP A LVQ NEURONOVÝCH SÍTÍ

MODELOVÁNÍ BONITY OBCÍ POMOCÍ KOHONENOVÝCH SAMOORGANIZUJÍCÍCH SE MAP A LVQ NEURONOVÝCH SÍTÍ MODELOVÁNÍ BONITY OBCÍ POMOCÍ KOHONENOVÝCH SAMOORGANIZUJÍCÍCH SE MAP A LVQ NEURONOVÝCH SÍTÍ Vladimír Olej, Petr Hájek Univerzita Pardubice, Fakulta ekonomicko-správní, informatiky Ústav systémového inženýrství

Více

VYUŽITÍ MATLAB WEB SERVERU PRO INTERNETOVOU VÝUKU ANALÝZY DAT A ŘÍZENÍ JAKOSTI

VYUŽITÍ MATLAB WEB SERVERU PRO INTERNETOVOU VÝUKU ANALÝZY DAT A ŘÍZENÍ JAKOSTI VYUŽITÍ MATLAB WEB SERVERU PRO INTERNETOVOU VÝUKU ANALÝZY DAT A ŘÍZENÍ JAKOSTI Aleš Linka 1, Petr Volf 2 1 Katedra textilních materiálů, FT TUL, 2 Katedra aplikované matematiky, FP TUL ABSTRAKT. Internetové

Více

StatSoft Jak poznat vliv faktorů vizuálně

StatSoft Jak poznat vliv faktorů vizuálně StatSoft Jak poznat vliv faktorů vizuálně V tomto článku bychom se rádi věnovali otázce, jak poznat již z grafického náhledu vztahy a závislosti v analýze rozptylu. Pomocí následujících grafických zobrazení

Více

Vytěžování znalostí z dat

Vytěžování znalostí z dat Pavel Kordík, Josef Borkovec (ČVUT FIT) Vytěžování znalostí z dat BI-VZD, 2011, Cvičení 9 1/16 Vytěžování znalostí z dat Pavel Kordík, Josef Borkovec Department of Computer Systems Faculty of Information

Více

Vícerozměrné metody. PSY117/454 Statistická analýza dat v psychologii Přednáška 12. Schematický úvod

Vícerozměrné metody. PSY117/454 Statistická analýza dat v psychologii Přednáška 12. Schematický úvod PSY117/454 Statistická analýza dat v psychologii Přednáška 12 Vícerozměrné metody Schematický úvod Co je na slově statistika tak divného, že jeho vyslovení tak často způsobuje napjaté ticho? William Kruskal

Více

Vysoká škola ekonomická v Praze. Fakulta financí a účetnictví

Vysoká škola ekonomická v Praze. Fakulta financí a účetnictví Vysoká škola ekonomická v Praze Fakulta financí a účetnictví Katedra bankovnictví a pojišťovnictví Diplomová práce Srovnání logistické regrese a rozhodovacích stromů při tvorbě skóringových modelů Ladislav

Více

Vědecký tutoriál, část I. A Tutorial. Vilém Vychodil (Univerzita Palackého v Olomouci)

Vědecký tutoriál, část I. A Tutorial. Vilém Vychodil (Univerzita Palackého v Olomouci) ..! POSSIBILISTIC Laboratoř pro analýzu INFORMATION: a modelování dat Vědecký tutoriál, část I A Tutorial Vilém Vychodil (Univerzita Palackého v Olomouci) George J. Klir State University of New York (SUNY)

Více

Základy business intelligence. Jaroslav Šmarda

Základy business intelligence. Jaroslav Šmarda Základy business intelligence Jaroslav Šmarda Základy business intelligence Business intelligence Datový sklad On-line Analytical Processing (OLAP) Kontingenční tabulky v MS Excelu jako příklad OLAP Dolování

Více

You created this PDF from an application that is not licensed to print to novapdf printer (http://www.novapdf.com)

You created this PDF from an application that is not licensed to print to novapdf printer (http://www.novapdf.com) Závislost náhodných veličin Úvod Předchozí přednášky: - statistické charakteristiky jednoho výběrového nebo základního souboru - vztahy mezi výběrovým a základním souborem - vztahy statistických charakteristik

Více

Přednáška 10. Analýza závislosti

Přednáška 10. Analýza závislosti Přednáška 10 Analýza závislosti Analýza závislosti dvou kategoriálních proměnných Analýza závislosti v kontingečních tabulkách Analýza závislosti v asociačních tabulkách Simpsonův paradox Analýza závislosti

Více

Měření závislosti statistických dat

Měření závislosti statistických dat 5.1 Měření závislosti statistických dat Každý pořádný astronom je schopen vám předpovědět, kde se bude nacházet daná hvězda půl hodiny před půlnocí. Ne každý je však téhož schopen předpovědět v případě

Více

UROLOGY WEEK 2012 Urologická klinika VFN a 1. LF UK v Praze

UROLOGY WEEK 2012 Urologická klinika VFN a 1. LF UK v Praze Urologická klinika VFN a 1. LF UK v Praze MUDr. Libor Zámečník, Ph.D., FEBU Urologická klinika VFN a 1. LF UK v Praze přednosta prof. MUDr. Tomáš Hanuš, DrSc. Urologická klinika VFN a 1. LF UK se letos

Více

Vybrané partie z obrácených úloh. obrácených úloh (MG452P73)

Vybrané partie z obrácených úloh. obrácených úloh (MG452P73) Vybrané partie z obrácených úloh obrácených úloh (MG452P73) Obsah přednášky Klasifikace obrácených úloh a základní pojmy Lineární inverzní problém, prostor parametrů a dat Gaussovy transformace, normální

Více

Tomáš Karel LS 2012/2013

Tomáš Karel LS 2012/2013 Tomáš Karel LS 2012/2013 Doplňkový materiál ke cvičení z předmětu 4ST201. Na případné faktické chyby v této presentaci mě prosím upozorněte. Děkuji. Tyto slidy berte pouze jako doplňkový materiál není

Více

Model výkonnosti hokejových reprezentačních týmů

Model výkonnosti hokejových reprezentačních týmů www.pwc.com/cz Model výkonnosti hokejových reprezentačních týmů Duben 5 Poradenská společnost analyzovala předpoklady jednotlivých zemí pro úspěch na mistrovství světa v hokeji, které začíná. května v

Více

Záznam dat Úvod Záznam dat zahrnuje tři základní funkce: Záznam dat v prostředí třídy Záznam dat s MINDSTORMS NXT

Záznam dat Úvod Záznam dat zahrnuje tři základní funkce: Záznam dat v prostředí třídy Záznam dat s MINDSTORMS NXT Úvod Záznam dat umožňuje sběr, ukládání a analýzu údajů ze senzorů. Záznamem dat monitorujeme události a procesy po dobu práce se senzory připojenými k počítači prostřednictvím zařízení jakým je NXT kostka.

Více

UNIVERZITA OBRANY Fakulta ekonomiky a managementu. Aplikace STAT1. Výsledek řešení projektu PRO HORR2011 a PRO GRAM2011 3. 11.

UNIVERZITA OBRANY Fakulta ekonomiky a managementu. Aplikace STAT1. Výsledek řešení projektu PRO HORR2011 a PRO GRAM2011 3. 11. UNIVERZITA OBRANY Fakulta ekonomiky a managementu Aplikace STAT1 Výsledek řešení projektu PRO HORR2011 a PRO GRAM2011 Jiří Neubauer, Marek Sedlačík, Oldřich Kříž 3. 11. 2012 Popis a návod k použití aplikace

Více

13 Barvy a úpravy rastrového

13 Barvy a úpravy rastrového 13 Barvy a úpravy rastrového Studijní cíl Tento blok je věnován základním metodám pro úpravu rastrového obrazu, jako je např. otočení, horizontální a vertikální překlopení. Dále budo vysvětleny různé metody

Více

METODIKA ZPRACOVÁNÍ EKONOMICKÝCH ČASOVÝCH ŘAD S VYUŽITÍM SIMULÁTORŮ NEURONOVÝCH SÍTÍ

METODIKA ZPRACOVÁNÍ EKONOMICKÝCH ČASOVÝCH ŘAD S VYUŽITÍM SIMULÁTORŮ NEURONOVÝCH SÍTÍ METODIKA ZPRACOVÁNÍ EKONOMICKÝCH ČASOVÝCH ŘAD S VYUŽITÍM SIMULÁTORŮ NEURONOVÝCH SÍTÍ PROCESSING METHODOLOGY OF ECONOMIC TIME SERIES USING NEURAL NETWORK SIMULATORS Jindřich Petrucha Evropský polytechnický

Více

Třídění statistických dat

Třídění statistických dat 2.1 Třídění statistických dat Všechny muže ve městě rozdělíme na 2 skupiny: A) muži, kteří chodí k holiči B) muži, kteří se holí sami Do které skupiny zařadíme holiče? prof. Raymond M. Smullyan, Dr. Math.

Více

7 Kardinální informace o kritériích (část 1)

7 Kardinální informace o kritériích (část 1) 7 Kardinální informace o kritériích (část 1) Předpokládejme stejná značení jako v předchozích cvičeních. Kardinální informací o kritériích se rozumí ohodnocení jejich důležitosti k pomocí váhového vektoru

Více

Příprava dat v softwaru Statistica

Příprava dat v softwaru Statistica Příprava dat v softwaru Statistica Software Statistica obsahuje pokročilé nástroje pro přípravu dat a tvorbu nových proměnných. Tyto funkcionality přinášejí značnou úsporu času při přípravě datového souboru,

Více

Úvod do mobilní robotiky AIL028

Úvod do mobilní robotiky AIL028 Pravděpodobnostní plánování zbynek.winkler at mff.cuni.cz, md at robotika.cz http://robotika.cz/guide/umor05/cs 12. prosince 2005 1 Co už umíme a co ne? Jak řešit složitější případy? Definice konfiguračního

Více

Přednáška 9. Testy dobré shody. Grafická analýza pro ověření shody empirického a teoretického rozdělení

Přednáška 9. Testy dobré shody. Grafická analýza pro ověření shody empirického a teoretického rozdělení Přednáška 9 Testy dobré shody Grafická analýza pro ověření shody empirického a teoretického rozdělení χ 2 test dobré shody ověření, zda jsou relativní četnosti jednotlivých variant rovny číslům π 01 ;

Více

4.2.15 Funkce kotangens

4.2.15 Funkce kotangens 4..5 Funkce kotangens Předpoklady: 44 Pedagogická poznámka: Pokud nemáte čas, doporučuji nechat tuto hodinu studentům na domácí práci. Nedá se na tom nic zkazit a v budoucnu to není nikde příliš potřeba.

Více

Pravidla a podmínky k vydání osvědčení o způsobilosti vykonávat aktuárskou činnost

Pravidla a podmínky k vydání osvědčení o způsobilosti vykonávat aktuárskou činnost Pravidla a podmínky k vydání osvědčení o způsobilosti vykonávat aktuárskou činnost (dále jen společnost) stanoví k vydání osvědčení o způsobilosti vykonávat aktuárskou činnost (dále jen osvědčení) následující

Více

Řešené statistické příklady v SPSS

Řešené statistické příklady v SPSS Řešené statistické příklady v SPSS Lektor: Ing. Martin Kořínek, Ph.D. 1 Krátce o SPSS Statistických programů komerčně šířených existuje veliké množství. Jako nejpopulárnější příklady můžeme zmínit NCSS,

Více

Statistika. Regresní a korelační analýza Úvod do problému. Roman Biskup

Statistika. Regresní a korelační analýza Úvod do problému. Roman Biskup Statistika Regresní a korelační analýza Úvod do problému Roman Biskup Jihočeská univerzita v Českých Budějovicích Ekonomická fakulta (Zemědělská fakulta) Katedra aplikované matematiky a informatiky 2008/2009

Více

SONAR Spastic Dystonia Registry

SONAR Spastic Dystonia Registry SONAR Spastic Dystonia Registry Registr pacientů s první akutní CMP v karotickém povodí s permanentním neurologickým deficitem. Podmínky pro zařazení: Každý pacient s první akutní CMP v karotickém povodí

Více

4.8 Jak jsme na tom v porovnání s jinými přístupy

4.8 Jak jsme na tom v porovnání s jinými přístupy Vážení zákazníci, dovolujeme si Vás upozornit, že na tuto ukázku knihy se vztahují autorská práva, tzv. copyright. To znamená, že ukázka má sloužit výhradnì pro osobní potøebu potenciálního kupujícího

Více

Diagnostika infarktu myokardu pomocí pravidlových systémů

Diagnostika infarktu myokardu pomocí pravidlových systémů pomocí pravidlových systémů Bakalářská práce 2009 pomocí pravidlových systémů Přehled prezentace Motivace a cíle Infarkt myokardu, EKG Pravidlové systémy Výsledky Motivace Infarkt myokardu Detekce infarktu

Více

Robust 2014, 19. - 24. ledna 2014, Jetřichovice

Robust 2014, 19. - 24. ledna 2014, Jetřichovice K. Hron 1 C. Mert 2 P. Filzmoser 2 1 Katedra matematické analýzy a aplikací matematiky Přírodovědecká fakulta, Univerzita Palackého, Olomouc 2 Department of Statistics and Probability Theory Vienna University

Více

Testování hypotéz a měření asociace mezi proměnnými

Testování hypotéz a měření asociace mezi proměnnými Testování hypotéz a měření asociace mezi proměnnými Testování hypotéz Nulová a alternativní hypotéza většina statistických analýz zahrnuje různá porovnání, hledání vztahů, efektů Tvrzení, že efekt je nulový,

Více

Výhody a nevýhody jednotlivých reprezentací jsou shrnuty na konci kapitoly.

Výhody a nevýhody jednotlivých reprezentací jsou shrnuty na konci kapitoly. Kapitola Reprezentace grafu V kapitole?? jsme se dozvěděli, co to jsou grafy a k čemu jsou dobré. rzo budeme chtít napsat nějaký program, který s grafy pracuje. le jak si takový graf uložit do počítače?

Více

Hedonický cenový index na datech poskytovatelů hypotečních úvěrů. Ing. Mgr. Martin Lux, Ph.D.

Hedonický cenový index na datech poskytovatelů hypotečních úvěrů. Ing. Mgr. Martin Lux, Ph.D. Hedonický cenový index na datech poskytovatelů hypotečních úvěrů Ing. Mgr. Martin Lux, Ph.D. Proč nový index? V ČR existuje již několik cenových indexů například index ČSÚ (na transakčních i nabídkových

Více

3. Optimalizace pomocí nástroje Řešitel

3. Optimalizace pomocí nástroje Řešitel 3. Optimalizace pomocí nástroje Řešitel Rovnováha mechanické soustavy Uvažujme dvě různé nehmotné lineární pružiny P 1 a P 2 připevněné na pevné horizontální tyči splývající s osou x podle obrázku: (0,0)

Více

4EK211 Základy ekonometrie

4EK211 Základy ekonometrie 4EK211 Základy ekonometrie LS 2014/15 Cvičení 4: Statistické vlastnosti MNČ LENKA FIŘTOVÁ KATEDRA EKONOMETRIE, FAKULTA INFORMATIKY A STATISTIKY VYSOKÁ ŠKOLA EKONOMICKÁ V PRAZE Upřesnění k pojmům a značení

Více

IQ - SixSigma. IQ SixSigma Software pro analýzu a sledování procesů

IQ - SixSigma. IQ SixSigma Software pro analýzu a sledování procesů IQ - SixSigma IQ SixSigma Popis: IQ-SixSigma je software vyvinutý pro analýzu a sledování procesů. Slouží ke statistickému řízení procesů (SPC Statistical Process Control). Může se jednat o technologické,

Více

Termovizní měření. 1 Teoretický úvod. Cíl cvičení: Detekce lidské kůže na snímcích z termovizní i klasické kamery

Termovizní měření. 1 Teoretický úvod. Cíl cvičení: Detekce lidské kůže na snímcích z termovizní i klasické kamery Termovizní měření Cíl cvičení: Detekce lidské kůže na snímcích z termovizní i klasické kamery 1 Teoretický úvod Termovizní měření Termovizní kamera je přístroj pro bezkontaktní měření teplotních polí na

Více

Cíle lokalizace. Zjištění: 1. polohy a postavení robota (robot pose) 2. vzhledem k mapě 3. v daném prostředí

Cíle lokalizace. Zjištění: 1. polohy a postavení robota (robot pose) 2. vzhledem k mapě 3. v daném prostředí Cíle lokalizace Zjištění: 1. polohy a postavení robota (robot pose) 2. vzhledem k mapě 3. v daném prostředí 2 Jiný pohled Je to problém transformace souřadnic Mapa je globální souřadnicový systém nezávislý

Více

2 Zpracování naměřených dat. 2.1 Gaussův zákon chyb. 2.2 Náhodná veličina a její rozdělení

2 Zpracování naměřených dat. 2.1 Gaussův zákon chyb. 2.2 Náhodná veličina a její rozdělení 2 Zpracování naměřených dat Důležitou součástí každé experimentální práce je statistické zpracování naměřených dat. V této krátké kapitole se budeme věnovat určení intervalů spolehlivosti získaných výsledků

Více

Odpřednesenou látku naleznete v kapitole 3.3 skript Diskrétní matematika.

Odpřednesenou látku naleznete v kapitole 3.3 skript Diskrétní matematika. Lineární kódy, část 2 Odpřednesenou látku naleznete v kapitole 3.3 skript Diskrétní matematika. Jiří Velebil: A7B01LAG 22.12.2014: Lineární kódy, část 2 1/12 Dnešní přednáška 1 Analýza Hammingova (7, 4)-kódu.

Více

4EK211 Základy ekonometrie

4EK211 Základy ekonometrie 4EK211 Základy ekonometrie Úvod do předmětu obecné informace Základní pojmy ze statistiky / ekonometrie Úvod do programu EViews, Gretl Některé užitečné funkce v MS Excel Cvičení 1 Zuzana Dlouhá Úvod do

Více

2. Statistická terminologie a vyjadřovací prostředky. 2.1. Statistická terminologie. Statistická jednotka

2. Statistická terminologie a vyjadřovací prostředky. 2.1. Statistická terminologie. Statistická jednotka 2. Statistická terminologie a vyjadřovací prostředky 2.1. Statistická terminologie Statistická jednotka Statistická jednotka = nositel statistické informace, elementární prvek hromadného jevu. Příklady:

Více

Korelační a regresní analýza

Korelační a regresní analýza Korelační a regresní analýza Analýza závislosti v normálním rozdělení Pearsonův (výběrový) korelační koeficient: r = s XY s X s Y, kde s XY = 1 n (x n 1 i=0 i x )(y i y ), s X (s Y ) je výběrová směrodatná

Více

Matematická vsuvka I. trojčlenka. http://www.matematika.cz/

Matematická vsuvka I. trojčlenka. http://www.matematika.cz/ Matematická vsuvka I. trojčlenka http://www.matematika.cz/ Trojčlenka přímá úměra Pokud platí, že čím více tím více, jedná se o přímou úměru. Čím více kopáčů bude kopat, tím více toho vykopají. Čím déle

Více

Hodina 50 Strana 1/14. Gymnázium Budějovická. Hodnocení akcií

Hodina 50 Strana 1/14. Gymnázium Budějovická. Hodnocení akcií Hodina 50 Strana /4 Gymnázium Budějovická Volitelný předmět Ekonomie - jednoletý BLOK ČÍSLO 8 Hodnocení akcií Předpokládaný počet : 9 hodin Použitá literatura : František Egermayer, Jan Kožíšek Statistická

Více

10. Předpovídání - aplikace regresní úlohy

10. Předpovídání - aplikace regresní úlohy 10. Předpovídání - aplikace regresní úlohy Regresní úloha (analýza) je označení pro statistickou metodu, pomocí nichž odhadujeme hodnotu náhodné veličiny (tzv. závislé proměnné, cílové proměnné, regresandu

Více

Rozhodovací pravidla

Rozhodovací pravidla Rozhodovací pravidla Úloha klasifikace příkladů do tříd. pravidlo Ant C, kde Ant je konjunkce hodnot atributů a C je cílový atribut A. Algoritmus pokrývání množin metoda separate and conquer (odděl a panuj)

Více

scale n_width width center scale left center range right center range value weight_sum left right weight value weight value weight_sum weight pixel

scale n_width width center scale left center range right center range value weight_sum left right weight value weight value weight_sum weight pixel Změna velikosti obrázku Převzorkování pomocí filtrů Ačkoliv jsou výše uvedené metody mnohdy dostačující pro běžné aplikace, občas je zapotřebí dosáhnout lepších výsledků. Pokud chceme obrázky zvětšovat

Více

APLIKACE METOD UMĚLÉ INTELIGENCE PŘI PREDIKCI CHEMICKÉHO SLOŽENÍ RAFINAČNÍCH STRUSEK

APLIKACE METOD UMĚLÉ INTELIGENCE PŘI PREDIKCI CHEMICKÉHO SLOŽENÍ RAFINAČNÍCH STRUSEK APLIKACE METOD UMĚLÉ INTELIGENCE PŘI PREDIKCI CHEMICKÉHO SLOŽENÍ RAFINAČNÍCH STRUSEK APPLICATION OF ARTIFICIAL INTELLIGENCE METHODS FOR PREDICTION OF CHEMICAL COMPOSITION OF REFINING SLAG Zora Jančíková

Více

Základy vytěžování dat

Základy vytěžování dat Základy vytěžování dat předmět A7Bb36vyd Vytěžování dat Filip Železný, Miroslav Čepek, Radomír Černoch, Jan Hrdlička katedra kybernetiky a katedra počítačů ČVUT v Praze, FEL Evropský sociální fond Praha

Více

Získávání znalostí z databází. Alois Kužela

Získávání znalostí z databází. Alois Kužela Získávání znalostí z databází Alois Kužela Obsah související pojmy datové sklady, získávání znalostí asocianí pravidla 2/37 Úvod získávání znalostí z dat, dolování (z) dat, data mining proces netriviálního

Více

MODELOVÁNÍ POTRUBNÍCH SÍTÍ. Vladimír Hanta. Vysoká škola chemicko-technologická v Praze, Ústav počítačové a řídicí techniky

MODELOVÁNÍ POTRUBNÍCH SÍTÍ. Vladimír Hanta. Vysoká škola chemicko-technologická v Praze, Ústav počítačové a řídicí techniky MODELOVÁNÍ POTRUBNÍCH SÍTÍ Vladimír Hanta Vysoká škola chemicko-technologická v Praze, Ústav počítačové a řídicí techniky Klíčová slova: distribuční logistika, potrubní sítě, optimální potrubní cesta,

Více

SOLVER UŽIVATELSKÁ PŘÍRUČKA. Kamil Šamaj, František Vižďa Univerzita obrany, Brno, 2008 Výzkumný záměr MO0 FVT0000404

SOLVER UŽIVATELSKÁ PŘÍRUČKA. Kamil Šamaj, František Vižďa Univerzita obrany, Brno, 2008 Výzkumný záměr MO0 FVT0000404 SOLVER UŽIVATELSKÁ PŘÍRUČKA Kamil Šamaj, František Vižďa Univerzita obrany, Brno, 2008 Výzkumný záměr MO0 FVT0000404 1. Solver Program Solver slouží pro vyhodnocení experimentálně naměřených dat. Základem

Více

Návrh systému řízení

Návrh systému řízení Návrh systému řízení Jelikož popisované ostrovní systémy využívají zdroje elektrické energie s nestabilní dodávkou elektrické energie, jsou kladeny vysoké nároky na řídicí systém celého ostrovního systému.

Více

Automatizované řešení úloh s omezeními

Automatizované řešení úloh s omezeními Automatizované řešení úloh s omezeními Martin Kot Katedra informatiky, FEI, Vysoká škola báňská Technická universita Ostrava 17. listopadu 15, Ostrava-Poruba 708 33 Česká republika 25. října 2012 M. Kot

Více

Západočeská univerzita v Plzni Fakulta aplikovaných věd Katedra informatiky a výpočetní techniky. Automatická klasifikace textových dokumentů

Západočeská univerzita v Plzni Fakulta aplikovaných věd Katedra informatiky a výpočetní techniky. Automatická klasifikace textových dokumentů Západočeská univerzita v Plzni Fakulta aplikovaných věd Katedra informatiky a výpočetní techniky Bakalářská práce Automatická klasifikace textových dokumentů Plzeň 2012 Veronika Černá Prohlášení Prohlašuji,

Více

Regresní analýza jednoduchá lineární regrese mnohonásobná lineární regrese logistická regrese

Regresní analýza jednoduchá lineární regrese mnohonásobná lineární regrese logistická regrese Regresní analýza jednoduchá lineární regrese mnohonásobná lineární regrese logistická regrese Regresní analýza korelační koeficient říká, že mezi dvěma proměnnými existuje souvislost - jsme schopni vyslovit

Více

otec 165 178 158 170 180 160 170 167 185 165 173 175 syn 162 184 163 170 189 165 177 170 187 176 171 183

otec 165 178 158 170 180 160 170 167 185 165 173 175 syn 162 184 163 170 189 165 177 170 187 176 171 183 Regresní analýza 1. Byla zjištěna výška otců a výška jejich nejstarších synů [v cm]. otec 165 178 158 170 180 160 170 167 185 165 173 175 syn 162 184 163 170 189 165 177 170 187 176 171 183 c) Odhadněte

Více

Střední hodnota a rozptyl náhodné. kvantilu. Ing. Michael Rost, Ph.D.

Střední hodnota a rozptyl náhodné. kvantilu. Ing. Michael Rost, Ph.D. Střední hodnota a rozptyl náhodné veličiny, vybraná rozdělení diskrétních a spojitých náhodných veličin, pojem kvantilu Ing. Michael Rost, Ph.D. Príklad Předpokládejme že máme náhodnou veličinu X která

Více

Automaticka klasikace dokumentu s podobnym obsahem

Automaticka klasikace dokumentu s podobnym obsahem Zapadoceska univerzita v Plzni Fakulta aplikovanych ved Katedra informatiky a vypocetn techniky Diplomova prace Automaticka klasikace dokumentu s podobnym obsahem Plzen, 2012 Michal Hrala Poděkování Děkuji

Více

Analýzy regionálního trhu práce v České republice Analysis of regional labour market in Czech Republic

Analýzy regionálního trhu práce v České republice Analysis of regional labour market in Czech Republic 2 nd Central European Conference in Regional Science CERS, 2007 862 Analýzy regionálního trhu práce v České republice Analysis of regional labour market in Czech Republic PETR ŘEHOŘ, DARJA HOLÁTOVÁ Jihočeská

Více

KOMPRESE OBRAZŮ. Václav Hlaváč. Fakulta elektrotechnická ČVUT v Praze katedra kybernetiky, Centrum strojového vnímání. hlavac@fel.cvut.

KOMPRESE OBRAZŮ. Václav Hlaváč. Fakulta elektrotechnická ČVUT v Praze katedra kybernetiky, Centrum strojového vnímání. hlavac@fel.cvut. 1/24 KOMPRESE OBRAZŮ Václav Hlaváč Fakulta elektrotechnická ČVUT v Praze katedra kybernetiky, Centrum strojového vnímání hlavac@fel.cvut.cz http://cmp.felk.cvut.cz/ hlavac KOMPRESE OBRAZŮ, ÚVOD 2/24 Cíl:

Více

Funkce, funkční závislosti Lineární funkce

Funkce, funkční závislosti Lineární funkce Funkce, funkční závislosti Lineární funkce Obsah: Definice funkce Grafické znázornění funkce Konstantní funkce Lineární funkce Vlastnosti lineárních funkcí Lineární funkce - příklady Zdroje Z Návrat na

Více

1 Linearní prostory nad komplexními čísly

1 Linearní prostory nad komplexními čísly 1 Linearní prostory nad komplexními čísly V této přednášce budeme hledat kořeny polynomů, které se dále budou moci vyskytovat jako složky vektorů nebo matic Vzhledem k tomu, že kořeny polynomu (i reálného)

Více

13 Specifika formování poptávky firem po práci a kapitálu

13 Specifika formování poptávky firem po práci a kapitálu 13 Specifika formování poptávky firem po práci a kapitálu Na rozdíl od trhu finálních statků, kde stranu poptávky tvořili jednotlivci (domácnosti) a stranu nabídky firmy, na trhu vstupů vytvářejí jednotlivci

Více

11 Analýza hlavních komponet

11 Analýza hlavních komponet 11 Analýza hlavních komponet Tato úloha provádí transformaci měřených dat na menší počet tzv. fiktivních dat tak, aby většina informace obsažená v původních datech zůstala zachována. Jedná se tedy o úlohu

Více

6.1 Normální (Gaussovo) rozdělení

6.1 Normální (Gaussovo) rozdělení 6 Spojitá rozdělení 6.1 Normální (Gaussovo) rozdělení Ze spojitých rozdělení se v praxi setkáme nejčastěji s normálním rozdělením. Toto rozdělení je typické pro mnoho náhodných veličin z rozmanitých oborů

Více

RESEARCH REPORT. ÚTIA AVČR, P.O.Box 18, 182 08 Prague, Czech Republic Fax: (+420)286890378, http://www.utia.cz, E-mail: utia@utia.cas.

RESEARCH REPORT. ÚTIA AVČR, P.O.Box 18, 182 08 Prague, Czech Republic Fax: (+420)286890378, http://www.utia.cz, E-mail: utia@utia.cas. Akademie věd České republiky Ústav teorie informace a automatizace Academy of Sciences of the Czech Republic Institute of Information Theory and Automation RESEARCH REPORT J. Andrýsek, P. Ettler Rozšíření

Více

Obsah. 3 Testy 31 3.1 z test... 32 3.2 z test 2... 33 3.3 t test... 34 3.4 t test 2s... 35

Obsah. 3 Testy 31 3.1 z test... 32 3.2 z test 2... 33 3.3 t test... 34 3.4 t test 2s... 35 Obsah 1 Popisná statistika 4 1.1 bas stat........................................ 5 1.2 mean.......................................... 6 1.3 meansq........................................ 7 1.4 sumsq.........................................

Více

DATABÁZE MS ACCESS 2010

DATABÁZE MS ACCESS 2010 DATABÁZE MS ACCESS 2010 KAPITOLA 5 PRAKTICKÁ ČÁST TABULKY POPIS PROSTŘEDÍ Spuštění MS Access nadefinovat název databáze a cestu k uložení databáze POPIS PROSTŘEDÍ Nahoře záložky: Soubor (k uložení souboru,

Více

Metody řešení problematiky neúplných dat

Metody řešení problematiky neúplných dat Metody řešení problematiky neúplných dat Ing. David Pejčoch, DiS. Katedra informačního a znalostního inženýrství Fakulta informatiky a statistiky Vysoká škola ekonomická Nám. W. Churchilla 4 130 00 Praha

Více

Geometrické transformace obrazu a související témata. 9. přednáška předmětu Zpracování obrazů

Geometrické transformace obrazu a související témata. 9. přednáška předmětu Zpracování obrazů Geometrické transformace obrazu a související témata 9. přednáška předmětu Zpracování obrazů Martina Mudrová 2004 Téma přednášk O čem bude tato přednáška? Geometrické transformace obrazu Interpolace v

Více

StatSoft Jaký je mezi nimi rozdíl?

StatSoft Jaký je mezi nimi rozdíl? StatSoft Jaký je mezi nimi rozdíl? GAINS ROC X P okud se zabýváte klasifikačními úlohami, pak většinou potřebujete nějakým způsobem mezi sebou porovnat kvalitu vyprodukovaných modelů. Mezi základní pomůcky

Více

Numerické řešení variačních úloh v Excelu

Numerické řešení variačních úloh v Excelu Numerické řešení variačních úloh v Excelu Miroslav Hanzelka, Lenka Stará, Dominik Tělupil Gymnázium Česká Lípa, Gymnázium Jírovcova 8, Gymnázium Brno MirdaHanzelka@seznam.cz, lenka.stara1@seznam.cz, dtelupil@gmail.com

Více

Mendelova univerzita v Brně Provozně ekonomická fakulta. Analýza dat sleep Semestrální práce do předmětu Informační systémy pro rozhodování

Mendelova univerzita v Brně Provozně ekonomická fakulta. Analýza dat sleep Semestrální práce do předmětu Informační systémy pro rozhodování Mendelova univerzita v Brně Provozně ekonomická fakulta Analýza dat sleep Semestrální práce do předmětu Informační systémy pro rozhodování Jan Grmela, EI Brno 2011 Popis zdrojových dat Zdrojová data souboru

Více