ZÍSKÁVÁNÍ ZNALOSTÍ Z DATABÁZÍ

Save this PDF as:
 WORD  PNG  TXT  JPG

Rozměr: px
Začít zobrazení ze stránky:

Download "ZÍSKÁVÁNÍ ZNALOSTÍ Z DATABÁZÍ"

Transkript

1 metodický list č. 1 Dobývání znalostí z databází Cílem tohoto tematického celku je vysvětlení základních pojmů z oblasti dobývání znalostí z databází i východisek dobývání znalostí z databází inspirovaných oblastí databází, statistiky a strojového učení. Tématický celek je rozdělen do těchto dílčích témat: 1. Základní pojmy z oblasti dobývání znalostí 2. Zdroje dobývání znalostí 1. dílčí téma: Základní pojmy z oblasti dobývání znalostí K prvnímu dílčímu tématu si přečtěte příslušné kapitoly v: dobývání znalostí z databází, analýza nákupního košíku rozdíl mezi procesem dobývání znalostí a krokem data mining základní typy úloh dobývání znalostí z databází základní kroky metodiky CRISP-DM 2. dílčí téma: Východiska dobývání znalostí K druhému dílčímu tématu si přečtěte příslušné kapitoly v: 1

2 OLAP, datový sklad, mutidimenzionální krychle, roll-up, drill-down, kontingenční tabulka, shluková analýza, objekt, atribut, učení na základě podobnosti, prostor kombinací (modelů), učení jako prohledávání, učení jako aproximace, gradientní metoda rozdíl mezi MOLAP a ROLAP rozdíl mezi databázovým schématem hvězda a sněhová vločka rozdíl mezi diskriminační a regresní analýzou rozdíl mezi hierarchickým shlukováním a shlukováním metodo k-středů rozdíl mezi učením s učitelem a učením bez učitele rozdíl mezi aproximací a interpolací způsob převodu datové tabulky do podoby mutidimenzionální krychle princip χ 2 testu typy atributů formální vyjádření úlohy učení s učitelem základní způsoby prohledávání prostoru kombinací (modelů) 2

3 metodický list č. 2 Symbolické metody dobývání znalostí Cílem tohoto tematického celku je vysvětlení základních principů algoritmů pro tvorbu rozhodovacích stromů, rozhodovacích a asociačních pravidel a algoritmů pro učení založeném na instancích. K tématickému celku si přečtěte příslušné kapitoly v: rozhodovací strom, prořezávání stromů, rozhodovací pravidlo, asociační pravidlo, pokrývání množin, implikace, dvojitá implikace, ekvivalence, centroid (etalon) rozdíl mezi rozhodovacími a regresními stromy rozdíl mezi rozhodovacími a asociačními pravidly základní kritéria používaná pro větvení rozhodovacího stromu základní podobu algoritmu pro tvorbu rozhodovacích stromů základní kvantitativní charakteristiky asociačních pravidel základní podobu algoritmu pro tvorbu rozhodovacích pravidel základní metriky pro měření vzdálenosti mezi příklady základní podobu algoritmu učení založeném na instancích 3

4 metodický list č. 3 Subsymbolické metody dobývání znalostí Cílem tohoto tematického celku je vysvětlení základních principů neuronových sítí, genetických algoritmů a bayesovských klasifikátorů. K tématickému celku si přečtěte příslušné kapitoly v: lineární neuron, vícevrstvá neuronová síť, Kohonenova mapa, selekce, křížení a mutace, naivní bayesovský klasifikátor, bayesovská síť rozdíl mezi různými modely jednoho neuronu rozdíl mezi naivním bayesovským klasifikátorem a bayesovskou sítí problém uváznutí v lokálním optimu a způsoby jeho řešení geometrickou interpretaci činnosti lineárního neuronu základní princip algoritmů pro učení neuronových sítí základní princip metody SVM základní podobu genetického algoritmu 4

5 metodický list č. 4 Další kroky procesu dobývání znalostí Cílem tohoto tematického celku je vysvětlení základních způsobů hodnocení kvality nalezených znalostí i základních metod předzpracování dat. Tématický celek je rozdělen do těchto dílčích témat: 1. Vyhodnocení výsledků 2. Příprava dat 1. dílčí téma: Vyhodnocení výsledků K prvnímu dílčímu tématu si přečtěte příslušné kapitoly v: matic záměn, přesnost a úplnost, ROC křivka, kombinování modelů meta-učení rozdíl mezi hodnocením správnosti klasifikace a numerické predikce vizualizací klasifikací a vizualizací modelů rozdíl mezi metodami bagging, boosting a stacking metody testování modelů metody porovnávání modelů 2. dílčí téma: Příprava dat K druhému dílčímu tématu si přečtěte příslušné kapitoly v: 5

6 diskretizace, selekce atributů, rozdíl mezi ostrou a fuzzy diskretizací rozdíl mezi diskretizací bez využití a s využitím informací o rozdělení objektů do tříd rozdíl mezi redukcí počtu atributů metodami transformace a metodami selekce způsob převodu časové řady na datovou tabulku způsob převodu relační databáze na jednu datovou tabulku kritéria pro selekci atributů metodou filtru způsob hodnocení kvality diskretizace z hlediska klasifikační úlohy 6

7 metodický list č. 5 Nové trendy dobývání znalostí Cílem tohoto tematického celku je vysvětlení základních způsobů dobývání znalostí z textů a z webu.. Tématický celek je rozdělen do těchto dílčích témat: 1. Dobývání znalostí z textů 2. Dobývání znalostí z webu 2. dílčí téma: Dobývání znalostí z textů K prvnímu dílčímu tématu si přečtěte příslušné kapitoly v: TFIDF, booleovský model, vektorový model, přesnost a úplnost rozdíl mezi vyhledáváním informací a extrakcí informací způsoby reprezentování textových dokumentů pro úlohy dobývání znalostí způsoby měření podobnosti dokumentů 2. dílčí téma: Dobývání znalostí z webu K druhému dílčímu tématu si přečtěte příslušné kapitoly v: 7

8 web content mining, web structure mining, web usage mining, kolaborativní filtrování, rozcestník (hub) a autorita, web server log rozdíl mezi vyhledáváním a meta-vyhledáváním 8

Úvodem Dříve les než stromy 3 Operace s maticemi

Úvodem Dříve les než stromy 3 Operace s maticemi Obsah 1 Úvodem 13 2 Dříve les než stromy 17 2.1 Nejednoznačnost terminologie 17 2.2 Volba metody analýzy dat 23 2.3 Přehled vybraných vícerozměrných metod 25 2.3.1 Metoda hlavních komponent 26 2.3.2 Faktorová

Více

Dobývání znalostí z webu web mining

Dobývání znalostí z webu web mining Dobývání znalostí z webu web mining Web Mining is is the application of data mining techniques to discover patterns from the Web (Wikipedia) Tři oblasti: Web content mining (web jako kolekce dokumentů)

Více

Dobývání a vizualizace znalostí

Dobývání a vizualizace znalostí Dobývání a vizualizace znalostí Olga Štěpánková et al. 1 Osnova předmětu 1. Dobývání znalostí - popis a metodika procesu a objasnění základních pojmů 2. Nástroje pro modelování klasifikovaných dat a jejich

Více

IBM SPSS Modeler Professional

IBM SPSS Modeler Professional IBM SPSS Modeler Professional 16 IBM SPSS Software IBM SPSS Modeler Professional Včasné rozhodnutí díky přesným informacím Metodami data miningu získáte detailní přehled o svém současném stavu i jasnější

Více

kapitola 2 Datové sklady, OLAP

kapitola 2 Datové sklady, OLAP Tomáš Burger, burger@fit.vutbr.cz kapitola 2 Datové sklady, OLAP Získávání znalostí z databází IT-DR-3 / ZZD Co je to datový sklad A data warehouse is a subjectoriented, integrated, time-variant and nonvolatile

Více

Uživatelská podpora v prostředí WWW

Uživatelská podpora v prostředí WWW Uživatelská podpora v prostředí WWW Jiří Jelínek Katedra managementu informací Fakulta managementu Jindřichův Hradec Vysoká škola ekonomická Praha Úvod WWW obsáhlost obsahová i formátová pestrost dokumenty,

Více

Získávání znalostí z databází. Alois Kužela

Získávání znalostí z databází. Alois Kužela Získávání znalostí z databází Alois Kužela Obsah související pojmy datové sklady, získávání znalostí asocianí pravidla 2/37 Úvod získávání znalostí z dat, dolování (z) dat, data mining proces netriviálního

Více

NÁSTROJE BUSINESS INTELLIGENCE

NÁSTROJE BUSINESS INTELLIGENCE NÁSTROJE BUSINESS INTELLIGENCE Milena Tvrdíková VŠB Technická univerzita Ostrava, Ekonomická fakulta, Katedra informatiky v ekonomice, Sokolská 33, 701021 Ostrava1, ČR, milena.tvrdikova@vsb.cz Abstrakt

Více

Modely vyhledávání informací 4 podle technologie. 1) Booleovský model. George Boole 1815 1864. Aplikace booleovské logiky

Modely vyhledávání informací 4 podle technologie. 1) Booleovský model. George Boole 1815 1864. Aplikace booleovské logiky Modely vyhledávání informací 4 podle technologie 1) Booleovský model 1) booleovský 2) vektorový 3) strukturní 4) pravděpodobnostní a další 1 dokumenty a dotazy jsou reprezentovány množinou indexových termů

Více

Dobývání znalostí. Doc. RNDr. Iveta Mrázová, CSc. Katedra teoretické informatiky Matematicko-fyzikální fakulta Univerzity Karlovy v Praze

Dobývání znalostí. Doc. RNDr. Iveta Mrázová, CSc. Katedra teoretické informatiky Matematicko-fyzikální fakulta Univerzity Karlovy v Praze Dobývání znalostí Doc. RNDr. Iveta Mrázová, CSc. Katedra teoretické informatiky Matematicko-fyzikální fakulta Univerzity Karlovy v Praze Dobývání znalostí Rozhodovací stromy Doc. RNDr. Iveta Mrázová, CSc.

Více

Trendy v IS/ICT přístupy k návrhu multidimenzionální modelování

Trendy v IS/ICT přístupy k návrhu multidimenzionální modelování Trendy v IS/ICT přístupy k návrhu multidimenzionální modelování Aplikace IS/ICT BI SCM e-business ERP ERP CRM II e-business Aplikace pro podporu základních řídících a administrativních operací 1 Informační

Více

Novinky SQL Serveru 2005 v oblasti Business Intelligence

Novinky SQL Serveru 2005 v oblasti Business Intelligence Novinky SQL Serveru 2005 v oblasti Business Intelligence Seminární práce na předmět Business Intelligence (4IT435) Vypracoval Borek Bernard, leden 2006 1 Abstrakt Microsoft SQL Server 2005 je po mnoha

Více

IDENTIFIKACE AUTOMATICKÝCH PŘÍSTUPŮ INTERNETOVÝCH OBCHODŮ S VYUŽÍTÍM METOD WEB USAGE MININGU

IDENTIFIKACE AUTOMATICKÝCH PŘÍSTUPŮ INTERNETOVÝCH OBCHODŮ S VYUŽÍTÍM METOD WEB USAGE MININGU IDENTIFIKACE AUTOMATICKÝCH PŘÍSTUPŮ INTERNETOVÝCH OBCHODŮ S VYUŽÍTÍM METOD WEB USAGE MININGU Jana Filipová, Karel Michálek, Pavel Petr Ústav systémového inženýrství a informatiky, Fakulta ekonomicko-správní,

Více

Univerzita Hradec Králové Fakulta informatiky a managementu Katedra informačních technologií

Univerzita Hradec Králové Fakulta informatiky a managementu Katedra informačních technologií Univerzita Hradec Králové Fakulta informatiky a managementu Katedra informačních technologií Aplikace strojového učení v oblasti e-komerce Diplomová práce Autor: Pavel Vraný Studijní obor: aplikovaná informatika

Více

Obsah. Úvod do problematiky. Datový sklad. Proces ETL. Analýza OLAP

Obsah. Úvod do problematiky. Datový sklad. Proces ETL. Analýza OLAP Petr Jaša Obsah Úvod do problematiky Data vs. informace Operační vs. analytická databáze Relační vs. multidimenzionální model Datový sklad Důvody pro budování datových skladů Definice, znaky Schéma vazeb

Více

9. Dobývání znalostí v praxi

9. Dobývání znalostí v praxi 9. Dobývání znalostí v praxi 9.1 Příklad úlohy Na závěr knihy se opět vraťme k příkladu zmíněném v první kapitole. Vodítkem při dobývání znalostí nám bude metodologie CRISP-DM. 9.1.1 Porozumění problematice

Více

Ing. Roman Danel, Ph.D. 2010

Ing. Roman Danel, Ph.D. 2010 Datový sklad Ing. Roman Danel, Ph.D. 2010 Co je to datový sklad a kdy se používá? Pojmem datový sklad (anglicky Data Warehouse) označujeme zvláštní typ databáze, určený primárně pro analýzy dat v rámci

Více

DATABÁZOVÉ SYSTÉMY. Metodický list č. 1

DATABÁZOVÉ SYSTÉMY. Metodický list č. 1 Metodický list č. 1 Cíl: Cílem předmětu je získat přehled o možnostech a principech databázového zpracování, získat v tomto směru znalosti potřebné pro informačního manažera. Databázové systémy, databázové

Více

Vícerozměrné metody. PSY117/454 Statistická analýza dat v psychologii Přednáška 12. Schematický úvod

Vícerozměrné metody. PSY117/454 Statistická analýza dat v psychologii Přednáška 12. Schematický úvod PSY117/454 Statistická analýza dat v psychologii Přednáška 12 Vícerozměrné metody Schematický úvod Co je na slově statistika tak divného, že jeho vyslovení tak často způsobuje napjaté ticho? William Kruskal

Více

Využití strojového učení k identifikaci protein-ligand aktivních míst

Využití strojového učení k identifikaci protein-ligand aktivních míst Využití strojového učení k identifikaci protein-ligand aktivních míst David Hoksza, Radoslav Krivák SIRET Research Group Katedra softwarového inženýrství, Matematicko-fyzikální fakulta Karlova Univerzita

Více

Analýza dat Meningoencephalitis

Analýza dat Meningoencephalitis Analýza dat Meningoencephalitis Štěpán Sem 4IZ450 Dobývání znalostí z databází LS 2009/2010 1 Úvod Cílem této práce je řešení vybrané úlohy z oblasti dobývání znalostí (predikce, klasifikace, deskripce)

Více

Vědecký tutoriál, část I. A Tutorial. Vilém Vychodil (Univerzita Palackého v Olomouci)

Vědecký tutoriál, část I. A Tutorial. Vilém Vychodil (Univerzita Palackého v Olomouci) ..! POSSIBILISTIC Laboratoř pro analýzu INFORMATION: a modelování dat Vědecký tutoriál, část I A Tutorial Vilém Vychodil (Univerzita Palackého v Olomouci) George J. Klir State University of New York (SUNY)

Více

Stručný obsah. K2118.indd 3 19.6.2013 9:15:27

Stručný obsah. K2118.indd 3 19.6.2013 9:15:27 Stručný obsah 1. Stručný obsah 3 2. Úvod 11 3. Seznamy a databáze v Excelu 13 4. Excel a externí data 45 5. Vytvoření kontingenční tabulky 65 6. Využití kontingenčních tabulek 81 7. Kontingenční grafy

Více

StatSoft Úvod do neuronových sítí

StatSoft Úvod do neuronových sítí StatSoft Úvod do neuronových sítí Vzhledem k vzrůstající popularitě neuronových sítí jsme se rozhodli Vám je v tomto článku představit a říci si něco o jejich využití. Co si tedy představit pod pojmem

Více

Aplikovaná informatika Možnosti analýzy validity a prezentace získaných dat z informačních databází. ZEMÁNEK, Z. - PLUSKAL, D. - ŠUBRT, Z.

Aplikovaná informatika Možnosti analýzy validity a prezentace získaných dat z informačních databází. ZEMÁNEK, Z. - PLUSKAL, D. - ŠUBRT, Z. Aplikovaná informatika Možnosti analýzy validity a prezentace získaných dat z informačních databází. ZEMÁNEK, Z. - PLUSKAL, D. - ŠUBRT, Z. Operační program Vzdělávání pro konkurenceschopnost Název projektu:

Více

Obr. 1 Plochý soubor s daty

Obr. 1 Plochý soubor s daty 2. Databáze 2.1 Relační databáze V prehistorii databází byla data ukládána v jednom velkém plochém souboru (tzv. flat file) ke kterému se přistupovalo indexsekvenčními metodami (ISAM). Soubor byl indexován

Více

pomocí hodnoty TFIDF (term frequency inverse document frequency) 4

pomocí hodnoty TFIDF (term frequency inverse document frequency) 4 10. Nové směry V drtivé většině se databázemi ze kterých se dobývají znalosti myslí relační databáze (jedna nebo více). U těchto databází se předpokládá vzájemná nezávislost záznamů z hlediska pořadí v

Více

DOBÝVÁNÍ ZNALOSTÍ Z DATABÁZÍ PŘÍKLADY APLIKACÍ V KARDIOLOGICKÝCH DATECH Jan Rauch

DOBÝVÁNÍ ZNALOSTÍ Z DATABÁZÍ PŘÍKLADY APLIKACÍ V KARDIOLOGICKÝCH DATECH Jan Rauch DOBÝVÁNÍ ZNALOSTÍ Z DATABÁZÍ PŘÍKLADY APLIKACÍ V KARDIOLOGICKÝCH DATECH Jan Rauch Anotace: Příspěvek obsahuje základní informace o dobývání znalostí jakožto důležité disciplíně informatiky a ukazuje příklady

Více

4ft-Miner pro začátečníky Získávání znalostí z databází

4ft-Miner pro začátečníky Získávání znalostí z databází 4ft-Miner pro začátečníky Získávání znalostí z databází Dobývání znalostí z databází (DZD) Knowledge Discovery in (from) Databases (KDD) Data Mining (DM) Materiál pro posluchače kurzů IZI211 Metody zpracování

Více

Možnosti modelování lesní vegetační stupňovitosti pomocí geoinformačních analýz

Možnosti modelování lesní vegetační stupňovitosti pomocí geoinformačních analýz 25. 10. 2012, Praha Ing. Petr Vahalík Ústav geoinformačních technologií Možnosti modelování lesní vegetační stupňovitosti pomocí geoinformačních analýz 21. konference GIS Esri v ČR Lesní vegetační stupně

Více

Základy business intelligence. Jaroslav Šmarda

Základy business intelligence. Jaroslav Šmarda Základy business intelligence Jaroslav Šmarda Základy business intelligence Business intelligence Datový sklad On-line Analytical Processing (OLAP) Kontingenční tabulky v MS Excelu jako příklad OLAP Dolování

Více

Big Data a oficiální statistika. Unicorn College Open 24. dubna 2015 Doc. Ing. Marie Bohatá, CSc.

Big Data a oficiální statistika. Unicorn College Open 24. dubna 2015 Doc. Ing. Marie Bohatá, CSc. Big Data a oficiální statistika Unicorn College Open 24. dubna 2015 Doc. Ing. Marie Bohatá, CSc. Obsah příspěvku Charakteristiky Big Data Výzvy a úskalí z perspektivy statistiky Výzvy z perspektivy computing

Více

Vybrané partie z obrácených úloh. obrácených úloh (MG452P73)

Vybrané partie z obrácených úloh. obrácených úloh (MG452P73) Vybrané partie z obrácených úloh obrácených úloh (MG452P73) Obsah přednášky Klasifikace obrácených úloh a základní pojmy Lineární inverzní problém, prostor parametrů a dat Gaussovy transformace, normální

Více

Zdroje informací v organizaci IS/ICT BI v rámci IS/ICT historie architektura OLTP x DW ukládání dat

Zdroje informací v organizaci IS/ICT BI v rámci IS/ICT historie architektura OLTP x DW ukládání dat Zdroje informací v organizaci IS/ICT BI v rámci IS/ICT historie architektura OLTP x DW ukládání dat Vladimíra Zádová BI CRM ERP SCM Aplikace pro podporu základních řídících a administrativních operací

Více

Profilová část maturitní zkoušky 2013/2014

Profilová část maturitní zkoušky 2013/2014 Střední průmyslová škola, Přerov, Havlíčkova 2 751 52 Přerov Profilová část maturitní zkoušky 2013/2014 TEMATICKÉ OKRUHY A HODNOTÍCÍ KRITÉRIA Studijní obor: 78-42-M/01 Technické lyceum Předmět: TECHNIKA

Více

Business Intelligence a datové sklady

Business Intelligence a datové sklady Business Intelligence a datové sklady Ing Jan Přichystal, PhD Mendelova univerzita v Brně 2 prosince 2014 Ing Jan Přichystal, PhD Úvod Intenzivní nasazení informačních technologií způsobuje hromadění obrovské

Více

Databáze Bc. Veronika Tomsová

Databáze Bc. Veronika Tomsová Databáze Bc. Veronika Tomsová Databázové schéma Mapování konceptuálního modelu do (relačního) databázového schématu. 2/21 Fyzické ik schéma databáze Určuje č jakým způsobem ů jsou data v databázi ukládána

Více

2. přednáška z předmětu GIS1 Data a datové modely

2. přednáška z předmětu GIS1 Data a datové modely 2. přednáška z předmětu GIS1 Data a datové modely Vyučující: Ing. Jan Pacina, Ph.D. e-mail: jan.pacina@ujep.cz Pro přednášku byly použity texty a obrázky z www.gis.zcu.cz Předmět KMA/UGI, autor Ing. K.

Více

RÁMCOVÝ VZDĚLÁVACÍ PROGRAM PRO ZÍSKÁNÍ SPECIALIZOVANÉ ZPŮSOBILOSTI. v oboru KLINICKÉ INŽENÝRSTVÍ SE ZAMĚŘENÍM NA ANALÝZU A ZPRACOVÁNÍ BIOSIGNÁLŮ.

RÁMCOVÝ VZDĚLÁVACÍ PROGRAM PRO ZÍSKÁNÍ SPECIALIZOVANÉ ZPŮSOBILOSTI. v oboru KLINICKÉ INŽENÝRSTVÍ SE ZAMĚŘENÍM NA ANALÝZU A ZPRACOVÁNÍ BIOSIGNÁLŮ. RÁMCOVÝ VZDĚLÁVACÍ PROGRAM PRO ZÍSKÁNÍ SPECIALIZOVANÉ ZPŮSOBILOSTI v oboru KLINICKÉ INŽENÝRSTVÍ SE ZAMĚŘENÍM NA ANALÝZU A ZPRACOVÁNÍ BIOSIGNÁLŮ pro BIOMEDICÍNSKÉ INŽENÝRY 1. Cíl specializačního vzdělávání

Více

Processing of EEG Data Marek Penhaker Konference IT4Innovations, Ostrava 21. 10. 2013

Processing of EEG Data Marek Penhaker Konference IT4Innovations, Ostrava 21. 10. 2013 Processing of EEG Data Marek Penhaker Konference IT4Innovations, Ostrava 21. 10. 2013 Podstata biologických signálů Signál nosič informace Biosignál signál, který je generovaný živým organismem Rozdělení

Více

Distanční opora předmětu: Databázové systémy Tématický blok č. 3: OLAP, operátory CUBE a ROLLUP Autor: RNDr. Jan Lánský, Ph.D.

Distanční opora předmětu: Databázové systémy Tématický blok č. 3: OLAP, operátory CUBE a ROLLUP Autor: RNDr. Jan Lánský, Ph.D. Distanční opora předmětu: Databázové systémy Tématický blok č. 3: OLAP, operátory CUBE a ROLLUP Autor: RNDr. Jan Lánský, Ph.D. Obsah kapitoly 1 OLTP a OLAP 1.1 Datový sklad 1.2 Datová kostka 2 OLAP dotazy

Více

StatSoft Úvod do data miningu

StatSoft Úvod do data miningu StatSoft Úvod do data miningu Tento článek je úvodním povídáním o data miningu, jeho vzniku, účelu a využití. Historie data miningu Rozvoj počítačů, výpočetní techniky a zavedení elektronického sběru dat

Více

5.1 Rozhodovací stromy

5.1 Rozhodovací stromy 5.1 Rozhodovací stromy 5.1.1 Základní algoritmus Způsob reprezentování znalostí v podobě rozhodovacích stromů je dobře znám z řady oblastí. Vzpomeňme jen nejrůznějších klíčů k určování různých živočichů

Více

Lineární diskriminační funkce. Perceptronový algoritmus.

Lineární diskriminační funkce. Perceptronový algoritmus. Lineární. Perceptronový algoritmus. Petr Pošík Czech Technical University in Prague Faculty of Electrical Engineering Dept. of Cybernetics P. Pošík c 2012 Artificial Intelligence 1 / 12 Binární klasifikace

Více

Dotazovací jazyky I. Datová krychle. Soběslav Benda

Dotazovací jazyky I. Datová krychle. Soběslav Benda Dotazovací jazyky I Datová krychle Soběslav Benda Obsah Úvod do problematiky Varianty přístupu uživatelů ke zdrojům dat OLTP vs. OLAP Datová analýza Motivace Vytvoření křížové tabulky Datová krychle Teorie

Více

EXTRAKCE STRUKTUROVANÝCH DAT O PRODUKTOVÝCH A PRACOVNÍCH NABÍDKÁCH POMOCÍ EXTRAKČNÍCH ONTOLOGIÍ ALEŠ POUZAR

EXTRAKCE STRUKTUROVANÝCH DAT O PRODUKTOVÝCH A PRACOVNÍCH NABÍDKÁCH POMOCÍ EXTRAKČNÍCH ONTOLOGIÍ ALEŠ POUZAR EXTRAKCE STRUKTUROVANÝCH DAT O PRODUKTOVÝCH A PRACOVNÍCH NABÍDKÁCH POMOCÍ EXTRAKČNÍCH ONTOLOGIÍ ALEŠ POUZAR PŘEDMĚT PRÁCE Popis extrakce strukturovaných dat ve vybraných doménách ze semistrukturovaných

Více

11 Analýza hlavních komponet

11 Analýza hlavních komponet 11 Analýza hlavních komponet Tato úloha provádí transformaci měřených dat na menší počet tzv. fiktivních dat tak, aby většina informace obsažená v původních datech zůstala zachována. Jedná se tedy o úlohu

Více

Obr. 1 Biologický neuron

Obr. 1 Biologický neuron 5.4 Neuronové sítě Lidský mozek je složen asi z 10 10 nervových buněk (neuronů) které jsou mezi sebou navzájem propojeny ještě řádově vyšším počtem vazeb [Novák a kol.,1992]. Začněme tedy nejdříve jedním

Více

MODELOVÁNÍ BONITY OBCÍ POMOCÍ KOHONENOVÝCH SAMOORGANIZUJÍCÍCH SE MAP A LVQ NEURONOVÝCH SÍTÍ

MODELOVÁNÍ BONITY OBCÍ POMOCÍ KOHONENOVÝCH SAMOORGANIZUJÍCÍCH SE MAP A LVQ NEURONOVÝCH SÍTÍ MODELOVÁNÍ BONITY OBCÍ POMOCÍ KOHONENOVÝCH SAMOORGANIZUJÍCÍCH SE MAP A LVQ NEURONOVÝCH SÍTÍ Vladimír Olej, Petr Hájek Univerzita Pardubice, Fakulta ekonomicko-správní, informatiky Ústav systémového inženýrství

Více

5 Vícerozměrná data - kontingenční tabulky, testy nezávislosti, regresní analýza

5 Vícerozměrná data - kontingenční tabulky, testy nezávislosti, regresní analýza 5 Vícerozměrná data - kontingenční tabulky, testy nezávislosti, regresní analýza 5.1 Vícerozměrná data a vícerozměrná rozdělení Při zpracování vícerozměrných dat se hledají souvislosti mezi dvěma, případně

Více

Vyhledávání informací v prostředí webu mírný pokrok v mezích zákona

Vyhledávání informací v prostředí webu mírný pokrok v mezích zákona Vyhledávání informací v prostředí webu mírný pokrok v mezích zákona Vilém Sklenák * sklenak@vse.cz 1 Úvod Abstrakt: Nabídka služeb pro vyhledávání informací je v poslední době poměrně stabilizovaná. Rozšiřování

Více

Katedra informatiky FEI VŠ-TUO. Analýza dat do předmětu Metody analýzy dat. Krasobruslaři

Katedra informatiky FEI VŠ-TUO. Analýza dat do předmětu Metody analýzy dat. Krasobruslaři Katedra informatiky FEI VŠ-TUO Analýza dat do předmětu Metody analýzy dat Krasobruslaři Květen 2011 Jan Górecki 1. ZADÁNÍ ANALÝZY 1.1. Popis dat Sportovní klub krasobruslení Karviná za posledních 10 let

Více

T T. Think Together 2012. Martin Závodný THINK TOGETHER. Business Intelligence systémy Business Intelligence systems

T T. Think Together 2012. Martin Závodný THINK TOGETHER. Business Intelligence systémy Business Intelligence systems Česká zemědělská univerzita v Praze Provozně ekonomická fakulta Doktorská vědecká konference 6. února 2012 T T THINK TOGETHER Think Together 2012 Business Intelligence systémy Business Intelligence systems

Více

TECHNOLOGIE FUZZY-BAYESOVSKÉ KLASIFIKACE RASTROVÝCH OBRAZŮ

TECHNOLOGIE FUZZY-BAYESOVSKÉ KLASIFIKACE RASTROVÝCH OBRAZŮ TECHNOLOGIE FUZZY-BAYESOVSKÉ KLASIFIKACE RASTROVÝCH OBRAZŮ ÚVOD Technologie fuzzy-bayesovské klasifikace rastrových obrazů je realizována v rámci webové aplikace Waclass. Tato webová aplikace provádí řízenou

Více

CPM/BI a jeho návaznost na podnikové informační systémy. Martin Závodný

CPM/BI a jeho návaznost na podnikové informační systémy. Martin Závodný CPM/BI a jeho návaznost na podnikové informační systémy Martin Závodný Agenda Význam CPM/BI Aplikace CPM/BI Projekty CPM/BI Kritické body CPM/BI projektů Trendy v oblasti CPM/BI Diskuse Manažerské rozhodování

Více

Kalendář kurzů. Zimní semestr září 2015 - leden 2016. Praha / Bratislava. Statistika a analýza dat Data mining Software IBM SPSS a IBM Cognos

Kalendář kurzů. Zimní semestr září 2015 - leden 2016. Praha / Bratislava. Statistika a analýza dat Data mining Software IBM SPSS a IBM Cognos Kalendář kurzů a analýza dat Software IBM SPSS a IBM Cognos Zimní semestr září 2015 - leden 2016 Praha / Bratislava Vladimíra Kozojedová - manažerka pro kurzy CV Michal Kadlec - analytik, lektor, konzultant

Více

0,7 0,6 0,5 0,4 0,3 0,2 0,1

0,7 0,6 0,5 0,4 0,3 0,2 0,1 VÝVOJ PROSTŘEDKŮ VÝPOČTOVÉ INTELIGENCE PRO MONITOROVÁNÍ A ŘÍZENÍ OCELÁŘSKÝCH VÝROBNÍCH PROCESŮ Miroslav Pokorný¹ Václav Kafka² Zdeněk Bůžek³ 1) VŠB TU Ostrava, FEI, 17. listopadu 15, 708 33 Ostrava, ČR,

Více

Rozhodovací pravidla

Rozhodovací pravidla Rozhodovací pravidla Úloha klasifikace příkladů do tříd. pravidlo Ant C, kde Ant je konjunkce hodnot atributů a C je cílový atribut A. Algoritmus pokrývání množin metoda separate and conquer (odděl a panuj)

Více

4IT218 Databáze. 4IT218 Databáze

4IT218 Databáze. 4IT218 Databáze 4IT218 Databáze Osmá přednáška Dušan Chlapek (katedra informačních technologií, VŠE Praha) 4IT218 Databáze Osmá přednáška Normalizace dat - dokončení Transakce v databázovém zpracování Program přednášek

Více

Fenomén Big Data Pohled technický

Fenomén Big Data Pohled technický Fenomén Big Data Pohled technický Diribet / Q-DAS Konference Homo Digitalis, 2014-10-09 Motivace Běžná situace při rozhodování: Mám více dat, než jsem schopen zpracovat Mám pocit nedostatku informací Více

Více

Management informačních systémů. Název Information systems management Způsob ukončení * přednášek týdně

Management informačních systémů. Název Information systems management Způsob ukončení * přednášek týdně Identifikační karta modulu v. 4 Kód modulu Typ modulu profilující Jazyk výuky čeština v jazyce výuky Management informačních systémů česky Management informačních systémů anglicky Information systems management

Více

NÁVRH A REALIZACE TRADING STRATEGIÍ NA BÁZI STROJOVÉHO UČENÍ S POMOCÍ MATLABU

NÁVRH A REALIZACE TRADING STRATEGIÍ NA BÁZI STROJOVÉHO UČENÍ S POMOCÍ MATLABU NÁVRH A REALIZACE TRADING STRATEGIÍ NA BÁZI STROJOVÉHO UČENÍ S POMOCÍ MATLABU RNDr. Miroslav Pavelka, PhD m.pavelka@sh.cvut.cz Ing. Jan Hovad jan@hovad.cz OBSAH Obchodování a strojové učení Specifika prediktivního

Více

13 Barvy a úpravy rastrového

13 Barvy a úpravy rastrového 13 Barvy a úpravy rastrového Studijní cíl Tento blok je věnován základním metodám pro úpravu rastrového obrazu, jako je např. otočení, horizontální a vertikální překlopení. Dále budo vysvětleny různé metody

Více

Systémy pro podporu rozhodování. Modelování a analýza

Systémy pro podporu rozhodování. Modelování a analýza Systémy pro podporu rozhodování Modelování a analýza 1 Připomenutí obsahu minulé přednášky Datové sklady, přístup, analýza a vizualizace Povaha a zdroje dat (data, informace, znalosti a interní, externí,

Více

ZPRACOVÁNÍ A VYUŽITÍ DAT PŘI ŘÍZENÍ PROCESU PLYNULÉHO ODLÉVÁNÍ OCELI

ZPRACOVÁNÍ A VYUŽITÍ DAT PŘI ŘÍZENÍ PROCESU PLYNULÉHO ODLÉVÁNÍ OCELI ZPRACOVÁNÍ A VYUŽITÍ DAT PŘI ŘÍZENÍ PROCESU PLYNULÉHO ODLÉVÁNÍ OCELI Zdeněk FRANĚK 1), Miloš MASARIK 2), René PYSZKO 3), Miroslav PROKEL 4) 1) Slezská univerzita, Obchodně podnikatelská fakulta, Univerzitní

Více

MODELOVÁNÍ DAT V INFORMAČNÍCH SYSTÉMECH. Jindřich Kaluža Ludmila Kalužová

MODELOVÁNÍ DAT V INFORMAČNÍCH SYSTÉMECH. Jindřich Kaluža Ludmila Kalužová MODELOVÁNÍ DAT V INFORMAČNÍCH SYSTÉMECH Jindřich Kaluža Ludmila Kalužová Recenzenti: prof. Ing. Milan Turčáni, CSc. prof. Ing. Ivan Vrana, DrSc. Tato kniha vznikla za finanční podpory Studentské grantové

Více

KLASIFIKACE V PROUDU DAT POMOCÍ SOUBORU KLASIFIKÁTORŮ

KLASIFIKACE V PROUDU DAT POMOCÍ SOUBORU KLASIFIKÁTORŮ VYSOKÉ UČENÍ TECHNICKÉ V BRNĚ BRNO UNIVERSITY OF TECHNOLOGY FAKULTA INFORMAČNÍCH TECHNOLOGIÍ ÚSTAV INFORMAČNÍCH SYSTÉMŮ FACULTY OF INFORMATION TECHNOLOGY DEPARTMENT OF INFORMATION SYSTEMS KLASIFIKACE V

Více

MUDr. Miloš Suchý, Bc. Petr Suchý, Konference QUIP, Praha 12.2.2008. Měření výkonnosti, zkušenosti ze zdravotnictví a sociální péče

MUDr. Miloš Suchý, Bc. Petr Suchý, Konference QUIP, Praha 12.2.2008. Měření výkonnosti, zkušenosti ze zdravotnictví a sociální péče MUDr. Miloš Suchý, Bc. Petr Suchý, Konference QUIP, Praha 12.2.2008 Měření výkonnosti, zkušenosti ze zdravotnictví a sociální péče Měření výkonnosti Slovo výkonnost je českou obdobou slova performance

Více

TECHNICKÁ DIAGNOSTIKA

TECHNICKÁ DIAGNOSTIKA . Marcel Kreidl, Radislav Šmíd TECHNICKÁ DIAGNOSTIKA SENZORY - METODY - ANALÝZA SIGNÁLU Praha 2006 tanovení Ignostika,ostickou lespokojí :i závady 'oduvodu 1,v knize :h mfjtod obsahují 'stických 'tfedních

Více

Shluková analýza vícerozměrných dat v programu R

Shluková analýza vícerozměrných dat v programu R Shluková analýza vícerozměrných dat v programu R - příklad použití metod PAM, CLARA a fuzzy shlukové analýzy http://data.tulipany.cz Úvodní poznámky a popis dat Pro analýzu vícerozměrných dat existují

Více

Pravidla a podmínky k vydání osvědčení o způsobilosti vykonávat aktuárskou činnost

Pravidla a podmínky k vydání osvědčení o způsobilosti vykonávat aktuárskou činnost Pravidla a podmínky k vydání osvědčení o způsobilosti vykonávat aktuárskou činnost (dále jen společnost) stanoví k vydání osvědčení o způsobilosti vykonávat aktuárskou činnost (dále jen osvědčení) následující

Více

NADSTAVBOVÝ MODUL MOHSA V1

NADSTAVBOVÝ MODUL MOHSA V1 NADSTAVBOVÝ MODUL MOHSA V1 Nadstavbový modul pro hierarchické shlukování se jmenuje Mod_Sh_Hier (MOHSA V1) je součástí souboru Shluk_Hier.xls. Tento soubor je přístupný na http://jonasova.upce.cz, a je

Více

ADVANTA / Dokumentace: Přehled funkčních modulů

ADVANTA / Dokumentace: Přehled funkčních modulů ADVANTA / Dokumentace: Přehled funkčních modulů Primárním účelem nástroje ADVANTA je pokrýt aktuální potřeby správy projektového portfolia. Jak postupně roste úroveň akceptace a integrace do prostředí

Více

Databázové a informační systémy Jana Šarmanová

Databázové a informační systémy Jana Šarmanová Databázové a informační systémy Jana Šarmanová Obsah Úloha evidence údajů, způsoby evidování Databázové technologie datové modely, dotazovací jazyky. Informační systémy Datové sklady Metody analýzy dat

Více

Sdílení a poskytování dat KN. Jiří Poláček

Sdílení a poskytování dat KN. Jiří Poláček Sdílení a poskytování dat KN Jiří Poláček Přehled služeb Datové služby Výměnný formát (SPI, SGI) Skenované katastrální mapy Aplikace a webové služby Dálkový přístup do KN (včetně webových služeb) Nahlížení

Více

Database engine (databázový stroj, databázový motor, databázové jádro) Systém řízení báze dat SŘBD. Typy SŘBD podle způsobu práce s daty

Database engine (databázový stroj, databázový motor, databázové jádro) Systém řízení báze dat SŘBD. Typy SŘBD podle způsobu práce s daty Systém řízení báze dat SŘBD programový systém umožňující vytvoření, údržbu a použití báze dat databáze program Database engine (databázový stroj, databázový motor, databázové jádro) funkce: přenos (načítání)

Více

GIS jako důležitá součást BI. Jan Broulík, Petr Panec ARCDATA PRAHA, s.r.o.

GIS jako důležitá součást BI. Jan Broulík, Petr Panec ARCDATA PRAHA, s.r.o. GIS jako důležitá součást BI Jan Broulík, Petr Panec ARCDATA PRAHA, s.r.o. ARCDATA PRAHA, s.r.o. THE GEOGRAPHIC ADVANTAGE Motto Sladit operační taktiku s organizační strategií Strategie bez taktiky je

Více

Robust 2014, 19. - 24. ledna 2014, Jetřichovice

Robust 2014, 19. - 24. ledna 2014, Jetřichovice K. Hron 1 C. Mert 2 P. Filzmoser 2 1 Katedra matematické analýzy a aplikací matematiky Přírodovědecká fakulta, Univerzita Palackého, Olomouc 2 Department of Statistics and Probability Theory Vienna University

Více

Modelování a návrh datových skladů

Modelování a návrh datových skladů Modelování a návrh datových skladů Doc. Ing. B. Miniberger, CSc. BIVŠ Obsah 1. Přednáška I. Základy modelování datových skladů (DW) 2. Přednáška II. ETL procesy III. Data Mining IV. Kvalita dat a BI Literatura

Více

Architektura - struktura sítě výkonných prvků, jejich vzájemné propojení.

Architektura - struktura sítě výkonných prvků, jejich vzájemné propojení. Základní pojmy z oblasti neuronových sítí Zde je uveden přehled některých základních pojmů z oblasti neuronových sítí. Tento přehled usnadní studium a pochopení předmětu. ADALINE - klasická umělá neuronová

Více

Kartogramy. Přednáška z předmětu Tematická kartografie (KMA/TKA) Otakar Čerba Západočeská univerzita

Kartogramy. Přednáška z předmětu Tematická kartografie (KMA/TKA) Otakar Čerba Západočeská univerzita Kartogramy Přednáška z předmětu Tematická kartografie (KMA/TKA) Otakar Čerba Západočeská univerzita Datum vytvoření dokumentu: 20. 9. 2004 Datum poslední aktualizace: 17. 10. 2011 Definice Kartogram je

Více

VYSOKÁ ŠKOLA EKONOMICKÁ V PRAZE FAKULTA INFORMATIKY A STATISTIKY

VYSOKÁ ŠKOLA EKONOMICKÁ V PRAZE FAKULTA INFORMATIKY A STATISTIKY VYSOKÁ ŠKOLA EKONOMICKÁ V PRAZE FAKULTA INFORMATIKY A STATISTIKY Diplomová práce Systém předzpracování dat pro dobývání znalostí z databází Vypracovala: Hana Kotinová Vedoucí práce: prof. Ing. Petr Berka,

Více

Přehled vhodných metod georeferencování starých map

Přehled vhodných metod georeferencování starých map Přehled vhodných metod georeferencování starých map ČVUT v Praze, katedra geomatiky 12. 3. 2015 Praha Georeferencování historická mapa vs. stará mapa georeferencování umístění obrazu mapy do referenčního

Více

PowerOPTI Řízení účinnosti tepelného cyklu

PowerOPTI Řízení účinnosti tepelného cyklu PowerOPTI Řízení účinnosti tepelného cyklu VIZE Zvýšit konkurenceschopnost provozovatelů elektráren a tepláren. Základní funkce: Spolehlivé hodnocení a řízení účinnosti tepelného cyklu, včasná diagnostika

Více

MATEMATIKA A 3 Metodický list č. 1

MATEMATIKA A 3 Metodický list č. 1 Metodický list č. 1 Název tématického celku: Úvod do problematiky diskrétní matematiky Cíl: Cílem tohoto tématického celku je vymezení oblasti diskrétní matematiky a příprava na další výklad kurzu. Jedná

Více

4.9.70. Logika a studijní předpoklady

4.9.70. Logika a studijní předpoklady 4.9.70. Logika a studijní předpoklady Seminář je jednoletý, je určen pro studenty posledního ročníku čtyřletého studia, osmiletého studia a sportovní přípravy. Cílem přípravy je orientace ve formální logice,

Více

23. Splnitelnost a platnost výrokových formulí, dedukce ve výrokové logice

23. Splnitelnost a platnost výrokových formulí, dedukce ve výrokové logice Okruhy otázek k přijímacím zkouškám Studijní obor: Informační studia se zaměřením na knihovnictví A. TEORETICKÉ A METODOLOGICKÉ ZÁKLADY INFORMAČNÍ VĚDY 1. Citační etika, zásady citování a porušování citační

Více

Ukládání a vyhledávání XML dat

Ukládání a vyhledávání XML dat XML teorie a praxe značkovacích jazyků (4IZ238) Jirka Kosek Poslední modifikace: $Date: 2014/12/04 19:41:24 $ Obsah Ukládání XML dokumentů... 3 Ukládání XML do souborů... 4 Nativní XML databáze... 5 Ukládání

Více

Laserové skenování (1)

Laserové skenování (1) (1) Prohloubení nabídky dalšího vzdělávání v oblasti zeměměřictví a katastru nemovitostí ve Středočeském kraji CZ.1.07/3.2.11/03.0115 Projekt je finančně podpořen Evropským sociálním fondem astátním rozpočtem

Více

Geografické informační systémy GIS

Geografické informační systémy GIS Geografické informační systémy GIS Prohloubení nabídky dalšího vzdělávání v oblasti zeměměřictví a katastru nemovitostí ve Středočeském kraji CZ.1.07/3.2.11/03.0115 Projekt je finančně podpořen Evropským

Více

Základní principy, na kterých projekt DRG restart plánuje vybudovat systém optimalizace úhrad lůžkové péče, jsou následující:

Základní principy, na kterých projekt DRG restart plánuje vybudovat systém optimalizace úhrad lůžkové péče, jsou následující: Metodická optimalizace a zefektivnění systému úhrad nemocniční péče v ČR Projekt DRG restart Pilotní verze projektové dokumentace vznikajícího projektu. Dokument bude průběžně doplňován, konečná verze

Více

FOURIEROVA ANAL YZA 2D TER ENN ICH DAT Karel Segeth

FOURIEROVA ANAL YZA 2D TER ENN ICH DAT Karel Segeth FOURIEROVA ANALÝZA 2D TERÉNNÍCH DAT Karel Segeth Motto: The faster the computer, the more important the speed of algorithms. přírodní jev fyzikální model matematický model numerický model řešení numerického

Více

Modelování na burze cenných papírů metodami umělé inteligence

Modelování na burze cenných papírů metodami umělé inteligence Univerzita Pardubice Fakulta ekonomicko-správní Ústav systémového inženýrství a informatiky Modelování na burze cenných papírů metodami umělé inteligence Bc. Vojtěch Zákoutský Diplomová práce 2013 Prohlášení

Více

Získávání obrázků. Úpravy fotografií. ZPS 10 Home (Office) ZPS 10 Xpress. ZPS 10 Professional ZPS 10. Classic

Získávání obrázků. Úpravy fotografií. ZPS 10 Home (Office) ZPS 10 Xpress. ZPS 10 Professional ZPS 10. Classic Získávání obrázků získávání obrázků z fotoaparátu získávání obrázků skenováním stáhnutí obrázků ze schránky snímání obrazovky stahování obrázků z webu získat z Adobe DNG získat z Canon RAW Úpravy fotografií

Více

Geoinformační technologie

Geoinformační technologie Geoinformační technologie Geografické informační systémy (GIS) Výukový materiál l pro gymnázia a ostatní středn ední školy Gymnázium, Praha 6, Nad Alejí 1952 Vytvořeno v rámci projektu SIPVZ 1357P2006

Více

Základy vytěžování dat

Základy vytěžování dat Základy vytěžování dat předmět A7Bb36vyd Vytěžování dat Filip Železný, Miroslav Čepek, Radomír Černoch, Jan Hrdlička katedra kybernetiky a katedra počítačů ČVUT v Praze, FEL Evropský sociální fond Praha

Více

Teorie řízení a regulace (Vysoký)

Teorie řízení a regulace (Vysoký) Teorie systémů 1. Tvrdé (hard) a měkké (soft) systémy, jejich charakterizace, příklady a aplikace; definice systému. 2. Identifikace systému. Vztahy: originál / model / systém; relace systém okolí; přístupy

Více

K metodám převodu souřadnic mezi ETRS 89 a S-JTSK na území ČR

K metodám převodu souřadnic mezi ETRS 89 a S-JTSK na území ČR K metodám převodu souřadnic mezi ETRS 89 a S-JTSK na území ČR Vlastimil Kratochvíl * Příspěvek obsahuje popis vlastností některých postupů, využitelných pro transformaci souřadnic mezi geodetickými systémy

Více

Operační program Praha Adaptabilita 17.1 Podpora rozvoje znalostní ekonomiky

Operační program Praha Adaptabilita 17.1 Podpora rozvoje znalostní ekonomiky Operační program Praha Adaptabilita 17.1 Podpora rozvoje znalostní ekonomiky Program dalšího vzdělávání pro zaměstnance ČGS ohrožené na trhu práce Číslo úkolu ČGS: 661030 RNDr. Jan Čurda člen Týmu pro

Více