Detekce kategorie obsahu webové stránky prostřednictvím metod strojového učení.
Loading...
Date
Authors
Dohnal, Patrik
Journal Title
Journal ISSN
Volume Title
Publisher
Jihočeská univerzita
Abstract
Tato bakalářská práce se zabývá návrhem systému pro klasifikaci obsahu webových stránek včetně následné implementace v programovacím jazyce Python. K samotné klasifikaci jsou využívány modely strojového učení jako jsou Naivní Bayesův klasifikátor, K-Nejbližších sousedů a Support Vector Machines. V rámci celého procesu se rovněž předpokládá tvorba vlastní množiny dat, na kterých jsou tyto modely trénovány a následně testovány. Součástí práce je i podrobná rešerše použitých metod.
Description
Keywords
Strojové učení, Text mining, Klasifikace, Dataset, Webové stránky, Předzpracování dat, Zakódování textu, TF-IDF, Support Vector Machines, Naivní Bayesuv klasifikátor, K-Nejbližší sousedů, Machine learning, Text Mining, Classification, Dataset, Webpages, Data preprocessing, Word embedding, TF-IDF, Support Vector Machines, Naive Bayes classifier, K-Nearest neighbors
