Příspěvky

Martina Trnková: Analýza nestrukturovaných dat

Obrázek
Ana lýza nestrukturovaných dat za účelem najití zajímavého patternu Cílem práce je analýza dat z jazykového korpusu. Jako  dataset je použit Santa Barbara Corpus of Spoken American English. Korpus obsahuje cca 250.000 slov ve formě přepisu nahrávek převážně rozhovorů (ale také telefonních hovorů, pracovních meetingů, vyučovacích hodin atd.). Tyto rozhovory jsou náhodně vybrané napříč různými sociálními vrstvami v celé USA. V korpusu jsou tedy zastoupeny široké vzorky respondentů různých ras, náboženství, věku, zaměstnání, vzdělání a etnicko-sociálního prostředí. Dataset byl tedy vybrán zejména pro jeho rozmanitost a široký záběr, díky jemuž ho považuji za vypovídající vzorek současné mluvené americké angličtiny, vhodný k textové analýze. Účelem práce je najití zajímavého patternu, který by mohl sloužit k efektivnímu rozšíření slovní zásoby anglického jazyka. Na základě frekvenční analýzy budou extrahována nejvíce a nejméně používaná slovesa ...

Dana Bajeneza: Analýza chování zákazníka na webových stránkách iLikeSharePoint

Obrázek
                                                                                      V závěrečném projektu IV. běhu digitální akademie lite Brno 2017 jsem analyzovala data poskytnutá firmou iLikeSharePoint o chování jejich skutečných i potencionálních klientů v časovém období 1. 9. 2015 – 1. 9. 2017. Data z firemního účtu Google Analytics mi poskytla mentorka. Analýza je zaměřená na vyhodnocení návštěvnosti stránek a segmentaci návštěvníků s grafickými výstupy v Power BI k jednotlivým kritériím. Práce může být využita jako zpětná vazba pro firmu za sledované období. Zároveň je možné použít úvod práce jako pomůcku při vytváření prvních grafů v Power BI. Práce na projektu mi umožnila využít své dosavadní znalosti Excelu a hlavně zdokonalit se a získat nové poznatky...