Cursusbeschrijving
Nu programmeertalen steeds vaker worden gebruikt bij data-analyse, is dit het moment om ze grondig onder de knie te krijgen. Deze cursus richt zich op het begrijpen van statistische modellen en het analyseren van de resultaten, terwijl je leert werken met R. Naast een introductie van de software voor beginners, worden basis- en meer geavanceerde statistische methoden behandeld binnen het overkoepelende kader van het gegeneraliseerde lineaire model.
De eerste week staat in het teken van het leren omgaan met R en regressieanalyse. We beginnen met het inlezen van gegevens in R, beschrijvende statistiek en de visuele weergave van gegevens, wat de eerste stap is voor statistische analyses. Vervolgens introduceren we het lineaire regressiemodel, een veelgebruikt model met twee hoofddoelen: het modelleren van relaties tussen de variabelen en het voorspellen van toekomstige waarnemingen.
In de tweede week breiden we het lineaire model uit naar het gegeneraliseerde lineaire kader, om discrete afhankelijke variabelen te analyseren. De logit-regressie waarmee je gaat werken, blijkt nuttig te zijn voor het begrijpen van de rest van de cursus: classificatie. Je leert hoe je de dimensies van gegevens kunt verminderen met behulp van hoofdcomponentenanalyse en clusteranalyse, en hoe je de aangeleerde methoden kunt gebruiken voor voorspellingen.
Elke dag bestaat uit korte colleges met voorbeelden en oefeningen waarin je het geleerde direct in de praktijk brengt. De nadruk in de oefeningen en opdrachten ligt op het programmeren in R en op het toepassen en interpreteren van gegeneraliseerde lineaire regressiemodellen. Na de les word je geacht aan een opdracht te werken waarin je de kennis die je tijdens de oefeningen hebt opgedaan, integreert. Deze opdracht wordt beoordeeld.
Download de syllabus van de cursus.
Lees hieronder verder voor meer informatie