BUSINESS
INTELLIGENCE
EXAMENFOCUS
Examenfocus
UGent - Handelswetenschappen
Instelling Opleiding
UGent - FEB Handelswetenschappen
Examenformat Bronnen
20 MC-vragen, schriftelijk, 2 uur Slides, examens 2021-2025 & 12.956
Discord-berichten
Wat staat in dit document?
Dit document bundelt vijf jaar aan examenvragen (2021 tot en met 2025), uitgewerkte
modelantwoorden, terugkerende patronen en concrete studietips voor het Business Intelligence-
examen aan UGent. De inhoud is opgebouwd vanuit de slides, samenvattingen, transcripts na elke
zitting & 12.956 uitgelezen Discord-berichten.
Kleurenlegenda
EXAMENVRAAG Letterlijke vraag zoals gesteld op het examen (of een nagenoeg identieke variant).
MODELANTWOORD Uitgewerkt antwoord op basis van slides, samenvatting en transcripts.
THEORIE/BEGRIP Definitie of achtergrondkennis die je nodig hebt om de vraag correct te
beantwoorden.
STUDIETIP Praktische tip of aanvulling voor het examen.
PATROON/VALKUIL Terugkerend patroon of veelgemaakte fout.
,Business Intelligence - Examenfocus | UGent Handelswetenschappen
Inhoudsopgave
1. Examenstructuur en studieprioriteit
2. Cost-Benefit analyse en threshold (good/bad)
3. Naive Bayes en Laplace-correctie
4. ZeroR, accuraatheid en baseline
5. Confusion matrix: rij versus kolom
6. Expected Value framework en de T-shirtvraag
7. TF-IDF en Bag of Words
8. ROC-curve: permissief versus conservatief
9. Entropie en Information Gain
10. Cross-validatie: k+1 modellen
11. Associatieregels: lift, support, confidence
12. k-Nearest Neighbour en afstandsfuncties
13. SVM, hinge loss en objective function
14. Clustering: k-means, centroiden, dendrogram
15. Selectiebias (vliegtuigen, bank)
16. Learning curve versus fitting graph
17. Snel overzicht: alle formules en begrippen
, Business Intelligence - Examenfocus | UGent Handelswetenschappen
1. Examenstructuur en studieprioriteit
Hoe ziet het examen eruit?
Formaat: 20 meerkeuzevragen met 4 antwoordmogelijkheden (A/B/C/D)
Groepswerk: 40% van het eindcijfer (Weka-classificatieproject)
Examen: 60% van het eindcijfer
Duur: 2 uur
Hulpmiddelen: niet-grafische rekenmachine toegestaan, GEEN formularium
Cesuur: standaard 12-13 vragen juist voor een 10/20
Permutaties: verschillende versies met dezelfde inhoud maar in andere volgorde
Geen giscorrectie: elke vraag telt even hard
Wat komt elk jaar terug?
Op basis van vijf jaar Discord-nabespreksingen komen deze onderwerpen elk jaar terug:
Threshold + Cost-Benefit voor good/bad (8 van 8 jaren)
Naive Bayes berekening (8 van 8 jaren)
ZeroR / meerderheidsklasse + 99,8%-scenario (7 van 8 jaren)
Entropie / Information Gain (7 van 8 jaren)
Confusion matrix: fout geclassificeerd (6 van 8 jaren)
T-shirtvraag / klanten boven 150 euro (6 van 8 jaren)
Laplace-correctie (5 van 8 jaren)
TF-IDF: IDF = 1 betekent publieke antenne (5 van 8 jaren)
ROC-curve: permissief vs conservatief (5 van 8 jaren)
Lift/leverage bij associatieregels (5 van 8 jaren)
Expected Value framework en break-evenkans (5 van 8 jaren)
Selectiebias: vliegtuigen, bank (5 van 8 jaren)
Clustering: centroid, k-means, dendrogram (5 van 8 jaren)
Studieprioriteit
Absolute must (elk jaar aanwezig)
• Threshold-vraag met cost-benefit voor GOOD of BAD
• Naive Bayes: P(A|B) berekenen en interpreteren
• ZeroR: FN = 0 of FP = 0, afhankelijk van de meerderheidsklasse
• Confusion matrix: rij = actual, kolom = predicted (of omgekeerd in Weka)
• ROC-curve: linksboven = perfect, linksonder = conservatief, rechtsboven = permissief
• T-shirtvraag: confusion matrix opstellen + modelkeuze op basis van verwachte winst
Zeer waarschijnlijk aanwezig
• Laplace-correctie: formule (n+1)/(n+m) toepassen
• TF-IDF: IDF = 1 + log2(N/n), interpreteren wat lage/hoge IDF betekent
• Information Gain: op zicht het zuiverste attribuut aanwijzen
• Cross-validatie: k+1 modellen kennen en nested CV
• Associatieregels: lift, support, confidence berekenen