100% tevredenheidsgarantie Direct beschikbaar na je betaling Lees online óf als PDF Geen vaste maandelijkse kosten 4.2 TrustPilot
logo-home
College aantekeningen

Colleges statistiek B (Cijfer 9,3)

Beoordeling
-
Verkocht
-
Pagina's
44
Geüpload op
29-01-2022
Geschreven in
2021/2022

Colleges statistiek B

Instelling
Vak











Oeps! We kunnen je document nu niet laden. Probeer het nog eens of neem contact op met support.

Geschreven voor

Instelling
Studie
Vak

Documentinformatie

Geüpload op
29 januari 2022
Aantal pagina's
44
Geschreven in
2021/2022
Type
College aantekeningen
Docent(en)
-
Bevat
Alle colleges

Onderwerpen

Voorbeeld van de inhoud

STATISTIEK B BLOK 4
COLLEGE 1.1 | 08.01.2021. CORRELATIE EN LINEAIRE REGRESSIE HOOFDSTUK 10, 11 EN 12

Organisatie

- Vier hoorcolleges, vijf werkgroepen, waarvan twee SPSS-practica
- Bereid de werkgroepen goed voor (maak de opgaven)
- Werkgroepdocenten: Wouter van der Schors en Michel Oskam

Leerdoelen: een correlatiecoëfficiënt interpreteren

Wat en waarom?
Samenhang*

- Spreidingsdiagram (of: scatterplot)
o Grafische weergave samenhang
- Correlatiecoëfficiënt en -analyse
o Maat voor sterkte van de samenhang
- Regressie analyse
Lijn door puntenwolk tekenen, die zo goed mogelijk past
o Methode om de samenhang tussen twee (of meer) variabelen te beschrijven / bepalen met
behulp van een functionele relatie
o Schat/tekent lijn die de gegevens in het spreidingsdiagram zo goed mogelijk beschrijft

* Ook: Chi-kwadraat toets. (is behandeld in Statistiek A)

Veel meer kijken naar 2 variabelen die samenhang hebben, veel vollediger de vraag beantwoorden
A alleen kijken of er statistisch verschil is. B wat zijn de factoren die invloed hebben
Naar verklaringen zoeken voor een bepaald gegeven. Kijken samenhang tussen variabelen

Wat en waarom?
Wat is het verband tussen de temperatuur en het aantal uren per dag dat iemand het strand
bezoekt?
Aantal uren is continu. Bij x kwadraat was alleen categorisch. Kunnen meerdere variabelen meten

Wat is het verband tussen aantal facebook vrienden, reistijd naar de universiteit, sporten, het hebben van een
smartphone?


Spreidingsdiagram: scatterplot
Wat is het verband tussen ‘Aantal Facebook-vrienden’ en ‘Reistijd’?

Allemaal individuele waarden.
Regres analyse gaat proberen zo’n goed mogelijke lijn te tekenen

,Correlatiecoëfficiënt – algemeen
Maat voor lineaire samenhang tussen 2 variabelen (zie K&S pg 93)


r=
 ( x − x )( y − y )
i i
=
cov( x, y )

 (x − x)  ( y − y)
2 2 sx s y
i i

Als vermenigvuldigen van de twee termen pos is dan is pos correlatie, meer reizen is meer vrienden
Meer reizen, minder facebook vrienden als neg is.
Onafhankelijk van schaal waarop variabelen gemeten worden
Coëfficiënt altijd tussen -1 en 1

Kenmerken:

- Onderzoekt geen oorzakelijk (= causaal) verband
- Variabelen tenminste op intervalniveau gemeten
- Dimensieloze index
- Tussen -1 en +1
- Ordinaal

Correlatiecoëfficiënt – interpretative
r = 1 of -1 → resp. perfect positieve of negatieve lineaire samenhang
r = 0 → geen lineaire samenhang
0 < r < 1 of -1 < r < 0 → resp. positief / negatief lineaire samenhang




Aantal standaardafwijkingen verandering in y voor een standaardafwijking verandering in x
Hoe dichter bij 1 pos verband en -1 neg verband. Vinden waar sterkste verband en grootste correlatie
Standaardafwijking veranderen hetzelfde
Coëfficiënten vergelijken tussen verschillende situaties en kijken waar grootste is

College 1.2 | 08.01.2020
Leerdoel: een lineaire regressievergelijking opstellen en interpreteren

Regressie analyse – algemeen

- Methode om de samenhang tussen 2 (of meer) variabelen te beschrijven met behulp van een
functionele relatie (= de regressievergelijking)
- Techniek levert de ‘best passende’ lijn die de puntenwolk (zie spreidingsdiagram) zo goed mogelijk
beschrijft om (o.a.):
o Voorspellingen te doen
o Theorie te vormen / te toetsen, Stel voorop dat je verwacht… toetsen op data

, Regressie analyse – spreidingsdiagram

Wat is het verband tussen ‘Aantal Facebook-vrienden’ en
‘Reistijd’?

Welke lijn past het beste?

Lastig om op het oog te zien




Regressie analyse – onderdelen

- Enkelvoudige lineaire regressie continu afhankelijke variabele
- Meervoudige lineaire regressie, binaire dummy
- Logistische regressie (college 2), geordende categorische variabele
- Ordinale regressie (wordt niet behandeld)
- Multinomiale regressie (wordt niet behandeld)
- Keuze (regressie-model) hangt af van meetniveau afhankelijke variabele!

(enkelvoudige) Lineaire regressive
Notatie (enkelvoudig): y = β0 + β1 * x + e waarbij

- y (op y-as): afhankelijke variabele (of: outcome)
o Meetniveau: altijd interval of ratio
- x (op x-as): onafhankelijke variabele (of: exposure)
o Meetniveau: interval of ratio, indien anders: herdefinieren als 0 - 1 variabele
- β0 & β1: regressiecoefficienten (of: parameters) waarbij
o β0: snijpunt met y-as (of: intercept)
o β1: richtingscoefficient (of: slope)
- e: residu (error / voorspellingsfout).
o Verdeling is N(0,σ)

(enkelvoudige) Lineaire regressie (2)
Wat is de ‘best passende’ lijn?
Waarbij geen residu is, is niet echt mogelijk.
y’ is de voorspelde waarde

- Ideaal: y = β0 + β1 * x
- Beschikbaar: meetpunten (xi, yi) waarbij i = 1, 2, …, n
- Dus: voorspelde waarde yi’ bij gegeven xi: yi’ = β0 + β1 * xi
- En: regressievergelijking: y’ = β0 + β1 * x

, (enkelvoudige) Lineaire regressie (3)
‘Best passende’ lijn




Overal aantal afwijkingen, fout in de voorspelling, residuen zijn er nog

(enkelvoudige) Lineaire regressie (4)

- Fout in voorspelling: residuen (afstand van de meetpunten tot voorspelde regressielijn)
o Wiskundig: ei = yi – yi’= yi - (β0 + β1 * xi)
- Gezocht: de lijn waarbij het kwadraat van de afstanden van alle punten tot die lijn zo klein mogelijk is
n

e 2
i
- Wiskundig: minimalisering i =1 (kleinste kwadratencriterium)
Kwadraten: neg waardes pos, zo’n klein mogelijke som.

(enkelvoudige) Lineaire regressie (5)

- Uitgaande van het kleinste kwadratencriterium kan wiskundig de vergelijking voor de beste lijn
worden afgeleid
- We gebruiken daarvoor x en y




Variantie tov elkaar

Maak kennis met de verkoper

Seller avatar
De reputatie van een verkoper is gebaseerd op het aantal documenten dat iemand tegen betaling verkocht heeft en de beoordelingen die voor die items ontvangen zijn. Er zijn drie niveau’s te onderscheiden: brons, zilver en goud. Hoe beter de reputatie, hoe meer de kwaliteit van zijn of haar werk te vertrouwen is.
lunavandenbergh Erasmus Universiteit Rotterdam
Volgen Je moet ingelogd zijn om studenten of vakken te kunnen volgen
Verkocht
116
Lid sinds
4 jaar
Aantal volgers
46
Documenten
37
Laatst verkocht
8 maanden geleden

3,5

8 beoordelingen

5
1
4
3
3
3
2
1
1
0

Recent door jou bekeken

Waarom studenten kiezen voor Stuvia

Gemaakt door medestudenten, geverifieerd door reviews

Kwaliteit die je kunt vertrouwen: geschreven door studenten die slaagden en beoordeeld door anderen die dit document gebruikten.

Niet tevreden? Kies een ander document

Geen zorgen! Je kunt voor hetzelfde geld direct een ander document kiezen dat beter past bij wat je zoekt.

Betaal zoals je wilt, start meteen met leren

Geen abonnement, geen verplichtingen. Betaal zoals je gewend bent via Bancontact, iDeal of creditcard en download je PDF-document meteen.

Student with book image

“Gekocht, gedownload en geslaagd. Zo eenvoudig kan het zijn.”

Alisha Student

Veelgestelde vragen