Logistische regressie: Difference between revisions
No edit summary |
No edit summary |
||
Line 7: | Line 7: | ||
In een logistisch regressiemodel wordt niet de dichotome uitkomst zelf gemodelleerd, maar de kans op die uitkomst. Omdat een kans loopt van minimum 0 tot maximaal 1 en bij lineaire regressie de uitkomstvariabele continu moet zijn, kunnen we de kans niet rechtstreeks als uitkomstvariabele gebruiken. We kunnen wel gebruik maken van de relatieve kans: de [[odds ratio|odds]]. Immers, de odds is een continue variabele die loopt van 0 tot oneindig. Vervolgens moet er statistisch nog iets aanvullends worden gedaan. De odds, die loopt van 0 tot oneindig, is immers nog niet normaal verdeeld, hetgeen óók een voorwaarde is voor lineaire regressie. Als uitkomstvariabele wordt daarom niet de odds gebruikt, maar de natuurlijke logaritme van de odds, die niet alleen continu maar ook normaal verdeeld is. | In een logistisch regressiemodel wordt niet de dichotome uitkomst zelf gemodelleerd, maar de kans op die uitkomst. Omdat een kans loopt van minimum 0 tot maximaal 1 en bij lineaire regressie de uitkomstvariabele continu moet zijn, kunnen we de kans niet rechtstreeks als uitkomstvariabele gebruiken. We kunnen wel gebruik maken van de relatieve kans: de [[odds ratio|odds]]. Immers, de odds is een continue variabele die loopt van 0 tot oneindig. Vervolgens moet er statistisch nog iets aanvullends worden gedaan. De odds, die loopt van 0 tot oneindig, is immers nog niet normaal verdeeld, hetgeen óók een voorwaarde is voor lineaire regressie. Als uitkomstvariabele wordt daarom niet de odds gebruikt, maar de natuurlijke logaritme van de odds, die niet alleen continu maar ook normaal verdeeld is. | ||
In de logistische regressie vergelijking | In de logistische regressie vergelijking | ||
<math> | <math> | ||
ln(odds)=a+b_1X_1+b_2X_2+\cdots+b_kX_k | ln(odds)=a+b_1X_1+b_2X_2+\cdots+b_kX_k | ||
</math> | </math> | ||
== Referenties == | is de natuurlijke logaritme van de odds de uitkomst variabele, is <math>a</math> de constante, zijn <math>X_i, (i = 1,2, ….., k)</math> de verklarende variabelen of covariaten, en vormen <math>b_1, b_2, \ldots b_k</math> de logistische regressiecoëfficiënten. | ||
==Hoe interpreteer ik mijn SPSS output bij gebruik van een enkelvoudig logistisch model?== | |||
(Het hierna volgende voorbeeld is afkomstig uit het boek “Inleiding in de toegepaste biostatistiek” van J.W.R Twisk, Elsevier gezondheidszorg, Maarssen, 2007). | |||
In een case-control onderzoek wordt bij 100 patiënten en 100 controlepersonen de relatie onderzocht tussen roken en het krijgen van een hartinfarct. De onderzoeksresultaten staan in de volgende 2x2 tabel weergegeven. | |||
{| border ="1" style=align="left" cellpadding="3" cellspacing="0" | |||
|width="100"| | |||
|width="100" | patient | |||
|width="100" | controle | |||
|width="100" | Totaal | |||
|- | |||
|rookt wel | |||
|style="background:#faecc8"| 39 | |||
|style="background:#faecc8"| 14 | |||
|53 | |||
|- | |||
|rookt niet | |||
|style="background:#faecc8"| 61 | |||
|style="background:#faecc8"| 86 | |||
|147 | |||
|- | |||
|Totaal | |||
|100 | |||
|100 | |||
|200 | |||
|} | |||
==Referenties== | |||
Revision as of 15:29, 5 June 2009
Wanneer gebruik ik een logistisch regressie model?
Met logistische regressie kan je een dichotome uitkomstvariabele (dood versus leven, wel of geen klachten, etc.) relateren aan één of meerdere predictoren. Het basis idee achter logistische regressie is dat je de uitkomstvariabele zodanig transformeert dat er een soort lineaire regressie mogelijk is. De logistische regressie coëfficiënten van de onafhankelijke variabelen in het model kunnen vervolgens worden omgezet in odds ratio’s.
In tegenstelling tot bij lineaire regressie gelden bij logistische regressie niet al te veel statistische voorwaarden. Zo hoeven er bijvoorbeeld geen aannames te worden gedaan over de verdeling van de variabelen en mogen de voorspellers (of verklarende variabelen) zowel discreet als continu zijn. Wel moeten de observaties onafhankelijk van elkaar zijn. Dat betekent dat logistische regressie dus niet geschikt is om onderzoeksgegevens te analyseren waarbij de patiënten herhaaldelijk in de tijd zijn gemeten (voor herhaalde metingen bestaan andere technieken).
Hoe werkt logistische regressie?
In een logistisch regressiemodel wordt niet de dichotome uitkomst zelf gemodelleerd, maar de kans op die uitkomst. Omdat een kans loopt van minimum 0 tot maximaal 1 en bij lineaire regressie de uitkomstvariabele continu moet zijn, kunnen we de kans niet rechtstreeks als uitkomstvariabele gebruiken. We kunnen wel gebruik maken van de relatieve kans: de odds. Immers, de odds is een continue variabele die loopt van 0 tot oneindig. Vervolgens moet er statistisch nog iets aanvullends worden gedaan. De odds, die loopt van 0 tot oneindig, is immers nog niet normaal verdeeld, hetgeen óók een voorwaarde is voor lineaire regressie. Als uitkomstvariabele wordt daarom niet de odds gebruikt, maar de natuurlijke logaritme van de odds, die niet alleen continu maar ook normaal verdeeld is. In de logistische regressie vergelijking
is de natuurlijke logaritme van de odds de uitkomst variabele, is de constante, zijn Failed to parse (SVG (MathML can be enabled via browser plugin): Invalid response ("Math extension cannot connect to Restbase.") from server "https://wikimedia.org/api/rest_v1/":): {\displaystyle X_i, (i = 1,2, ….., k)} de verklarende variabelen of covariaten, en vormen de logistische regressiecoëfficiënten.
Hoe interpreteer ik mijn SPSS output bij gebruik van een enkelvoudig logistisch model?
(Het hierna volgende voorbeeld is afkomstig uit het boek “Inleiding in de toegepaste biostatistiek” van J.W.R Twisk, Elsevier gezondheidszorg, Maarssen, 2007). In een case-control onderzoek wordt bij 100 patiënten en 100 controlepersonen de relatie onderzocht tussen roken en het krijgen van een hartinfarct. De onderzoeksresultaten staan in de volgende 2x2 tabel weergegeven.
patient | controle | Totaal | |
rookt wel | 39 | 14 | 53 |
rookt niet | 61 | 86 | 147 |
Totaal | 100 | 100 | 200 |
Referenties
Terug naar OVERZICHT voor een overzicht van alle statistische onderwerpen op deze wiki.
Terug naar KEUZE TOETS voor hulp bij het uitzoeken van een geschikte toets of analyse.