8.5 Modellvurdering og praktisk bruk
Sammenligne modeller, vurdere gyldighet og bruke modeller kritisk.
Sammenligne modeller
I de forrige kapitlene har vi lært ulike regresjonsmetoder og funksjonstyper. I praksis må vi ofte velge mellom flere mulige modeller for det samme datasettet. Hvordan vet vi hvilken modell som er «best»?
Det finnes ikke alltid ett entydig svar. En god modell skal:
1. Passe godt til kjente data (høy -verdi)
2. Gi fornuftige forutsigelser (spesielt ved interpolering)
3. Være basert på faglig kunnskap (forstå mekanismen bak)
4. Være enkel nok (ikke unødvendig kompleks)
Punkt 4 kalles parsimonitetsprinsippet (Ockhams barberkniv): Alt annet likt, foretrekk den enkleste modellen.
- (eller 100 %): Modellen forklarer all variasjon – perfekt tilpasning
- (eller 0 %): Modellen forklarer ingen variasjon
- Typisk ønsker vi for en god modell
For lineær regresjon er kvadratet av korrelasjonskoeffisienten: .
NB: Høy betyr ikke nødvendigvis at modellen er riktig – den kan overtilpasses.
Interpolering vs. ekstrapolering: pålitelighet
Interpolering – anslå verdier mellom kjente datapunkter – er generelt pålitelig dersom modellen passer godt til dataene. Vi beveger oss innenfor det området der modellen har blitt «trent».
Ekstrapolering – anslå verdier utenfor dataområdet – er langt mer risikabelt. Jo lenger vi ekstrapolerer, desto mer usikkert blir resultatet. Ulike modeller kan gi svært forskjellige forutsigelser ved ekstrapolering, selv om de passer like godt til kjente data.
Huskeregel: Bruk modellen forsiktig utenfor dataområdet, og vær alltid klar over at forutsigelser langt frem i tid eller utenfor kjente forhold er usikre.
Tabellen viser gjennomsnittlig strømforbruk per husstand (, i kWh per år) i Norge ved ulike år:
| År | 2000 | 2004 | 2008 | 2012 | 2016 | 2020 |
|---|---|---|---|---|---|---|
| kWh | 21 500 | 20 800 | 20 200 | 19 500 | 19 000 | 18 200 |
La være antall år etter 2000. Tilpass lineær og eksponentiell modell, og vurder hvilken som er best.
med
Eksponentiell modell:
med
Begge modellene passer svært godt. Den lineære modellen sier at forbruket synker med 162 kWh per år. Den eksponentielle sier at forbruket synker med ca. 0,83 % per år.
Vurdering:
- For kort tids ekstrapolering gir begge lignende resultater.
- Den lineære modellen gir negativt forbruk rundt (år 2132), noe som er umulig.
- Den eksponentielle modellen nærmer seg null, men blir aldri negativ, som er mer realistisk.
- Faglig sett er prosentvis nedgang (energieffektivisering) mer naturlig enn konstant nedgang.
Den eksponentielle modellen er trolig best for lengre fremskrivninger, men begge modellene er usikre langt frem i tid.
Begrensninger ved modeller
Alle matematiske modeller har begrensninger. Noen viktige å være klar over:
1. Gyldighetsområde: Modellen gjelder bare innenfor et visst område av -verdier. Utenfor dette kan den gi meningsløse resultater (f.eks. negativ befolkning).
2. Forenklinger: Modellen ser bort fra faktorer som kan være viktige. En modell for fritt fall ignorerer luftmotstand, en modell for befolkningsvekst ignorerer kriger og epidemier.
3. Tidsbegrensning: En modell som passer godt nå, trenger ikke passe i fremtiden. Trender kan endre seg.
4. Datatilpasning ≠ forståelse: En modell med høy betyr ikke at vi forstår mekanismen. Modellen beskriver mønsteret, men forklarer det ikke nødvendigvis.
En dyreparksavdeling har registrert antall gjester per år (, i tusen) de siste årene:
| År etter oppstart () | 1 | 2 | 3 | 4 | 5 | 6 | 7 | 8 |
|---|---|---|---|---|---|---|---|---|
| Gjester (tusen) | 15 | 28 | 52 | 80 | 95 | 103 | 108 | 110 |
Analyser datasettet med ulike modeller og gi en anbefaling.
Dataene viser rask vekst i begynnelsen som flater ut. Dette tyder på en S-kurve eller en logaritmisk/rotfunksjonsmodell.
Steg 2: Prøv ulike modeller i GeoGebra
Lineær: ,
Andregradsfunksjon: ,
Potensmodell: ,
Steg 3: Vurdering
- Den lineære modellen fanger ikke opp utflatningen og gir .
- Andregradsfunksjonen passer best med , men den snur nedover og forutsier at besøkstallet synker etter noen år – noe som kanskje ikke er realistisk.
- Potensmodellen med gir avtagende vekst uten å snur nedover, som er mer realistisk.
Anbefaling: For interpolering og kort tids ekstrapolering er andregradsfunksjonen best. For lengre fremskrivninger er potensmodellen eller en logaritmisk modell () mer fornuftig, fordi disse ikke forutsier nedgang.
Vi ser at andregradsfunksjonens toppunkt er ved , og modellen forutsier nedgang etter dette. Dersom vi forventer at besøkstallet stabiliserer seg (men ikke synker), trenger vi en annen modelltype.
Kritisk vurdering av modeller i media og forskning
Matematiske modeller brukes mye i media, forskning og politikk. Det er viktig å stille kritiske spørsmål:
- Hvilke data er modellen basert på? Er dataene pålitelige og representative?
- Hvilken funksjonstype er valgt, og hvorfor? Er det faglig grunnlag for valget?
- Er det interpolering eller ekstrapolering? Forutsigelser langt utenfor dataene er usikre.
- Hvilke forenklinger er gjort? Alle modeller forenkler virkeligheten.
- Hvem har laget modellen, og med hvilket formål? Kan det være skjevheter?
Et klassisk eksempel: Under pandemien ble det presentert mange modeller for smittespredning. Ulike modeller ga svært forskjellige forutsigelser, avhengig av antagelser om smitterate, tiltak og befolkningsadferd. Modellene var nyttige for å forstå mulige scenarier, men forutsigelsene var usikre.
1. Passer modellen til kjente data? (Sjekk og residualer)
2. Er modelltypen faglig begrunnet?
3. Gir modellen fornuftige verdier for ekstrempunkter?
4. Er det interpolering eller ekstrapolering?
5. Hvilke forenklinger er gjort?
6. Er den enkleste tilstrekkelige modellen valgt?
Skriv inn et datasett og tilpass ulike modeller. Sammenlign -verdiene og vurder visuelt hvilken modell som passer best.
Avgjør om følgende utsagn er interpolering eller ekstrapolering:
a) Vi har temperaturdata fra kl. 08:00 til 16:00 og anslår temperaturen kl. 12:00.
b) Vi har salgsdata for 2018–2023 og anslår salget i 2025.
c) Vi har data for inntekt og utdanningsnivå for personer med 8–20 års utdanning, og anslår inntekten for en person med 15 års utdanning.
d) Vi har data for en balls posisjon i de første 3 sekundene, og beregner posisjonen etter 10 sekunder.
En bedrift har registrert omsetning (, i millioner kr) over 6 år:
| År () | 1 | 2 | 3 | 4 | 5 | 6 |
|---|---|---|---|---|---|---|
| Omsetning | 2,1 | 2,5 | 3,0 | 3,6 | 4,3 | 5,2 |
Tilpass en lineær og en eksponentiell modell i GeoGebra.
Sammenlign forutsigelsene for år 10 og år 20.
Hvilken modell ville du anbefale, og hvorfor?
Forklar hva som er feil eller problematisk med følgende påstander:
a) «Modellen vår har , så den er garantert riktig.»
b) «Vi fant et tiendegradspolynom som går gjennom alle 10 datapunktene, så det er den beste modellen.»
c) «Det er sterk korrelasjon mellom skoforbruk og inntekt, altså tjener man mer penger av å kjøpe flere sko.»
En kommune har registrert årlig vannforbruk (, i millioner liter) og befolkningstall (, i tusen innbyggere) over 8 år:
| Innbyggere (tusen) | 12 | 14 | 16 | 19 | 22 | 25 | 28 | 32 |
|---|---|---|---|---|---|---|---|---|
| Vannforbruk (mill. liter) | 1,8 | 2,3 | 2,9 | 3,8 | 4,8 | 5,9 | 7,2 | 9,0 |
Tilpass lineær, eksponentiell og potensmodell i GeoGebra.
Forutsi vannforbruket ved 40 000 innbyggere med hver modell.
Hvilken modell er mest fornuftig fra et faglig synspunkt? Begrunn svaret.
Diskuter begrensningene ved den valgte modellen.
I en avisartikkel står det: «Forskning viser at land med høyere sjokoladeforbruk per innbygger har flere nobelprisvinnere per million innbyggere. Korrelasjonen er sterk (). Sjokolade gjør deg smartere!»
a) Hva er galt med denne konklusjonen?
b) Foreslå minst to mulige konfunderende variabler.
c) Beskriv hvordan du ville undersøkt om det faktisk er en kausal sammenheng.
Oppsummering
I dette kapittelet har du lært å vurdere modeller kritisk:
- Forklaringsgrad : Andelen av variasjonen i dataene som modellen forklarer ()
- Sammenlikne modeller: Høyere er bedre, men modellen må også gi mening i situasjonen
- Interpolering vs. ekstrapolering: Prediksjoner innenfor dataområdet er mer pålitelige enn utenfor
- Begrensninger: Alle modeller er forenklinger — vurder gyldighetsområde, rimelighet og hva som kan endre seg
- Kritisk blikk: Vurder modeller i media og forskning: Hvem har laget dem, på hvilket datagrunnlag, og hva er usikkerheten?
Nøkkelbegreper
| Begrep | Forklaring |
|---|---|
| Forklaringsgrad () | Hvor mye av variasjonen modellen forklarer |
| Gyldighetsområde | Området der modellen er pålitelig |
| Prediksjon | Forutsigelse basert på modellen |
Husk
- En modell med nær kan likevel gi gale prediksjoner utenfor dataområdet
Dette kapitlet er skrevet av Anthropics toppmodeller (Claude Opus og Claude Fable) og er foreløpig ikke manuelt gjennomgått — kvalitetskontrollen gjøres av uavhengige KI-agenter, og innmeldte feil rettes fortløpende. Funnet en feil? Meld fra, så retter vi den. Les mer om hvordan innholdet lages.