Det med småt, i klar tale
Sådan virker siden, og hvor den kan tage fejl
Alle tal her stammer fra offentlige data eller en kilde, vi kan pege på. Hvor vi har måttet skønne i stedet for at måle direkte, skriver vi det på denne side, ikke bare i en fodnote.
Hvor data kommer fra
- Danske køretøjsregistreringer. Motorregistrets (DMR) offentlige statistikudtræk: mærke, model, første indregistreringsdato, drivmiddel, brændstofforbrug, CO2, vægt og motoreffekt for hver indregistreret bil. Vi beholdt benzin-, diesel- og hybridpersonbiler første gang indregistreret mellem 2010 og 2022, i alt 1.778.307 biler.
- Pålidelighed. To nationale synsarkiver, kombineret. Det britiske offentlige MOT-synsarkiv (Ministry of Transport-test, den britiske pendant til dansk syn) med 48.220.796 anvendelige syn, udgivet af Driver and Vehicle Standards Agency under Open Government Licence v3.0, som tillader denne brug med kildeangivelse. Og den norske periodiske køretøjskontrol (PKK / EU-kontroll), udgivet af Statens vegvesen under CC BY 4.0, som ligeledes tillader denne brug med kildeangivelse. Begge er udenlandske data, se forbeholdet nedenfor.
- Brændstofpriser. Circle K's offentlige pris-API, hentet på ny hver gang siden bygges. Seneste tal: benzin 16.69 kr/l, diesel 17.49 kr/l (hentet 2026-07-31).
- Danske afgifter. Satser for registreringsafgift og grøn ejerafgift, indtastet i hånden fra Skatteministeriets offentliggjorte satstabeller, kontrolleret 31-07-2026. Dansk afgiftslovgivning ændrer sig næsten hvert år. Læser du det her et stykke tid efter den dato, så tag kronebeløbene som omtrent rigtige, ikke aktuelle.
- Priser. Se prisafsnittet nedenfor. Det er den del af projektet med flest skøn i.
Pålideligheden kommer fra udenlandske biler på udenlandske veje, holdt op mod hinanden
Der findes ikke et offentligt dansk arkiv på modelniveau svarende til det britiske MOT-arkiv, så pålideligheden kommer fra biler på udenlandske markeder: udenlandske veje, udenlandsk vejr, udenlandsk vejsalt. En models pålidelighed i forhold til andre modeller burde kunne overføres nogenlunde, for den handler mest om, hvordan bilen er bygget. Den præcise fejlrate gør ikke nødvendigvis, for danske vintre og danske veje er ikke de samme som i kildelandene. Stol mere på rækkefølgen mellem bilerne end på den præcise procent for en enkelt bil.
Vi justerer for, hvor langt en bil typisk er kørt, så en model der normalt køres hårdt, ikke sammenlignes urimeligt med en der køres nænsomt. Vi offentliggør kun et pålidelighedstal, hvor der var syn nok til at stole på det. Hvor der ikke var nok, skriver vi det i stedet for at vise et usikkert tal.
Fra og med denne opdatering bygger pålideligheden på to landes synsdata, ikke ét. Vi tilføjede den norske periodiske køretøjskontrol (PKK) ved siden af det britiske MOT-arkiv, og undersøgte om de to er enige, i stedet for at antage at ét udenlandsk land er en sikker stedfortræder for Danmark. Det er de delvist, og det ærlige svar afhænger af, hvor gammel bilen er.
Det, der ikke overføres mellem de to lande, er den rå bestået-procent: Norges målte bestået-procent ligger 30 til 40 procentpoint under Storbritanniens for de samme modeller i samme alder, en forskel drevet af forskellige lovbestemte fejlgrænser og synsvirksomheders incitamenter, ikke af at norske biler faktisk fejler dobbelt så tit. Så vi lægger aldrig en britisk bestået-procent direkte sammen med en norsk. I stedet omregnes hvert lands rate til en standardiseret score (nærmere bestemt logit af bestået-procenten, derefter en z-score), beregnet separat inden for hver aldersgruppe og hvert land, hvilket fjerner den landespecifikke forskydning og kun beholder, hvor en model ligger i forhold til sine jævnaldrende i samme land og aldersgruppe. De to standardiserede scorer kombineres derefter med et vægtet gennemsnit, vægtet efter hvor meget data der ligger bag hver enkelt (et britisk tal bygget på 400.000 syn flytter den kombinerede score mere end et norsk tal bygget på 3.000), aldrig efter om de to kilder er enige.
Det, der overføres, i varierende grad, er rækkefølgen: om de britiske og norske data er enige om, hvilke modeller der er mere eller mindre pålidelige end deres jævnaldrende, i samme alder. Det har vi målt direkte, model for model, inden for hver aldersgruppe:
| Aldersgruppe | Biler af den alder i dag | Enighed mellem UK og Norge (rangkorrelation) |
|---|---|---|
| 4 til 6 år | 2020 til 2022 | 0,42, svag |
| 7 til 9 år | 2017 til 2019 | 0,46, svag til moderat |
| 10 til 12 år | 2014 til 2016 | 0,75, stærk |
| 13 til 16 år | 2010 til 2013 | 0,88, stærk |
Læs det ligeud: for de nyeste biler på siden er enigheden mellem de to lande svag, og dataene understøtter ikke stærkt tanken om, at en britisk-baseret og en norsk-baseret rangordning ville placere de samme unge biler øverst. For de ældste biler er landene tæt enige, og den enighed er reel dokumentation for, at rangordningen afspejler noget ved, hvordan bilen er bygget, ikke en artefakt af ét lands veje. Vi ledte grundigt efter en forklaring på, hvorfor gruppe 1 er svagere (færre syn, en anden sammensætning af talte fejl) og udelukkede begge dele; den ærlige tilbageværende forklaring er, at forskellene i pålidelighed mellem unge biler er små nok, og overdøvet nok af lokale forhold, til at en rangordning baseret på ét land er mindre pålidelig for de nyeste biler, end den ser ud til.
Én mærkegruppe er svagere end resten, og det er ikke gemt i en mærkeliste, det falder ud af tallene for hver enkelt model direkte: BMW, Mercedes-Benz, Audi og Volvo, i de to yngste aldersgrupper, viser næsten ingen enighed mellem de britiske og norske data (deres interne rangkorrelation ligger omkring 0,1 til 0,2 i gruppe 1 og 2, mod 0,75 til 0,85 for mærker med rene modelnavne som Skoda, Peugeot, Volkswagen og Toyota i de samme grupper). Vi sporede det så langt, vi kunne: det overlever at rette rigtige fejl i krydsmatchningen på den norske side (disse mærkers norske modelstrenge er bare motorkoder, som "320D" eller "X3 XDRIVE20D", der skal grupperes op til et modelnavn), og det forklares ikke af, hvilken slags fejl der tælles. Det er ikke et hardkodet flag på de fire mærker: sikkerhedsmærket på hver bilside styres af, hvor godt netop den models egne tal er enige, og en håndfuld BMW-, Mercedes-, Audi- og Volvo-model/alderskombinationer er faktisk enige og markeret derefter. Men de fleste af dem, i de to yngste grupper, er det ikke, og er markeret "lavt" datagrundlag af netop den grund.
Sikkerhedsmærket for pålidelighed
Hver rangeret bil har nu et sikkerhedsmærke for pålidelighed, lavt, middel eller højt, ved siden af det eksisterende sikkerhedsmærke for pris. Det er bygget af tre ting: hvor mange syn der ligger bag tallet, om ét lands data eller begges data ligger bag, og hvor godt de to er enige for netop den model og aldersgruppe, hvor begge findes.
- To kilder, tæt enighed, betydeligt mere data end det bare minimum: højt. Begge lande peger uafhængigt samme vej, og ingen af dem er tynd.
- To kilder med rimelig, men ikke tæt enighed, eller én stærk kilde uden noget at holde den op mod: middel. Det er de fleste biler på siden, og det er dataens ærlige form, ikke en standard vi faldt tilbage på. Et tal fra ét land alene kan aldrig nå "højt", uanset hvor mange syn der ligger bag, fordi der ikke er nogen måde at udelukke, at det er netop den slags model, hvor ét lands rangordning ikke overføres, hvilket er hele grunden til, at vi gik på jagt efter en anden kilde.
- To kilder, der er uenige med mere end én hel standardafvigelse inden for deres aldersgruppe, eller én kilde der kun lige akkurat klarer sit eget stabilitetskrav: lavt. Mere data løser ikke det første tilfælde: vi har allerede tjekket, og uenigheden mellem de britiske og norske data er reel, ikke støj fra stikprøvestørrelsen, så en større stikprøve på nogen af siderne ville ikke få den til at forsvinde.
233 rangerede biler bygger på begge lande, 334 på kun ét. Af alle rangerede biler har 112 "højt" datagrundlag, 404 har "middel", og 51 har "lavt". De fleste biler lander på middel, og det melder vi ligeud i stedet for at justere grænserne, så billedet ser mere afklaret ud, end dataene understøtter.
Reparationsestimatet er et groft indeks, ikke et værkstedstilbud
Vi tæller, hvor tit hver del af en bil dumper til MOT-syn, og vægter det med en faktor per mærke for, hvor dyre det mærkes reservedele og timer plejer at være. En sprunget forlygtepære og en defekt bærearm tæller lige meget lige nu, en forenkling, for et undervognsarbejde koster langt mere. Vi laver indekset om til kroner med en fast sats på 3.000 kr per point per år. Det er et skøn, ikke en måling, for der findes ikke noget offentligt datasæt over danske reparationspriser per model. Med den sats fylder reparationer en beskeden del af de fleste bilers samlede pris. Er den rigtige sats meget højere, kan rækkefølgen inden for en prisklasse rykke sig, men det overordnede billede burde holde.
Sådan estimerer vi en brugtpris
Bilbasen og DBA's annoncedatabaser er beskyttet af EU's databaseret, og Danmark udgiver heller ikke en offentlig database over brugtbilpriser. At kopiere hele databasen fra nogen af siderne er ikke en mulighed. Så vi byggede et estimat i stedet for at droppe priser helt, og holdt derefter estimatet op mod et lille antal rigtige danske udbudspriser: mest indsamlet i hånden, suppleret hvor nødvendigt med et fåtal individuelle, hastighedsbegrænsede opslag på Bilbasen og DBA, ikke i større skala end en køber, der selv tjekker et par annoncer, aldrig en samlet udtrækning af nogen af sidernes database.
- Startet i et marked næsten uden bilafgift. Polens brugtbilafgift er forsvindende lille, så udbudspriserne der er en rimelig stedfortræder for, hvad en bil er værd, før noget lands afgift lægges oveni. Vi brugte et offentligt datasæt med polske brugtbilannoncer (frigivet til fri afbenyttelse, ingen scraping nødvendig) til at se, hvordan hver models pris ændrer sig med alderen.
- Omregnet til dansk pris med Danmarks faktiske afgiftsformel. Vi indtastede registreringsafgiftsformlen fra Skatteministeriets offentliggjorte satstabeller og anvendte den. Det er her, estimatet er svagest: dansk lovgivning vil strengt taget have en brugt bils afgift skrevet ned efter, hvor meget den har tabt i værdi siden ny, og vi har ikke en pålidelig nypris for hver model at regne det ud fra. Vi tilnærmer os uden om det i stedet for at opfinde en nypris. Se "kendte begrænsninger" nedenfor.
- Holdt resultatet op mod det danske marked: udbudspriser vi indsamlede i hånden og, for de modeller vi ikke ellers kunne finde nok af, gennem et lille antal individuelle opslag på Bilbasen og DBA, på tværs af en række almindelige modeller og prisniveauer, og korrigerede hele estimatet med den forskel, vi fandt. Biler under 150.000 kr blev korrigeret for sig og biler over for sig, for forskellen var ikke helt lige stor i begge ender.
Det sammenkoblingstrin har allerede fanget en rigtig fejl. Alle BMW-, Mercedes-Benz- og Volvo-modeller på nær de enkleste navne (X1, X3, GLC, V70) faldt stille og roligt tilbage på en gennemsnitspris for hele mærket, fordi Motorregistret staver modellerne "1-Serie", "A-Klasse", "XC60", mens de polske annoncer staver de samme biler "Seria 1", "Klasa A", "XC 60": omvendt ordstilling i de to første, et manglende mellemrum i den tredje. Intet match på modelniveau, men heller ingen fejlmeddelelse, bare et forkert tal der så plausibelt ud. Rettet med en tabel over accepterede alternative stavemåder, og nu prissættes hver BMW-, Mercedes- og Volvo-model ud fra sine egne annoncer.
Kalibreringen har sine grænser. Vi målte, hvor godt korrektionen passer på de samme priser, vi byggede den ud fra, og det vil altid se bedre ud end resultatet på en bil, vi ikke har tjekket. Tag "kalibreret mod danske annoncer" for pålydende, og "præcis inden for en bestemt procent" som noget, der endnu ikke er bevist.
Hver pris på siden har også en markering af datagrundlaget, lavt, middel eller højt, ud fra hvor mange sammenlignelige udenlandske annoncer der lå bag, og om vi måtte låne hele mærkets prismønster, fordi en bestemt model havde færre end 15 annoncer af sine egne at bygge et fair estimat på. Den grænse betyder noget: en samlet Skoda-pris bliver for eksempel lagt i gennemsnit med Octavia, Superb og Kodiaq, så en billig bybil kan ende med at blive prissat som en mellemklassesedan, medmindre den klarer grænsen selv. Du ser markeringen på enhver bilside, hvor datagrundlaget ikke er "højt".
Kilometertallet betyder også noget, og det justerer vi for
Et prisestimat er forankret i et "typisk" kilometertal for bilens alder, ikke en bestemt udlæsning på tælleren. Vi målte ud fra danske annoncer, hvor meget prisen flytter sig med kilometrene (omkring 3.0% for hver ekstra 10.000 km), og bruger det til at justere en gensalgsværdi, når vi sammenligner en bil købt i én alder med den samme bil solgt år senere.
Biler vi slet ikke kunne prissætte
Suzuki- og DS-modeller er næsten ikke til stede i de udenlandske annoncedata, vi bruger, så de fleste af dem har ikke noget solidt at bygge et prisestimat på. For nogle få (Swift, Baleno, Ignis, Celerio) fandt vi danske udbudspriser i hånden og brugte samme metode med kurveform fra en tilsvarende bil, som vi bruger til Skoda Citigo (se kendte begrænsninger nedenfor): vi låner værditabskurven fra en model i samme segment og skalerer den til den pris. De er markeret "lavt datagrundlag", da de hviler på en eller to annoncer frem for en hel kurve. Resten viser stadig pålidelighed og driftsomkostninger uden pris og uden placering, tydeligt markeret. 5 modeller er stadig uden pris.
Hvad "mest bil for pengene" betyder
Hver prisklasseside har to lister. "Billigst at eje" rangerer rent på penge. "Mest bil for pengene" blander den rangering med en køreglædescore bygget på effekt per vægt, antal cylindre og egenvægt, en lige 50/50-fordeling, oplyst her frem for gemt væk i koden. Vi har målt, at de to ting trækker i hver sin retning oftere end ikke: biler der er sjovere at køre, koster typisk mere i drift. Ingen af listerne er "mere rigtig" end den anden, de svarer på hver sit spørgsmål.
Hvad vi ikke gør
- Vi laver ikke en samlet kopi af Bilbasen, DBA eller andre annoncesiders database. Den slags er beskyttet af EU's databaseret, og der findes ikke noget offentligt API. Et lille antal individuelle, hastighedsbegrænsede opslag for at udfylde huller i vores egen priskalibrering er ikke det, og vi gengiver ikke det, de opslag returnerer.
- Vi henter ikke tabeller fra TÜV Report eller ADAC Pannenstatistik. De er ophavsretligt beskyttet. Vi må omtale deres offentliggjorte hovedkonklusioner i tekst, ikke gengive deres data.
- Vi rangerer ikke elbiler i denne version. Der er endnu ikke data nok på tværs af aldersgrupper til at gøre det fair.
Kendte begrænsninger, samlet ét sted
- Pålidelighedstal kommer fra britiske og norske biler, ikke danske, og de to kilder er kun svagt enige for de nyeste biler (aldersgruppe 1 og 2) og for BMW, Mercedes-Benz, Audi og Volvo specifikt i de grupper. Se ovenfor.
- Reparationstallet er en skønsbaseret sats per point, ikke målte regninger. Se ovenfor.
- Priskalibreringen er ikke testet mod et sæt annoncer, den ikke er bygget på. Se ovenfor.
- Skoda Citigo har to annoncer af sine egne i de udenlandske data, vi bruger, og den ene angiver en 1968 ccm dieselmotor, en Citigo der aldrig er bygget. Derfor er dens priskurve lånt fra Volkswagen Up!, den samme bil på den samme platform solgt under et andet mærke (Seat Mii er det tredje mærke og har annoncer nok til at blive prissat direkte). Registreringsafgiften regnes stadig ud fra Citigoens eget målte CO2-tal, det er kun den underliggende markedsværdi, der deles.
- Kilometerjusteringen bruger én fast sats for alle biler, fra den billigste bybil til den dyreste SUV, selvom kilometertallet nok betyder mere i kroner for en dyr bil.
- Alle lister kan sorteres om efter et andet årligt kilometertal end udgangspunktet på 15.000 km. Kun brændstofudgiften og hvor meget gensalgsværdien falder, følger med tallet. Grøn ejerafgift er fast per år, uanset hvor langt du kører, og det samme er reparationsestimatet, så et højt valg undervurderer den sande pris en smule.
- Biler første gang indregistreret 2010 til 2013 (vores ældste aldersgruppe) har ikke et senere gensalgspunkt i vores data, så deres tal er kun driftsomkostninger, ikke et fuldt køb-og-salg-regnskab. De er markeret med en stjerne, hvor de optræder.
- Brændstoftallene går på tværs af en ændring i 2018 af, hvordan EU måler brændstofforbrug (NEDC til WLTP), hvilket får nogle ældre biler til at se en anelse bedre ud på papiret, end de er. Sammenligninger inden for samme aldersgruppe er stort set upåvirkede.
- Et modelnavn kan dække mere end én generation inden for en enkelt treårig aldersgruppe, hvis modellen fik et facelift eller en motorændring undervejs. De fleste generationer holder længere end tre år, så det er undtagelsen frem for reglen, men hvor det sker, blander rækken specifikationer fra det, en køber ville opleve som to forskellige biler.
- Hybridbiler er ikke registreret som deres eget drivmiddel i registret, de står under benzin eller diesel. Vi markerer en bil som hybrid, når mindst 3 ud af 10 af de registrerede biler bag rækken har et variantnavn, der nævner "hybrid" eller "plug-in", en lavere grænse end et rent flertal. Vi havde brug for den lavere: Hyundai Ioniq, der næsten udelukkende er solgt som hybrid, plug-in eller el i denne generation, rammer stadig kun 44 til 49 procent af variantnavnene, fordi ikke alle hybridvarianter skriver det. Det misser stadig nogle og markerer af og til en model, der kun delvist er hybrid. Deres officielle forbrugstal er desuden typisk optimistiske (testen tillader hjælp fra batteriet), så en hybrids faktiske driftspris er nok lidt højere end vist. Brug filteret "Skjul hybridbiler" på en liste for at sætte dem til side.
- Filteret "Skjul diesel" virker på samme måde og markerer en bil, når over halvdelen af de registrerede køretøjer bag rækken er diesel. Nogle få rækker blander begge drivmidler under én linje, så filteret er en stærk indikator, ikke en perfekt opdeling.
Ser noget på denne side forkert ud, eller mangler der noget? Hele databehandlingen og alle referencefiler bag tallene ligger i projektets kodelager. Intet her genereres på forespørgsel, hvert tal er regnet ud på forhånd fra de kilder, der er nævnt ovenfor.