Academy

/

Geo-lift og holdout-test af influencer marketing: Sådan gør du i praksis

Guide

Tracking & ROI

Brands

Geo-lift og holdout-test af influencer marketing: Sådan gør du i praksis

En geo-lift-test måler en kampagnes reelle effekt ved at sammenligne salget i en gruppe geografiske områder, der ser kampagnen (testgruppen), med et "holdout" af sammenlignelige områder, der ikke gør (kontrolgruppen). Forskellen i salg mellem de to grupper — korrigeret for den naturlige baseline-udvikling — er kampagnens inkrementelle løft. Metoden bruges typisk til betalte annoncer, hvor eksponeringen kan geografisk afgrænses; på organisk influencer-indhold er den sværere at gennemføre rent, fordi et opslag ikke kan holdes ude af et bestemt område.

Hvad en geo-lift-test er, og hvorfor den findes

En geo-lift-test er en praktisk måde at gennemføre en inkrementalitetstest på: i stedet for at splitte enkelte brugere tilfældigt i en eksponeret gruppe og en holdout-gruppe, splitter du geografiske områder — postnummerklynger, regioner eller hele markeder. Nogle områder ser kampagnen (testgruppen), andre gør bevidst ikke (kontrol- eller holdout-gruppen). Forskellen i salg mellem de to grupper — korrigeret for den naturlige udvikling begge grupper ville have haft alligevel — er kampagnens reelle, inkrementelle løft. Attribution i influencer marketing introducerer inkrementalitetstest og holdout-grupper som begreb; denne artikel går i dybden med, hvordan du rent faktisk designer, kører og læser en geografisk version af testen.

Bruger-niveau holdout vs. geografisk holdout

De to varianter besvarer samme spørgsmål, men kræver vidt forskellige forudsætninger:

 Bruger-niveau holdoutGeografisk holdout (geo-lift)
Hvordan grupperne dannesTilfældig udvælgelse af enkeltpersoner i en delt målgruppeHele geografiske områder (postnumre, regioner, lande) tildeles test eller kontrol
Hvad det kræver tekniskMulighed for at udelukke specifikke individer fra eksponering (typisk kun muligt i betalt annoncering)Mulighed for at afgrænse eksponering geografisk — igen typisk kun muligt i betalt annoncering med geo-målretning
Fungerer det på organisk indhold?Stort set ikke — man kan ikke forhindre en bestemt person i at se et opslagKun delvist — se afsnittet om organisk indhold nedenfor
Typisk brugt tilEnkeltkanal, betalte kampagner med adgang til brugerniveau-dataKampagner der spænder over flere kanaler, eller hvor brugerniveau-tracking er svækket eller umuligt
StyrkeKan give en mere præcis, mindre støjfyldt måling, hvis datagrundlaget er derKræver ikke cookies eller enheds-ID'er — robust over for tracking-begrænsninger
SvaghedFølsom over for cookie-levetid og cross-device-tabKræver nok geografiske enheder til at finde statistisk sammenlignelige par

Sådan bygger du en geo-lift-test i praksis: 5 trin

Trin 1 — Vælg metrik og baseline-periode. Bestem hvilket tal, testen skal måle (ordrer, omsætning, app-installationer), og indsaml mindst 4-8 ugers historiske data for hvert kandidatområde, før kampagnen overhovedet designes. Uden en solid baseline kan I ikke skelne en reel kampagneeffekt fra almindelig ugentlig udsving.

Trin 2 — Vælg og par geografiske områder. Det vigtigste designvalg er, at test- og kontrolområdet ligner hinanden historisk — samme sæsonmønster, samme prisfølsomhed, samme kategori-adfærd. Metas eget open source-værktøj til formålet, GeoLift, bruger det, der kaldes en synthetic control: i stedet for at matche testområdet til ét enkelt kontrolområde, bygger værktøjet en vægtet blanding af flere kontrolområder, konstrueret til at efterligne testområdets faktiske salgsmønster i perioden før kampagnen. Jo bedre den syntetiske kontrolgruppe rammer testområdets historiske kurve, desto mere troværdig er den lift, der måles bagefter.

Trin 3 — Beregn testens styrke (power-analyse). Før I kører noget, bør I regne på, hvor stort et løft testen overhovedet kan opdage pålideligt, givet antallet af områder og testens længde — det, der kaldes den mindste detekterbare effekt (MDE). Ifølge GeoLifts egen dokumentation testes typisk kombinationer af 2-4 testområder mod resten som kontrol, med en holdout, der spænder fra 50-100% af kontrolgruppens konverteringer holdt tilbage fra kampagnen, og en test-længde, der som minimum dækker én fuld købscyklus for kategorien — værktøjets eget eksempel afprøver både 10- og 15-dages vinduer for en hurtigt-omsættende kategori. De konkrete tal er illustrationer fra Metas egen dokumentation, ikke universelle regler — jeres egen kategoris købscyklus og datavolumen afgør, hvad der giver mening hos jer.

Trin 4 — Kør testen. På betalt annoncering kan I bruge platformenes egne værktøjer: Google Ads' Conversion Lift baseret på geografi opdeler landet i algoritmisk genererede regioner (Google kalder dem "Google Marketing Areas"), tildeler dem til test eller kontrol og kræver, at kampagnen målretter ét enkelt land for at være egnet til testen. På organisk influencer-indhold er den slags geo-målretning ikke teknisk mulig — se det dedikerede afsnit nedenfor.

Trin 5 — Læs resultatet. Sammenlign testområdets faktiske performance under kampagnen med den syntetiske eller matchede kontrolgruppes forventede performance i samme periode. Forskellen er den inkrementelle lift. Ifølge Google Ads' egen definition beregnes den efterfølgende iROAS (inkrementel ROAS) som inkrementel omsætning divideret med den samlede annonceudgift — samme logik som i sådan beregner du ROI på influencer marketing, blot med en lift-baseret omsætning i stedet for en last-click-baseret.

Hvorfor geo-lift er sværere på organisk influencer-indhold end på betalte annoncer

Betalte annoncer kan geo-målrettes teknisk — platformen viser simpelthen ikke annoncen til brugere i kontrolområdet. Et organisk influencer-opslag kan ikke det samme: en creator kan ikke forhindre en bestemt følger i at se et opslag, og indhold spredes videre via reposts, screenshots og DM'er på tværs af enhver geografisk grænse, I forsøger at sætte. Det giver kontaminering — kontrolgruppen bliver alligevel delvist eksponeret, hvilket trækker den målte lift nedad og undervurderer kampagnens reelle effekt.

To praktiske arbejdsomgåelser bruges typisk i stedet for en ren geo-fence på organisk indhold:

  • Forskudt lancering (staggered rollout): kampagnen starter i testområdet på et tidligere tidspunkt end i kontrolområdet, så I kan sammenligne de to områders udvikling i overlapsperioden, før kontrolområdet selv eksponeres.
  • Konverter til en geo-målrettet betalt boost: hvis I whitelister creatorens indhold og kører det som en betalt annonce via Partnership Ads eller Spark Ads, bliver eksponeringen igen teknisk geo-målretbar, fordi den nu er en betalt annonce med platformens egen geo-målretning — prisen er, at I måler den whitelistede annonce, ikke den rene organiske effekt.

Danmark-problemet: hvorfor et rent nationalt geo-split sjældent kan lade sig gøre

Google Ads' egen dokumentation for Conversion Lift baseret på geografi kræver, at en kampagne målretter ét enkelt land, og at landet indeholder nok statistisk forskellige regioner til at opnå en pålidelig test — værktøjet viser selv en "feasibility"-vurdering (High/Medium/Low), og lav befolkning eller lav geografisk variation trækker den vurdering ned. Danmark, med et samlet befolkningsgrundlag på under seks millioner og en relativt ensartet digital adfærd på tværs af landsdele, rammer typisk netop den begrænsning: der er for få og for ens regioner til at finde statistisk pålidelige test/kontrol-par internt i landet alene.

To realistiske alternativer for et brand, der udelukkende sælger i Danmark:

  • Tidsbaseret on/off-holdout i stedet for et geografisk split: kør kampagnen i udvalgte uger og pause den i andre, og sammenlign salget i "on"- og "off"-perioderne — korrigeret for sæsonudsving, ugedag og eventuelle andre kampagner, der kører samtidig. Det er metodisk svagere end et geo-split (I kan ikke isolere effekten lige så rent, fordi tiden, ikke geografien, er den varierende faktor), men det er teknisk muligt for ethvert dansk-kun brand.
  • Brug et sammenligneligt marked som kontrol, hvis brandet også sælger i mindst ét andet nordisk land med lignende forbrugeradfærd — fx holde Danmark som testmarked og et andet marked som kontrol, eller omvendt. Det kræver, at de to markeder rent faktisk har sammenlignelige baseline-salgsmønstre, hvilket bør efterprøves med historiske data, før testen designes — ikke antages.

Regnestykke: en difference-in-differences-beregning

Tallene nedenfor er hypotetiske og udelukkende til illustration af beregningsmetoden. Det er ikke en reel Make Influence-kundecase, og ingen af tallene er benchmarks for, hvad en kampagne typisk leverer.

Antag, at et brand identificerer to sammenlignelige, hypotetiske områder — Område A og Område B — med næsten samme salgsniveau i en 4-ugers baseline-periode før kampagnen: Område A sælger gennemsnitligt 82 ordrer om ugen pr. 10.000 indbyggere, Område B 79 — en forskel på under 4%, hvilket gør dem til et rimeligt matchet par.

Område A bliver testregion og eksponeres for en influencer-kampagne i 4 uger. Område B forbliver kontrolgruppe. I kampagneperioden stiger salget i begge områder — dels på grund af kampagnen, dels på grund af almindelig sæsonudvikling, som begge områder oplever uanset kampagnen:

  • Område A stiger til 101 ordrer/uge pr. 10.000 indbyggere — en stigning på 101 − 82 = 19.
  • Område B stiger til 84 ordrer/uge pr. 10.000 indbyggere — en stigning på 84 − 79 = 5, som må tilskrives den sæsoneffekt, begge områder deler.
  • Difference-in-differences-løftet = 19 − 5 = 14 ordrer pr. 10.000 indbyggere om ugen, der kan tilskrives kampagnen specifikt — efter den fælles sæsoneffekt er trukket fra.

Antag, at Område A har 400.000 indbyggere, altså 40 enheder af 10.000. Det inkrementelle salg bliver da 14 × 40 = 560 ordrer om ugen, og over den 4-uger lange kampagne: 560 × 4 = 2.240 inkrementelle ordrer i alt. Ved en gennemsnitlig ordreværdi på 350 kr. giver det en inkrementel omsætning på 2.240 × 350 = 784.000 kr. Kostede kampagnen 180.000 kr. i honorarer og eventuel betalt boost, bliver iROAS = 784.000 ÷ 180.000 ≈ 4,4× — altså 4,4 kr. inkrementel omsætning for hver krone brugt, målt via lift, ikke via last-click-sporede koder eller links.

Hvilken tilgang passer til jer

 Platformsdrevet lift-studie (Google/Meta)Open source-værktøj (fx GeoLift)DIY difference-in-differences
Hvem det passer tilBrands med adgang til en Google- eller Meta-kontorepræsentant og et budget, der kvalificerer til studietBrands med interne data-ressourcer, der kan sætte værktøjet op selvEthvert brand med historiske salgsdata pr. område, uanset teknisk modenhed
Hvad det kræverAdgang gennem platformen; kampagnen skal målrette ét landR-kendskab eller en analytiker, der kan sætte det op; nok historisk salgsdata pr. områdeEt regneark, to sammenlignelige områder og disciplin til at holde kampagnen ude af kontrolområdet
StyrkeHåndterer markedsvalg, power-analyse og statistik automatiskGratis, gennemsigtig metode, brugt af store annoncørerSimpelt at forstå og forklare til en beslutningstager
SvaghedIkke tilgængeligt for alle konti; kræver typisk et vist budgetniveauKræver statistisk kompetence at sætte rigtigt op og fortolkeMindre statistisk robust — følsom over for, hvor godt de to områder faktisk matcher

Typiske fejl

  • At vælge to områder, der ikke reelt er sammenlignelige. Forskellig sæsonprofil, forskellige samtidige kampagner eller forskellig kategori-modenhed ødelægger testen, selvom befolkningstallene ligner hinanden.
  • At ignorere kontaminering på organisk indhold. Hvis kontrolområdet alligevel eksponeres via deling eller genopslag, undervurderer testen den reelle effekt — uden at I nødvendigvis opdager det.
  • At køre testen for kort til at dække én købscyklus. En test, der slutter, før den typiske kunde når at handle, undertæller lift systematisk.
  • At overse eksterne begivenheder i testperioden. Et udsalg, en konkurrentkampagne eller en vejrhændelse i det ene område kan efterligne eller maskere en kampagneeffekt.
  • At forsøge et rent geografisk split i Danmark uden at kende Googles egen feasibility-begrænsning. Se afsnittet om Danmark-problemet ovenfor — det er sjældent den rette startmetode for et dansk-kun brand.

Beslutningsramme: hvornår giver en geo-lift-test mening

  • HVIS I kører betalt annoncering med geo-målretning, og har budget nok til en flerugers test → en platformsdrevet lift-studie (Google eller Meta) eller GeoLift er den mest robuste vej.
  • HVIS I kun sælger i Danmark og ikke har adgang til et lift-studie → en tidsbaseret on/off-holdout er det mest realistiske alternativ, ikke et internt geo-split.
  • HVIS kampagnen er organisk influencer-indhold uden betalt boost → forvent kontaminering, og overvej i stedet en forskudt lancering eller at whitelist indholdet, hvis I skal måle det geografisk rent.
  • HVIS I ikke har nok volumen til at opdage et pålideligt løft (for få ordrer, for lille en kampagne) → brug last-click og de operationelle tal i stedet, og betragt dem som et gulv for den reelle effekt, som beskrevet i attribution i influencer marketing.

Make Influence's erfaring

I Make Influences erfaring har de fleste danske DTC-brands hverken volumen eller den geografiske spredning, der skal til for at få en platformsdrevet geo-lift-test op i "High"-feasibility. Vores eget sporingsmodel er bygget på ordreniveau — tracking-links og rabatkoder med et 30-dages cookie-vindue, se sådan fungerer influencer tracking teknisk — hvilket besvarer et andet spørgsmål end en geo-lift-test: hvilke ordrer kan spores til hvilken creator, ikke hvor mange ordrer kampagnen som helhed skabte ud over baseline. Vores anbefaling til brands uden ressourcerne til et fuldt geo-lift-program er sjældent at bygge det fra bunden — det er at supplere den daglige last-click-rapportering med en periodisk, simplere on/off-test, og bruge rabatkoder eller tracking-links konsekvent nok til, at den daglige sporing i det mindste er sammenlignelig over tid.

FAQ

Hvad er forskellen på en geo-lift-test og en almindelig holdout-test?

En almindelig holdout-test splitter enkeltpersoner tilfældigt i en eksponeret gruppe og en holdout-gruppe. En geo-lift-test splitter hele geografiske områder på samme måde. Geo-lift bruges typisk, når bruger-niveau-tracking er for svagt eller umuligt, mens et bruger-niveau-split kræver adgang til individuelle brugerdata.

Hvor længe skal en geo-lift-test køre?

Som minimum skal testen dække én fuld købscyklus for jeres kategori — kortere tests undertæller systematisk lift. Metas eget GeoLift-værktøj bruger i sin dokumentation eksempler på 10-15 dage for en hurtigt-omsættende kategori; en kategori med længere overvejelsestid kræver tilsvarende længere test.

Kan jeg køre en geo-lift-test på organisk influencer-indhold, eller kun på betalte annoncer?

Det er teknisk muligt, men markant sværere, fordi et organisk opslag ikke kan holdes ude af et bestemt geografisk område. Se afsnittet ovenfor om forskudt lancering og whitelisting som praktiske arbejdsomgåelser.

Skal jeg bruge Googles eller Metas eget værktøj, eller kan jeg selv regne det ud?

Begge dele er mulige. Platformenes egne værktøjer håndterer markedsvalg og statistik automatisk, men kræver typisk adgang gennem en kontorepræsentant. En simpel difference-in-differences-beregning, som regnestykket ovenfor, kan gennemføres i et regneark uden adgang til nogen platform — den er blot mindre statistisk robust.

Er en geo-lift-test realistisk for et brand, der kun sælger i Danmark?

Sjældent i sin rene form, fordi Danmark typisk er for lille og for ensartet til at opfylde platformenes egne krav til geografisk variation. En tidsbaseret on/off-holdout er det mere realistiske alternativ for de fleste dansk-kun brands.

Hvor mange inkrementelle salg skal jeg se, før resultatet er pålideligt?

Det afhænger af jeres baseline-volumen og hvor stort et løft, I forsøger at opdage — det er præcis det, en power-analyse regner ud, før testen sættes i gang. Som tommelfingerregel: jo mindre kampagnens forventede effekt er i forhold til den naturlige udsving i salget, desto flere ordrer og desto længere en test kræves for et pålideligt resultat.

Make Influence

Skal influencer marketing være nemmere?

Find influencere med rigtige målgruppedata, styr samarbejderne ét sted, og se klik og salg pr. influencer mens kampagnen kører.

Book en demoOpret konto

Make Influence

Få betaling for den følgerskare, du har bygget

Søg på kampagner fra brands, der leder efter influencere lige nu, følg dine egne klik og salg, og få udbetalt uden at rykke for fakturaer.

Opret influencerprofilFlere guides til influencere

Make Influence

Hele samarbejdet ét sted

Briefing, aftalte vilkår, tracking-links og resultater ligger samlet — så brand og influencer ser de samme tal.

Sådan virker detSe hele Academy