Tre uger før

Et strategisk initiativ misser en vigtig milepæl i august. Ingen katastrofe, men dyrt nok til, at direktionen vil vide, hvorfor ingen så det komme.

Nogen finder det. Tre uger før milepælen faldt initiativets Team Confidence tydeligt — fra et niveau, det havde ligget stabilt på i to perioder. Signalet stod i systemet. Ingen kiggede.

På næste direktionsmøde bliver konklusionen formuleret på tolv ord: »Team Confidence var vores ledende indikator. Vi skal bare reagere hurtigere på den.«

Det kan være rigtigt. Problemet er, at vi ikke ved det endnu — og at sætningen ændrer, hvad direktionen kigger på, og hvad der udløser eskalering. Så inden nogen beslutter noget, ser strategichefen på de tre andre initiativer fra perioden.

Fire initiativer i den samme periode
  • Initiativ A Team Confidence faldt. Milepælen blev senere misset.
  • Initiativ B Team Confidence faldt. Milepælen blev nået alligevel.
  • Initiativ C Team Confidence lå stabilt. Milepælen blev alligevel misset.
  • Initiativ D Team Confidence lå stabilt. Milepælen blev nået.

Initiativ A er historien, mødet startede med. De tre andre havde ingen set på, fordi de ikke fejlede på en måde, der krævede en forklaring. Med alle fire på bordet ændrede signalet sig to gange — og resultatet fulgte efter den ene.

CEO'en stiller det spørgsmål, der bliver hængende resten af paperet: »Hvornår har vi egentlig evidens nok til at kalde noget ledende?«

Bemærk, hvad casen ikke afgør. Den siger ikke, at Team Confidence er ubrugelig, eller at signalet er uden værdi. Den siger kun, at én historie, der passer, ikke er nok til at vide, om signalet holder.

Før er ikke det samme som ledende

Serien har brugt seks papers på at gøre eksekveringen synlig. Paper 01 skelnede mellem resultatindsigt og eksekveringsindsigt. Paper 02 spurgte, hvad en grøn status dækker. Paper 03 handlede om, hvad et tal på en vurdering kan bære. Paper 04 viste kapaciteten mellem initiativerne, Paper 05 beslutningerne som arbejde, og Paper 06 friktionen som eksekveringsdata.

Hvert af dem sluttede med den samme forsigtighed: illustrative signalhypoteser — ikke validerede ledende indikatorer. Det var ikke en tom formulering, men et løfte om, at spørgsmålet ville blive taget alvorligt, når vi nåede hertil.

Vi er her nu. Og svaret begynder med et skel, der er lettere at acceptere end at overholde.

Først en oplysning om ordet. Begrebet »ledende indikator« bruges forskelligt på tværs af fag — nogle steder om et forebyggende mål, andre steder om et mål med en efterprøvet relation til et senere resultat. Her bruger jeg det bevidst stramt: et signal får først status som ledende, når relationen til et navngivet senere resultat er efterprøvet i en defineret population og tidshorisont. Alt før det kalder jeg observation, tidligt signal, signalhypotese eller kandidat. Det er en metodisk konvention i dette paper — ikke en påstand om, at alle fag bruger ordet sådan.

Før er et spørgsmål om tid. Ledende er et spørgsmål om dokumenteret relation.— Thomas Friisnæs

At et signal kommer først, gør det til et tidligere signal. Ikke til en ledende indikator. Rækkefølgen er en observation, enhver kan gøre bagefter. Relationen er en påstand, der skal kunne efterprøves.

Skellet er krævende, fordi ordet ledende er nemt at tildele og langt sværere at dokumentere. Det lyder som en egenskab ved tallet, men en ledende indikator er ikke en type tal. Det er en relation mellem ét bestemt signal og ét bestemt senere resultat, inden for en bestemt periode og sammenhæng. Fjerner man et led, er påstanden ikke forkert. Den er ufuldstændig.

Og så er der den pointe, jeg vender tilbage til til sidst: et signal kan være ledelsesmæssigt nyttigt, længe før det er valideret som prædiktivt. Paperet handler om ikke at forveksle de to spørgsmål.

Ledende for hvad?

Sætningen »det er en ledende indikator« er ikke forkert. Den er uafsluttet — den mangler det, den er ledende for.

Prøv den på casen. Team Confidence kan tænkes at hænge sammen med, om et initiativ misser en milepæl i den følgende periode — et konkret, afgrænset resultat, og noget helt andet end at hævde, at Team Confidence er ledende for omsætning, markedsandel eller »strategiens succes«. De ting har forskellige tidsskalaer og målemetoder.

Det samme gælder seriens øvrige signaler. Alderen på en åben beslutning kan hænge sammen med, hvor længe et stykke arbejde står stille. Om den også siger noget om strategiens resultat to år senere, er et langt sværere spørgsmål.

Derfor er en påstand om, at noget er ledende, først fuldstændig, når den har tre led:

Tre led, en påstand om ledende ikke kan undvære
  • Resultatet Hvilket konkret, senere forhold skal signalet sige noget om? Ikke »succes«, men en milepæl, der skrider, et scope, der skæres, en lancering, der rykker.
  • Populationen For hvilke initiativer, enheder eller sager gælder relationen? Den, der gælder for store tværgående programmer, gælder ikke nødvendigvis for små lokale.
  • Tidshorisonten Hvor lang tid før? Et signal kan hænge sammen med noget, der sker om tre uger, og ikke med det samme om et år.

De tre led afgør, hvad man kan gøre. Et signal om næste uge kalder på en anden handling end et, der peger et halvt år frem — og et, der kun gælder én type initiativ, skal ikke udløse eskalering på tværs af porteføljen.

Spørgsmålet, der gør arbejdet, er derfor kort nok til at stille ved et direktionsbord: Ledende for hvad — og over hvilken tidshorisont?

Spørgsmålet er kort, fordi det skal kunne stilles. Populationen følger som det næste: for hvilke initiativer?

At styrken kan variere, er ikke kun en retorisk pointe. I et studie af CEO-aflønningsordninger arbejder Vincent O'Connell og Don O'Sullivan med det, de kalder lead indicator strength — hvor stærkt kundetilfredshed i den enkelte virksomhed hænger sammen med senere indtjening — og undersøger, om en stærkere relation oftere følges af, at aflønningen kobles til målet.

Forskningsgrundlag (empirisk studie, CEO-aflønning): O'Connell & O'Sullivan (2014), »The influence of lead indicator strength on the use of nonfinancial measures in performance management: Evidence from CEO compensation schemes«, Strategic Management Journal, 35(6), 826–844. Konteksten er kundetilfredshed som ikke-finansielt mål i aflønningsordninger. Bruges alene som empirisk eksempel på, at lead indicator strength kan operationaliseres som styrken i relationen mellem et bestemt mål og et bestemt senere resultat — ikke som evidens for, at alle fag definerer »ledende indikator« sådan, og ikke som evidens for, at kundetilfredshed generelt er en ledende indikator for indtjening.

Det, der overføres, er formen — ikke resultatet og ikke metoden. Det er den form, jeg bruger i dette paper: relationen kan være stærkere eller svagere og kan derfor undersøges. »Ledende« bliver dermed en evidenspåstand — ikke bare et label.

Niveau, retning og forspring

Når et signal bliver diskuteret, bliver tre spørgsmål typisk til ét. Skellet nedenfor er mit eget, ikke en etableret taksonomi, men det afgør, hvad man kan sige.

Tre spørgsmål, der besvares hver for sig
  • Niveauet Hvor står signalet nu? Ét tal fra én periode. Det siger, hvor vi er — ikke hvor vi er på vej hen.
  • Retningen Hvordan har signalet ændret sig? Det kræver mindst to sammenlignelige tidspunkter, den samme definition og den samme målemetode. Ændrer definitionen sig undervejs, er kurven ikke en retning. Den er to forskellige mål tegnet sammen.
  • Forspringet Har signalet en dokumenteret relation til et navngivet senere resultat? Det er hverken niveauet eller retningen. Det er et tredje spørgsmål, som kun data over tid kan besvare.

Sammenblandingen er nem at få øje på, når den står alene. En eksekveringsscore på 72 kan være steget fra 55, faldet fra 88 eller ligget stille i tre perioder. Samme tal, tre forløb — og ingen af dem fortæller, hvad der sker i næste periode.

Et højt niveau er ikke fremdrift. En stigende kurve er ikke i sig selv en ledende indikator. Det første er et øjebliksbillede, det andet er en beskrivelse af noget, der allerede er sket. Begge kan være rigtige. Ingen af dem er en påstand om fremtiden, før relationen er undersøgt.

Vær særligt opmærksom, når et mål bærer ordet momentum i navnet. Beregnes tallet på den aktuelle periodes værdier, beskriver det den aktuelle periode — uanset hvad det hedder.

Et signal skal overleve alle fire felter

De fire initiativer fra åbningscasen er ikke tilfældige historier. Når signalet og resultatet er defineret binært — ændrede sig / ændrede sig ikke og indtraf / indtraf ikke — er de de fire mulige kombinationer og tilsammen den prøve, ethvert signal skal bestå.

Illustration · konstrueret eksempel
Et signal skal overleve alle fire felter
Resultatet kom
Resultatet kom ikke
Signalet
ændrede sig
Signal · resultatRamteInitiativ A. Signalet faldt, og milepælen skred bagefter.
Signal · intet resultatFalsk alarmInitiativ B. Signalet faldt, og milepælen blev nået alligevel.
Signalet
ændrede sig ikke
Intet signal · resultatMisset varselInitiativ C. Signalet lå stille, og milepælen skred alligevel.
Intet signal · intet resultatStille sagInitiativ D. Hverken signal eller afvigelse.

Konstrueret eksempel med fire illustrative initiativer. Felterne kræver, at både signalet og resultatet er defineret på forhånd — hvad tæller som en ændring, hvad tæller som resultatet, og inden for hvilken periode.

Ser du kun på de gange, signalet ramte, validerer du historien — ikke signalet.

Og så er der det, casen ikke sagde. Med én sag i hvert felt ændrede signalet sig i halvdelen af sagerne, og resultatet indtraf i halvdelen: signalet skiller ikke de fire initiativer ad. Det var præcis den fordeling, mødet læste som et varsel.

I en retrospektiv forklaring er det fristende at holde sig til de to felter til venstre. »Ramte« bliver til beviset, »misset varsel« bliver til grunden til at indføre et nyt signal, og ingen har bedt om en forklaring på B og D. Men hvis de falske alarmer og de stille sager ikke bliver hentet frem, kan relationen ikke vurderes — og så kan spørgsmålet, der afgør sagen, ikke besvares: hvor ofte ændrer signalet sig, uden at der sker noget?

Falske alarmer er ikke en teknikalitet. De koster opmærksomhed, møder og indgreb i initiativer, der ikke havde brug for det — og den pris skal ikke opgøres i kroner for at være reel. Missede varsler er den modsatte fejl: sagerne, hvor systemet var tavst, og det gik galt alligevel.

Når en konkret tærskel eller beslutningsregel vælges, vil der ofte være en afvejning mellem falske alarmer og missede varsler. Et bedre signal kan flytte hele afvejningen, men ingen af fejltyperne må forsvinde ud af vurderingen. Hvor grænsen skal ligge, hører til Paper 09. Her er pointen kun, at begge felter skal med, før nogen bruger ordet ledende.

Og en ting, der er nem at glemme: et signal behøver ikke ramme hver gang for at være nyttigt. Validering handler om dokumenteret performance under en defineret test — ikke om fejlfrihed. Et signal må gerne tage fejl; det afgørende er, at vi ved hvor ofte, hvordan og i hvilken sammenhæng.

Bedre end hvad?

Selv et signal, der rammer ofte, kan være uden værdi. Det afhænger af alternativet.

Forestil dig, at ni ud af ti initiativer rammer deres milepæle. Et signal, der altid siger »det går efter planen«, får ret i ni ud af ti tilfælde. Det lyder imponerende, men siger det samme som at gætte på det almindeligste udfald. Det tilfører ingen information.

Derfor skal enhver påstand om et signal besvare et spørgsmål mere: bedre end hvad? Sammenligningsgrundlaget behøver ikke være avanceret — hvor ofte resultatet plejer at indtræffe, eller hvad statusbilledet allerede ville have fortalt.

Et signal bliver først interessant som varsel, når det gør os bedre end et rimeligt udgangspunkt.— Thomas Friisnæs

Den anden halvdel af spørgsmålet er lige så vigtig: fortæller signalet os noget, vi ikke allerede vidste?

Falder Team Confidence først, efter at forsinkelsen er synlig i rapporteringen, er signalet ikke tidligt. Det er en anden måde at se det samme på — stadig nyttigt, bare ikke som varsel. Et signal skal have et forspring i forhold til det billede, organisationen har i forvejen. Ellers bekræfter det bare.

Discipliner, der lever af at forudsige, har formaliseret det. En metoderamme fra epidemiologien anbefaler, at prædiktionsmodeller vurderes ad flere dimensioner — blandt andet hvor godt de adskiller de tilfælde, der ender forskelligt, og hvor godt vurderingerne stemmer med det, der faktisk sker. Pointen for et direktionsbord er princippet: en prædiktiv påstand skal vurderes eksplicit og ad flere dimensioner. Én beskrevet sammenhæng er ikke nok.

Metodegrundlag (prædiktionsmodeller, epidemiologi): Steyerberg, Vickers, Cook m.fl. (2010), »Assessing the Performance of Prediction Models: A Framework for Traditional and Novel Measures«, Epidemiology, 21(1), 128–138. Konteksten er kliniske prædiktionsmodeller, og dette paper bygger ikke en sådan model. Bruges alene til det generelle metodiske princip, at prædiktive påstande kræver eksplicit vurdering ad flere dimensioner — ikke til at overføre kliniske mål eller metrikker til strategieksekvering.

At forudsige er ikke at forklare

Antag nu, at relationen holder: Team Confidence falder, og milepælen skrider oftere bagefter, også når de andre felter tælles med. Så ligger den næste fejl klar — at behandle signalet som årsagen.

Galit Shmueli beskrev i en metodeartikel fra 2010 forskellen mellem to formål med statistisk modellering — at forklare og at forudsige — og gjorde opmærksom på, at sammenblandingen er udbredt. Antagelsen om, at høj forklaringskraft også giver høj forudsigelseskraft, holder ikke nødvendigvis.

Metodegrundlag (statistisk metodeartikel): Shmueli (2010), »To Explain or to Predict?«, Statistical Science, 25(3), 289–310. Generel statistisk metodelitteratur; artiklen handler ikke om strategieksekvering. Bruges alene til skellet mellem at forklare og at forudsige som forskellige formål, og til pointen, at høj forklaringskraft ikke automatisk medfører høj forudsigelseskraft.

Oversat til vores sammenhæng betyder det to ting, der begge er ubekvemme:

Noget kan forudsige uden at være årsagen. Faldende Team Confidence kan være et symptom på noget, teamet allerede har opdaget. Eller den kan dele en fælles årsag med forsinkelsen — en afhængighed, der er skredet, og som både påvirker humøret og tidsplanen. I begge tilfælde kan signalet hjælpe med at se noget tidligere. I ingen af dem forårsager det forsinkelsen.

Det har en direkte konsekvens for handlingen. Falder Team Confidence, følger det ikke, at man skal hæve Team Confidence — det ville være at behandle termometeret. Det, der følger, er at undersøge, hvad faldet handler om.

Og noget kan være en årsag uden at være en god forudsigelse. En faktor kan have reel betydning og alligevel være ubrugelig til at skelne mellem de initiativer, der klarer sig, og dem der ikke gør — fordi den varierer for lidt, måles for upræcist eller slår igennem for sent.

En beslægtet antagelse har en ældre form i strategisk performance-måling. Hanne Nørreklit analyserede i 2000 kritisk nogle af Balanced Scorecards antagelser og undersøgte, i hvilket omfang der er en årsags-virkningsrelation mellem kortets fire perspektiver. Pointen er ikke en dom over modellen, men at en kæde mellem drivere og resultater ikke bliver dokumenteret af at blive tegnet.

Forskningsgrundlag (kritisk analyse): Nørreklit (2000), »The balance on the balanced scorecard — a critical analysis of some of its assumptions«, Management Accounting Research, 11(1), 65–88. En kritisk analyse af Balanced Scorecards antagelser, herunder i hvilket omfang der findes en årsags-virkningsrelation mellem de fire perspektiver. Bruges alene til princippet, at en antaget årsagskæde mellem drivere og resultater skal undersøges, ikke forudsættes — ikke som dom over Balanced Scorecard som styringsredskab.

Når en ledelsesmodel indeholder sådan en kæde, er kæden ikke i sig selv problemet — den gør en antagelse eksplicit. Problemet opstår, når pilen mellem to kasser bliver læst som et resultat i stedet for som det, den er: en antagelse, der endnu ikke er efterprøvet.

Tidshorisonten er en del af påstanden

Et signal kan hænge sammen med noget, der sker om tre uger, og slet ikke med det samme et halvt år senere. Eller omvendt: være uden værdi på kort sigt og alligevel sige noget om et forløb over et år.

Derfor er »ledende« uden en tidshorisont metodisk ufuldstændigt. Det tredje led fra afsnit 03 rummer i praksis tre spørgsmål: Hvor længe før? Målt over hvilken periode? Og med hvilken kadence i opfølgningen?

Kadencen bliver overset. Hvis selve signalet kun observeres ved kvartalsskift, kan et forspring på tre uger ikke opløses i data — ikke fordi forspringet ikke findes, men fordi målingen ikke er fin nok til at se det. En månedlig observation kan tilsvarende være for grov til at dokumentere rækkefølgen i et forløb, der udspiller sig på ti dage.

Jeg vil ikke foreslå et bestemt antal dage. Der findes ingen universel lead time. Horisonten skal vælges ud fra det resultat, signalet skal sige noget om, og ud fra hvor lang tid en handling skal bruge for at nå at virke. Et varsel, der kommer for sent til at handle på, kan være korrekt og stadig kun bruges til at kalibrere næste periode.

Historier fortalt bagfra er ikke validering

Tilbage til åbningscasen. Det, der skete på mødet, var ikke en analyse, men en søgning med facit i hånden — og ingen havde defineret, hvad »tydeligt« betød, før mødet begyndte.

Når resultatet er kendt, er det let at finde noget, der gik forud: en survey, der faldt, en kommentar i et referat, en beslutning, der trak ud. Jo flere målepunkter organisationen kan lede tilbage i, desto lettere bliver det bagefter at finde mindst ét, der bevægede sig i en retning, som passer til historien. Det kan være et resultat af antallet af målepunkter lige så vel som af forudgående indsigt.

Modtrækket er ikke mistro over for egne observationer, men at flytte beslutningen om, hvad der tæller, hen før man kender svaret.

  • Hvilket signal ser vi på — og hvad tæller som en ændring?
  • Hvilket konkret resultat skal det sige noget om?
  • Over hvilken tidshorisont?
  • I hvilken retning forventer vi, relationen går?
  • Hvad vil vi kalde en træffer, en falsk alarm og et misset varsel?

Fem spørgsmål, besvaret skriftligt før perioden begynder. Det er hele indgrebet — ikke hele metoden, for sammenligningsgrundlaget og populationen kommer til nedenfor. Det fjerner ikke usikkerheden, men det gør det sværere at vælge sit bevis bagefter.

Og en ting mere, før nogen tror, det er nemt. Arbejdsmiljøområdet har arbejdet med ledende indikatorer længe. Et scoping review fra 2025 gennemgik 48 studier af, hvordan de faktisk præsterer. Forfatterne skriver, at ingen to studier undersøgte det samme forskningsspørgsmål, hvilket forhindrede en meningsfuld sammenfatning. De fleste rapporterede en positiv sammenhæng — men forfatterne vurderer samlet evidensgrundlaget som svagt på tre punkter: studiedesignene var ikke egnede til at afgøre årsag, den interne validitet var moderat til lav, og resultaterne lod sig dårligt generalisere.

Forskningsgrundlag (scoping review, arbejdsmiljø): Watkins m.fl. (2025), »A scoping review of the evidence base for the performance of leading indicators for improving safety outcomes«, Journal of Safety Research, 95, 530–544: søgning i otte databaser, 48 inkluderede primærstudier. Konteksten er arbejdsmiljø og sikkerhed, ikke strategieksekvering, og reviewet siger intet om strategiske signaler. Bruges alene som tværfaglig forsigtighed: selv i et felt, hvor ledende indikatorer har været brugt længe, er definitioner, evidens og validering fortsat vanskelige.

Det er ikke et argument for at lade være, og ikke en dom over vores egne tal — reviewet handler om et andet fag. Det er et argument om vores selvsikkerhed. Hvis et felt med sin egen forskningstradition kan nå frem til, at evidensgrundlaget er svagt, skal vi være varsomme med at kalde vores egne tal ledende efter én periode og fire initiativer.

Signalhypotesen — den ærlige mellemstation

Mellem »det her ser vi ofte« og »det er en valideret ledende indikator« ligger en nyttig arbejdsposition. Når den mangler et navn, ender samtalen let i enten overdrivelse eller afvisning.

Jeg kalder den en signalhypotese — mit eget arbejdsbegreb, ikke en etableret term.

Signalhypotese
  • Definition en eksplicit, testbar antagelse om, at et bestemt eksekveringssignal kan have en relevant relation til et navngivet senere resultat inden for en defineret tidshorisont.
  • Skabelon Når [signal] ændrer sig på [defineret måde], forventer vi oftere [navngivet resultat] inden for [horisont].

Skabelonen er ikke en formalitet. Den tvinger de led frem, som den løse udgave springer over, og gør påstanden mulig at tage fejl af. En hypotese, der ikke kan vise sig forkert, er en overbevisning.

Bemærk også, hvad der skal navngives som resultat. »Strategiens succes« kan man ikke teste imod. Et studie af eksekveringsbegrebet, afprøvet på 276 virksomheder, opbygger begrebet af flere dimensioner og skelner mellem de handlinger, der skal gennemføres, og de resultater, de forventes at give. Begrebet kan måles — men ikke som ét forhold, og det er en god grund til ikke at bede ét signal dække det hele.

Forskningsgrundlag (målemodel, 276 virksomheder): de Oliveira, Carneiro & Esteves (2019), »Conceptualizing and measuring the ›strategy execution‹ construct«, Journal of Business Research, 105, 333–344: en begrebs- og målemodel afprøvet på 276 virksomheder, som omfatter årsager (de handlinger, der skal gennemføres) og konsekvenser (de resultater, handlingerne forventes at give). Bruges alene til, at eksekvering er flerdimensionel, og at handlinger og resultater er begrebsmæssigt forskellige — ikke som validering af noget bestemt signal.

Signalhypotesen er ét trin på en stige. Stigen nedenfor er mit eget praktiske skel, ikke en akademisk taksonomi, og den bruges på ét signal ad gangen. Dens funktion er at svare ærligt på: hvad ved vi egentlig om det her signal i dag?

Model · Thomas Friisnæs' praktiske evidensstige
Seks trin — hvad ved vi om signalet?

Status, ikke kvalitet. Et signal på trin 2 kan være mere nyttigt end et på trin 5.

TrinHvad der skal til — og hvad man må sige
1 · Observation»Vi kan se det«Signalet er defineret og registreres. Man må sige, hvad der står. Ikke hvad det betyder for noget senere.
2 · Tidligt signal»Det kom før«Signalet blev i en eller flere sager observeret før et relevant resultat. Man må sige rækkefølgen — ikke at den gentager sig.
3 · Signalhypotese»Vi har skrevet den ned«Relationen er gjort eksplicit og testbar med resultat, retning og horisont — før næste periode. Man må sige, at den testes.
4 · Kandidat»Den holder indtil videre«Relationen er gentaget over flere perioder, med begge fejltyper talt med, og ligger over det udgangspunkt, den blev sammenlignet med. Man må sige kandidat. Ikke ledende.
5 · Lokalt valideret»Vi har testet den her«Relationen er testet mod det definerede resultat over den definerede horisont, med begge fejltyper talt med, mod et rimeligt udgangspunkt og på perioder, der ikke blev brugt til at finde den. Lokalt betyder: i denne organisation, i denne sammenhæng, i denne periode.
6 · Overvåget»Og vi tester den igen«Relationen genbesøges. Ændrer processen, strategien, populationen eller målemetoden sig, kan den forsvinde. Validering er ikke permanent.
Trinnet er ikke en dom over signalet. Det er en oplysning om, hvor meget vægt det kan bære i en beslutning.

Det er helt legitimt, at et signal bliver stående på trin 1 til 3. Problemet opstår først, hvis det omtales, som om det stod på trin 5.

Trin 6 fortjener en bemærkning. En relation kan forsvinde af sig selv — men også fordi organisationen begynder at styre efter signalet. Får et mål vægt i governance, kan adfærden omkring det ændre sig. Det er ikke nødvendigvis snyd; det kan være den reaktion, man ønskede. Men relationen skal genbesøges, netop fordi man bruger den.

Fra signalhypotese til evidens

Evidensstigen i afsnit 10 siger, hvor et signal står. De seks led nedenfor er arbejdsgangen, der kan flytte det — ét signal ad gangen. Ingen modenhedsmodel, ingen score, ingen garanti for, at signalet ender højere, end det begyndte.

Framework
Fra signalhypotese til evidens
Thomas Friisnæs' praktiske arbejdsgang til ét signal ad gangen. Ender i en evidensstatus, ikke i et tal.
1

Navngiv resultatet

Hvad præcis skal signalet sige noget om? Ikke »strategiens succes«, men noget, der kan afgøres: en milepæl, der skrider, et scope, der skæres, en beslutning, der står åben ud over en aftalt grænse. Kan I ikke blive enige om, hvornår resultatet er indtruffet, kan I ikke teste det. Sig samtidig, for hvilke initiativer påstanden gælder.

2

Fastlæg tidshorisonten

Hvor tidligt skal signalet være relevant — og hvor tidligt kan I se det? Én opfølgningsperiode, to, eller en anden konkret horisont. Vælg den ud fra, hvor lang tid en handling skal bruge for at virke. Horisonten aftales før analysen, ikke efter.

3

Formulér signalhypotesen

Skriv den ned, før perioden begynder. Når [signal] ændrer sig på [defineret måde], forventer vi oftere [resultat] inden for [horisont]. Definér samtidig, hvad der tæller som en ændring. Ingen universelle tærskler — jeres definition er jeres valg, og den skal kunne begrundes.

4

Tæl hele billedet

Alle fire felter, ikke kun træfferne. Hvor ofte kom signal og resultat sammen? Hvor ofte kom signalet uden resultat? Resultatet uden signal? Og hvor ofte skete ingen af delene? Sammenlign så med et rimeligt udgangspunkt, og spørg, om signalet tilføjer noget til det statusbillede, I har.

5

Afprøv på nye data

En relation, der er fundet i et datasæt, skal bekræftes uden for det. Brug de næste perioder, nye initiativer eller den del af materialet, der ikke blev brugt til at finde den. Holder den ikke, så nedgradér evidensstatus. Det er ikke et nederlag — det er det, der gør de øvrige trin troværdige.

6

Hold øje med relationen

Også et signal, der har virket, skal genbesøges. Ændrer processen, strategien, populationen eller målemetoden sig, kan relationen forsvinde — og det gælder også, når I selv begynder at styre efter signalet. Sæt en dato for næste eftersyn, samtidig med at I tager signalet i brug.

Rammen ender ikke i en score, men i en sætning, en direktion kan bruge: dette signal står i dag på trin tre, det testes mod dette resultat over denne horisont og for disse initiativer, og vi gør status, når perioden er slut.

Et signal kan være nyttigt, før det er valideret

Alt det foregående kunne læses som en opfordring til at droppe signaler, indtil de er bevist. Det ville være den forkerte konklusion — to ting skal holdes adskilt.

To forskellige værdier
  • Varslingsværdi Hvor godt siger signalet noget om et senere resultat? Det er spørgsmålet, resten af paperet har handlet om, og det kræver evidens.
  • Undersøgelsesværdi Får signalet ledelsen til at tage et initiativ op, den ellers ikke havde taget op i denne periode? Det kræver ikke prædiktiv validering. Men det bør stadig vurderes på, om signalet bringer ny, beslutningsrelevant information frem til en rimelig belastning.

Et signal med høj varslingsværdi kan være ubrugeligt, hvis det først kommer, når alt er afgjort. Og et utestet signal kan være værdifuldt med det samme, hvis det får en direktion til at spørge ind til et initiativ, den ellers ikke havde talt om. Gratis er det ikke: det signal, der åbner den gode samtale, er det samme, der af og til åbner den unødvendige. En undersøgelse bruger også tid og opmærksomhed; forskellen er, at signalet ikke i sig selv udløser den endelige handling.

Sådan har de foregående papers brugt deres signaler. Alderen på en åben beslutning, den gentagne friktion ved samme grænseflade, den kapacitet, der er lovet to steder — ingen er validerede varsler. Hver især er de en grund til at åbne en samtale tidligere, ikke mere.

Et signal behøver ikke være en valideret forudsigelse for at være et legitimt ledelsessignal. Det skal bare ikke omtales som noget, det ikke er.— Thomas Friisnæs

Seriens rækkefølge gælder også her: signal, undersøgelse, diagnose, beslutning, handling. Ikke signal og så handling. Et signal, der automatisk udløser en indgriben, har sprunget det led over, hvor man kunne have opdaget, at det var en falsk alarm.

Og en sidste balance er værd at sige højt: et resultatmål er ikke gammeldags. Det, der er sket, er ofte mere direkte målt og bedre egnet til ansvarlighed end noget signal undervejs. De to har forskellige opgaver, det ene erstatter ikke det andet, og en governance-model med kun den ene slags mangler noget.

Hvad kunne du se tidligere?

Den faste rubrik får en anden funktion her. Hidtil har den vist, hvad man kan få øje på — nu, hvordan man skriver det ned, så det kan afprøves.

Seriens signatur · Paper 07
Signalhypoteser — ikke validerede ledende indikatorer
Signalet og ændringenMuligt resultat, horisont — og hvad der skal testes
Team Confidence falder mærkbart på ét initiativMuligt resultat: milepæl, der skrider i den følgende periode. Plausibelt, hvis teamets vurdering kan fange forhold, før de bliver synlige i statusrapporteringen. Test: hvor ofte faldt den uden at noget skred?
Alderen på åbne beslutninger med høj påvirkning stigerMuligt resultat: arbejde, der står stille i næste periode. Plausibelt, fordi noget venter på valget. Test: skete det også, når alderen ikke steg?
Den vurderede kapacitetsrealisme falder over to perioderMuligt resultat: leverance, der rykkes inden for kvartalet. Plausibelt, hvis de, der udfører arbejdet, ser belastningen før planen gør. Test: hvor ofte rykkede noget uden faldet?
Gentagen friktion ved en kritisk grænseflade tager tilMuligt resultat: genarbejde eller forsinkelse inden for de følgende to perioder. Plausibelt, fordi den type modstand kan skabe ventetid eller genarbejde. Test: hvad skete der de gange, gentagelsen ikke tog til?
Mængden af igangsat, men ikke afsluttet arbejde vokserMuligt resultat: længere gennemløbstid i næste periode. Plausibelt, fordi meget påbegyndt arbejde deler den samme kapacitet. Test: gælder det for alle initiativtyper eller kun nogle?
Den vurderede milepælsfremdrift sakker bagud i forhold til planenMuligt resultat: milepæl, der misses. Men tilføjer det noget ud over statusrapporteringen? Test: kommer signalet før eller samtidig?
Antallet af lokale omveje omkring det samme procestrin stigerMuligt resultat: kvalitetsafvigelse eller genarbejde inden for kvartalet. Plausibelt, men svagt observeret. Test: registreres omvejene overhovedet konsekvent?
Andelen af beslutninger, der bliver lukket, falder over flere perioderMuligt resultat: flere initiativer med arbejde, der står stille, i den følgende periode. Test: hvad tæller nævneren med — og ændrede den sig, samtidig med at andelen faldt?

Alle otte er signalhypoteser. Ingen af dem er validerede ledende indikatorer, forudsigelser eller årsager. »Plausibelt« er en foreslået mekanisme, ikke evidens — derfor er linjen en hypotese. Horisonterne er eksempler, og hvad der tæller som en ændring, står bevidst udefineret: det er jeres valg i trin 3. Testlinjen er det første spørgsmål, ikke hele testen; den kræver alle fire felter og et sammenligningsgrundlag.

Bemærk, hvad hver linje gør ud over at pege på noget: den navngiver et resultat, siger hvorfor relationen er plausibel, og hvad der skal undersøges først. Det er forskellen på en liste over KPI'er og et register over hypoteser.

Hvad må du ikke konkludere?

Den anden faste rubrik er vigtigere her end i de foregående papers, fordi fejlslutningerne er så nemme at gøre i god tro.

Seriens signatur · Paper 07
Hvad må du ikke konkludere?

Ud fra et signal, der kom før et resultat, kan du ikke konkludere …

  • at det er en ledende indikator
  • at det forårsagede resultatet
  • at rækkefølgen gentager sig
  • at den grænse, I valgte, er den rigtige
  • at en indsats rettet mod signalet ændrer resultatet

Ud fra en samvariation kan du ikke konkludere …

  • at der er en årsagssammenhæng
  • at relationen kan handles på
  • at den gælder uden for jeres eget materiale

Ud fra et signal, der er valideret ét sted, kan du ikke konkludere …

  • at det gælder universelt
  • at horisonten er den samme andre steder
  • at grænsen er den samme
  • at det gælder for en anden population
  • at det bliver ved med at gælde

Ud fra en høj samlet score kan du ikke konkludere …

  • at fremtiden ser god ud
  • at kurven peger opad
  • at strategien lykkes
Et tidligt signal kan give ledelsen et bedre spørgsmål. Det giver ikke automatisk et svar om fremtiden.

Det gælder også opad. En bestyrelse behøver normalt ikke valideringsmatricer, men kan have god grund til at spørge, hvilke tidlige varsler direktionen stoler på, om relationerne er efterprøvede, og hvilke der stadig kun er hypoteser. Det er et rimeligt bestyrelsesspørgsmål.

Hvad kalder vi ledende uden at vide det?

Individuel øvelse · CEO, direktionsmedlem, CFO eller Strategy Office · Skriftlig
⏱ Cirka 10 minutter · Ingen score og ingen modenhedsvurdering.

Vælg ét tal, som organisationen i dag omtaler som ledende, som et tidligt varsel eller som et udtryk for fremdrift. Svar skriftligt og i rækkefølge.

  1. Hvilket konkret senere resultat siger vi, at signalet leder?
  2. Over hvilken tidshorisont?
  3. Blev relationen defineret før resultatet — eller bagefter?
  4. Hvor mange sager bygger vi det på?
  5. Hvor ofte ændrede signalet sig, uden at resultatet kom?
  6. Hvor ofte kom resultatet, uden at signalet ændrede sig — og hvor ofte skete ingen af delene?
  7. Hvad ville et rimeligt udgangspunkt have sagt?
  8. Tilføjer signalet noget ud over det, vi allerede kunne se?
  9. Hvilket trin på evidensstigen fortjener det i dag?
  10. Hvad er den billigste næste test?

Øvelsen ender ikke i en score, men i seks linjer: ét signal · ét resultat · én horisont · ét sammenligningsgrundlag · én evidensstatus · ét næste valideringstrin. Kan du ikke besvare spørgsmål 5 og 6, er det svaret på spørgsmål 9.

Stil det spørgsmål, ingen stiller

⏱ 2 minutter · ved næste strategigennemgang

Ét spørgsmål, to opfølgende og ét tilbud. Ingen ny proces og intet ekstra møde.

Næste gang nogen siger »det er en ledende indikator«, så spørg: »Ledende for hvad — og over hvilken tidshorisont?«

Derefter: »Hvad er vores evidens — og hvor ofte har signalet taget fejl?«

Er svaret »det plejer vi at kunne se«, så er det ikke et nederlag. Så er det et sted at begynde: »Fint. Så lad os kalde det en signalhypotese og skrive den ned, før næste periode.«

Bemærk tonen. Spørgsmålet er ikke en afvisning af signalet — det er en opgradering af, hvordan det bliver brugt. Den forskel kan have betydning for, om folk fortsat bringer usikre signaler frem, før de er færdiganalyseret.

Gør det konkret — og fortsæt din vej gennem serien

Paper 07 · Før resultatet flytter sig Ikke gennemført endnu

Serien er bygget til at blive brugt, ikke bare læst. Skriv ét konkret næste skridt; det gemmes kun lokalt i din browser.

Skriv signalet, dets definition, hvad der tæller som en ændring, resultatet, populationen, horisonten, sammenligningsgrundlaget, hvad der tæller som træffer, falsk alarm og misset varsel — og hvornår I gør op. Eksempel: »Signal: Team Confidence på initiativniveau, defineret som medianen af de indsendte vurderinger. Ændring: fald på mindst ét trin fra én periode til den næste. Resultat: milepæl, der rykkes. Population: de strategiske initiativer i porteføljen. Horisont: den følgende periode. Sammenligning: hvor ofte milepæle rykkes i det hele taget. Træffer: fald efterfulgt af rykket milepæl. Falsk alarm: fald uden rykket milepæl. Misset varsel: rykket milepæl uden fald. Gøres op efter Q2.« Eksemplet er en illustration, ikke en anbefaling.

✓ Gemt lokalt
Din vej gennem Strategien sker mellem kvartalerne0 af 10 gennemført
Se alle serier i Executive Library →

FAQ

Hvad er forskellen på et tidligt signal og en ledende indikator? +
I dette paper bruger jeg skellet sådan: tidligt handler om timing — signalet blev observeret før resultatet. Ledende kræver derudover en efterprøvet relation til et navngivet senere resultat for en bestemt population inden for en defineret tidshorisont. Det første kan konstateres i én sag. Det andet kræver, at relationen testes. Andre fag bruger »ledende indikator« bredere; dette er paperets bevidst strenge metodiske konvention (se afsnit 02).
Skal et ledende signal være årsagen? +
Nej. At forudsige og at forklare er to forskellige formål. Et signal kan sige noget om et senere resultat uden at være det, der frembringer det — for eksempel fordi begge dele har en fælles bagvedliggende årsag (se afsnit 07).
Kan noget være en årsag og alligevel en dårlig forudsigelse? +
Ja. En faktor kan have reel betydning og stadig være ubrugelig til at skelne mellem de forløb, der går godt, og dem der ikke gør — hvis den varierer for lidt, måles for upræcist eller slår igennem for sent. Betydning og forudsigelseskraft er ikke det samme.
Hvor mange observationer kræver en validering? +
Der findes ikke ét universelt minimum. Det afhænger af, hvor ofte resultatet indtræffer, hvor meget signalet varierer, hvor sammenlignelige sagerne er, og hvad relationen skal bruges til. Der er intet magisk antal, og et tal uden de forudsætninger siger ikke det, det ser ud til at sige.
Er en samvariation ikke nok? +
Nej. Den er højst ét element. Uden falske alarmer, missede varsler, et rimeligt sammenligningsgrundlag og en afprøvning på data, der ikke blev brugt til at finde relationen, er en samvariation en beskrivelse af fortiden (se afsnit 05 og 06).
Hvad med falske alarmer? +
De er en del af signalets præstation og skal tælles med. Et signal, der udløser opmærksomhed, møder og indgreb, hver gang det bevæger sig, har en pris, også når der ikke sker noget bagefter. Man må ikke kun tælle de gange, det ramte.
Hvad hvis resultatet kommer uden signal? +
Det er et misset varsel, og det skal tælles med. Hvor tungt det bør veje i en beslutning, afhænger af konsekvensen af at overse et relevant udfald sammenlignet med konsekvensen af en falsk alarm. Det er også det felt, der er lettest at glemme, fordi der ikke er noget at kigge på — signalet var jo tavst (se afsnit 05).
Er Team Confidence en ledende indikator? +
Ikke som generel påstand. Det kan være en signalhypotese, der kan testes mod et bestemt resultat over en bestemt horisont i jeres egen organisation. Om den så holder, er et empirisk spørgsmål — og svaret gælder jer, ikke alle.
Kan vi bruge et signal, der ikke er valideret? +
Ja. Som anledning til at undersøge noget tidligere — og det kan også indgå i en eksplicit governance-trigger, hvis organisationen accepterer afvejningen. Men reglen skal beskrives som et governance-valg, ikke som bevis på, at signalet forudsiger udfaldet. Jo mere irreversibel handlingen er, desto højere bør evidenskravet være (se afsnit 12).
Er signaler undervejs bedre end resultatmål? +
Nej. De har forskellige opgaver. Resultatmål er ofte mere direkte målt og bedre egnet til ansvarlighed, mens signaler på vejen kan gøre noget synligt tidligere. En governance-model, der kun har den ene slags, mangler noget.
Hvad gør jeg på mandag? +
Find ét tal, I kalder ledende eller et tidligt varsel. Spørg: ledende for hvad, over hvilken horisont, og hvad er vores evidens? Skriv derefter én signalhypotese ned, før næste periode begynder. Mikrohandlingen i afsnit 16 tager to minutter, diagnosen i afsnit 15 cirka ti.

Fra signal til evidens

Spørgsmålet, paperet efterlader, kræver ikke et værktøj: Ledende for hvad — og over hvilken tidshorisont? Kan I svare på det for bare ét af jeres tal ved næste strategigennemgang, har paperet gjort sit arbejde.

Det er rimeligt at sige, hvor jeg selv arbejder med spørgsmålet, og at jeg har en kommerciel interesse i værktøjet. Strategy Execution Observatory™ gør flere eksekveringssignaler synlige: beslutninger, vurderet milepælsfremdrift, kapacitet, friktion og teamets vurdering af tilliden til planen. Om de er synlige tidligere end det, statusrapporteringen viser, afgør synligheden ikke i sig selv. Det er den påstand, der skal testes — også af mig, og ingen af paperets kilder handler om de signaler.

Og her rammer paperet mit eget værktøj. Det sammensatte tal hedder Execution Momentum Index, men regnes på den aktuelle periodes komponentværdier: et øjebliksbillede, ikke en bane og ikke en forudsigelse. Navnet lover mere, end beregningen holder. Tærsklerne for, hvornår tallet kaldes stærkt eller svagt, er konfiguration og ikke kalibreret mod noget resultat. Dækning, beregning og fremstilling bruger heller ikke samme komponentafgrænsning, og det felt, hvor et team selv vurderer fremdriften, indgår slet ikke i beregningen. Og den vurdering, der hedder milepælsrate, opgøres som gennemsnitlig fremdrift — ikke som andelen af ramte milepæle.

Tallet kan være regnet korrekt og stadig være fortolket for stærkt. Det metodiske problem ligger i betydningen; formuleringerne er det, der rejser længst. Mit eget metodegrundlag har beskrevet Closure Rate som den stærkeste ledende indikator for strategirealisering, og min egen side taler om førende adfærdsindikatorer. Der er tre problemer i den formulering: stærkeste er en rangering uden sammenligning, strategirealisering er for bredt som senere resultat uden en eksplicit operationalisering, og ledende er ikke valideret over nogen defineret horisont. De enkelte mål bør derfor omtales som eksekveringssignaler, og det sammensatte EMI bør foreløbig beskrives som et composite execution signal — ikke som dokumenteret momentum eller et prædiktivt indeks.

Hvis mit eget værktøj bruger ordet ledende, skylder det samme evidens som alle andre.— Thomas Friisnæs

Det er ikke en undskyldning for værktøjet. Det er den ærlige status, målt på min egen stige: Observatorys nuværende signaler kan placeres på trin 1 — de er defineret, og de registreres. Et konkret signal kan først placeres på trin 2, når det kan dokumenteres, at det faktisk blev observeret før et navngivet senere resultat i en konkret sag. Det dokumenterer produktet ikke systematisk i dag. Trin 3 kræver desuden, at signal, resultat, population og horisont er specificeret, før perioden begynder — den struktur er heller ikke en del af metoden i dag. Det er samtidig køreplanen: log de fire led, tæl begge fejltyper, sammenlign med et rimeligt udgangspunkt, og validér på perioder, der kommer efter.

Samtale

Hvilket af jeres tal kalder I ledende?

Vælg ét tal, som nogen omtaler som et tidligt varsel. På 20 minutter kan vi skille tingene ad: hvilket resultat det skulle lede, over hvilken horisont, hvilket trin på evidensstigen det står på, og hvad den billigste næste test ville være.

20 min. Ét problem. Én plan. →

Næste problem

Sæt nu, at signalet er skrevet ned, testet og holder. Så står det spørgsmål tilbage, som al tidlig viden løber ind i. Et tidligt signal kan fortælle, at noget bevæger sig i en uønsket retning. Det fortæller ikke, om organisationen har de kompetencer og den kapabilitet, der skal til for at ændre den. Det er emnet for Paper 08.

Kilder og forskningsgrundlag
Forudsigelse og evidensstatus
Strategisk performance-måling
Aktuel tværfaglig forsigtighed

Begrebet strategisk observabilitet, skellet mellem tidligt og ledende, skellet mellem niveau, retning og forspring, begrebet signalhypotese, evidensstigen, firefeltsillustrationen, frameworket »Fra signalhypotese til evidens«, signalhypoteserne i »Hvad kunne du se tidligere?«, diagnosen og mikrohandlingen er Thomas Friisnæs' egne praktiske begreber og rammer, ikke validerede modeller. Kilderne har hver deres kontekst og felt: Shmueli er generel statistisk metodelitteratur; Steyerberg og kolleger beskriver vurdering af prædiktionsmodeller i epidemiologi; Nørreklit er en kritisk analyse af Balanced Scorecards antagelser; O'Connell og O'Sullivan undersøger kundetilfredshed i CEO-aflønningsordninger; de Oliveira og kolleger afprøver en målemodel for eksekvering på 276 virksomheder; og Watkins og kolleger gennemgår ledende indikatorer på arbejdsmiljøområdet. Ingen af de citerede studier validerer noget signal i Strategy Execution Observatory™, og ingen af dem handler om de konkrete signaler, paperet nævner. Åbningscasen er konstrueret, alle horisonter og eksempler er illustrative, ingen tærskel i paperet er en universel regel, og ingen af de nævnte signalhypoteser er validerede ledende indikatorer. Danske gengivelser af engelske formuleringer er egne oversættelser.

Strategien sker mellem kvartalerne — serien

Ti papers om strategisk observabilitet

Serien handler om, hvad ledelsen kan se af strategiens eksekvering, mens den stadig er i gang, og om at gøre det synligt uden at forveksle signaler med sandhed. Alle 10 papers er udgivet.

Serie 06Strategien sker mellem kvartalerne

Fra informationsgabet over signaler, kapacitet, beslutninger og friktion til kompetencer, metode og governance.

  1. Strategien sker mellem kvartalerne
  2. Grøn er ikke det samme som sund
  3. Det kvalitative kan godt kvantificeres
  4. Kapacitet findes ikke i planen
  5. Beslutninger er en del af produktionsapparatet
  6. Friktion er data
  7. Før resultatet flytter sig — du læser dette
  8. Ved vi, om vi kan det, strategien kræver?
  9. Et indeks er ikke sandheden
  10. Demokratisér udsynet. Centralisér metoden.
Tag paperet med dig
Download som PDF
Hele paperet i A4 — klar til at læse, gemme eller tage med til næste strategimøde i direktionen eller bestyrelsen.
Åbner din browsers udskriv-dialog — vælg “Gem som PDF” som destination.

Læs også

Næste i serien · Paper 08 Ved vi, om vi kan det, strategien kræver? Kompetence, evne og evidens Strategien sker mellem kvartalerne · Paper 03 Det kvalitative kan godt kvantificeres: Hvad kan et tal på en vurdering bære? Strategien sker mellem kvartalerne · Paper 01 Strategien sker mellem kvartalerne: Hvad sker der med eksekveringen lige nu? Executive Library Alle serier og papers — strategi, hold, eksekvering og kapacitet