Analytics-infrastructuur

Een dashboard is zo betrouwbaar als de leidingen eronder. Die leidingen zijn geen bijzaak, ze zijn het verschil tussen cijfers die kloppen en cijfers die toevallig klopten.

Bijna elk rapportageprobleem dat eruitziet als een dashboardprobleem, is er geen. De grafiek klopt niet omdat de data die er binnenkomt niet klopt, of te laat is, of vorige week stilletjes van formaat veranderde zonder dat iemand het merkte. Wie dat probeert op te lossen in de laatste stap, blijft repareren.

Er is ook een tweede versie van hetzelfde probleem, en die is duurder. Het werkt wel, maar precies één persoon weet hoe. Zodra die vertrekt of een half jaar niet kijkt, durft niemand er nog iets aan te veranderen. Dat is geen technische schuld, dat is een afhankelijkheid.

Wat de infrastructuurlaag inhoudt

Dit is het fundament onder dat gedeelde beeld: pipelines die data betrouwbaar laten stromen, een opslagsysteem dat meegroeit zonder de kosten te laten ontsporen, software tools die breed gedragen worden en servers om het op te draaien. Gebouwd op open, goed begrepen tools, zodat de volgende engineer die het aanraakt geen dichtgetimmerd platform hoeft te leren.

In de praktijk gaat het om de bronnen ontsluiten waar je data in zit, ze opschonen zodat velden betekenen wat ze beloven, ze koppelen op de sleutels die er werkelijk toe doen, en dat hele traject herhaalbaar maken. Niet één keer met de hand, maar elke nacht opnieuw, met een controle die het meldt als er iets misgaat in plaats van het stil door te laten stromen naar het dashboard.

De keuze voor open standaarden

De tools waarop dit draait zijn bewust gangbaar en vervangbaar. Dat is geen technische voorkeur maar een zakelijke: het houdt de kosten voorspelbaar naarmate je groeit, en het zorgt dat je op elk moment een andere partij naar binnen kunt halen zonder dat die eerst een eigen platform moet ontrafelen. De volledige redenering staat in de architectuurvisie.

Lees de architectuurvisie

  • Een modern data-fundament dat meebeweegt met het bedrijf
  • Niet vastzitten aan één engineer of leverancier
  • Kosten die voorspelbaar blijven, ook bij groei

Wat het niet is

Dit is geen platform dat je koopt en daarna zelf mag bemannen, en het is geen migratie naar de duurste stack die er te vinden is. De omvang volgt uit wat je werkelijk nodig hebt. Voor veel bedrijven is dat aanzienlijk minder dan een leverancier zou offreren, en dat hoor je dan ook.

Waar het meestal begint

Zelden met een migratie. Meestal met de bron die het vaakst stukgaat, of met het proces dat nu elke week met de hand wordt gedraaid. Dat stuk automatiseren en van een controle voorzien levert direct tijd op, en laat zien hoe de rest eruit gaat zien.

Daarna komt de vraag hoe ver het moet reiken. Een bedrijf met vier bronsystemen heeft iets anders nodig dan een bedrijf met veertig, en dat antwoord hoort te vallen voor de bouw begint, niet halverwege. De toets achteraf is simpel: wat er staat als het af is, moet te overzien zijn door iemand die er niet aan gewerkt heeft.

Met wie je werkt

Dezelfde persoon die de vraag met je scherp krijgt, bouwt ook de pipelines en levert het eindresultaat op. Dat is bewust: de meeste fouten in datatrajecten ontstaan op de overdracht tussen wie het bedacht en wie het bouwde. Vaste projectprijs, vooraf bekend, en na oplevering kan het onderhoud maandelijks doorlopen zolang je het nodig hebt.

Dit past als je rapportage nu breekt zodra iets in een bronsysteem verandert, of als het draaiende houden ervan bij één persoon ligt.

Breekt je rapportage steeds opnieuw?