Blog

Matching: zonder sleutels vergelijk je de verkeerde dingen

De meeste “verschillen” ontstaan niet door bedragen. Ze ontstaan doordat je de verkeerde rijen met elkaar vergelijkt.

Als je twee CSV’s naast elkaar legt, lijkt het logisch om direct velden te vergelijken: datum, bedrag, status, noem maar op. Maar er is één stap die alles bepaalt:

Matching.

Want als record A uit bestand 1 niet eenduidig gekoppeld is aan record B uit bestand 2, dan krijg je afwijkingen die geen afwijkingen zijn. Je vergelijkt gewoon twee verschillende entiteiten.

  • Daarom draait een vergelijking bij ons om één basiscontrole vóór alle andere checks
  • Sleutelveld heeft een gelijke waarde in het andere bestand
  • (referentiële integriteit: kan ik deze rij überhaupt vergelijken?)
  • En pas als die match klopt, hebben de inhoudelijke controles betekenis, zoals
  • datumvelden gelijk
  • bedragen binnen tolerantie (bijv. 0,02% én > €0,01)

In onze rapportage maken we dat ook expliciet: referentiefouten staan apart, omdat je die eerst moet oplossen. Anders ben je business rules aan het controleren op rijen die niet goed gematched zijn—en dat is gegarandeerd ruis.

Volgende post: hoe we de output opsplitsen in samenvatting / referentie / business rules / formaat, zodat je niet eindigt met een “diff-dump”, maar met iets waar je actie op kunt nemen.

Wil je sparren over welke sleutel/matching het beste werkt voor jouw use-case? Stuur me “matching” in een DM.

Op zoek naar een slimme oplossing?

Wij staan voor je klaar.