En als je ooit twee grote CSV’s naast elkaar hebt moeten leggen, weet je waarom: een steekproef kan je nooit eerlijk laten concluderen dat twee files écht gelijk zijn—alleen dat je in je steekproef geen verschillen zag.
Wij liepen hier tegenaan toen we ongeveer 1,5 miljoen rijen moesten vergelijken met meer dan 200 controles. Excel is krachtig, maar het stopt bij 1.048.576 rijen per worksheet—dus je móét knippen, stapelen en hopen dat je niets mist.
Daarom bouwden we bij Metaverses een CSV Vergelijkingstool die dit in één run controleert (max ± 1 uur) en een Excel-rapport oplevert met:
- een samenvatting
- referentiefouten (sleutels/matching)
- business rule fouten (bijv. bedragen binnen 0,02% én > €0,01)
- formaatfouten (bijv. datumvelden gelijk)
- én een overzicht van alle uitgevoerde controles
In de komende posts neem ik je mee in hoe we toleranties instelbaar maken, waarom referentiële integriteit de basis is, en hoe je van “diffs” naar beslissingen komt.
Herkenbaar? Stuur me een DM met “demo”.
