csrdready Zaraďte ma na zoznam čakateľov

Kennisbank

Od bunky v tabuľke k číslu v správe: čo je medzi tým

Tabuľka sa zdá byť jednoduchým zdrojom. Bunka s číslom, hárok s názvom, export z iného systému, ktorý bol vložený. Ale medzi touto bunkou a číslom, ktoré sa nakoniec objaví v správe, leží séria úprav, ktorá zvyčajne nie je nikde zaznamenaná. Source-to-report mapping je zmapovanie tejto série: každý krok, ktorým číslo prechádza od okamihu, keď vstúpi do tabuľky, až po okamih, keď skončí v riadku správy.

Prečo tabuľka toto sťažuje, nie zjednodušuje

Pri systéme s pevnými poľami a pevnou štruktúrou sa väčšinou ešte dá vysledovať, ktoré pole odkiaľ pochádza. Tabuľka takúto štruktúru nemá sama od seba. Niekto pridá medzihárok na agregáciu. Niekto iný skopíruje stĺpec do iného súboru, aby urobil prepočet. Tretí vloží výsledok ako hodnotu do hárku so správou, čím zmizne formula a spolu s ňou aj stopa. Nič z toho nie je chybou v okamihu, keď sa to stane. Problém vzniká o rok neskôr, keď musí niekto vysvetliť, odkiaľ číslo pochádza, a odpoveď sa už nedá zrekonštruovať.

Kroky, ktoré je potrebné zaznamenať

Source-to-report mapping pre zdroj v podobe tabuľky sa skladá z niekoľkých rozpoznateľných krokov, z ktorých každý si vyžaduje samostatnú pozornosť.

Prvým krokom je pôvod nespracovaných údajov: ktorý súbor, ktorý hárok, ktorá bunka alebo rozsah buniek, a kto ich zadáva alebo dodáva. Bez tohto kotevného bodu neexistuje zdroj, na ktorý by sa dalo odkázať.

Druhým krokom je aké úpravy sa nachádzajú medzi zdrojom a správou, ak je zdrojom tabuľka. Ide napríklad o prepočet jednotiek, filtre, ktoré vylučujú určité riadky, alebo formuly, ktoré hodnoty spočítavajú či preškálovávajú. Každá úprava zmení číslo a každá úprava, ktorá nie je zaznamenaná, je krok, ktorý sa neskôr nedá overiť.

Tretím krokom je agregácia: viacero riadkov, hárkov alebo súborov, ktoré sa spájajú do jedného čísla. Pri tabuľke sa to často robí manuálne, stlačením funkcie súčtu nad rozsahom, ktorý si niekto sám vymedzil. Spôsob, akým bol tento rozsah zvolený, a to, čo sa v ňom nachádza, ovplyvňuje výsledné číslo rovnako ako podkladové údaje. Presne preto je potrebné zaznamenať ako zaznamenať agregáciu, ak je zdrojom tabuľka: nie ako formalitu, ale pretože samotný krok agregácie je zdrojom chýb, ktoré si inak nikto nevšimne.

Štvrtým krokom je normalizácia: rôzne jednotky, rôzne vykazované obdobia alebo rôzne lokality, ktoré sa prevedú na spoločný základ, aby boli porovnateľné. Aj tu platí, že voľba prepočítacieho faktora alebo referenčnej hodnoty určuje výsledok, a táto voľba musí byť vysledovateľná. Ako to funguje, je rozpracované v ako zaznamenať normalizáciu, ak je zdrojom tabuľka.

Posledným krokom je miesto, kam číslo dopadne: riadok správy, indikátor, ročný súčet. Aj tento prechod musí mať stopu, nielen odkaz na zdrojový dokument.

Prečo je toto viac než len vedenie záznamu

Je lákavé myslieť si, že postačuje zoznam toho, kto čo upravil. To je záznam, a záznam zaznamenáva zmeny bez toho, aby ukázal logiku, ktorá za nimi stojí. Audit trail, ktorý má zmysel, neukazuje len to, že bunka sa zmenila, ale aj prečo, na základe akého pravidla a s akým výsledkom, vysledovateľným až k pôvodnému zdroju. Tento rozdiel je ďalej vysvetlený v prečo je audit trail viac než len záznam, ak je zdrojom tabuľka.

Dá sa toto zvládnuť bez nástroja, ktorý to robí automaticky

Väčšina organizácií, ktoré pracujú s tabuľkami, nemá systém, ktorý by automaticky sledoval lineage. To neznamená, že mapping je nemožný, znamená to, že sa musí robiť manuálne, s disciplínou namiesto softvéru. Aké kroky sú na to potrebné a ako sa proces vedený tabuľkami napriek tomu stane vysledovateľným, je popísané v ako vytvoriť lineage bez nástroja, ak je zdrojom tabuľka. Súvisiaca otázka, ktorá sa často vynecháva, je kto vlastní definíciu dátového bodu: bez určeného vlastníka definície sa význam dátového bodu mení podľa toho, kto sa na neho v danom momente pozerá, a potom má aj najkrajší mapping malú hodnotu.

Prečo najprv toto, skôr než pribudne nástroj

Nástroj, ktorý zveľadí správy, nič nemení na spoľahlivosti čísel, ktoré do nich vstupujú. Ak cesta od bunky k správe nie je zaznamenaná, nástroj vyprodukuje krajšie správy o tých istých neistých číslach. Mapping od zdroja k správe teda nie je krokom, ktorý nasleduje po nástroji, ale krokom, ktorý mu predchádza.

Kedy ide aj o to, kto danú prácu robí

Hneď ako sú kroky medzi zdrojom a správou vypísané, stane sa zrejmým aj to, ktoré z týchto krokov sú prácou ľudí a ktoré nasledujú pevnú, opakovateľnú úpravu. Toto rozlíšenie je základom pre pracovný scan FTE TO AI, ktorý pre každú úlohu vypočíta, akú časť práce môže prevziať AI, na základe toho, čo už bolo zaznamenané o úprave, pravidlách a pôvode údajov.

Marvinde assistent van de Data Readiness Scan

Vraag maar waar een datapunt vandaan komt. Dat is meestal de hele vraag.

Answers come from this site’s knowledge base. Not tailored advice, and not a scan of your company.