csrdready Laita minut jonotuslistalle

Kennisbank

Milloin datapiste on todellisuudessa rekisteröity kaksi kertaa?

Kaksinkertainen datapiste harvoin erottuu nimen perusteella. Kaksi riviä rekisterissä kuulostavat usein erilaisilta — 'toimiston energiankulutus' ja 'sähkönkulutus NL-toimipiste' — vaikka ne viittaavat samaan mittariin, samaan laskuun tai samaan lähteeseen. Kaksinkertaisuus ei piile tekstissä, vaan alkuperässä. Se, joka etsii vain nimen perusteella, ei löydä duplikaatteja.

Mitä datapisterekisteri tallentaa

Datapisterekisteri ei ole lista raportointirivejä, vaan rekisteri taustalla olevasta datasta: kunkin datapisteen määritelmä, lähde, omistaja ja reitti lähteestä raporttiin. Jokainen datapiste saa kiinteän paikan neljällä kiinteällä kentällä: mikä se on, mistä se tulee, kuka on siitä vastuussa ja mitä käsittelyvaiheita siihen on sovellettu ennen kuin se päätyy raporttiin. Näitä neljää kenttää lukuun ottamatta rekisteri on sanasto, ei valvontavälinaine.

Kysymys mikä on source-to-report-mapping kuvaa tätä kolmatta vaihetta yksityiskohtaisesti: reitti, jonka luku kulkee lähdejärjestelmästä raporttiriville. Tämä samainen reitti on väline, jolla kaksinkertaisuudet tehdään näkyviksi. Kaksi datapistettä, joilla on eri nimi mutta identtinen lähde-raporttilinja, ovat samaa datapistettä, kirjattuna kahteen kertaan.

Miten kaksinkertaisuus syntyy

Kaksinkertaiset datapisteet syntyvät useimmiten eivät huolimattomuudesta, vaan organisaatiorakenteesta. Kiinteistötiimi rekisteröi energiankulutuksen kiinteistöhallintaa varten, kestävyystiimi rekisteröi saman kulutuksen CSRD-raportointia varten. Molemmat tiimit työskentelevät omasta laskentataulukostaan käsin, omalla nimeämiskäytännöllään, näkemättä toistensa rekisteröintiä. Useamman toimipisteen tai liiketoimintayksikön tapauksessa tämä kuvio moninkertaistuu: joka yksikkö tallentaa vastaavaa dataa oman nimikkeensä alla.

Sivu missä datapiste on jo olemassa useissa liiketoimintayksiköissä käsittelee juuri tätä mekanismia: ennen datapisteen lisäämistä rekisteriin ensimmäinen kysymys on, esiintyykö se jo jossain organisaatiossa, ainoastaan eri nimellä tai eri osastolla. Tämän kysymyksen esittäminen ennen rekisteröintiä estää suuren osan kaksinkertaisuuksista, jotka muutoin täytyy jäljittää jälkikäteen.

Lähde testinä, ei nimi

Luotettava tapa tunnistaa kaksinkertaisuus ei ole kuvausten vertailu, vaan lähteiden vertailu. Kaksi datapistettä, jotka tulevat samasta järjestelmästä, samasta taulusta tai samasta vientitiedostosta, samalla mittauspäivällä ja samalla yksiköllä, ovat ehdokkaita yhdistämiseen — myös silloin, kun nimeäminen ei sitä paljasta. Kääntäen: kaksi datapistettä, joilla on samankaltainen nimi mutta eri lähde, eivät välttämättä ole kaksinkertaisuus, vaan kaksi erillistä mittausta, jotka sattuvat muistuttamaan toisiaan.

Tämä erottelu on mahdollista tehdä vain, jos rekisteri tallentaa lähteen datapistekohtaisesti, ei vain lopullista arvoa. Rekisteri, joka kerää vain lukuja alkuperää tallentamatta, ei voi jäljittää kaksinkertaisuuksia — se voi parhaimmillaan epäillä niitä.

Omistajuus toisena signaalina

Lähteen ohella omistajuus on toinen viite. Kun kahdella datapisteellä on sama lähde, mutta ne on rekisteröity eri omistajille, se ei itsessään ole ongelma — se voi viitata datapisteeseen, jota käyttää useampi osasto. Signaaliksi se muuttuu, kun molemmat omistajat suorittavat toisistaan riippumatta samat käsittelyvaiheet, tietämättä toistensa työstä. Silloin kaksinkertainen ei ole itse datapiste, vaan sen ympärillä oleva prosessi.

Kysymys mitkä käsittelyvaiheet sijaitsevat lähteen ja raportin välillä on tässä kohdassa oleellinen: kaksi datapistettä, joilla on sama lähde mutta eri käsittelyvaiheet, voivat tuottaa eri lukuja, vaikka ne raportissa esiintyvät samalla nimikkeellä. Se on riskialttiimpi tilanne kuin yksinkertainen kaksinkertaisuus, koska luvut voivat poiketa toisistaan kenenkään huomaamatta.

Milloin jäljittäminen on valmis

Kaksinkertaisten datapisteiden jäljittäminen ei ole kertaluonteinen harjoitus, joka päättyy kiinteänä ajankohtana. Kasvavassa organisaatiossa, uusien järjestelmien tai muuttuneiden raportointirajojen myötä syntyy uusia kaksinkertaisuusehdokkaita. Sivu milloin rekisteri on valmis kuvaa, että rekisteri ei ole täydellinen kiinteänä päivämääränä, vaan sillä hetkellä kun jokaisella datapisteellä on lähde, omistaja ja jäljitettävä reitti raporttiin — mukaan lukien tarkistus siitä, oliko tämä datapiste jo olemassa muualla.

Useamman liiketoimintayksikön organisaatioissa kysymys mitä datapisteitä todella tarvitsette useissa liiketoimintayksiköissä on hyvä lähtökohta, sillä tämä kysymys määrittää rekisterin laajuuden ennen kuin kaksinkertaisuuksien etsintä alkaa. Pienempi, tarkemmin rajattu rekisteri sisältää luonnostaan vähemmän tilaa päällekkäisyydelle.

Tunnistamisesta rakenteelliseen ennaltaehkäisyyn

Lähteiden, omistajien ja käsittelyvaiheiden manuaalinen läpikäynti kaksinkertaisuuksien löytämiseksi on juuri sellaista työtä, joka voidaan jäsentää toistettaviksi vaiheiksi: tietojen vertailu rinnakkain, yhtäläisyyksien tunnistaminen, yhdistämisehdotuksen laatiminen arvioitavaksi. Organisaatioille, jotka haluavat tietää, mikä osa tästä vertailutyöstä on siirrettävissä AI-sovellukselle ja mikä osa vaatii edelleen ihmisen arviointia, FTE TO AI:n työskannaus laskee tämän tehtävätasolla. Skannaus ei anna arviota rekisteristänne, vaan erittelyn siinä esiintyvistä tehtävistä — lähtökohdan ennen kuin päätätte, miten organisoitte kaksinkertaisuuksien jäljittämisen.

Marvinde assistent van de Data Readiness Scan

Vraag maar waar een datapunt vandaan komt. Dat is meestal de hele vraag.

Answers come from this site’s knowledge base. Not tailored advice, and not a scan of your company.