Wat is ROT-data, en hoe ruim je het op
ROT staat voor redundant, obsolete en trivial: redundant, verouderd en triviaal. Het is de data die niemand gebruikt maar waar iedereen voor betaalt, in opslagkosten, compliance-risico en CO₂. Hier lees je wat ROT-data is, waarom het ertoe doet, en hoe je het praktisch vindt en verwijdert.
Wat ROT-data eigenlijk betekent
ROT-data is een letterwoord voor drie overlappende soorten waardearme informatie die zich in elke organisatie ophopen:
- Redundant: duplicaten en bijna-duplicaten, hetzelfde bestand op vijf plekken opgeslagen, back-ups van back-ups, opnieuw gedeelde bijlagen, "definitief_v2 (kopie)".
- Verouderd: data die ooit nuttig was maar dat niet meer is: achterhaalde documenten, werkruimtes van afgeronde projecten, bestanden van mensen die jaren geleden zijn vertrokken.
- Triviaal: content zonder enige zakelijke waarde: privéfoto's, systeemrommel, cachebestanden, wegwerpconcepten.
Afzonderlijk lijkt elk bestand onschuldig. Bij elkaar opgeteld kan ROT een groot deel van alles wat je opslaat beslaan, en anders dan waardevolle data levert het je nooit iets op.
Waar ROT-data vandaan komt
ROT is geen teken van een slecht geleide organisatie: het is het natuurlijke bijproduct van dagelijks werk. Mensen bewaren kopieën "voor de zekerheid". Systemen bewaren standaard elke versie en elk concept. E-mailbijlagen worden gedownload, opnieuw opgeslagen en opnieuw gedeeld. Migraties tillen hele mappenbomen naar een nieuw platform zonder het oude ooit uit te faseren. Medewerkers vertrekken, en hun bestanden blijven achter zonder eigenaar en zonder herzieningsdatum.
Omdat geen enkele losse handeling een zichtbaar probleem veroorzaakt, hoopt ROT zich stilletjes op. Er is zelden een moment waarop iemand besluit "we gaan nu een halve petabyte data opslaan die niemand gebruikt": het groeit gewoon, één redelijk ogende beslissing per keer, tot de opslagrekening en het risicoregister de vraag afdwingen.
Hoe groot is het probleem? Het dark-datacijfer
ROT overlapt sterk met wat analisten dark data noemen: informatie die wordt opgeslagen maar nooit gebruikt of zelfs maar geclassificeerd. Het veelgeciteerde Veritas Databerg-onderzoek stelde vast dat ongeveer 52% van de data die organisaties opslaan dark is: meer dan de helft onzichtbaar, onbeheerd en grotendeels ROT. (Bron: Veritas Databerg-rapport.)
Als de helft van wat je bewaart geen enkel doel dient, gaat een groot deel van je opslagrekening, back-upvensters en gegevensbeschermingsinspanning op aan niets.
Waarom ROT-data je op drie manieren geld kost
1. Geld
Elke gigabyte die je bewaart is een gigabyte waarvoor je betaalt om op te slaan, te repliceren, te back-uppen en (in de cloud) uit te lezen. ROT blaast dat allemaal op. Erger nog: het verhult de groei van je echte data, waardoor capaciteitsplanning en licentiebeslissingen op opgeblazen cijfers worden genomen. ROT verwijderen is een van de weinige IT-acties die kosten verlaagt met vrijwel geen nadeel.
2. Risico
ROT is een compliance-last. Oude bestanden vol persoonsgegevens die je zonder reden nog bewaart, botsen rechtstreeks met het AVG-beginsel van dataminimalisatie: je mag persoonsgegevens niet langer bewaren dan nodig. Vergeten, ongeclassificeerde bestanden zijn ook precies wat aanvallers buitmaken en wat van een inbreuk een meldplichtig incident maakt. Hoe minder verouderde persoonsgegevens je bewaart, hoe kleiner je aanvalsoppervlak en je toezichtrisico.
3. CO₂
Opgeslagen data is niet gewichtloos. Het staat op schijven in datacenters die dag en nacht stroom trekken voor rekenkracht, koeling en redundantie. Datacenters zijn goed voor ruwweg 2,5% van de wereldwijde uitstoot (Nature Climate), en elke terabyte ROT die je bewaart draagt zijn deel bij. Data verwijderen die je nooit gebruikt is een van de eenvoudigste manieren om je digitale CO₂-voetafdruk te verkleinen, en steeds vaker iets wat je moet meten en rapporteren onder kaders als de CSRD. Data die je toch al wilde verwijderen die een rapporteerbare duurzaamheidswinst wordt, is zo'n beetje het dichtst bij een gratis lunch dat IT te bieden heeft.
Hoe je ROT-data vindt en aanpakt
ROT opruimen is een herhaalbaar proces, geen eenmalige schoonmaak:
- Ontdekken. Scan elke repository (SharePoint, OneDrive, cloud object storage, NAS en lokale schijven) en inventariseer wat je werkelijk bewaart. Je kunt niet opruimen wat je niet ziet.
- Classificeren. Scheid het redundante, verouderde en triviale van de data die er echt toe doet, zodat je weet waar je veilig op kunt handelen.
- Prioriteren. Rangschik bevindingen op de kosten, het risico en de CO₂ die ze meedragen, zodat je de grootste winst eerst pakt in plaats van aan de randen te knabbelen.
- Beslissen en handelen. Pas heldere regels toe (bewaren, archiveren of verwijderen) en leg de onderbouwing vast, zodat de opruimactie controleerbaar is.
- Herhalen. ROT groeit terug. Scan periodiek opnieuw, zodat het nooit weer aangroeit tot waar je begon.
Automatiseer het geheel met TerraBytes
Dit handmatig doen over een echte omgeving is traag en foutgevoelig. TerraBytes doorloopt de cyclus van ontdekken, classificeren en prioriteren in één serverless scan. Je data verlaat je omgeving nooit en blijft de hele tijd versleuteld. Het markeert dubbele, verouderde, te grote en risicovolle bestanden in SharePoint, OneDrive, NetApp, NAS en lokale schijven, en hangt aan elke bevinding een bedrag in euro's en CO2, zodat je aanpakt wat het zwaarst weegt. Er wordt niets automatisch verwijderd: jij bepaalt de regels voor bewaren, archiveren en verwijderen en houdt de regie. Voor de risicokant, zie AVG-dataopschoning; om kosten en CO2 in je hele omgeving aan te pakken, begin bij de storage cleaner en optimizer.
Verder lezen
Dubbele bestanden vinden →
Pak de "redundante" in ROT aan: spoor duplicaten op in cloud en on-prem.
AVG-dataopschoning →
Vind risicovolle, persoonlijke en onversleutelde bestanden en pak ze aan voordat ze een aansprakelijkheid worden.
De verborgen kosten van opslag →
Waarom ongebruikte data stilletjes zowel je kosten als je CO₂-uitstoot opdrijft.