El 85% de los datos corporativos almacenados son inservibles o se desconoce su valor
- Tecnologías
La acumulación masiva de datos obsoletos o redundantes encarece la infraestructura, reduce el rendimiento y aumenta los riesgos de ciberseguridad. El almacenamiento indiscriminado también incrementa la huella de carbono por el consumo físico de los centros de datos.
La acumulación indiscriminada de información en los servidores corporativos se ha convertido en un problema estructural para las empresas. Según el análisis de Raúl Reyero Díez, coordinador del Máster en Big Data y Ciencia de Datos de la Universidad Internacional de Valencia (VIU), alrededor del 85% de los datos almacenados son inservibles, redundantes, obsoletos o triviales, una tendencia que denomina “síndrome de Diógenes digital”.
Estos datos oscuros, también conocidos como Dark Data, incluyen registros antiguos, versiones duplicadas, copias de seguridad innecesarias y carpetas mal etiquetadas que se conservan bajo el criterio del por si acaso. Reyero advierte que esta práctica genera costes invisibles, problemas de rendimiento, vulnerabilidades de seguridad y un impacto ambiental creciente.
“Los Dark Data son datos que la empresa tiene almacenados, pero que no utiliza o cuyo valor desconoce”, explica el docente. “Algunos podrían resultar útiles si estuvieran bien clasificados; otros son redundantes, obsoletos o triviales, y ahí está el mayor margen de mejora”.
Más copias, tiempo perdido y riesgo
El experto recuerda que, hace décadas, el almacenamiento era caro y obligaba a optimizar cada megabyte. Hoy, la accesibilidad de la nube ha eliminado esa barrera, pero también ha fomentado la acumulación sin criterio.
Mantener gigabytes o terabytes inservibles implica copias de seguridad más costosas, migraciones más lentas cuando cambia la infraestructura, dificultad para localizar archivos en servidores saturados, y riesgo de conservar datos personales sensibles sin justificación legal, aumentando la exposición ante auditorías y brechas de seguridad.
“Un archivo no ocupa solo un hueco en un disco. También entra en las copias de seguridad, se replica, se protege frente a ataques y se migra cuando cambia la infraestructura”, señala Reyero.
Aunque la nube se percibe como un entorno abstracto, Reyero recuerda que detrás hay edificios llenos de servidores, sistemas de refrigeración, redes y consumo continuo de agua y electricidad.
“Cuando guardamos una foto o enviamos un correo, da la sensación de que desaparece en un lugar abstracto, pero no es así”, afirma. Reducir la información innecesaria disminuye las transferencias, las copias y el almacenamiento activo, lo que contribuye a reducir la huella de carbono de forma acumulativa.
Borrado inteligente como solución
Frente al temor de que una IA elimine archivos sin control, Reyero aclara que el borrado inteligente funciona mediante reglas de negocio predefinidas por la empresa, aplicadas de forma automatizada y consistente. “El algoritmo no inventa las reglas; las aplica de forma consistente y a una escala que ninguna persona podría asumir revisando carpetas una por una”, explica.
Los modelos analizan antigüedad del archivo, duplicados, vinculación a proyectos activos y obligaciones legales de conservación. Esta automatización facilita también el cumplimiento del derecho al olvido del RGPD, localizando información dispersa en hojas de cálculo, entornos de prueba o copias olvidadas.
El experto subraya que las pymes son las más afectadas por la saturación, ya que disponen de menos margen para desperdiciar recursos. Contar con arquitecturas de visualización de datos es clave para identificar el desorden y priorizar la limpieza. “Lo que no se mide, o simplemente no se ve, acaba quedando siempre para más adelante”, apunta Reyero.
Como recomendación final, el docente aconseja empezar “intentando entender qué información tiene realmente la empresa, haciendo un inventario en un repositorio concreto y probando el proceso en un entorno pequeño”.