Articulo de referencia

Voldemort (almacén de datos distribuido)

Voldemort es un almacén de datos distribuido que fue diseñado como un almacén de clave-valor utilizado por LinkedIn para almacenamiento altamente escalable. [ 1 ] Recibe su nomb...

Voldemort es un almacén de datos distribuido que fue diseñado como un almacén de clave-valor utilizado por LinkedIn para almacenamiento altamente escalable. [ 1 ] Recibe su nombre del villano ficticio de Harry Potter, Lord Voldemort .

Descripción general

Voldemort no intenta satisfacer relaciones arbitrarias ni las propiedades ACID , sino que es una tabla hash grande, distribuida y persistente. [ 2 ] Un estudio de 2012 que comparó sistemas para almacenar datos de gestión del rendimiento de aplicaciones informó que Voldemort, Apache Cassandra y HBase ofrecían escalabilidad lineal en la mayoría de los casos, con Voldemort presentando la latencia más baja y Cassandra el mayor rendimiento. [ 3 ]

En la terminología del teorema CAP de Eric Brewer , Voldemort es un sistema de tipo AP.

LinkedIn, creador de Voldemort y principal colaborador corporativo, migró todos sus sistemas fuera de Voldemort aproximadamente en agosto de 2018, sin un patrocinador de reemplazo hasta octubre de 2018.. [ 4 ] En 2022, LinkedIn anunció Project Venice como un reemplazo de código abierto [ 5 ]

Propiedades

Voldemort utiliza almacenamiento en caché en memoria para eliminar una capa de caché independiente. Cuenta con una capa de almacenamiento que se puede emular. Las lecturas y escrituras de Voldemort escalan horizontalmente . La API decide la replicación y la ubicación de los datos y admite una amplia gama de estrategias específicas de la aplicación. [ 2 ] [ 6 ]

El almacén de datos distribuido Voldemort admite estrategias de ubicación conectables para su distribución entre centros de datos. Los datos se replican automáticamente entre servidores. Los datos están particionados, lo que significa que un solo servidor contiene solo una parte del total. Cada nodo de datos es independiente para evitar un punto central de fallo . La serialización conectable permite claves y valores enriquecidos, incluyendo listas y tuplas con campos con nombre, así como la integración con marcos de serialización comunes como Avro , Java Serialization, Protocol Buffers y Thrift . Los fallos del servidor se gestionan de forma transparente. Los elementos de datos están versionados, lo que maximiza la integridad de los datos. [ 1 ]

Véase también

Referencias

  1. 1 2 "Voldemort es un sistema de almacenamiento distribuido de clave-valor" . Proyecto Voldemort: una base de datos distribuida. Archivado del original el 26/12/2018 . Recuperado el 20/04/2015 .
  2. 1 2 "Comparación con bases de datos relacionales" . Proyecto Voldemort: una base de datos distribuida. Archivado del original el 23 de abril de 2011. Recuperado el 5 de abril de 2011 .
  3. Rabl, Tilmann; Sadoghi, Mohammad; Jacobsen, Hans-Arno; Gómez-Villamor, Sergio; Muntés-Mulero, Víctor; Mankovskii, Serge (agosto de 2012). "Resolver los desafíos de Big Data para la gestión del rendimiento de aplicaciones empresariales" (PDF) . Actas del Fondo de Dotación VLDB . 5 (12): 1724-1735 . arXiv : 1208.4167 . doi : 10.14778/2367502.2367512 . S2CID 15591565 . 
  4. Publicación en la lista de correo project-voldemort . 16 de agosto de 2018. Consultado el 6 de octubre de 2018.
  5. Publicación de LinkedIn . 26 de septiembre de 2022. Consultado el 29 de noviembre de 2023.
  6. Procesamiento de grandes volúmenes de datos calculados por lotes con Project Voldemort
  • Proyecto Voldemort - Una base de datos distribuida. Archivado el 26/12/2018 en Wayback Machine.
  • Debates en tiempo real sobre el Proyecto Voldemort