Cassandra, una de las bases de datos distribuidas de código abierto más populares, se adentra en la era de la IA con la versión 5.0, que incorpora datos vectoriales y búsqueda vectorial. Pero también hay otras novedades muy importantes en el menú.
Desarrollada inicialmente en Facebook para potenciar la búsqueda en los mensajes antes de ser confiada a la incubadora de proyectos de código abierto Apache en 2010, Cassandra es una base de datos NoSQL diseñada para gestionar grandes cantidades de datos distribuidos en muchos servidores en un contexto en el que las escrituras suelen superar a las lecturas. Su particular arquitectura garantiza una alta disponibilidad y elimina los puntos únicos de fallo, lo que la convierte en una de las bases de datos más sólidas del mercado.
Con el tiempo, se ha convertido en una de las bases de datos más populares para los actores de Internet y ahora cuenta con más de 300.000 empresas usuarias.
Basta decir que la versión 5.0 anunciada esta semana es esperada con impaciencia, especialmente porque marca una modernización real de la base de datos en un contexto donde las aplicaciones de IA se están multiplicando con un claro deseo de las empresas de ver su IA explotar sus bases de datos existentes y los datos que alojan.
Esta importante actualización trae algunas características clave:
Índice de almacenamiento adjunto (SAI)
SAI revoluciona la flexibilidad y el rendimiento de las consultas, especialmente para grandes conjuntos de datos. Permite realizar consultas más eficientes en columnas que no son claves primarias, lo que amplía las posibilidades de modelado de datos. Este mecanismo pretende sustituir la antigua funcionalidad de los índices secundarios y podría transformar radicalmente la estructura de los modelos de datos de las aplicaciones.
Tablas de memoria Trie y tablas de memoria Trie
Estas optimizaciones de bajo nivel ofrecen mejoras impresionantes en el uso de la memoria y la eficiencia del almacenamiento, lo que proporciona una mejora del rendimiento «gratuita» sin necesidad de cambiar el modelo de datos. Una actualización en línea de su clúster habilita esta función de inmediato con solo unos pocos ajustes de configuración.
Soporte para Java Development Kit (JDK) 17
La esperada actualización a JDK 17 ofrece una mejora del rendimiento de hasta un 20 % en algunos casos, gracias a una mejor gestión de la memoria. Además, permite a los operadores de Cassandra aprovechar las nuevas mejoras en la gestión de la recolección de elementos no utilizados, disponibles con esta versión.
Estrategia de compactación unificada (UCS)
UCS actúa como un piloto automático para la organización de datos, adaptándose automáticamente a las necesidades cambiantes a medida que crece el clúster. Esta característica mejora en gran medida la eficiencia operativa, especialmente para implementaciones a gran escala, al aumentar la densidad de nodos.
Búsqueda de vectores
Con la introducción de un tipo de datos vectoriales y la indexación para búsquedas de vecinos más cercanos aproximados, Cassandra 5.0 sienta las bases para aplicaciones avanzadas de inteligencia artificial y aprendizaje automático. Los desarrolladores que crean aplicaciones de inteligencia artificial generativa ahora pueden combinar la escala y la distribución de Cassandra con las últimas tecnologías de búsqueda inteligente.
Enmascaramiento dinámico de datos
Inspiradas en los requisitos del RGPD, las nuevas capacidades de enmascaramiento dinámico de datos permiten ocultar información confidencial mediante columnas ocultas, lo que mejora la seguridad de los datos sin alterarlos. Este enmascaramiento se puede realizar en tiempo de ejecución con la sintaxis SELECT o integrarse en el nivel del servidor mediante definiciones de esquema y seguridad basada en roles.
Con las mejoras de la versión 5.0, Cassandra DBMS se vuelve más potente, más segura y más adecuada para aplicaciones modernas como la inteligencia artificial. Ya sea para empresas que buscan maximizar su rendimiento o para desarrolladores que buscan aprovechar las últimas tecnologías de datos, esta versión marca un nuevo hito y coloca a Cassandra en la era de las bases de datos que admiten la inteligencia artificial y las aplicaciones de inteligencia artificial.
Lea también:
Oracle Database: No me llames «23c», llámame «23ai»
MongoDB: “Apoyamos la modernización de aplicaciones y proyectos de Migración a la Nube”
MySQL y SQL Server están ganando popularidad
K8ssandra: Cassandra se adapta a Kubernetes
[

