
¿Trabajas con el almacenamiento NoSQL Apache Cassandra?
El 23 de mayo, Odnoklassniki invita a desarrolladores experimentados a su oficina en San Petersburgo para , dedicado al trabajo con Apache Cassandra. Solo es importante tu experiencia con Cassandra y tu deseo de compartirla.
Estamos en OK Apache Cassandra en 2010 para almacenar calificaciones de fotos. Actualmente, somos los mayores usuarios de Apache Cassandra en Runet y unos de los más grandes en Europa. Tenemos más de cien clústeres diferentes que se utilizan tanto para almacenar diversas informaciones de productos — como clases, chats, mensajes — como para gestionar datos críticos de infraestructura — mapeo de bloques lógicos a discos de un gran almacenamiento binario — , gestión de datos de la nube interna etc.
En total, en bajo la gestión de Cassandra hay petabytes de datos en miles de nodos. Durante este tiempo hemos acumulado una gran experiencia en administración, desarrollo y explotación de soluciones basadas en Cassandra, ¡e incluso hemos desarrollado nuestra propia .
Ahora nos gustaría compartir todo esto contigo — con casos reales de la práctica y sin secretos; El evento se llevará a cabo en un formato de discusión en vivo entre los participantes, lo que significa que la discusión tomará la mayor parte del tiempo. están listos para compartir sus ideas y enfoques. El evento será conducido por y .
¿Cuáles serán los temas?
Explotación:
Revisaremos configuraciones típicas de nodos y clústeres en varias instalaciones en producción. Discutiremos cómo expandir clústeres a medida que aumentan los volúmenes de datos y la carga, y cómo reemplazar nodos fallidos con un mínimo efecto para los clientes. Compartiremos las dificultades y sistematizaremos los problemas comunes. Verificaremos cómo monitorear clústeres para entender con anticipación dónde y qué exactamente no funciona. Abordaremos problemas de despliegue de nuevas versiones de Cassandra.
Rendimiento:
Intentaremos entender en qué métricas debemos fijarnos y qué se puede optimizar para mejorar las métricas. Abordaremos si debemos realizar reintentos o no y, si es así, cómo. Identificaremos cuellos de botella en la arquitectura y la implementación de Cassandra, y revisaremos algunos trucos ingenieros para evitarlos. Abordaremos el tan comentado repair y compaction sin degradar el rendimiento.
Disponibilidad:
El hardware no es eterno, por lo que los fallos ocurren constantemente, y también puede que la mano de un colega tiemble y eliminemos algo de más. Por eso, discutiremos la recuperación tras fallos de discos, máquinas o centros de datos, así como la restauración a un estado consistente a partir de copias de seguridad en caso de errores del operador.
y cuenta a tus amigos y colegas sobre el evento.
Fuente: habr.com
