En este artículo se explica cómo se ejecuta Spark en un cluster , para facilitar la comprensión de los componentes involucrados. Las a...
Introducción a la programación Hive
Desde los primeros días de la ruptura principal de Internet, los principales motores de búsqueda y las empresas de comercio electrónico han...
Visión de alto nivel de la arquitectura de Amazon Kinesis
En esta publicación voy a hablar sobre la recogida de datos en un cluster AWS, donde daré algunas pautas sobre cómo podemos mover datos a A...
Guía de Spark SQL, DataFrames y DataSets
Spark SQL es un módulo de Spark para el procesamiento de datos estructurados. A diferencia de la API básica Spark RDD, las interfaces propo...
Como escribir una aplicación Kafka Streams en Scala
En el siguiente documento tienes una guía completa de como puedes empezar a escribir una Aplicación Kafka Streams en Scala desde 0.
¿Que API de Kafka debo usar en mi Caso de Uso?
El aprendizaje de Kafka es complicado. Aunque el núcleo de Kafka se mantenga bastante estable con el tiempo, los frameworks que envuelven a...
Ingestión de datos con Spark y Kafka
Un componente de arquitectura importante de cualquier plataforma de datos son aquellas piezas que gestionan la ingestión de datos. En muchos...
Introducción a la ingesta en Tiempo Real con Kafka
En una publicación anterior aborde el tema de la ingestión de datos masivos usando la herramienta Flume (consúltala aquí ). Siguiendo con e...
Introducción a Apache Spark con Anaconda Spider
Esta publicación introductoria está destinada a ayudarte a dar el primer paso en el procesamiento de Big Data con Apache Spark utilizando l...
Introducción a la ingesta de datos con Flume
Flume está diseñado para la ingestión de grandes volúmenes de datos basados en eventos en Hadoop. El ejemplo clásico es usar Flume para rec...
Soporte al Coaching basado en Big Data: Entrevista con Oblu Coaching
La película de 2011 Moneyball representa la verdadera historia del manager de béisbol Billy Beane (interpretado por Brad Pitt) que desafía ...
Combatiendo el fraude en la Banca con Big Data Analytics
El fraude y los delitos financieros ya no pueden ser un coste aceptable al hacer negocios. Los esquemas de fraude son cada vez más sofistic...
El uso de la IA en Banca
La IA puede mejorar la personalización de los clientes, identificar patrones y conexiones que los humanos no pueden, y responder a pregunta...
Componentes Principales del Ecosistema Hadoop
En este artículo voy a hablar de varias herramientas diferentes que se utilizan en la parte superior del framework Hadoop. Con la evolución...
El auge de la Inteligencia Artificial en proyectos de explotación de datos
Ya va a hacer un año de lo que muchos bautizaron como uno de los principales hitos de la historia de la Inteligencia Artificial. Un algorit...