Curso de Big Data con Apache Kudu para Equipos de Datos en la Empresa
Aprende con el curso de Big Data con Apache Kudu para empresas hasta 100% bonificado, a medida para tu organización.
Totalmente práctico y aplicable
Formación en Big Data con Apache Kudu a medida
100% bonificable a través de FUNDAE
Curso TUTORIZADO por expertos
Modalidad Aula Virtual Personalizada
Curso de Big Data con Apache Kudu en Aula Virtual Personalizada
Nuestra modalidad AVP es una formación en directo, práctica y 100% adaptada a vuestro equipo. No trabajamos con contenidos genéricos: diseñamos la formación en función de vuestro nivel, objetivos, procesos internos y necesidades reales de aplicación.
Solicitar informaciónTemario 100% a medida
Creamos el temario desde cero a partir de vuestras necesidades, nivel del equipo y objetivos concretos, priorizando aquellos contenidos que realmente aporten valor en el día a día.
Proyectos personalizados
Durante la formación trabajaremos con archivos, ejemplos, informes o procesos similares a los que utiliza vuestro equipo, para que el aprendizaje sea directamente aplicable al puesto de trabajo.
Sesiones en directo con consultor experto
Un formador especialista imparte las clases en tiempo real, resolviendo dudas, revisando casos concretos y adaptando el ritmo de la formación a la evolución del grupo.
Calendario adaptado a vuestra disponibilidad
Definimos conjuntamente fechas, horarios y duración de las sesiones para facilitar la asistencia del equipo y minimizar el impacto en la operativa diaria de la empresa.
Curso de Big Data con Apache Kudu hasta 100% Bonificable a través de FUNDAE
Tu bonificación paso a paso
Forma a tu equipo sin costes mediante la bonificación estatal.
Este programa de Big Data con Apache Kudu para empresas es subvencionable hasta el 100%.
- Potencia las habilidades de edición y automatización de tus profesionales.
- Accede a una formación avanzada en Big Data con Apache Kudu práctica y orientada a resultados.
- Prepara a tu equipo para los retos documentales del entorno laboral actual.
- Gestionamos gratis tu bonificación de este curso corporativo de Big Data con Apache Kudu ante FUNDAE.
Calcula tu bonificación
Revisamos tu caso
Preparamos la gestión
Tu equipo realiza el curso
Aplicas la bonificación
La formación que decides
te devuelve dinero
Todos nuestros cursos son bonificables a través de FUNDAE.
Gestionamos toda la documentación por ti.
Calcula tu crédito aproximado
Crédito bonificable estimado
420€*
*Cálculo orientativo
Impulsa la Rentabilidad Empoderando tu Empresa con Apache Kudu, Spark e Impala
Profesionaliza a tu equipo en Big Data con Apache Kudu A Medida, tutorizado por Expertos y bonificable hasta el 100% por FUNDAE para empresas. Pide información.
Obtén ventajas competitivas mediante la implementación de data warehousing adaptado a las necesidades específicas de tu empresa, integrando soluciones líderes del ecosistema Hadoop para un análisis de datos superior y en tiempo real.
Capacita a tus equipos en el uso de herramientas avanzadas de Big Data, facilitando el acceso a datos críticos y permitiendo el desarrollo de proyectos estratégicos que fortalezcan la innovación y competitividad de la organización.
Asegura la escalabilidad y flexibilidad en las operaciones, adaptando las infraestructuras de manejo de datos a las exigencias cambiantes del mercado, garantizando así un entorno robusto y preparado para el crecimiento futuro.
Personaliza el temario al 100% para tu equipo
Diseñamos una formación a medida utilizando los documentos y flujos de trabajo reales de tu empresa.
Nueva Plataforma
de E-learningFormación en directo con plataforma de apoyo para reforzar el aprendizaje
Acceso a las grabaciones
Los alumnos podrán revisar las sesiones grabadas para repasar conceptos clave, recuperar explicaciones concretas o reforzar aquellos contenidos que necesiten después de la clase en directo.
Recursos formativos
Materiales, sesiones grabadas y documentación de apoyo quedan centralizados en la plataforma para que el equipo pueda consultarlos durante y después de la formación.
Confirmación de asistencia
La plataforma permite registrar y confirmar la asistencia de los participantes, facilitando el seguimiento de la formación y la gestión documental necesaria para la bonificación FUNDAE.
Ejercicios prácticos
Después de la formación en directo, los alumnos podrán acceder a ejercicios prácticos para aplicar lo trabajado en clase y consolidar el aprendizaje con actividades guiadas.
Acceso a las grabaciones
Los alumnos podrán revisar las sesiones grabadas para repasar conceptos clave, recuperar explicaciones concretas o reforzar aquellos contenidos que necesiten después de la clase en directo.
Recursos formativos
Materiales, sesiones grabadas y documentación de apoyo quedan centralizados en la plataforma para que el equipo pueda consultarlos durante y después de la formación.
Confirmación de asistencia
La plataforma permite registrar y confirmar la asistencia de los participantes, facilitando el seguimiento de la formación y la gestión documental necesaria para la bonificación FUNDAE.
Ejercicios prácticos
Después de la formación en directo, los alumnos podrán acceder a ejercicios prácticos para aplicar lo trabajado en clase y consolidar el aprendizaje con actividades guiadas.
Practica y mejora con nuestra plataforma
Una plataforma practica, con IA integrada y pensada para que mejores desarrollando. Se adapta a tu ritmo, te corrige al instante y te muestra tu progreso real.
Correccion magica
Feedback inteligente
Aprende de cada acierto y fallo con explicaciones claras
Temario del curso
Encuentra todo el temario del curso aquí.
Introducción a los conceptos de Big Data
Utilidades y ventajas reales del Big data
¿Qué es el ecosistema de Apacha Hadoop y qué aplicaciones lo componen?
¿Para qué empleamos Apache Spark?
¿Para qué empleamos Apache Impala?
¿Para qué empleamos Apache Kudu?
Introducción a Data Warehousing para empresas (EDW)
¿Qué son los datos estructurados?
La importancia de los datos estructurados
EDW en la actualidad
Modeado dimansional
Big Data Warehousing con Impala y Kudu
El uso de Apache Kudu con datos estructurados
Casos de uso de Apache Kudu: Mantenimiento y análisis de datos relacionales
Casos de uso de Apache Kudu: Series temporales y datos de IoT
Casos de uso de Apache Kudu: Almacén de plataformas de Machine Learning
Fundamentos esenciales de Apache Kudu
Analizando la arquitectura de Apache Kudu
Introducción al concepto de MVCC (Multi Version Concurrency Control)
¿Cómo las bases de datos con MVCC garantizan la consistencia de lectura?
Instalaciones y y puesta en marcha
Cliente API para Java
Cliente API para Python
Cliente API para C++
Copias de seguridad a través de CTAS
Exportación de resultados desde Impala Shell a directorio local
Exportación de resultados desde Impala Shell a NFS
Exportación de resultados desde Impala Shell a volúmenes SAN
Exportación de resultados desde un Cliente API
Exportación de resultados desde Apache Spark
Replicación con Spark y la API de Kudu Data Source
Introducción a la replicación en tiempo real con StreamSets
Replicación de datos usando soluciones ETL (Talend, Pentaho, etc.)
Introducción a librería Impyla
Pyodbc
SQLAlchemy
Ingesta de datos dual con Kafka y Spark Streaming
Replicación datos Kafka con MirrorMaker
Ingesta de datos dual con Kafka y StreamSets
Ingesta de datos dual con StreamSets
Introducción a Cloudera Manager Kudu Service
Introducción a Kudu Master Web UI
Introducción a Kudu Tablet Server Web UI
Introducción a Kudu Metrics
Introducción a Kudu CLI
Problemas más conocidos y soluciones actuales
Principales limitaciones de Apache Kudu a tener en cuenta
Buenas prácticas y recomendaciones
Mecanismos de seguridad aplicables a Apache Kudu
Buenas práctiacas a la hora de aplicar seguridad
Introducción a la integración de Impala y Kudu
Claves primarias
Tipos de datos
Tablas internas de Impala
Tablas externas de Impala
Inserción de filas
Actualización de filas
Alteración de filas
Borrado de filas
Esquemas y cómo modificarlos
Introducción al particicionamiento en Impala y Kudu
Particionamiento por hash
Particionamiento por rango
Particionamiento por hash-rango
Particionamiento por hash-hash
Listado de particiones
Usando JDBC con Impala y Kudu
Introducción a la integración de Spark y Kudu
Diferencias entre versiones Spark
Introducción al contexto de Kudu
Insertando datos
Creación de una Tabla Kudu
Actualizando una tabla de Kudu
Alteración de datos
Borrado de datos
Escogiendo datos
Insertando archivos CSV en Kudu
Insertando archivos CSV en Kudu con Spark-CSV
Insertando archivos CSV en Kudu de manera programática especificando un esquema
Insertando archivos XML en Kudu con Spark-XML
Insertando archivos JSON en Kudu
Insertando datos desde MySQL
Insertando datos SQL Server en Kudu
Insertando datos desde HBase en Kudu
Insertando datos desde SOLR en Kudu
Insertando datos desde AWS S3 en Kudu
Insertando filas de datos de Kudu a Apache Parquet
Insertando Dataframes de Oracle y SQL Server en Kudu
Integrando Spark Streaming y Kudu
Introducción a Streamsets Data Collector
Pipelines
Orígenes de datos
Procesadores de datos
Ejecutores
Consola de recolección de datos
Opciones de despliegue
Usando StreamSets Data Collectos
Ingesta de archivos XML en Kudu
Configurando pipelines
Configurando el directorio de origen
Configurando el procesador de tratamiento XML
¿Cómo validar un pipeline?
¿Cómo previsualizar un pipeline?
Iniciando un pipeline
Stream Selector
Evaluación de expresiones
Usando el evaluador de Javascript
Ingesta de datos en múltiples clusters de Kudu
Rest API
Event Framework
Dataflow Performance Manage
Ingesta de datos con Kudu
Integración con Pentaho
Ingesta de archivos CSV en HDFS y Kudu
Ingesta de datos en Kudu con transformación
Integración con Talend Open Studio
Integración con SQL Server
Transformación de datos
Integración con SSIS
Integración con Apache NIFI
Integración de Oracle Data Integrator para Big Data
Integración con IBM InfoShere DataStage
Integración con SyncSort
Ingesta de datos con Spark y Kudu Client API
MapReduce y Kudu
Introducción a las visualizaciones de Big Data
SAS Visual Analytics
Zoomdata
Self-Service Business Intelligence y analítica para Big Data
Visualización de datos en tiempo real
Arquitectura
Integración con Apache Spark
Zoomdata Fuson
Trabajando con mútiples orígenes de datos
Trabajando con datos en tiempo real de IoT con StreamSets, Kudu y Zoomdata
Analizando datos con Trifacta
Analizando datos con Alteryx
Analizando datos con Datameer
Introducción a los conceptos de la computación distribuida
Arquitectura
¿Qué es Alluxio y por qué usarlo?
¿Cómo mejorar la eficiencia del procesado de datos y su escalabilidad?
Compartiendo datos a velocidad de memoria entre varias aplicaciones
Proporcionando alta disponibilidad y persistencia ante errores o caidas de una aplicación
Optimizando el uso de memoria
Minimizando la gestión de recolección de basura
Reduciento requisitos de HW
Componentes de Alluxio
Instalación y puesta en marcha de Alluxio
Integración de Apache Spark y Alluxio
Administración y configuraciones recomendadas de Alluxio (master & worker)
Trabajando con Apache Ignite
Trabajando con Apache Geode
Introducción a los fundamentos de la Gobernanza de datos
Introducción a Cloudera Navigator
Mantenimiento de metadatos
Clasificación de datos
Almacenamiento y análisis de impacto de datos
La importancia del cifrado de datos
Introducción a Clouder Navigator Encrypt
Introducción a Apache Atlas
Introducción a la administración de metadatos de Informatica y Enterprise Data Catalog
Introducción a Collibra
Introducción a Waterline Data
Introducción a Smartlogic
AWS
Azure
GCP
Cloudera Enterprise en soluciones en la nube
Soluciones híbridas
Soluciones multi cloud
Transient Clusters
Persistent Clusters con Cloudera Director
Pensado para quienes deben dominar Big Data con Apache Kudu en su día a día
Científicos de Datos
Pretenden optimizar sus análisis utilizando herramientas avanzadas del ecosistema Hadoop.
Ingenieros de Software
Buscan integrar nuevas tecnologías de Big Data en los sistemas de sus organizaciones.
Administradores de Bases de Datos
Desean mejorar en la gestión de grandes volúmenes de datos estructurados y no estructurados.
Analistas de Negocios
Necesitan transformar datos en insights valiosos para la toma de decisiones estratégicas.
Responsables de TI
Quieren implementar soluciones eficaces de almacenamiento y procesamiento de datos.
Consultores Tecnológicos
Planean ofrecer soluciones de Big Data personalizadas para sus clientes empresariales.
Empresas que ya han formado a sus equipos
Experiencias reales de equipos que ya han trabajado con nosotros.
+16
años de liderazgo
+3.500
empresas formadas
Nuestra empresa decidió contratar formación con Imagina aprovechando los créditos de FUNDAE, y fue una gran decisión. La modalidad online nos permitió adaptar los horarios a nuestro equipo. La formación ha sido práctica, clara y útil para el día a día. Es sencillo de gestionar y los resultados son excepcionales.
Hugo Gutiérrez
Analista Financiero
Gracias a Imagina, la eficiencia de nuestras sesiones de capacitación ha mejorado drásticamente. Es sencillo de usar y los resultados son excepcionales.
Luis Martínez
Administrativo
Gracias al aula virtual de Imagina siempre son capaces de adaptar los cursos a nuestras necesidades. El contenido fue muy completo y práctico.
Elena Pérez
Responsable de Recursos Humanos
Mejor de lo esperado, la modalidad online se adapta a nuestros horarios. La ayuda con la bonificación FUNDAE hizo todo más fácil. Práctico y necesario.
Alejandro Sánchez
Director de Operaciones
Nuestra empresa decidió contratar formación con Imagina aprovechando los créditos de FUNDAE, y fue una gran decisión. La modalidad online nos permitió adaptar los horarios a nuestro equipo. La formación ha sido práctica, clara y útil para el día a día. Es sencillo de gestionar y los resultados son excepcionales.
Hugo Gutiérrez
Analista Financiero
Gracias a Imagina, la eficiencia de nuestras sesiones de capacitación ha mejorado drásticamente. Es sencillo de usar y los resultados son excepcionales.
Luis Martínez
Administrativo
Gracias al aula virtual de Imagina siempre son capaces de adaptar los cursos a nuestras necesidades. El contenido fue muy completo y práctico.
Elena Pérez
Responsable de Recursos Humanos
Mejor de lo esperado, la modalidad online se adapta a nuestros horarios. La ayuda con la bonificación FUNDAE hizo todo más fácil. Práctico y necesario.
Alejandro Sánchez
Director de Operaciones
480.000 alumnos formados en Imagina
Resolvemos todas tus dudas sobre nuestra formación en Big Data con Apache Kudu
Explora las respuestas a las preguntas que guian a nuestra comunidad. Aqui encontraras claridad sobre como funciona todo, desde el acceso hasta los detalles de los cursos. Si buscas respuestas, este es el lugar para comenzar.
El curso se diseña a medida para cada empresa, ajustando el contenido a sus necesidades específicas. Se lleva a cabo en Aula Virtual Personalizada a través de Zoom, ofreciendo un aprendizaje adaptativo y enfocado en soluciones prácticas.
Sí, es ideal para equipos. Además de mejorar el manejo de Big Data, fortalecerá la colaboración entre miembros, multiplicando la eficiencia en proyectos. Los equipos aprenderán a gestionar el data warehousing, aprovechando innovaciones en tiempo real con Apache Kudu.
El curso es 100% bonificable a través de FUNDAE, permitiendo reducir costes de formación. Si gestionamos la bonificación, cobramos un 10% adicional más IVA, el cual también es bonificable. Esto facilita que tu empresa aproveche sin importar el presupuesto.
La inscripción se gestiona a través de nuestra página web. Es necesario completar un formulario detallado para ajustar el curso a las necesidades de la empresa y activar la bonificación. Una vez inscrito, recibirás toda la información adicional para iniciar las sesiones por Zoom.
En la modalidad de Aula Virtual Personalizada, adaptamos tanto los horarios como los proyectos a las necesidades particulares de cada empresa, asegurando una experiencia de formación relevante. Además, las sesiones se graban para acceso posterior.
Basta con disponer de un dispositivo con conexión a internet y acceso a Zoom. Se recomienda un entorno de trabajo equipado con las herramientas necesarias para practicar las habilidades aprendidas, optimizando la experiencia formativa.
El curso admite hasta 20 participantes por sesión, asegurando una atención personalizada y una adecuada interacción entre instructor y alumnos. Este número permite maximizar el impacto del aprendizaje y favorece un ambiente participativo y enriquecedor.
¿Tienes dudas?
Estamos aqui para ayudarte
El curso se diseña a medida para cada empresa, ajustando el contenido a sus necesidades específicas. Se lleva a cabo en Aula Virtual Personalizada a través de Zoom, ofreciendo un aprendizaje adaptativo y enfocado en soluciones prácticas.
¿Tienes dudas?
Estamos aqui para ayudarte
Sí, es ideal para equipos. Además de mejorar el manejo de Big Data, fortalecerá la colaboración entre miembros, multiplicando la eficiencia en proyectos. Los equipos aprenderán a gestionar el data warehousing, aprovechando innovaciones en tiempo real con Apache Kudu.
¿Tienes dudas?
Estamos aqui para ayudarte
El curso es 100% bonificable a través de FUNDAE, permitiendo reducir costes de formación. Si gestionamos la bonificación, cobramos un 10% adicional más IVA, el cual también es bonificable. Esto facilita que tu empresa aproveche sin importar el presupuesto.
¿Tienes dudas?
Estamos aqui para ayudarte
La inscripción se gestiona a través de nuestra página web. Es necesario completar un formulario detallado para ajustar el curso a las necesidades de la empresa y activar la bonificación. Una vez inscrito, recibirás toda la información adicional para iniciar las sesiones por Zoom.
¿Tienes dudas?
Estamos aqui para ayudarte
En la modalidad de Aula Virtual Personalizada, adaptamos tanto los horarios como los proyectos a las necesidades particulares de cada empresa, asegurando una experiencia de formación relevante. Además, las sesiones se graban para acceso posterior.
¿Tienes dudas?
Estamos aqui para ayudarte
Basta con disponer de un dispositivo con conexión a internet y acceso a Zoom. Se recomienda un entorno de trabajo equipado con las herramientas necesarias para practicar las habilidades aprendidas, optimizando la experiencia formativa.
¿Tienes dudas?
Estamos aqui para ayudarte
El curso admite hasta 20 participantes por sesión, asegurando una atención personalizada y una adecuada interacción entre instructor y alumnos. Este número permite maximizar el impacto del aprendizaje y favorece un ambiente participativo y enriquecedor.
¿Tienes dudas?
Estamos aqui para ayudarte
Encuentra el Curso Perfecto para tu Organización
Análisis de datos con Hadoop
Este curso de Análisis de Datos con Hadoop enseña a los participantes los conceptos fundamentales de Big Data, cómo configurar, crear y ejecutar jobs con Hadoop, así como usar herramientas como Hadoop, Hive, Pig y Spark para realizar análisis de datos complejos.
Apache Kudu
Este curso trata sobre cómo utilizar big data centrándose en las tres soluciones Apache más populares, dentro del ecosistema Hadoop: Apache Kudu, Apache Spark, Apache Impala para garantizar soluciones Big Data escalables y rendimiento.
Spark
Apache Spark es un framework de computación en clúster de código abierto, orientado al procesamiento de datos en tiempo real, que provee de una interfaz para programar clústers con paralelismo de datos implícito y tolerancia a fallos y actualmente es el proyecto de Apache más activo.
Diseñemos hoy el curso que tu empresa necesita
Cuéntanos tus objetivos de negocio y prepararemos una propuesta formativa bonificable totalmente ad hoc