Описание

Книга является пособием для изучения технологий больших данных, охватывая основные и продвинутые аспекты работы с данными в распределенных системах. Начав с основ, она объясняет значение БД, их эволюцию и экосистему Hadoop, включая компоненты и инструменты: HDFS, MapReduce, Hive, Pig, HBase, Sqoop и Flume. Автор раскрывает архитектуру и принципы работы Apache Hadoop, а также примеры использования MapReduce и работу с данными в HDFS, Apache Spark, описывая его основные компоненты, такие как RDD, DataFrames, Spark SQL, Spark Streaming, MLLib и GraphX, и предоставляет практические примеры установки и настройки. Раздел, посвященный Apache Kafka, рассматривает основы архитектуры, проектирование и настройка кластеров, а также интеграция с другими системами. Практические примеры и проекты предлагают возможность применить полученные знания, анализируя данные, разрабатывая потоковые приложения и интегрируя технологии Hadoop, Spark и Kafka в единую систему.

О книге

ИздательствоАвтор
Год издания2024
Языкru
ФорматыFB2.ZIP, TXT, TXT.ZIP, RTF.ZIP, A4.PDF, A6.PDF, MOBI.PRC, EPUB, IOS.EPUB, FB3
Возрастное ограничение12

Частые вопросы

О чём книга «Обработка больших данных»?
«Обработка больших данных» — это информатика и вычислительная техника. Книга является пособием для изучения технологий больших данных, охватывая основные и продвинутые аспекты работы с данными в распределенных системах. Начав с основ, она объясняет значение БД, их эволюцию и экосистему Hadoop, включая…
Где читать или купить «Обработка больших данных»?
Книгу можно читать или купить у партнёра ЛитРес (эл. книга). Цена у партнёра — 799 ₽. Переход — по кнопке в блоке «Где читать или купить».
Что почитать похожее на «Обработка больших данных»?
Близкие по теме книги: «Информационные технологии и лингвистика XXI века», «Теория принятия решений», «Материалы студенческой научной сессии, г. Москва, 03-08 апреля 2017 г.». Полный список — в блоке «Похожие книги».