Silen
Администратор
- Регистрация
- 3 Дек 2015
- Сообщения
- 179.689
- Реакции
- 755.679
Складчина: [ДМК] Apache Arrow. Обработка больших данных [Мэтью Топол]
Apache Arrow – это программная платформа с открытым исходным кодом, предназначенная для разработки приложений, эффективно выполняющих обработку и анализ табличных данных за счет размещения в оперативной памяти. В обновленном втором издании представлен обзор формата Arrow с акцентом на его преимуществах и универсальности.
Эта книга познакомит вас с форматами обмена и хранения данных и расскажет о взаимосвязи Arrow с Parquet, Protocol Buffers, FlatBuffers, JSON и CSV. Вы откроете для себя подпроекты Apache Arrow, включая Flight, SQL, Database Connectivity и nanoarrow, и освоите интеграцию с популярными системами обработки аналитических данных Snowflake, Dremio и DuckDB. В заключительных главах приводятся реальные примеры и описания продуктов на базе Apache Arrow.
Вы научитесь:
использовать библиотеки Apache Arrow;
обеспечивать эффективное производство и потребление данных Apache Arrow;
применять вычислительный механизм Arrow Асего для выполнения сложных операций;
создавать серверы и клиенты Arrow Flight для быстрой передачи данных;
создавать библиотеки Arrow в локальном режиме и распространять их в сообществе.
Желательны базовые знания концепций анализа данных. В книге представлены многочисленные примеры исходного кода на языках C++, Python и Go.
Издание предназначено разработчикам, инженерам и научным работникам, занятым в обработке данных и желающим в полной мере изучить и использовать функциональные возможности Apache Arrow. Независимо от того, создаете ли вы утилиты для анализа данных и механизмов запросов или формируете полнофункциональные конвейеры для обработки табличных данных, эта книга поможет вам организовать работу на любом языке программирования. Программисты и исследователи найдут в ней рекомендации по выбору оптимальной среды для достижения целевых задач приложения, а также по управлению большими данными и их анализу.
Издание: Цветное
Оригинальное название: In-Memory Analytics with Apache Arrow
Оригинальный правообладатель: Packt
Автор: Топол М.
Объем, стр: 410
ISBN: 978-5-93700-273-0
Формат: PDF
Стоимость: 1520
СКАЧАТЬ СЛИВ КУРСА
Apache Arrow – это программная платформа с открытым исходным кодом, предназначенная для разработки приложений, эффективно выполняющих обработку и анализ табличных данных за счет размещения в оперативной памяти. В обновленном втором издании представлен обзор формата Arrow с акцентом на его преимуществах и универсальности.
Эта книга познакомит вас с форматами обмена и хранения данных и расскажет о взаимосвязи Arrow с Parquet, Protocol Buffers, FlatBuffers, JSON и CSV. Вы откроете для себя подпроекты Apache Arrow, включая Flight, SQL, Database Connectivity и nanoarrow, и освоите интеграцию с популярными системами обработки аналитических данных Snowflake, Dremio и DuckDB. В заключительных главах приводятся реальные примеры и описания продуктов на базе Apache Arrow.
Вы научитесь:
использовать библиотеки Apache Arrow;
обеспечивать эффективное производство и потребление данных Apache Arrow;
применять вычислительный механизм Arrow Асего для выполнения сложных операций;
создавать серверы и клиенты Arrow Flight для быстрой передачи данных;
создавать библиотеки Arrow в локальном режиме и распространять их в сообществе.
Желательны базовые знания концепций анализа данных. В книге представлены многочисленные примеры исходного кода на языках C++, Python и Go.
Издание предназначено разработчикам, инженерам и научным работникам, занятым в обработке данных и желающим в полной мере изучить и использовать функциональные возможности Apache Arrow. Независимо от того, создаете ли вы утилиты для анализа данных и механизмов запросов или формируете полнофункциональные конвейеры для обработки табличных данных, эта книга поможет вам организовать работу на любом языке программирования. Программисты и исследователи найдут в ней рекомендации по выбору оптимальной среды для достижения целевых задач приложения, а также по управлению большими данными и их анализу.
Издание: Цветное
Оригинальное название: In-Memory Analytics with Apache Arrow
Оригинальный правообладатель: Packt
Автор: Топол М.
Объем, стр: 410
ISBN: 978-5-93700-273-0
Формат: PDF
Стоимость: 1520
СКАЧАТЬ СЛИВ КУРСА
Для просмотра скрытого содержимого вы должны зарегистрироваться
Возможно, Вас ещё заинтересует:
- Энергетическое целительство (3 ступени) [Марьяна Романова]
- Курс про тревогу [Базовый тариф] [Яков Кочетков, Полина Тур]
- МАРКЕТИНГ БЕЗ УСИЛИЙ: НЕЙРОСЕТИ ДЛЯ ПСИХОЛОГОВ [Анастасия Асмаловская]
- Поздно начинать – это ложь. Для тех, кому 35, 45, 55+ [Марина Христова]
- Методичка со значениями всех арканов Таро [Марина Анисина] [Аналитческое Таро]
- Расстройства личности. Второй модуль [ISTFP] [Отто Кернберг]