Перейти к содержимому

Big Data: 5 платформ обработки больших данных

Платформы обработки больших данных: Apache Spark, Apache Hadoop, Arenadata DB, Arenadata Hadoop, Yandex DataProc, SberTech. Распределённая обработка петабайтов, MapReduce, Spark SQL, ML на big data.

Найдено сервисов: 5
Apache Hadoop — логотип

Apache Hadoop

Бесплатный

Открытый фреймворк для распределённого хранения и обработки больших данных на кластерах обычных серверов

Бесплатно
On-premises / ОблакоApache Foundation (США)50+ интеграций
HDFS — распределённая файловая системаMapReduce — параллельные вычисленияYARN — управление ресурсами кластераЛинейное горизонтальное масштабированиеОтказоустойчивость через репликацию+7
Подробнее
Apache Spark — логотип

Apache Spark

Бесплатный

Универсальный open-source движок для масштабной обработки данных с поддержкой SQL, ML и потоковой обработки.

Бесплатно
Локально / ОблакоOpen-source100+ интеграций
In-memory обработка данныхSpark SQL и DataFrame APIПотоковая обработка данныхМашинное обучение (MLlib)Обработка графов (GraphX)+5
Подробнее
Arenadata — логотип

Российская платформа данных: MPP-СУБД Arenadata DB на Greenplum, колоночная QuickMarts на ClickHouse, гибридная Hyperwave и потоковая Streaming на Kafka. Для корпоративных хранилищ и импортозамещения зарубежных DWH.

По запросу
On-premiseОблакоГибридРоссия
Arenadata DB — аналитическая MPP-СУБД на базе GreenplumArenadata Hyperwave (ADH) — гибридная платформа для данных любой структурыArenadata QuickMarts — колоночная кластерная СУБД на базе ClickHouseArenadata Prosperity — коммерческий дистрибутив PostgreSQL с Enterprise-функционаломArenadata Streaming — Apache Kafka и Apache NiFi для потоковой обработки+7
Подробнее
Data Sapience — логотип

Российский вендор аналитических платформ для среднего и крупного бизнеса: целевой маркетинг, управление рисками и комплаенс, машинное обучение, Lakehouse и управление данными. Для банков, телекома, ритейла и производства, в том числе в задачах импортозамещения.

от 2 500 000 ₽/год
Россия
CM Ocean — платформа целевого маркетинга (11 модулей)TALYS Ocean — управление кредитными и комплаенс-рисками (6 модулей)Kolmogorov — продвинутая аналитика, ML и математическая оптимизация (5 модулей)Data Ocean — Lakehouse-платформа для больших данныхData Ocean Governance — управление метаданными, мастер-данными и качеством данных+7
Подробнее
Yandex DataProc — логотип

Yandex DataProc

Бесплатный

Managed сервис Yandex Cloud для работы с Apache Spark, Hadoop, Hive и другими инструментами экосистемы big data без администрирования инфраструктуры.

Бесплатно
ОблакоРоссия20+ интеграций
Managed Apache Spark и HadoopПоддержка Hive, HBase, Tez, OozieИнтеграция с Zeppelin для ноутбуковРабота с Yandex Object StorageАвтоматическое масштабирование кластера+5
Подробнее

Сравнение сервисов Платформы обработки больших данных (Big Data)

Мин. цена
По запросу
Бесплатная версия
Развёртывание
On-premise / Облако / Гибрид
Мин. цена
Бесплатно
Бесплатная версия
Есть
Развёртывание
On-premises / Облако
Интеграции
50+
Мин. цена
от 2 500 000 ₽/год
Бесплатная версия
Мин. цена
Бесплатно
Бесплатная версия
Есть
Развёртывание
Локально / Облако
Интеграции
100+
Мин. цена
от 25 000 ₽/мес
Бесплатная версия
Развёртывание
Облако
Интеграции
20+

Часто задаваемые вопросы

Apache Spark или Hadoop?
Spark — современная замена Hadoop MapReduce: в 10-100 раз быстрее за счёт in-memory обработки, проще API (Python, Scala, SQL), встроенный ML (MLlib), потоковая обработка (Structured Streaming). Hadoop HDFS остаётся актуальным для хранения, но вычислительный слой MapReduce заменён на Spark. Новые проекты — сразу Spark.
Что такое Arenadata?
Российская big data платформа в реестре отечественного ПО. Включает: Arenadata DB (MPP-СУБД на базе Greenplum), Arenadata Hadoop (дистрибутив Hadoop), Arenadata Streaming (платформа на Kafka), Arenadata Catalog (data governance). Используется крупными российскими банками, ритейлом, телекомами для импортозамещения западных решений.
Yandex DataProc — что это?
Управляемый сервис Apache Spark и Hadoop от Яндекс.Облако. Развёртывает кластеры за минуты, автоматически масштабирует, оплата за часы использования. Интеграция с Yandex Object Storage, Yandex Query, Yandex DataLens. Альтернатива AWS EMR или Google Dataproc для российских компаний.
Сколько стоит big data?
Open source (Spark, Hadoop) — бесплатны, платите только за инфраструктуру. Cloud managed (Yandex DataProc, AWS EMR) — почасовая оплата за узлы кластера. Enterprise-дистрибутивы (Arenadata, Cloudera) — годовая лицензия плюс инфраструктура. Для старта — Spark + собственный VPS-кластер, для production — managed cloud. Актуальные тарифы — в карточках сервисов ниже.
Зачем нужна big data платформа?
Для анализа данных, которые не помещаются в одну машину: логи, транзакции, события IoT, научные данные, web crawling. Классические СУБД не справляются с петабайтами. Big data платформы параллелят обработку по кластеру из десятков-тысяч узлов. Используются крупными банками, ритейлом, телеком-операторами, R&D-командами.

Платформы обработки больших данных 2026

Apache Spark, Apache Hadoop, Arenadata DB, Arenadata Hadoop, Yandex DataProc, SberTech — платформы обработки больших данных. Распределённая обработка петабайт, MapReduce, Spark SQL, машинное обучение, потоковая обработка. Spark — современный стандарт. Arenadata — российская платформа в реестре отечественного ПО. Yandex DataProc — managed cloud от Яндекса.

Каталог обновлён: июль 2026