Java для раздела «Data Eng»
59 репозиториев на Java в разделе «Data Eng».
Apache Hive: Как SQL открывает двери в мир Больших Данных на Hadoop
Устали от сложности работы с Big Data? Apache Hive позволяет анализировать огромные массивы данных в Hadoop с помощью привычного SQL. Откройте для себ...
AutoMQ — Kafka без дисков, которая экономит миллионы и масштабируется за секунды
Устали от непомерных счетов за Kafka в облаке и сложностей с масштабированием? AutoMQ предлагает революционное решение: Kafka на S3, которая сокращает...
Debezium — Когда ваша база данных начинает говорить в реальном времени
Debezium – это open-source платформа для Change Data Capture, которая позволяет в реальном времени отслеживать и стримить изменения данных из ваших ба...
AKHQ Когда Kafka становится понятной и управляемой
AKHQ – это мощный и удобный графический интерфейс для Apache Kafka, который упрощает управление топиками, данными, группами потребителей и Kafka Conne...
Apache Fesod: Когда Excel не хочет дружить с памятью
Apache Fesod: высокопроизводительная и экономичная Java-библиотека для работы с табличными файлами, которая решает проблему OutOfMemoryError при обраб...
ИИ-агенты выходят в реалтайм с Apache Flink Agents
Обзор нового фреймворка Apache Flink Agents для создания распределенных ИИ-агентов, работающих с потоковыми данными в реальном времени.
SQL для всего: Как Apache Calcite превращает любые данные в базу данных
Устали от зоопарка баз данных и разных языков запросов? Apache Calcite — это мощный фреймворк, который позволяет говорить на SQL с любыми источниками...
Apache Beam — Пишите код для данных один раз, запускайте где угодно
Apache Beam: единая модель для пакетной и потоковой обработки данных. Пишите код один раз на Java, Python или Go, а запускайте на Spark, Flink или Goo...
OpenLineage ДНК ваших данных – от источника до отчета
Представьте, что вы всегда знаете, откуда пришли ваши данные, как они трансформировались и куда отправились. OpenLineage делает эту мечту реальностью,...
Kafbat UI — Визуальное управление Kafka без головной боли
Kafbat UI — удобный веб-интерфейс для управления кластерами Apache Kafka, который упрощает мониторинг и отладку данных в реальном времени
Как LinkedIn и Uber справляются с петабайтами данных в реальном времени - знакомство с Apache Pinot
Обзор Apache Pinot — распределенного OLAP-хранилища для real-time аналитики на петабайтных масштабах. Узнайте, как LinkedIn и Uber обрабатывают миллио...
QuestDB Когда миллионы событий в секунду — это не проблема, а норма
Устали от медленных баз данных для временных рядов? QuestDB предлагает молниеносную обработку и SQL-запросы для финансовых данных, IoT и мониторинга,...
Apache Kafka — высоконагруженная платформа для потоковой обработки данных
Как Apache Kafka стал стандартом для обработки потоковых данных и почему его используют тысячи компаний
Spring Batch Ваш надёжный швейцарский нож для пакетной обработки данных
Устали от рутинной обработки данных? Spring Batch — ваш надёжный помощник в мире Java-разработки, позволяющий легко создавать мощные и отказоустойчивы...
Apache POI Когда Java говорит на языке Microsoft Office
Apache POI — это ваш надежный помощник в мире Java, когда нужно программно работать с файлами Microsoft Office. Забудьте о рутине и автоматизируйте со...
ArcadeDB — когда одной модели данных становится мало
Обзор ArcadeDB — сверхбыстрой мультимодельной СУБД, объединяющей графы, документы, векторы и временные ряды в одном движке с поддержкой SQL, Cypher и...
JetLinks Когда IoT-проекты перестают быть головной болью
JetLinks — это открытая IoT-платформа на Java, Spring Boot и WebFlux, которая упрощает подключение, управление и обработку данных с тысяч устройств. И...
Apache SeaTunnel - Ваш надежный мост в мире данных
Apache SeaTunnel – высокопроизводительный инструмент для интеграции данных, способный синхронизировать огромные объемы информации из сотен источников,...
Apache Fluss — Когда данные текут как река к вашему Lakehouse
Apache Fluss — это новое хранилище данных для аналитики в реальном времени, которое элегантно объединяет стриминг и Lakehouse архитектуры. Откройте дл...
StarRocks: Как ускорить аналитику данных до субсекундных результатов и забыть о боли Data Lakehouse
Устали ждать, пока аналитические запросы выполнятся? StarRocks — это молниеносный движок для аналитики данных в реальном времени, который ускоряет зап...
Apache Flink когда batch-обработка и стриминг живут дружно
Устали от костылей при объединении потоковой и пакетной обработки данных? Apache Flink предлагает элегантное решение. Разбираемся, как этот фреймворк...
Apache Camel - Когда интеграция систем перестает быть головной болью
Устали от рутинной интеграции систем? Apache Camel — это фреймворк, который превращает сложную логику маршрутизации данных в элегантные и легко поддер...