C для раздела «Data Eng»
15 репозиториев на C в разделе «Data Eng».
H3 от Uber - Гексагональная магия для ваших геоданных
H3 от Uber: как гексагональные сетки меняют геопространственный анализ. Откройте для себя мощный инструмент для эффективной работы с географическими д...
Как DAOS выжимает максимум из NVMe и памяти SCM
Разбираем DAOS — распределённое объектное хранилище от Linux Foundation, созданное с нуля для работы с энергонезависимой памятью и высокими нагрузками...
Как хранить гигабайты научной графики и не сойти с ума
Обзор легендарной библиотеки netCDF-C для работы с огромными научными массивами данных. Разбираемся, как хранить гигабайты графики компактно и с быстр...
OpenZL — Сжатие данных, которое знает ваши форматы в лицо
Устали выбирать между скоростью и степенью сжатия? OpenZL от Facebook предлагает уникальный подход, создавая специализированные компрессоры, которые з...
UCX — Когда каждая наносекунда на счету в распределенных системах
Unified Communication X (UCX) — это высокопроизводительный фреймворк для обмена данными в распределенных системах, который позволяет вашим приложениям...
xxHash: Когда скорость хеширования имеет значение, а качество не страдает
Надоели медленные хеш-функции? xxHash — это молниеносный некриптографический алгоритм хеширования, который работает на скорости оперативной памяти и о...
Как превратить Postgres в полноценное хранилище данных с помощью pg_lake
Обзор pg_lake — мощного расширения для PostgreSQL, которое позволяет работать с Apache Iceberg и данными в S3 напрямую, используя DuckDB для ускорения...
Как хранить петабайты данных и не сойти с ума - знакомимся с HDF5
Обзор HDF5 — золотого стандарта для хранения огромных массивов данных. Узнайте, почему научное сообщество и Big Data инженеры выбирают этот формат и к...
pg_textsearch Когда PostgreSQL учится искать по-настоящему умно
Устали от нерелевантных результатов полнотекстового поиска в PostgreSQL? pg_textsearch от Timescale привносит современный BM25-ранжированный поиск пря...
TDengine: Укрощаем потоки данных IoT с умом
Представьте, что ваши IoT-устройства генерируют терабайты данных в день. Как их эффективно хранить, обрабатывать и анализировать? TDengine предлагает...
SPDK Когда каждый наносекунд на счету в мире хранилищ
Устали от медленного хранилища? SPDK переносит драйверы в userspace и использует опрос, чтобы выжать максимум производительности из NVMe и других устр...
Как обрабатывать терабайты карт без боли знакомство с движком GRASS GIS
Разбираем GRASS GIS — мощный движок для обработки геоданных с сорокалетней историей, который до сих пор дает фору современным инструментам в аналитике...
TimescaleDB Когда PostgreSQL становится королем временных рядов
TimescaleDB превращает PostgreSQL в мощную базу данных для временных рядов, предлагая гипертаблицы, непрерывные агрегаты и колоночное хранение для мол...