Go для раздела «Data Eng»
23 репозитория на Go в разделе «Data Eng».
Volcano Когда Kubernetes "закипает" от AI/ML и Big Data
Устали от того, как Kubernetes справляется с требовательными пакетными задачами? Volcano — это мощный планировщик, созданный специально для AI/ML, Big...
ClickHouse на Kubernetes Altinity Operator приручает Big Data
Устали от ручного развертывания ClickHouse в Kubernetes? Altinity ClickHouse Operator автоматизирует управление кластерами, масштабирование и обновлен...
Как собрать работающий дашборд быстрее чем заварится кофе
Обзор Rill — BI-инструмента нового поколения, который превращает SQL и YAML в реактивные дашборды. Рассказываем, как DuckDB и AI-агенты меняют работу...
Как в CockroachDB переписали RocksDB на Go и зачем им это понадобилось
Разбор Pebble — высокопроизводительного KV-движка на Go от создателей CockroachDB. Почему они отказались от RocksDB и чем хорош их собственный проект.
Как превратить гору CSV и Excel файлов в полноценную базу данных с помощью одной библиотеки
Обзор Go-библиотеки filesql, которая позволяет выполнять SQL-запросы к CSV, Excel, JSON и Parquet файлам без использования полноценной СУБД.
Как спать спокойно, когда база данных весит терабайты
Обзор WAL-G — современного инструмента на Go для резервного копирования баз данных в облака. Узнайте, как ускорить бэкапы и настроить восстановление н...
Sarama - Когда Go встречает Kafka — надежно и масштабируемо
Sarama — это зрелый и мощный Go-клиент для Apache Kafka, разработанный IBM, который поможет вам построить отказоустойчивые и высокопроизводительные ра...
Franz-go: когда вам нужен полный контроль над Kafka на Go
Полный обзор franz-go — самого быстрого и функционального Kafka-клиента на Go с поддержкой всех версий протокола и уникальными возможностями
Как переливать данные из Postgres в 10 раз быстрее привычных инструментов
Обзор PeerDB — специализированного ETL-инструмента для Postgres, который обещает 10-кратное ускорение репликации данных и нативную поддержку сложных т...
SeaweedFS: распределенное хранилище для эпохи больших данных
SeaweedFS — высокопроизводительная распределенная файловая система для работы с миллиардами файлов. Узнайте, как она обеспечивает O(1) доступ к данным...
Eino Examples - Ваш путеводитель по миру гибкой оркестрации и потоковой обработки данных
Погрузитесь в мир Eino: фреймворка для построения сложных систем с помощью компонентов, оркестрации и потоков данных. Этот репозиторий — ваш проводник...
Hatchet: Когда фоновые задачи перестают быть головной болью
Устали от борьбы с фоновыми задачами? Hatchet предлагает комплексное решение для надежной оркестрации, управления и мониторинга рабочих процессов, пос...
Как подружить базу данных с ИИ-агентами без написания лишнего кода
Обзор MCP Toolbox от Google — универсального моста между вашими базами данных и ИИ-агентами. Узнайте, как дать нейронке доступ к SQL без боли и лишнег...
Mangle — когда SQL уже недостаточно
Mangle — это язык программирования для работы с дедуктивными базами данных от Google. Узнайте, как он расширяет возможности Datalog и где может пригод...
Дашборды как код без боли и лишних кликов в интерфейсе
Обзор инструмента dac для создания дашбордов через код (YAML/TSX). Узнайте, как автоматизировать аналитику, использовать семантический слой и подружит...
JuiceFS — Когда облачное хранилище работает как локальный SSD (и даже лучше!)
JuiceFS — это высокопроизводительная POSIX-совместимая файловая система, которая превращает любое объектное хранилище в быстрый и масштабируемый диск...
Google Cloud Client Libraries для Go Ваш ключ к облаку
Откройте для себя официальные Go-библиотеки для Google Cloud Platform! Узнайте, как легко и идиоматично интегрировать ваши Go-приложения с десятками с...
Google Maps Scraper автоматизируем сбор бизнес-данных
Обзор open-source инструмента для парсинга данных с Google Maps — от командной строки до веб-интерфейса и REST API
Как переливать данные между базами одной командой без кода и боли
Обзор ingestr — мощного CLI-инструмента для копирования данных между любыми базами и сервисами без написания кода. Поддерживает Postgres, ClickHouse,...
RudderStack — ваш собственный хаб для клиентских данных
RudderStack — открытая альтернатива Segment для управления клиентскими данными с акцентом на приватность и интеграцию с хранилищами данных. Рассказыва...
Как подружить Postgres с масштабируемостью в духе Vitess
Обзор Multigres — амбициозного проекта, который переносит архитектуру Vitess на рельсы PostgreSQL для прозрачного горизонтального масштабирования.