#data
Погрузитесь в мир данных: от бизнес-аналитики и data engineering до защиты приватности и восстановления файлов. Находите лучшие open-source инструменты, генераторы тестовых данных и практические руководства для эффективной работы и разработки.
Как собрать работающий дашборд быстрее чем заварится кофе
Обзор Rill — BI-инструмента нового поколения, который превращает SQL и YAML в реактивные дашборды. Рассказываем, как DuckDB и AI-агенты меняют работу...
Как подружить нейросеть с вашими данными с помощью LlamaIndex
Обзор LlamaIndex — популярного фреймворка для создания AI-приложений на основе ваших данных. Разбираемся, как подключить нейросеть к документам, базам...
Как собрать базу компаний с Google Maps без лишней головной боли
Обзор Python-инструмента на базе Playwright для автоматического сбора данных о компаниях из Google Maps: от контактов до отзывов.
Как превратить статичную картинку в живую схему DrawIO
Обзор инструмента Edit Banana, который с помощью нейросетей SAM 3 превращает скриншоты и картинки в редактируемые диаграммы DrawIO.
Как договориться о данных и не сойти с ума
Обзор Open Data Contract Standard (ODCS) — открытого стандарта для описания соглашений между поставщиками и потребителями данных. Разбираемся, как нав...
Как приручить хаос финансовых данных с помощью QuantMind
Обзор QuantMind — фреймворка для автоматического сбора и анализа финансовой аналитики с помощью LLM-агентов. Разбираем архитектуру, возможности и кейс...
Где брать чистые данные для пет-проектов и обучения
Обзор легендарного репозитория FiveThirtyEight с огромной коллекцией реальных датасетов для аналитики, машинного обучения и визуализации.
Как не провалить System Design и вспомнить алгоритмы за один вечер
Обзор концентрированной базы знаний для разработчиков: от алгоритмов и структур данных до проектирования высоконагруженных систем и теории вероятносте...
Как Apple предлагает усмирить хаос в конфигурационных файлах
Обзор Pkl — нового языка конфигураций от Apple. Узнайте, как типизация и логика в конфигах могут избавить вас от ошибок в YAML и упростить жизнь разра...
Забудьте про CSV как подтянуть свежие финансовые данные прямо в pandas
Обзор pandas-datareader: библиотеки, которая позволяет загружать финансовые и экономические данные из Yahoo Finance, FRED и других источников напрямую...
Как ускорить Spark в четыре раза без переписывания кода
Обзор Sail — современного Rust-native движка, который заменяет Apache Spark, ускоряет обработку данных в 4 раза и радикально снижает расходы на облачн...
Как перестать писать SQL-запросы вручную и собрать своего аналитика на стероидах
Обзор nao — опенсорсного фреймворка для создания аналитических агентов. Узнайте, как превратить вопросы на обычном языке в точные SQL-запросы и визуал...
Как перестать склеивать ML пайплайны синей изолентой и перейти на Flyte
Обзор Flyte — мощного оркестратора для ML-пайплайнов на базе Kubernetes. Узнайте, как типизация, кэширование и изоляция зависимостей помогают строить...
Как превратить обычный Python-скрипт в надежный пайплайн данных
Обзор Prefect — современного Python-фреймворка для оркестрации данных. Узнайте, как легко превратить обычные скрипты в надежные и наблюдаемые пайплайн...
Как TanStack Query превращает хаос управления данными в элегантный код
Разбираемся, почему TanStack Query стал стандартом для управления серверным состоянием и как он избавляет разработчиков от написания бесконечных useEf...
Как отрисовать миллион строк в React и не сойти с ума
Обзор Glide Data Grid — мощной React-библиотеки на базе Canvas, способной плавно отображать миллионы строк данных с поддержкой редактирования и кастом...
Где брать данные для стриминг-приложений и тренировки моделей в реальном времени
Подборка лучших API и источников данных для работы в реальном времени: от курсов криптовалют и движения поездов до фидов новостей и сейсмической актив...
Как перестать коллекционировать курсы и наконец выучить Python
Обзор огромного образовательного хаба на GitHub: от основ Python и принципов SOLID до Machine Learning проектов и подготовки к техническим собеседован...
PyCM — Ваш швейцарский нож для оценки моделей машинного обучения
PyCM — это библиотека Python для многоклассовых матриц ошибок, которая станет вашим незаменимым помощником в глубоком анализе производительности модел...
Spice.ai - Ваш новый швейцарский нож для данных и ИИ-приложений
Spice.ai — это движок для SQL-запросов, поиска и LLM-инференса на Rust, который позволяет создавать быстрые, надёжные и управляемые данными приложения...
DocETL: Ваш проводник в мире обработки документов с LLM
DocETL — это инструмент для создания и выполнения конвейеров обработки данных, особенно подходящий для сложных задач с документами, использующий мощь...
DataFlow - Как превратить "грязные" данные в золото для ваших LLM
Устали от низкого качества данных для обучения LLM? DataFlow — это комплексная система для подготовки, обработки и оценки высококачественных данных, к...