HTML для раздела «Data Sci»
16 репозиториев на HTML в разделе «Data Sci».
Как устроено закулисье Schema.org и почему разработчикам стоит туда заглянуть
Разбираем внутренности Schema.org: почему проект сознательно избегает «красивого» кода, как запустить локальную копию стандарта и зачем разработчикам...
Newspaper4k Вторая жизнь легендарного парсера новостей
Newspaper4k — современная альтернатива популярного newspaper3k для парсинга новостных статей с улучшенной точностью извлечения данных и поддержкой 80+...
Prolet Неожиданная Роль GitHub в Сохранении Исторических Документов
Узнайте, как GitHub превращается в цифровой архив для уникальных исторических документов о Культурной революции в Китае. Проект Prolet открывает досту...
RDKit - Ваш швейцарский нож для работы с молекулами в химии и ML
RDKit – это мощная библиотека для хемоинформатики и машинного обучения, написанная на C++ и Python. Она позволяет химикам и дата-сайентистам анализиро...
Как собрать базу для фитнес-приложения за вечер и не сойти с ума
Обзор структурированного датасета из 1324 фитнес-упражнений с пошаговыми инструкциями на 6 языках и готовыми инструментами для развертывания БД.
Как собрать свой хедж-фонд на коленке и не сойти с ума
Обзор топового репозитория awesome-systematic-trading: всё, что нужно разработчику для создания торговых роботов, анализа данных и использования ИИ в...
TidyTuesday - еженедельный фитнес для вашего Data Science портфолио
Устали от однотипных учебных датасетов? TidyTuesday — это еженедельный проект, который подкидывает свежие реальные данные для практики, от экспедиций...
Как вытащить текст из любого файла и не сойти с ума
Разбор библиотеки textract — универсального инструмента для извлечения текста из любых форматов файлов: от PDF и DOCX до звуковых дорожек и сканов.
Как подружить экономические модели с ИИ агентами
Обзор репозитория awesome-econ-ai-stuff: коллекция специализированных навыков для ИИ-агентов, которые помогают экономистам автоматизировать работу в S...
Как не провалить собеседование в Data Science
Обзор популярного репозитория с вопросами и ответами для подготовки к собеседованиям по Data Science. Разбираем, как эффективно использовать этот ресу...
Как превратить Википедию в бесконечную ленту соцсетей
Обзор xikipedia — проекта, превращающего Википедию в бесконечную ленту с локальным алгоритмом рекомендаций без использования ML.
Оживите свои данные: 3D-графы, которые затягивают!
Погрузитесь в мир данных с 3D-визуализацией! Узнайте, как 3d-force-graph превращает сложные графы в интерактивные трехмерные модели, открывая новые го...
Как нейросети видят рынок труда — разбираем новый проект Андрея Карпати
Разбираем новый проект Андрея Карпати: как с помощью Python, Playwright и LLM визуализировать рынок труда и оценить влияние ИИ на разные профессии.
Прощайте, мучения с XPATH: как ScraperAI превращает хаос веб-страниц в структурированные данные
Обзор ScraperAI — open-source инструмента на Python, который использует мощь GPT для автоматического создания парсеров и извлечения данных без ручного...