#transformers
Погрузитесь в мир трансформеров и генеративного ИИ. Узнайте, как обучать, тонко настраивать и использовать большие языковые модели для решения реальных задач. Свежие обзоры open-source инструментов, библиотек и фреймворков для создания умных приложений и работы с нейросетями.
Как дообучить 8B нейросеть на ноутбуке с видеокартой на 4 ГБ
Обзор Soup — инструмента для быстрого файнтюнинга LLM из одного YAML-конфига со стримингом слоев для видеокарт с 4 ГБ памяти.
Как автоматически вычистить паспортные данные и номера карт из логов
Разбираем Presidio — открытый инструмент от data-privacy-stack для поиска и маскирования персональных данных (PII) в текстах, изображениях и логах с п...
Все инструменты для работы с векторным поиском и LLM в одной библиотеке Python
Обзор txtai — универсального Python-фреймворка для гибридного векторного поиска, оркестрации LLM и построения локальных RAG-систем.
SD.Next — замена Automatic1111 для тех, кому мало стандартного WebUI
Разбираем SD.Next — форк классического Stable Diffusion WebUI от Влада Мандича с квантованием моделей, поддержкой AMD/Intel/Apple и автоматическим офл...
Как превратить сухой текст нейросети в живую речь
Разбираем Python-инструмент на базе Streamlit, который превращает сгенерированный нейросетями текст в живую и академическую речь, помогая обходить дет...
Как собрать собственную языковую модель и не разориться на видеокартах
Разбираем репозиторий train-llm-from-scratch: как обучить собственную языковую модель на домашней видеокарте, используя PyTorch и датасет The Pile.
Как перестать копипастить промпты и начать понимать AI
Разбираем масштабный репозиторий ai-engineering-from-scratch: 435 уроков по AI, от математики до создания автономных агентов своими руками.
Генерация 4K изображений на домашней видеокарте: изучаем SANA от NVIDIA
Обзор SANA от NVIDIA — линейного диффузионного трансформера, который генерирует 4K изображения в 100 раз быстрее Flux и работает даже на видеокартах с...
Как Hugging Face научили компьютеры читать быстрее людей
Обзор библиотеки tokenizers от Hugging Face: как Rust превращает медленную обработку текста в мгновенную операцию и зачем это нужно современному разра...
Как приручить трансформеры без боли и лишних абстракций
Обзор впечатляющей коллекции туториалов по HuggingFace Transformers. Разбираемся, как быстро запустить SOTA-модели для анализа документов, компьютерно...
Запускаем локальные LLM без мучений и Python
Обзор shimmy — сверхбыстрого и легкого сервера на Rust для запуска локальных LLM с полной поддержкой OpenAI API без зависимостей и Python.
Как почувствовать нейросети на кончиках пальцев
Обзор проекта There Is No Spoon — инженерного гайда по машинному обучению, который заменяет сухую математику на понятные физические аналогии и архитек...
Как обучить модель на сотни миллиардов параметров и не сойти с ума
Разбираем Megatron-LM от NVIDIA — мощный фреймворк для обучения гигантских языковых моделей. Узнайте, как эффективно использовать тысячи GPU и достичь...
MLX-Audio — Когда ваш Mac на Apple Silicon заговорит и услышит
MLX-Audio – это мощная библиотека для Text-to-Speech (TTS), Speech-to-Text (STT) и Speech-to-Speech (STS), оптимизированная для Apple Silicon. Она поз...
LlamaFactory - Укрощаем LLM и VLM без лишних хлопот
LlamaFactory: ваш универсальный инструмент для быстрой и эффективной донастройки более 100 больших языковых и мультимодальных моделей. Забудьте о слож...
Разбираемся в Deep Learning — ваш гид по аннотированным реализациям статей от labml.ai
Погрузитесь в мир глубокого обучения с labml.ai! Этот проект предлагает более 60 аннотированных реализаций ключевых статей по DL на PyTorch, от Трансф...
ИИ прямо в браузере — Как Transformers.js меняет правила игры для веб-разработчиков
Запускайте передовые модели машинного обучения Hugging Face прямо в браузере, без бэкенда! Transformers.js открывает новую эру интерактивных веб-прило...
Как Microsoft Presidio защищает ваши данные: обзор фреймворка для анонимизации PII
Ваши данные под угрозой? Узнайте, как Microsoft Presidio помогает автоматически обнаруживать и анонимизировать конфиденциальную информацию (PII) в тек...
Не утонуть в море исследований GitHub-репозиторий, который станет вашим гидом по CVPR 2025
Устали искать код к свежим научным статьям по Computer Vision? Этот репозиторий — ваш личный куратор мира CVPR 2025, собирающий все важные исследовани...
Greenmask: когда вашей базе данных нужна маска
Greenmask — мощный инструмент для анонимизации данных PostgreSQL и генерации синтетических данных с поддержкой сложных сценариев и высокой производите...
SuperDuperDB — Когда ваша база данных становится умной
SuperDuperDB — это инновационный фреймворк для интеграции AI-моделей прямо в вашу базу данных. Узнайте, как он упрощает создание интеллектуальных прил...
Haystack: Ваш конструктор приложений на базе LLM
Haystack — это мощный фреймворк для создания LLM-приложений с поддержкой RAG, семантического поиска и генерации ответов. Узнайте, как он помогает разр...