#transformer
Откройте для себя мир трансформеров — архитектуры, лежащей в основе современных нейросетей. В этой подборке вы найдете проекты по созданию и запуску больших языковых моделей (LLM), генерации изображений и синтезу речи, а также инструменты для их оптимизации и развертывания.
SGLang: Когда скорость LLM перестает быть проблемой
Устали от медленного инференса LLM? SGLang — это высокопроизводительный фреймворк, который ускоряет работу больших языковых и мультимодальных моделей...
Как запустить LLM на смартфоне и не расплавить его - обзор Cactus Engine
Обзор Cactus — сверхбыстрого и энергоэффективного движка для запуска LLM, Whisper и Vision-моделей прямо на смартфонах и носимых устройствах.
Heretic — Когда ваш LLM слишком "вежлив"
Heretic: инструмент, который автоматически избавляет языковые модели от "цензуры" и "выравнивания безопасности", сохраняя их интеллектуальные способно...
vLLM-Omni - Мультимодальные модели на скорости света
Представьте, что вы можете быстро и легко развернуть любую мультимодальную модель, от текста до видео. vLLM-Omni делает это реальностью, предлагая выс...
Hugging Face Transformers Ваш универсальный инструмент для работы с AI
Обзор библиотеки Hugging Face Transformers — универсального инструмента для работы с современными моделями машинного обучения в тексте, аудио, видео и...
Best-of Machine Learning with Python ваш гид по миру ML-библиотек
Лучшие Python-библиотеки для машинного обучения: ежедневно обновляемый рейтинг с 920+ проектами
vLLM — Turbo-режим для ваших языковых моделей
vLLM — высокопроизводительный движок для работы с большими языковыми моделями, который ускоряет их вывод в 1.7 раза и экономит память. Узнайте, как он...
Как честно измерить интеллект нейросети с помощью LM Evaluation Harness
Обзор lm-evaluation-harness — индустриального стандарта для тестирования LLM. Узнайте, как объективно оценить знания нейросети на сотнях бенчмарков од...
Как запустить vLLM на железе от Huawei
Обзор плагина vllm-ascend для запуска больших языковых моделей на NPU Huawei Ascend. Разбираемся, как работает Hardware Pluggable и зачем это нужно ра...
Как создать свою GPT-модель без магии — разбираем проект LLMs-from-scratch
Практическое руководство по созданию собственной GPT-модели с нуля — от основ обработки текста до тонкой настройки для конкретных задач
Fish Speech — когда синтез речи становится искусством
Fish Speech — революционный open-source инструмент для синтеза речи с поддержкой клонирования голоса и эмоций. Узнайте, как он превосходит коммерчески...
Nano-vLLM — когда vLLM слишком тяжёлый, а своя реализация — слишком сложная
Nano-vLLM — легковесная альтернатива vLLM для быстрого вывода LLM-моделей с чистым кодом и производительностью на уровне оригинала
Не утонуть в море исследований GitHub-репозиторий, который станет вашим гидом по CVPR 2025
Устали искать код к свежим научным статьям по Computer Vision? Этот репозиторий — ваш личный куратор мира CVPR 2025, собирающий все важные исследовани...
Разбираемся в Deep Learning — ваш гид по аннотированным реализациям статей от labml.ai
Погрузитесь в мир глубокого обучения с labml.ai! Этот проект предлагает более 60 аннотированных реализаций ключевых статей по DL на PyTorch, от Трансф...
Faster Whisper — Когда скорость решает все в работе с речью
Устали ждать, пока OpenAI Whisper обработает ваши аудио? Faster Whisper — это то, что вам нужно: до 4 раз быстрее, экономнее и с теми же впечатляющими...
Как избавиться от ручного набора формул обзор LaTeX-OCR
Устали вручную набирать сложные математические формулы в LaTeX? Проект pix2tex использует искусственный интеллект для мгновенного преобразования изобр...
Petals — запускаем гигантские языковые модели на своём компьютере
Petals — это революционный способ запускать огромные языковые модели у себя дома, используя распределённые вычисления по принципу BitTorrent. Узнайте,...