#cuda
Погрузитесь в мир CUDA — технологии параллельных вычислений от NVIDIA. Откройте для себя фреймворки и инструменты, которые ускоряют нейросети, компьютерное зрение и сложные расчеты. Лучшие практики и обзоры для разработчиков, стремящихся к максимальной производительности.
TensorRT-LLM - Как NVIDIA заставляет большие языковые модели летать на GPU
Устали от медленного и дорогого инференса LLM? NVIDIA TensorRT-LLM — это ваш билет в мир молниеносных больших языковых моделей на GPU, с передовыми оп...
ALIEN: Создай свою вселенную с искусственной жизнью на CUDA
ALIEN — мощный симулятор искусственной жизни на CUDA, позволяющий наблюдать эволюцию цифровых организмов в реальном времени. Узнайте, как создать свою...
Как перестать гадать на кофейной гуще при выборе GPU и софта для LLM
Обзор InferenceX — опенсорсного проекта для непрерывного бенчмаркинга LLM. Узнайте, как софт влияет на скорость GPU и какие решения выбирают лидеры ин...
Обучение роботов на CPU: как UniLab меняет правила игры в Reinforcement Learning
Обзор UniLab — гибкого фреймворка для обучения роботов, который позволяет комбинировать CPU-симуляцию физики с мощностью любых GPU ускорителей, включа...
FlashInfer: Когда LLM летают, а не ползают
FlashInfer – это высокопроизводительная библиотека GPU-ядер для ускорения инференса больших языковых моделей. Решает проблемы производительности, памя...
SGLang: Когда скорость LLM перестает быть проблемой
Устали от медленного инференса LLM? SGLang — это высокопроизводительный фреймворк, который ускоряет работу больших языковых и мультимодальных моделей...
NVIDIA Warp: Разгоняем Python для симуляций и графики до космических скоростей
NVIDIA Warp: как превратить обычный Python в высокопроизводительный код для симуляций и графики на CPU и GPU. Фреймворк для пространственных вычислени...
Как ускорить Python в десятки раз одной строчкой импорта
Обзор CuPy — библиотеки, которая позволяет ускорить вычисления NumPy и SciPy в десятки раз, перенося их на GPU с минимальными изменениями в коде.
SCUDA — Как превратить удалённый GPU в локальный
SCUDA — инновационный проект, позволяющий использовать удалённые GPU как локальные, открывая новые возможности для машинного обучения и высокопроизвод...
LMCache — Turbo-режим для вашего LLM
Как ускорить работу LLM в 3-10 раз с помощью кэширования KV-кэшей? Обзор LMCache — революционного решения для оптимизации работы языковых моделей.
Как превратить чистую ОС в идеальное рабочее окружение одной командой
Обзор Awesome OS Setup — мощного TUI-инструмента и базы знаний для автоматизации настройки Windows, macOS и Linux. Узнайте, как развернуть идеальное р...
NVIDIA Transformer Engine Включаем нитро-ускорение для ваших трансформеров
Разбираемся, как библиотека Transformer Engine от NVIDIA позволяет значительно ускорить обучение и инференс LLM на новых GPU с помощью 8-битной точнос...
ZLUDA — CUDA на AMD видеокартах — мечта или реальность?
ZLUDA — это революционный проект, позволяющий запускать CUDA-приложения на AMD видеокартах с почти нативной производительностью. Узнайте, как это рабо...
Hashcat — швейцарский нож для взлома паролей
hashcat — самый быстрый инструмент для восстановления паролей с поддержкой 300+ алгоритмов хеширования. Узнайте, как использовать его в тестировании н...
Savant — ваш проводник в мир промышленного компьютерного зрения
Savant — высокопроизводительный фреймворк для компьютерного зрения, который превращает сложные задачи видеоаналитики в понятные конвейеры обработки. У...
Как запустить CUDA на видеокартах AMD без лишних вопросов к NVIDIA
BarraCUDA — дерзкий проект компилятора CUDA на чистом С99 без LLVM и зависимостей, который умеет запускать код на видеокартах AMD, NVIDIA и даже Tenst...
Burn: глубокое обучение на Rust без компромиссов
Burn — это новый фреймворк для глубокого обучения на Rust, который сочетает гибкость, производительность и кроссплатформенность. Узнайте, как он может...
GPU Hot — Мониторинг видеокарт NVIDIA без головной боли
GPU Hot — удобный веб-дашборд для мониторинга NVIDIA GPU в реальном времени. Просто запустите Docker-контейнер — и получайте детальную статистику без...
Как перестать страдать при настройке GPU в Kubernetes
Разбираемся, как автоматизировать установку драйверов, рантаймов и мониторинга для NVIDIA GPU в Kubernetes с помощью официального оператора.
Как перестать собирать Docker-образы для машинного обучения вручную
Обзор Cog — инструмента от создателей Docker Compose, который избавляет ML-инженеров от мучений с Dockerfile и CUDA. Узнайте, как превратить Python-ск...
PyOpenCL - Python-стиль для GPU-ускорения
PyOpenCL — это мост между Python и мощными GPU-вычислениями, который делает параллельное программирование доступным каждому разработчику.
vLLM — Turbo-режим для ваших языковых моделей
vLLM — высокопроизводительный движок для работы с большими языковыми моделями, который ускоряет их вывод в 1.7 раза и экономит память. Узнайте, как он...