#gpu
Материалы о роли GPU в современных IT-проектах. От ускорения терминалов и deep learning фреймворков до создания 2D-игр и профессиональной стабилизации видео. Узнайте, как использовать мощность графического процессора для решения самых разных задач в разработке.
Пишем CUDA-ядра на чистом Rust с проектом cuda-oxide
NVlabs выпустили компилятор, который превращает обычный Rust в PTX для NVIDIA. Разбираем, как писать GPU-ядра без DSL, зачем нужен single-source и где...
Как устроен локальный перевод манги на Rust и WebGPU
Обзор Koharu — десктопного инструмента на Rust для локального перевода манги с помощью нейросетей, WebGPU-холста и генеративного инпейнтинга.
Как перестать мучиться с деплоем ML-моделей и начать жить с Triton Inference Server
Разбираем Triton Inference Server — мощный инструмент от NVIDIA для стандартизации и оптимизации деплоя ML-моделей в продакшен.
Как заставить тяжелые 3D-модели летать даже на слабых GPU
Обзор meshoptimizer — мощной библиотеки на C++ для оптимизации 3D-мешей. Узнайте, как ускорить рендеринг, уменьшить вес моделей и эффективно использов...
Как ускорить Python в десятки раз одной строчкой импорта
Обзор CuPy — библиотеки, которая позволяет ускорить вычисления NumPy и SciPy в десятки раз, перенося их на GPU с минимальными изменениями в коде.
Бесконечный холст для терминалов как Horizon меняет работу с консолью
Обзор Horizon — инновационного терминала на Rust с бесконечным холстом, GPU-ускорением и глубокой интеграцией AI-агентов. Раскрываем, почему 2D-простр...
Как засунуть 3D графику в терминал и не сойти с ума
Обзор Ratty — экспериментального Rust-терминала, который умеет рендерить 3D-графику и искривлять пространство с помощью GPU.
Как заставить JavaScript летать на видеокарте с помощью GPU.js
Узнайте, как ускорить вычисления в JavaScript до 15 раз, перенеся их на видеокарту. Разбираем возможности библиотеки GPU.js: от умножения матриц до об...
Как перестать гадать и выбрать идеальную LLM под свое железо
Обзор whichllm — CLI-инструмента, который анализирует ваше железо и подбирает лучшие локальные нейросети на основе реальных бенчмарков и объема VRAM.
Как запустить CUDA на видеокартах AMD без лишних вопросов к NVIDIA
BarraCUDA — дерзкий проект компилятора CUDA на чистом С99 без LLVM и зависимостей, который умеет запускать код на видеокартах AMD, NVIDIA и даже Tenst...
Как перестать страдать при настройке GPU в Kubernetes
Разбираемся, как автоматизировать установку драйверов, рантаймов и мониторинга для NVIDIA GPU в Kubernetes с помощью официального оператора.
Как прокинуть GPU в контейнер без боли и страданий - знакомимся с ffmpeg-over-ip
Обзор ffmpeg-over-ip — инструмента для удаленного использования GPU-ускорения ffmpeg без настройки проброса устройств и сетевых файловых систем.
Как перестать внедрять SDK для мониторинга и начать жить
Обзор DeepFlow — платформы для глубокого мониторинга микросервисов на базе eBPF. Узнайте, как получить трассировку, метрики и профилирование без измен...
Смогут ли нейросети писать GPU-кернелы лучше людей
Обзор KernelBench — бенчмарка от Стэнфорда для оценки способности LLM писать высокопроизводительные GPU-кернелы. Разбираемся, как нейросети справляютс...
Как Rust и нейросети помогают читать мангу в оригинале
Обзор Koharu — мощного инструмента на Rust для автоматического перевода манги с помощью локальных нейросетей и компьютерного зрения.
Как приручить зоопарк GPU и не сойти с ума от настройки Kubernetes
Обзор Kubeflow Trainer — мощного инструмента для распределенного обучения нейросетей и тюнинга LLM в Kubernetes. Узнайте, как эффективно управлять GPU...
Как приручить зоопарк моделей и не сойти с ума от Big Data
Обзор H2O-3 — мощной open-source платформы для распределенного машинного обучения. Узнайте, как масштабировать ML-модели, использовать AutoML и внедря...
Как добавить профессиональные бьюти-фильтры в приложение за пару часов
Обзор GPUPixel — мощной кроссплатформенной библиотеки на C++ для обработки фото и видео в реальном времени с использованием GPU. Бьюти-фильтры и высок...
LACT Поднимаем производительность GPU в Linux на новый уровень
LACT – это мощный инструмент для Linux, который позволяет детально мониторить, настраивать и разгонять видеокарты AMD, Nvidia и Intel. Забудьте о комп...
NVIDIA Warp: Разгоняем Python для симуляций и графики до космических скоростей
NVIDIA Warp: как превратить обычный Python в высокопроизводительный код для симуляций и графики на CPU и GPU. Фреймворк для пространственных вычислени...
FlashInfer: Когда LLM летают, а не ползают
FlashInfer – это высокопроизводительная библиотека GPU-ядер для ускорения инференса больших языковых моделей. Решает проблемы производительности, памя...
ImageAI: Когда компьютер начинает "видеть" и "понимать" мир
Устали от сложностей в Computer Vision? ImageAI — это Python-библиотека, которая делает машинное зрение доступным, позволяя легко внедрять классификац...