DeepSeek открыла API для мультимодальной модели DeepSeek-V4-Flash-Vision-Exp

22.08.2026
9
DeepSeek открыла API для мультимодальной модели DeepSeek-V4-Flash-Vision-Exp

Компания DeepSeek запустила новую экспериментальную модель deepseek-v4-flash-vision-exp на собственной API-платформе. Модель поддерживает смешанный ввод текста и изображений. Возможности работы с текстом, рассуждениями и базовыми знаниями остались на уровне базовой DeepSeek-V4-Flash, а в специализированных тестах для мультимодальных агентов система приблизилась к результатам Opus-4.8.

Для отправки запросов используется имя модели deepseek-v4-flash-vision-exp. Разработчикам доступны конечные точки Chat Completions и Messages, куда изображения можно передавать в кодировке base64. За каждое переданное изображение система списывает до 384 токенов, а сам биллинг рассчитывается по базовому тарифу V4-Flash. Одновременно с запуском API вышла библиотека DeepSeek Harness версии 0.1.1 с поддержкой новой модели из коробки.

Вместе с моделью стал доступен бесплатный сервис Files API. Он дает возможность загрузить изображение на сервер один раз и получить идентификатор file_id. Затем этот идентификатор можно многократно использовать в вызовах к модели, что убирает необходимость повторной передачи тяжелых файлов и экономит сетевой трафик.

Источники

🍪 Мы используем файлы cookie и сервис аналитики Яндекс.Метрика, чтобы сайт работал лучше. Продолжая пользоваться devtrends.ru, вы соглашаетесь с обработкой данных согласно Политике конфиденциальности.