Большой контекст, понимание картинок и доступная цена редко идут в одном пакете. DeepSeek V4.1 Flash, новая модель от DeepSeek, вышла на платформе OpenRouter, обещая все три пункта: контекстное окно в миллион токенов, мультимодальный ввод и стоимость в десятки раз ниже конкурентов.
DeepSeek V4.1 Flash предлагает контекстное окно в 1 048 576 токенов и поддерживает мультимодальный ввод: принимает текст и изображения, выдавая текстовый ответ. Пока это временная бета-версия, что видно по идентификатору deepseek-v4.1-flash-expires-on-0910 с датой истечения 10 сентября 2026 года.
По данным DeepSeek, V4.1 Flash превосходит предыдущую версию V4 Pro по всем ключевым метрикам — производительности, стоимости, скорости и времени выполнения задач. Модель построена на новой архитектуре, которая обещает более высокую производительность, скорость инференса и масштабируемость. Хотя это самая маленькая модель в новой серии DeepSeek, она уже близка к GPT-6 Astra в задачах веб-дизайна, но при этом дешевле.
Скорость вывода V4.1 Flash, по ранним отчётам тестеров, составляет от 200 до 427 токенов в секунду, с отдельными заявлениями о более чем 500 токенах в секунду. Однако платформа AIHubMix фиксирует среднюю пропускную способность в 136.9 токенов в секунду. Модель заявляет о нативной мультимодальности, но некоторые ранние тесты выявили проблемы с вводом изображений.
Цены на V4.1 Flash установлены на уровне $0.155 за миллион входных токенов и $0.62 за миллион выходных токенов. Для сравнения, аналогичные операции с GPT-4o стоят $2.50 и $10.00 за миллион токенов соответственно. Это делает DeepSeek V4.1 Flash в 16 раз дешевле топовой модели OpenAI. Модель уже тестируется для решения задач, требующих работы с большими объёмами данных, включая кодирование, веб-дизайн, игры, автоматизацию браузеров и агентные рабочие процессы.
Появление DeepSeek V4.1 Flash с миллионным контекстом и мультимодальностью по такой цене открывает новые возможности для разработчиков, работающих с масштабными проектами. Однако статус "временной бета-версии" и некоторые расхождения в отчётах о скорости и мультимодальности требуют дополнительной проверки, прежде чем полагаться на неё в критически важных системах.