Компания DeepSeek объявила о выпуске модели DeepSeek V4.1 Flash для общего доступа, переведя её из ограниченной бета-версии в производственный продукт на новой архитектуре Causal-Encoder-Decoder Mixture-of-Experts. Компания позиционирует V4.1 Flash как самый компактный представитель этого семейства архитектур, заявляя, что модель превосходит DeepSeek V4 Pro по возможностям, стоимости, скорости и общему времени выполнения задач, что открывает путь к запланированному выводу Pro-версии из эксплуатации на этой неделе.
Архитектурно V4.1 Flash представляет собой модель MoE с 552 миллиардами параметров и асимметричной активацией: около 8 миллиардов параметров задействуются при чтении входных данных и около 16 миллиардов — при генерации вывода. DeepSeek утверждает, что такое разделение снижает вычислительные затраты по сравнению с более плотными моделями аналогичного общего размера, что важно для рабочих нагрузок агентов, которые обрабатывают большие кодовые базы, документы и историю чатов перед выдачей кратких решений или вызовов инструментов. Новое предварительное обучение в сочетании с масштабным пост-обучением с подкреплением лежит в основе GA-чекпоинта. Официальные данные демонстрируют высокие результаты в таких наборах тестов, как GPQA Diamond, задачи по программированию в стиле Codeforces, MathArena Apex, Terminal-Bench 2.1 и CyberGym. Кроме того, стек сжимает KV-кэш по сравнению с предыдущими поколениями, снижая нагрузку на память при длительных сессиях.
Встроенное понимание изображений теперь интегрировано в основной API Flash, а не является дополнительным экспериментом. Старые конечные точки V4 Flash и V4 Flash Vision Exp отключены; для обеспечения совместимости deepseek-v4-flash и deepseek-v4-flash-vision-exp временно перенаправляют запросы на V4.1 Flash. Разработчики могут передавать общедоступные URL-адреса изображений, закодированные полезные нагрузки или ссылки на Files API для описания, распознавания текста (OCR) и анализа диаграмм. Контекст по-прежнему составляет порядка одного миллиона токенов с большим максимальным бюджетом вывода, плюс поддержка вывода в формате JSON, вызовов инструментов и режимов рассуждений с настраиваемым уровнем усилий.
С переходом на новую версию вносятся коммерческие изменения. Новые пиковые и внепиковые тарифы Flash вступили в силу в 12:00 по пекинскому времени 10 сентября 2026 года, при этом стоимость входных данных при попадании в кэш вне пиковых часов снизилась примерно на 60% по сравнению с предыдущими тарифами Flash — это прямое преимущество для агентов, которые многократно воспроизводят историю. В 12:00 по пекинскому времени 14 сентября DeepSeek выведет из эксплуатации V4 Pro: запросы к deepseek-v4-pro будут перенаправляться на V4.1 Flash и тарифицироваться по тарифам Flash до выпуска будущей версии V4.1 Pro. GA-модель следует вызывать как deepseek-flash. В потребительском приложении режимы Quick, Expert и Vision объединены в один интеллектуальный режим, который определяет сложность, активирует обработку изображений при их поступлении и масштабирует процесс рассуждений без ручного переключения.
Таким образом, пакет представляет собой формальную перестройку архитектуры и линейки продуктов, а не очередную истекающую предварительную версию: новая основа MoE, мультимодальная Flash в качестве стандартного рабочего инструмента, более дешевый трафик с интенсивным использованием кэша и фиксированный календарь для вывода Pro-версии из эксплуатации и консолидации режимов.
Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.
Автор – Pandaily




