DeepSeek открыла краткосрочное внутреннее бета-тестирование DeepSeek V4.1 Flash — промежуточного чекпоинта, построенного на новой архитектуре модели с нативной поддержкой мультимодальности. Компания позиционирует релиз как более мощный, быстрый и экономичный по сравнению с предыдущими сборками Flash, сохраняя при этом цены уровня Flash в течение строго ограниченного периода тестирования, который продлится до истечения срока действия идентификатора модели.
Разработчики могут вызывать предварительную версию, не меняя существующий базовый URL API. Идентификатор модели — deepseek-v4.1-flash-expires-on-0910. Тарификация во время бета-тестирования соответствует DeepSeek V4 Flash, и на каждую учетную запись установлено ограничение в 20 одновременных запросов — значительно ниже, чем для Flash в производственной среде. Очевидно, что этот период предназначен для оценки, а не для обработки реального трафика. Дата, указанная в названии модели, сигнализирует о том, что этот идентификатор перестанет работать примерно 10 сентября 2026 года, оставляя около двух дней доступа с момента запуска 8 сентября.
Архитектурно V4.1 Flash отличается от предыдущего эксперимента V4 Flash с визуализацией, который предусматривал подключение отдельного пакета визуальных расширений к текстовой модели. DeepSeek утверждает, что мультимодальный ввод теперь является нативной частью переработанной архитектуры, поэтому текст и изображения — а также связанные с ними модальности, упомянутые в публикациях сообщества — обрабатываются внутри одного стека, а не через внешний путь кодировщика с последующим объединением. Для линейки продуктов, оптимизированных по задержке, это изменение имеет меньшее значение как заявление о пиковых показателях визуализации и больше как попытка избежать дополнительной задержки, которую часто добавляют плагины для работы с изображениями, когда их необходимо преобразовать перед включением в языковую последовательность.
Ранние отчеты разработчиков, циркулирующие в рамках бета-тестирования, указывают на стабильную генерацию в диапазоне примерно от 300 до 500 токенов в секунду при низкой нагрузке, при этом генерация описывается как относительно стабильная для итеративных циклов кодирования и прототипирования пользовательского интерфейса, где частые повторные попытки важнее одного длинного завершения. Эти цифры являются наблюдениями сообщества, а не официальными тестами; DeepSeek не публиковала количество параметров, длину контекста или формальные таблицы оценки для промежуточной сборки. Анкета обратной связи, приложенная к тесту, спрашивает, считают ли пользователи, что модель может заменить DeepSeek V4 Pro в онлайн-режиме — это сигнал о том, что компания проверяет, может ли скорость и цена Flash приблизиться к полезности уровня Pro, не отказываясь от структуры затрат Flash.
В совокупности ограниченный по времени идентификатор, потолок одновременных запросов и опрос о замене Pro позиционируют V4.1 Flash как ограниченную по времени мультимодальную предварительную версию новой архитектуры уровня Flash, а не как постоянный SKU. Разработчикам, которым нужна эта возможность, следует протестировать ее до истечения срока действия идентификатора модели; всем, кто планирует производственные нагрузки, по-прежнему потребуется последующий релиз с более высокой одновременностью, документированными ограничениями и неистекающим именем, прежде чем рассматривать новую архитектуру как стандартную инфраструктуру.
Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.
Автор – Pandaily




