Новая тарификация API DeepSeek «пик/внепик» вступает в силу 17 августа — рост цен до 1100%

Deepseek Api цены пиковые тарифы V4-Pro V4-Flash pandaily.com

Используйте новые тарифы DeepSeek API: пиковые и внепиковые ставки для V4-Flash и V4-Pro с соотношением 1:2. Пиковый ввод с попаданием в кэш V4-Pro вырос на 1100%, общий рост — от 50% до 1100%. Переносите задачи на внепиковое время для экономии.

В полночь 17 августа DeepSeek официально ввел новые цены на API: флагманские модели DeepSeek-V4-Flash и DeepSeek-V4-Pro впервые используют пиковые и внепиковые тарифы, причем внепиковые ставки ровно вдвое ниже пиковых. Корректировка также повысила базовую цену обеих моделей.

По новому расписанию пиковые цены DeepSeek-V4-Flash составляют 0,1 юаня за миллион токенов для ввода с попаданием в кэш, 3 юаня для ввода без попадания в кэш и 9 юаней для вывода; вне пика они снижаются до 0,05, 1,5 и 4,5 юаня. Более высокопозиционированная DeepSeek-V4-Pro взимает 0,3, 9 и 27 юаней в пиковое время, снижаясь до 0,15, 4,5 и 13,5 юаня вне пика. Пиковые часы — ежедневно с 9:00 до 12:00 и с 14:00 до 18:00 по пекинскому времени, всего семь часов; остальные семнадцать часов — внепиковые. Пакетная обработка данных, генерация кода и задачи оценки моделей, допускающие медленный ответ, могут быть перенесены на внепиковое время для снижения затрат.

По сравнению с предыдущими ценами, этот раунд — не просто удвоение. Для V4-Pro старые цены на ввод с попаданием в кэш, ввод без попадания и вывод составляли 0,025, 3 и 6 юаней; пиковые цены теперь выросли на 1100%, 200% и 350% соответственно, а внепиковые — на 500%, 50% и 125%. V4-Flash также заметно подорожала: старые цены были 0,02, 1 и 2 юаня, пиковые показывают рост на 400%, 200% и 350%, внепиковые — на 150%, 50% и 125%. В зависимости от модели, типа токена и времени вызова рост составляет от 50% до 1100%.

DeepSeek объявил новые цены 13 августа, в тот же день, когда выпустил официальную DeepSeek-V4-Pro. Модель с номером DeepSeek-V4-Pro-0813 поддерживает режимы мышления и без мышления, имеет контекстное окно в 1 миллион токенов и до 384 000 токенов на вывод, а также нативно поддерживает вызов инструментов, Responses API и Anthropic API. Ограничения параллелизма: 500 для V4-Pro и 2500 для V4-Flash.

Этот шаг знаменует переход API больших моделей от единого ценообразования к детализированному планированию вычислений. Инференс моделей непрерывно занимает AI-вычисления: запросы концентрируются в рабочее время, а внепиковая загрузка падает. Используя ценовой рычаг для стимулирования разнесенного по времени использования, DeepSeek может повысить загрузку своих кластеров интеллектуальных вычислений и снизить пиковую нагрузку. Для разработчиков планирование задач теперь заметно влияет на счета за токены: диалоги в реальном времени и онлайн-агенты вряд ли смогут избежать пиковых цен, тогда как офлайн-анализ, пакетный перевод, очистка данных и ночная оценка имеют больше возможностей для переноса. От открытия рынка низкими ценами до тарифов, зависящих от времени использования на основе спроса и предложения вычислений, бизнес API DeepSeek теперь работает по логике, напоминающей пиковые и ночные тарифы на электроэнергию, и ценовая война больших моделей вступает в более детализированную фазу 2.0.

Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.

Похожие новости: