Грань, которая когда-то определяла премиальную большую языковую модель, в Китае сместилась почти за одну ночь. За одну ночь Zhipu AI выпустила и открыла исходный код GLM-5.3-Flash — подтвердив, что именно эта модель была анонимной «Ox Alpha», лидировавшей на OpenRouter с 20 августа, — а Alibaba представила Qwen3.8-Flash, опубликовав веса на Hugging Face и в своём сообществе ModelScope. Обе модели — в версиях Flash, и обе имеют агрессивные цены, опрокидывая привычное правило, что более мощная модель означает более высокую цену.
GLM-5.3-Flash сохраняет контекстное окно в миллион токенов и является первой нативно мультимодальной моделью в семействе GLM-5, работающей с изображениями, видео, файлами и даже с управлением компьютером. Во время временной скидки ввод стоит примерно 0,05 евро за миллион токенов, а вывод — 0,18 евро, что примерно в двадцать раз дешевле GLM-5.3. Qwen3.8-Flash, позиционируемая как ранняя предварительная версия архитектуры Qwen4, также сохраняет окно в миллион токенов; при цене около 0,13 евро за миллион токенов на вводе и 0,38 евро на выводе она стоит примерно одну двенадцатую от Qwen3.8-Max, а в офисных сценариях Qwen сокращает потребление токенов на 75%.
Столь стремительное сравнение оказывает давление непосредственно на DeepSeek, долгое время бывший эталоном соотношения цены и производительности в Китае. DeepSeek V4 Flash сейчас предлагается по цене около 0,19 евро за ввод и 0,58 евро за вывод за миллион токенов, с пиковыми и непиковыми множителями. В бенчмарк-тестах GLM-5.3-Flash показала результат, близкий к моделям класса Opus — уровню, которого стоит ожидать от маркировки Flash, — и её анонимный запуск прервал 56-дневное лидерство DeepSeek на вершине OpenCode. Zhipu заявила, что трафик обслуживался более чем 100 000 отечественных ИИ-чипов, которые, по её утверждению, достигли аппаратной эффективности, сравнимой с массовыми GPU NVIDIA.
Более глубокий сигнал — стратегический. «Flash» теряет своё значение как урезанной дешёвой модели. Разработчики теперь рассматривают эти модели как настоящий флагман: большой контекст, мультимодальный ввод, конкурентоспособные рассуждения и цена, которая делает их выбором по умолчанию для повседневных производственных нагрузок в кодинг-агентах и офисных пакетах.
Результат — рынок, где ценовое якорение быстро фрагментируется. Поставщики моделей больше не конкурируют только по потолочным возможностям, а по обслуживанию практических нагрузок достаточно дёшево, чтобы большинство разработчиков никогда не обращались к уровню «Pro». На китайском рынке LLM дешёвое и щедрое тихо стало новой планкой флагмана.
Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.
Автор – Pandaily




