За вирусными мемами о «железном человеке» Лян Вэньфэне: как китайские LLM становятся глобальной «акулой»

Deepseek V4 Flash Openrouter Gpt-5.6 Luna китайские Llm цена-производительность pandaily.com

Узнайте, как DeepSeek V4 Flash возглавляет глобальный рейтинг OpenRouter с 7,1 трлн токенов. Четыре из пяти топ-моделей — китайские. OpenAI вынуждена урезать цены на GPT-5.6 Luna на 80%. Поймите, почему китайские LLM устанавливают новый стандарт цена-производительность.

Всё началось с фанарта. После того как фотографию основателя DeepSeek Лян Вэньфэна в теперь уже культовом синем костюме отфотошопили в мем про крутого парня в китайских соцсетях, шутка быстро стала серьёзной. Релиз, породивший мем — DeepSeek V4 Flash — набрал 7,1 триллиона токенов в еженедельном глобальном рейтинге OpenRouter и мгновенно стал самой используемой моделью на планете. Эта позиция помогла DeepSeek занять два места в глобальной пятёрке, причём четыре из пяти мест заняты китайскими моделями, а GPT-5.6 Luna отодвинута на шестое.
Экономика безжалостна. За день до выхода V4 Flash OpenAI снизила цены на GPT-5.6 Luna на 80% — до 0,2 доллара за миллион входных токенов и 1,2 доллара за миллион выходных. DeepSeek V4 Flash вышел с эквивалентом примерно 0,14 доллара за входные и 0,28 доллара за выходные токены, с 98% скидкой при попадании в кэш против отраслевого стандарта в 90%. Независимый оценщик Artificial Analysis оценил стоимость V4 Flash примерно на 60% ниже, чем у Luna, за типичную агентскую задачу. OpenCode зафиксировал 96% попаданий в кэш, снизив среднюю стоимость сессии до 0,06 доллара.
Производительность больше не является прежним разрывом. Собственные бенчмарки DeepSeek ставят V4 Flash выше V4 Pro Preview и GLM 5.2, чуть позади Opus-4.8, а Artificial Analysis оценил её в 50 баллов по своему индексу интеллекта против 51 у Luna. На VulcanBench технический директор Bold Metrics Морган Линтон описал V4 Flash как «экстраординарно стабильную при умеренных усилиях», превосходящую Claude Fable и GPT-4.5. Примерно половина трафика OpenRouter к DeepSeek теперь поступает от разработчиков из США и Европы — явный признак того, что это не только внутренний феномен.
Агентский толчок осознан. V4 Flash использует архитектуру V4 Flash Preview и фокусирует пост-тренинг на агентских возможностях. Ключевой участник Цуй Тяньи публично набирает инженеров в новую группу Harness — систему, которая оборачивает модель контекстом, инструментами, состоянием задачи и обратной связью, используя открытый код GitHub в качестве фильтра отбора. В мае независимый разработчик из США Хантер Боун создал терминальный кодинг-агент DeepSeek-TUI, который за несколько дней набрал более 11 000 звёзд на GitHub, а открытое письмо Боуна «Китовые братаны, я американец, который строит DeepSeek-TUI» стало транс-тихоокеанским культурным моментом. Поскольку зарубежные разработчики голосуют кошельками, китайские открытые LLM больше не диковинка. Они — планка цена-производительность, которую теперь всем нужно превзойти.

Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.

В тренде:


Похожие новости: