Новости: мультимодальность
Между Kimi K3 и DeepSeek V4: Почему встроенная мультимодальность задаёт будущее передовых китайских моделей
Узнайте, почему Moonshot AI, Alibaba и ByteDance делают ставку на нативное мультимодальное обучение, а DeepSeek, Zhipu и Tencent остаются текстовыми. Разберитесь, как «зрение в цикле» меняет агентные задачи и рейтинги моделей.

“Alibaba” выпускает официальную версию Qwen3.8-Max: 2,4 триллиона параметров, контекстное окно на 1 миллион токенов, способность к долгосрочной работе агента, и открытый исходный код в течение недели
Alibaba выпустила Qwen3.8-Max с 2,4 трлн параметров и контекстом в 1 млн токенов. Модель значительно улучшила программирование и офисные задачи, войдя в мировой топ-уровень. Открытые веса обещаны через неделю. Узнайте о возможностях долгосрочного агента и мультимодальной обработке.

ByteDance Seedream 5.0 Pro: Возвращение мощнейшей нейросети для генерации изображений с точным редактированием и мультиязычностью
Команда ByteDance Seed выпускает Seedream 5.0 Pro с визуализацией сложной информации, точным редактированием, качеством реальной фотографии и нативной многоязычной генерацией в 17 тестовых сценариях.

Tencent HY переманивает исследователя OpenAI Тянь Юнлуна для работы над мультимодальным ИИ
Tencent HY нанимает научного сотрудника OpenAI Тянь Юнлуна в качестве нового руководителя команды мультимодальных моделей, подчиняющегося главному специалисту по ИИ Яо Шунью в рамках последней громкой кадровой перестановки в сфере ИИ.

Meta* запустила Muse Image — свою первую модель для генерации изображений от Superintelligence Labs
Новая модель Muse Image от Meta*, основанная на архитектуре Muse Spark, предлагает расширенные мультимодальные возможности для генерации и редактирования изображений, включая понимание сложных запросов и интеграцию с веб-контекстом.

Tencent Hunyuan переманила исследователя OpenAI Тянь Юнлуна для разработки мультимодального ИИ
Tencent Hunyuan нанимает исследователя OpenAI Тянь Юнлуна на должность нового руководителя команды мультимодальных моделей, подчиняющегося главному научному сотруднику Яо Шуньюй, в рамках последней громкой кадровой перестановки в сфере ИИ.

CVPR 2026 бьет рекорды: доля «Multimodal AI» выросла вдвое, а 4089 научных работ меняют вектор развития индустрии
Конференция CVPR 2026 открылась в Денвере с рекордными 16 092 заявками и 4 089 принятыми работами — скачок на 42% — поскольку исследования в области зрения, языка и мультимодального ИИ удвоили свою долю, что стало крупнейшим сдвигом в недавней истории конференции. Среди номинантов на награды работы от NVIDIA, CMU и UVA охватывают игровых агентов. — techtimes.com

Новая модель Gemma 4 12B от Google создана для работы на любом ноутбуке с 16 ГБ оперативной памяти
Новая модель Google Gemma 4 12B использует новую схему кодирования и предсказания токенов, чтобы превзойти ожидания, будучи достаточно эффективной для запуска на большинстве потребительских ноутбуков. — arstechnica.com

Самое просматриваемое:
- Вот как использовать новую кнопку “Плюс”…
- Bitcoin Depot оштрафован на $18,5 млн – сталкивается…
- WatchGuard бьёт тревогу: критическая уязвимость…
- Как настроить ComfyUI для генерации изображений ИИ…
- ECARX берет управление бизнесом Flyme OS в свои руки…
- Результаты еженедельного опроса: Samsung Galaxy Z…
- Исследователи из MIT возродили 40-летнюю концепцию…
- США прикрыли платформу для хранения паролей, которой…
- Новейший датчик присутствия от Aqara определяет,…
- Представитель сервисного центра Google сообщил…

