Meta* выпускает Muse Glimmer — 30B-модель «агентного» ИИ с открытым кодом, работающую локально на ПК

Meta Muse Glimmer ии локальная модель агентная модель Gpu neowin.net

Запускайте мощную ИИ-модель на своем ПК: Meta* выпустила Muse Glimmer — 30B-параметрическую агентную модель, дистиллированную из Muse Spark. Работает на одном GPU, поддерживает 100+ языков и ускорение DFlash.

За последние несколько месяцев Meta* активно расширяла семейство ИИ-моделей Muse. В апреле компания впервые анонсировала Muse Spark, созданную недавно сформированной Meta* Superintelligence Labs, с многообещающими результатами бенчмарков. В июне Meta* выпустила Muse Spark 1.1 — крупное обновление Muse Spark с улучшениями в агентных задачах, использовании компьютера, программировании и мультимодальном понимании.

В начале этого месяца Meta* выпустила агента Muse Spark 1.2-powered Muse Code agent, чтобы составить конкуренцию OpenAI Codex и Anthropic Claude Code на высококонкурентном рынке программирования. Теперь Meta* нацеливается на ИИ-нагрузки, которые могут полностью выполняться на потребительском оборудовании.

Сегодня Meta* анонсировала Muse Glimmer — новую агентную модель с 30 миллиардами параметров, оптимизированную для постоянно работающих локальных агентов и способную работать на Mac или ПК с одним потребительским GPU. Meta* также выпускает веса модели под либеральной лицензией Apache 2.0.

Meta* подчеркнула, что Muse Glimmer поддерживает несколько возможностей, необходимых для типичных агентных нагрузок, включая долгосрочное рассуждение, надежный вызов инструментов, восстановление после сбоев, программирование и мультимодальное рассуждение. Кроме того, Glimmer поддерживает более 100 языков и работает с агентными фреймворками, такими как OpenClaw.

Как и ожидалось, Meta* предварительно обучила Glimmer, используя выходные данные модели Muse Spark с помощью logit distillation. Позже, на этапах mid-training и post-training, компания применила дополнительное обучение, ориентированное на агентов, supervised fine-tuning, reinforcement learning и on-policy distillation для улучшения способностей к рассуждению, программированию и агентным задачам. Muse Glimmer превосходит локальные модели Gemma4-31B и Qwen3.6-27B в нескольких популярных бенчмарках LLM.

Запуск модели с 30B параметров в полной точности локально обычно требует более 55 ГБ памяти. Однако 4-битная квантованная версия уменьшает размер модели до менее 20 ГБ, что позволяет всей конфигурации работать в пределах 24 или 32 ГБ памяти. Meta* также использует DFlash speculative decoding для увеличения скорости генерации токенов. DFlash обеспечивает ускорение в 3,1 раза на Nvidia RTX 5090, в 1,8 раза на M5 Max и в 1,5 раза на M4 Max.

Muse Glimmer уже доступна через Hugging Face с поддержкой Ollama, LM Studio, llama.cpp, MLX, ExecuTorch, vLLM и SGLang.

Генеральный директор Meta* Марк Цукерберг также сообщил, что компания выпустит веса модели Muse Spark 2.1 в ближайшие недели.

Facebook*, Instagram* и WhatsApp* принадлежат компании Meta* Platforms Inc., деятельность которой признана экстремистской и запрещена на территории Российской Федерации.

Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.

В тренде:


Похожие новости: