Нейросети и ИИ

Модель Muse Glimmer от Meta* запускается на одном компьютере

Модель Muse Glimmer от Meta запускается на одном компьютере

Meta* представила Muse Glimmer, 30-миллиардную языковую модель с отдельным энкодером восприятия, которую можно запускать локально без облачной инфраструктуры и сетевого доступа. Компания называет её вариантом для автономных агентных задач на потребительском железе.

Модель получила поддержку многошагового рассуждения, вызова инструментов, мультимодального анализа и восстановления после ошибок. Она обучалась и оценивалась на задачах полного завершения агентных сценариев, включая DeepSearch QA, MCP-Atlas, 𝛕3-Bench и SWE-Bench, где проверяются работа в рамках оболочек, написание и отладка кода, а также прохождение многоходовых запросов от начала до конца.

В карточке модели Meta* отдельно пишет, что Muse Glimmer оптимизировали под локальное развертывание. Для этого веса сжали до примерно 4-битной точности, а сам языковой блок уменьшился до менее чем 20 ГБ, чтобы модель помещалась в конфигурации с 24 ГБ или 32 ГБ памяти вместе с кешем KV, энкодером восприятия и вспомогательной моделью для speculative decoding. Ранее Meta* выпустила ИИ-модель Muse Spark 1.1.

Характеристики Muse Glimmer-30B

  • Архитектура: Dense Causal Transformer с perception encoder.
  • Параметры: около 29,6 млрд, из них vision encoder — примерно 1,8 млрд.
  • Контекст: 131 072+ токенов, максимальный визуальный объём — 4 096 токенов на изображение.
  • Модальности: текст и изображение на входе, текст на выходе.
  • Языки: данные более чем на 100 языках.
  • Лицензия: Apache 2.0.

В модели также заявлены скользящее окно 2048 токенов, 52 слоя, механизм gated attention и размер словаря 202 048. Для работы с изображениями используется отдельный perception encoder на базе ViT-G/14.

Meta* опубликовала и результаты замеров скорости. Для K-Quant-17GB с квантованным drafter на Nvidia RTX 5090 модель показала 233,4 токена в секунду против 74,9 без speculative decoding. На Apple M4 Max показатель вырос с 23,7 до 37,8 токена в секунду, на Apple M5 Max — с 26,6 до 50,2 токена в секунду.

Цена и доступность

Выпуск Muse Glimmer датирован августом 2026 года. Meta* выложила полный набор артефактов под Apache 2.0, включая полноточные веса BF16, две версии 4-битных квантованных весов, head для DFlash drafter и замороженный perception encoder.

Компания также указала рекомендуемые параметры генерации: temperature 1.0, top_p 0.95 и top_k 64. Для сложных задач, кодинга и агентных сценариев Meta* советует режимы high или xhigh у параметра reasoning strength.

В карточке модели отдельно сказано, что Muse Glimmer предназначена для коммерческого и исследовательского использования. Среди ограничений Meta* перечисляет возможные ошибки в многошаговом рассуждении, неполную оптимизацию под видео и снижение качества на языках вне сильнее поддерживаемой группы.

* Принадлежит компании Meta, она признана экстремистской организацией в РФ и её деятельность запрещена.

Источники: Huggingface, Engadget
Елизавета Добровольская
Автор itzine.ru с 2021 года. Пишет о смартфонах, гаджетах, железе, искусственном интеллекте и космосе — в общем, обо всём, что есть в мире технологий. От новостей о складных флагманах и процессорах до репортажей о культуре и рынке электромобилей. Следит за индустрией внимательно, но без фанатизма.

Оставить комментарий