<figure><img src="https://res.cloudinary.com/dcsny9dt4/image/upload/v1779305807/Slide_4_3_-_4_x1fd7a.png"></figure>

<p>Muse Glimmer — новая 30B опенсорсная агентная модель от <b>Meta Superintelligence Labs</b>, ориентированная на запуск прямо на локальном компьютере без облака. Это дистиллят Muse Spark, специально адаптированный для работы с локальными AI-агентами и инструментами.</p>

<h2>Что умеет Muse Glimmer</h2>

<p>Модель решает <b>end-to-end агентные задачи</b> — такие как SWE-Bench, DeepSearch QA, MCP-Atlas и τ-Bench. Она поддерживает надёжный вызов внешних функций и инструментов по заданным схемам, что особенно важно для многошаговых сценариев. Если какой-то инструмент "падает", Glimmer не зависает, а самостоятельно перезапускает его, обеспечивая устойчивость работы.</p>

<p>Модель принимает <b>мультимодальный вход</b>: не только текст, но и изображения — скриншоты, графики, документы. Для этого используется ViT-G/14 энкодер, способный обрабатывать до 4096 визуальных токенов на картинку.</p>

<h3>Технические детали</h3>

<p>Glimmer содержит 29,6 млрд параметров и поддерживает контекст более 131 тысячи токенов. Благодаря 4-битному квантованию модель занимает около 17 ГБ и помещается в 24 ГБ VRAM. DFlash speculative decoding ускоряет работу: на RTX 5090 — в 3,1 раза, на M5 Max — в 1,8 раза.</p>

<p>Модель работает на более чем 100 языках, а усилие рассуждения можно регулировать: от low до xhigh. Это позволяет выбирать баланс между скоростью и глубиной анализа.</p>

<h3>Интеграции и доступность</h3>

<p>Обещана поддержка интеграций с <b>llama.cpp</b>, MLX, ExecuTorch, Ollama, LM Studio и vLLM. Для тестирования доступны демо и различные варианты квантизации на Hugging Face.</p>

<p>Проект распространяется под лицензией Apache 2.0. Благодарность за релиз — <b>@m_franz</b>.</p>

Нейро Отличник

www.neurootlichnik.ru