Meta відповідає на 15-тижневе домінування ШІ Китаю з Muse Glimmer: модель, що вміщується на одному GPU та прискорює відповіді завдяки інноваційним технікам.

Meta відповідає на 15-тижневе домінування ШІ Китаю з Muse Glimmer: модель, що вміщується на одному GPU та прискорює відповіді завдяки інноваційним технікам. 1

Meta повертається до категорії відкритих моделей ШІ – підмножини великих мовних моделей (LLM), яку компанія започаткувала, але згодом значною мірою покинула через помилкові пріоритети. Компанія робить це гучно та ефектно, представивши відкриту модель Muse Glimmer. Ця модель використовує креативні техніки, щоб забезпечити її розміщення в одній споживчій відеокарті та блискавичну швидкість відповіді на запити.

Meta використала дистиляцію для забезпечення роботи Muse Glimmer на одній споживчій GPU, а допоміжна модель прискорює відповіді

Представляємо Muse Glimmer, відкриту модель з 30 мільярдами параметрів, оптимізовану для локальних, постійно активних агентських робочих процесів.

Muse Glimmer демонструє високу продуктивність у ключових сценаріях використання агентів та бенчмарках порівняно з провідними моделями свого розміру, і розроблена для роботи повністю на… pic.twitter.com/mI4z91GPnE

— AI at Meta (@AIatMeta) August 10, 2026

Meta щойно випустила Muse Glimmer, відкриту ШІ-модель з 30 мільярдами параметрів, яка конкуруватиме з такими рішеннями, як Gemma 4 від Google та Qwen 3.6 від Alibaba.

Для тих, хто, можливо, не знає, ваги моделі визначають, наскільки важливою є будь-яка концепція, і представляють повний обсяг бази знань цієї моделі.

Muse Glimmer від Meta вирізняється з двох основних причин. По-перше, для роботи 30-мільярдної моделі з повною точністю (fp16) потрібно близько 60 ГБ (30×10⁹x2) пам’яті лише для ваг моделі. Однак Meta використала квантування – по суті, дистиляцію, коли більша модель (Muse Spark) навчає меншу, наділяючи її багатьма своїми можливостями – щоб стиснути її та зменшити вимоги до пам’яті для ваг моделі до 20 ГБ. Разом з 2-4 ГБ, необхідними для KV-кешу, ці вимоги є достатньо скромними, щоб споживча відеокарта з 24 ГБ або 32 ГБ легко могла запускати Muse Glimmer. За даними Meta, таке стиснення моделі за допомогою дистиляції не призводить до помітного впливу на продуктивність.

По-друге, для прискорення генерації токенів (часу відповіді) Muse Glimmer використовує крихітну допоміжну модель – DFlash drafter model – яка прогнозує цілі блоки тексту, дозволяючи Muse Glimmer перевіряти відповідь одним кроком, зберігаючи правильні текстові відповіді та відкидаючи помилкові. Оскільки перевірка відповіді відбувається набагато швидше, ніж її генерація, ця схема забезпечує в 3,1 рази швидші відповіді на карті RTX 5090, в 1,8 рази на M5 Max та в 1,5 рази на M4 Max, згідно з даними, наданими Meta.

Https://t.co/TgUzVVM8sk

— Pandaily (@thePandaily) August 10, 2026

Звісно, поява Muse Glimmer від Meta не могла бути більш своєчасною для західного ландшафту відкритих моделей ШІ. Адже, за даними OpenRouter, китайські LLM нещодавно вперше перевищили рівень 34,25 трильйона тижневих токенів, причому V4 Flash від DeepSeek продемонструвала вражаюче зростання на 570% за тиждень.

Згідно з останніми даними OpenRouter за тиждень, що розпочався 3 серпня, глобальне використання моделей ШІ досягло 69 трильйонів токенів, що на 21,48% більше порівняно з попереднім тижнем. Китайські моделі становили 34,25 трильйона з цієї суми, тоді як американські моделі додали лише 9,17 трильйона токенів. Важливо зазначити, що це вже п’ятнадцятий тиждень поспіль, коли китайські моделі лідирують у глобальному рейтингу.

Отже, ми будемо уважно стежити за показниками наступного тижня, щоб побачити, чи матиме Muse Glimmer від Meta помітний вплив на невпинне сходження китайських відкритих моделей ШІ.

Meta відповідає на 15-тижневе домінування ШІ Китаю з Muse Glimmer: модель, що вміщується на одному GPU та прискорює відповіді завдяки інноваційним технікам. 2

Про автора: Письменництво – це моя незаперечна пристрасть. За останні шість років він написав понад 2200 статей на фінансові та технологічні теми, обсягом майже 1 мільйон слів. Він є членом команди Wcctech mobile з 2025 року. Як випускник Університету Торонто, програми Rotman Commerce, я привношу нюанси, глибокі знання та унікальну перспективу до кожної теми, яку висвітлюю. Коли я не пишу, я подорожую світом, досліджуючи приховані кондитерські та ресторани як претендент на роль гурмана.

Пропозиція дня

Meta відповідає на 15-тижневе домінування ШІ Китаю з Muse Glimmer: модель, що вміщується на одному GPU та прискорює відповіді завдяки інноваційним технікам. 3Meta відповідає на 15-тижневе домінування ШІ Китаю з Muse Glimmer: модель, що вміщується на одному GPU та прискорює відповіді завдяки інноваційним технікам. 4

Подальше читання

Голова ADATA попереджає: дефіцит DRAM триватиме ще 10 років, розмови про бульбашку ШІ можна відкласти до 2040 року

Хассан МуджтабаMeta відповідає на 15-тижневе домінування ШІ Китаю з Muse Glimmer: модель, що вміщується на одному GPU та прискорює відповіді завдяки інноваційним технікам. 5

Від ПК до серверів: пам’ять DDR4 повертається в дію, поки дефіцит DDR5 триває

Хассан МуджтабаMeta відповідає на 15-тижневе домінування ШІ Китаю з Muse Glimmer: модель, що вміщується на одному GPU та прискорює відповіді завдяки інноваційним технікам. 6

Процесори AWS Graviton5 тепер доступні: створені для ШІ з підвищенням продуктивності на 25%, 192 ядрами, підтримкою DDR5-8800 та PCIe Gen6

Хассан МуджтабаMeta відповідає на 15-тижневе домінування ШІ Китаю з Muse Glimmer: модель, що вміщується на одному GPU та прискорює відповіді завдяки інноваційним технікам. 7

Процесор Vera від NVIDIA залучив CoreWeave, Meta, Oracle та Alibaba як ранніх покупців, відкриваючи багатомільярдний фронт поза системами Rubin

Хассан Муджтаба

Подробиці можна знайти на сайті: wccftech.com

Залишити відповідь

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *