Перейти к содержимому
SBER 279,92 ₽ 1,04% ростIMOEX 2 284,94 0,92% рост

#GLM-5.3-Flash

26 августа
·Технологии· 26 августа 2026 г.

Z.ai выпустила GLM 5.3 Flash с открытыми весами. Модель уже доступна в KodaCode

Компания Z.ai представила GLM 5.3 Flash – первую нативно мультимодальную модель в серии GLM-5. Веса модели опубликованы на Hugging Face, а в карточке репозитория указана лицензия MIT. До официального релиза модель тестировали на OpenRouter под названием Ox Alpha. За несколько дней она возглавила рейтинг платформы по использованию. GLM 5.3 Flash построена на архитектуре «смесь экспертов»: всего в модели 320 млрд параметров, но при обработке каждого токена активируются только 18 млрд. Это…

·Технологии· 26 августа 2026 г.

Z.ai выпустили GLM-5.3-Flash: ту самую Ox Alpha, которая за неделю стала топ-1 в OpenCode и OpenRouter

Z.ai выпустили GLM-5.3-Flash, первую нативно мультимодальную модель семейства GLM-5. Она поддерживает контекст до 1 млн токенов и содержит 320 млрд параметров, из которых при генерации активируются 18 млрд. До официального релиза модель анонимно тестировали в OpenCode и OpenRouter под именем Ox Alpha. По данным OpenCode, за шесть дней она обработала 42 трлн токенов. В недельном рейтинге OpenRouter Ox Alpha также заняла первое место с 23,2 трлн токенов — вдвое больше, чем у ближайшей DeepSeek V4

·Технологии· 26 августа 2026 г.

Z.ai выпустила GLM-5.3-Flash: 320B параметров, 1 млн токенов контекста и нативная мультимодальность

Z.ai выпустила GLM-5.3-Flash — первую нативно мультимодальную модель семейства GLM-5. Она сочетает 320 млрд параметров, из которых на каждом токене активируется около 18 млрд, и гибридную архитектуру, рассчитанную на снижение стоимости инференса при работе с длинным контекстом. Главная архитектурная особенность — комбинация sparse attention и linear attention. Решение снижает объем вычислений attention, по сравнению с GLM-5.3, в 3,01 раза, а размер KV-cache — в 4,44 раза. Для длинного контекста

#GLM-5.3-Flash — Long/Short