Встречайте Maple-Preview — новую открытую языковую модель от DeepGrove
Встречайте Maple-Preview: 20B-A1B тернарная MoE-модель, которая выдает 218 токенов в секунду на CPU (Mac Mini M4). Это в несколько раз превышает показатели многих классических плотных или разреженных моделей сопоставимого класса.
Это отрывок статьи. Полную версию читайте на сайте источника по ссылке ниже.