Prism ML представила тернарную версию своей модели Qwen3.8-27B, получившую название Bonsai 2 27B. Эта новая версия занимает всего 5,9 ГБ, что значительно меньше по сравнению с исходной моделью, занимающей около 54 ГБ в формате FP16. При этом Bonsai 2 27B демонстрирует 98,2% от среднего результата оригинальной модели на бенчмарках.
Сжатие модели позволяет значительно упростить её внедрение и использование в различных приложениях, что может быть особенно полезно для разработчиков, работающих с ограниченными ресурсами. Это также может способствовать более широкому распространению технологий машинного обучения, так как уменьшение объема модели снижает требования к хранилищу и вычислительным ресурсам.
Важность данного релиза заключается в том, что он демонстрирует возможности оптимизации моделей машинного обучения без значительной потери качества. Такие достижения могут способствовать развитию более доступных и эффективных решений в области искусственного интеллекта, что имеет значение для многих отраслей, включая здравоохранение, финансы и технологии.