NVIDIA и Hugging Face объявили о расширении функциональности библиотеки NeMo Automodel, которая теперь поддерживает работу с диффузионными моделями. В рамках анонса, состоявшегося в июле, были представлены такие технологии, как FSDP2, тензорный и контекстный параллелизм, а также мультинодовая оркестрация.
Данная интеграция позволит пользователям масштабировать дообучение моделей FLUX, Wan и HunyuanVideo с одной видеокарты до сотен, что значительно увеличивает гибкость и производительность. Это особенно важно для исследователей и разработчиков, работающих с большими объемами данных и сложными моделями.
Внедрение новых технологий в NeMo Automodel подчеркивает стремление NVIDIA к улучшению инструментов для разработчиков и исследователей в области искусственного интеллекта. Возможность масштабирования без конвертации чек-пойнтов открывает новые горизонты для оптимизации процессов обучения нейросетей.