DeepSeek AI выпустила новую версию своей модели DeepSeek-V4.1-Flash, которая предназначена для работы с длинными контекстами и оптимизирована для снижения нагрузки на память. Модель использует 552 миллиарда основных параметров и 196 миллиардов дополнительных параметров, обеспечивая окно контекста в 1 миллион токенов. Это позволяет эффективно управлять кэшами и снижать нагрузку на ресурсы, такие как HBM и SSD.
Новая модель активирует 8 миллиардов параметров на токен во время предварительной обработки и 16 миллиардов во время декодирования. Важным достижением является уменьшение объема кэширования до 890 байт на токен, что значительно меньше по сравнению с предыдущими версиями. DeepSeek-V4.1-Flash также доступна с открытыми весами под лицензией MIT, что позволяет разработчикам интегрировать ее в свои проекты через платформы, такие как Hugging Face.
Эта версия модели имеет значительное значение для разработчиков и исследователей в области искусственного интеллекта, так как она предлагает новые возможности для работы с большими объемами данных и сложными задачами. Оптимизация кэша и возможность использования различных уровней рассуждения делают DeepSeek-V4.1-Flash привлекательным инструментом для создания более эффективных AI-приложений.