Investing.com02:52Федеральная резервная система США планирует дальнейшие повышения процентных ставокInvesting.com02:36Председатель ФРС Логан призывает к повышению ставок на 50 базисных пунктов и болееPhys.org00:40Новый метод генерации почти неразличимых фотонов для квантовой связиFast Company00:30Университет Вермонта исследует применение цифровых двойников в медицинеOilPrice23:40Китай приостанавливает экспорт топлива в октябре на фоне глобального дефицита дизеляFortune20:54Paramount и Warner Bros. завершили сделку на $111 миллиардов с обязательством выпускать 30 фильмов в годCarscoops20:30GM и LG Energy приближаются к производству новых батарейCryptoPotato19:59Evernorth получает одобрение акционеров для выхода на Nasdaq с XRPArs Technica19:28Искусственный интеллект Ataraxos одержал победу в игре StrategoOilPrice19:00Историческая сделка по сверхпроводникам приближает коммерческое использование термоядерного синтеза

vestka

Новые достижения в области искусственного интеллекта: Qwen3.8-27B и его особенности

Модель Qwen3.8-27B, представленная в рамках Q4TP, показывает значительные достижения в управлении контекстом и KV-кэшем. С весом около 14,3 ГБ, модель сталкивается с ограничениями при использовании длинного контекста, что приводит к увеличению KV-кэша на 65 536 байт с каждым токеном, достигая около 4 ГиБ на 64K токенов.

Для решения этой проблемы в Qwen3.8-27B используется экспериментальный режим O(1) рантайма CMF, который заменяет растущий KV-кэш фиксированным состоянием. Это позволяет использовать четыре sink-токена и точное окно последних 128 токенов, а также 32 опорных представления для дальней части, что значительно оптимизирует работу модели.

Эти нововведения имеют важное значение для разработки моделей с длинным контекстом, так как они позволяют более эффективно использовать ресурсы GPU и улучшать производительность при обработке больших объемов данных. Такой подход может привести к новым возможностям в области обработки естественного языка и других задач, требующих работы с длинными последовательностями.

Главное

  • Модель Qwen3.8-27B весит около 14,3 ГБ.
  • KV-кэш увеличивается на 65 536 байт с каждым токеном.
  • На 64K токенов KV-кэш составляет около 4 ГиБ.

Важное из дайджеста

Открыть полный дайджест →