Investing.com02:52Федеральная резервная система США планирует дальнейшие повышения процентных ставокInvesting.com02:36Председатель ФРС Логан призывает к повышению ставок на 50 базисных пунктов и болееPhys.org00:40Новый метод генерации почти неразличимых фотонов для квантовой связиFast Company00:30Университет Вермонта исследует применение цифровых двойников в медицинеOilPrice23:40Китай приостанавливает экспорт топлива в октябре на фоне глобального дефицита дизеляFortune20:54Paramount и Warner Bros. завершили сделку на $111 миллиардов с обязательством выпускать 30 фильмов в годCarscoops20:30GM и LG Energy приближаются к производству новых батарейCryptoPotato19:59Evernorth получает одобрение акционеров для выхода на Nasdaq с XRPArs Technica19:28Искусственный интеллект Ataraxos одержал победу в игре StrategoOilPrice19:00Историческая сделка по сверхпроводникам приближает коммерческое использование термоядерного синтеза

vestka

Alibaba представила Qwen3.8-2.4T-A95B с открытыми весами для Amazon SageMaker

12 августа 2026 года команда Qwen от Alibaba анонсировала модель Qwen3.8-2.4T-A95B, которая впервые представлена с открытыми весами. Модель имеет 2.4 триллиона параметров и использует гибридную архитектуру, сочетающую линейное и полное внимание, что позволяет обрабатывать контекст до 262 тысяч токенов, с возможностью расширения до 1 миллиона токенов.

Qwen3.8 нацелена на выполнение наиболее требовательных задач, включая многопроцессорное кодирование и долгосрочное планирование. Открытые веса предоставляют пользователям полный контроль над данными и поведением вывода, что позволяет избежать дополнительных затрат на API при масштабировании. Однако для развертывания такой модели требуется специализированная инфраструктура GPU и оптимизированный стек обслуживания.

Данная модель будет развернута на Amazon SageMaker HyperPod с использованием vLLM на инстансе ml.p6-b300, который включает 8 графических процессоров NVIDIA B300 Blackwell Ultra. Это решение открывает новые возможности для разработчиков, стремящихся к созданию мощных AI-приложений с высокой степенью кастомизации.

Главное

  • Модель Qwen3.8-2.4T-A95B имеет 2.4 триллиона параметров.
  • Контекст модели может быть расширен до 1 миллиона токенов.
  • Развертывание модели требует специализированной инфраструктуры GPU.

Упомянуто

Важное из дайджеста

Открыть полный дайджест →