STAT News18:08Комбинированная терапия от Lilly получила одобрение для лечения рака грудиThe Guardian Science17:00Ученые сообщают о нарушении планетарных границ для жизни на ЗемлеМедвестник13:16Роспотребнадзор зарегистрировал первый в мире CRISPR-тест на устойчивость к антибиотикамSTAT News11:30FDA одобрила новый препарат для лечения рака поджелудочной железыPhys.org02:40Новая технология увеличивает производство белка с помощью кольцевой мРНКOilPrice01:00Мировые цены на дизель достигают рекордов из-за нехватки перерабатывающих мощностейBBC Business00:34Paramount достиг соглашения по иску с США, открывая путь к слиянию с Warner Bros.OilPrice00:00Переход к новым источникам энергии: ускорение спроса на электроэнергиюCryptoPotato23:34Биткойн достигает $87,000, вызывая ликвидации на сумму $1 миллиардForbes23:09Paramount достиг соглашения по делу, открывающему путь к слиянию с Warner Bros.

vestka

Сравнение моделей GLM-5.3-Flash и Qwen3.8-Flash-Next от китайских лабораторий ИИ

На этой неделе две китайские лаборатории искусственного интеллекта представили свои новые модели: GLM-5.3-Flash от Z.ai и Qwen3.8-Flash-Next от Alibaba. GLM-5.3-Flash является мультимодальной моделью с 320 миллиардами параметров, из которых 18 миллиардов активны. В то же время Qwen3.8-Flash-Next имеет 125 миллиардов параметров с 6 миллиардами активных параметров и предваряет архитектуру Qwen4.

Несмотря на то, что обе модели были разработаны независимо, их конфигурации демонстрируют значительное сходство. Обе системы используют гибридное внимание в соотношении 3:1, выбирают контекст с помощью сжатого индексатора, ограниченного 2048 токенами, и расширяют остаточный поток на 4 управляемые ветви. Обе модели также обучаются с использованием оптимизатора Muon.

Эти релизы подчеркивают текущие тенденции в разработке ИИ, где лаборатории стремятся к созданию более мощных и эффективных архитектур. Сравнение моделей может помочь в дальнейшем развитии технологий и понимании, как различные подходы могут привести к схожим результатам в области искусственного интеллекта.

Главное

  • GLM-5.3-Flash имеет 320 миллиардов параметров, из которых 18 миллиардов активны.
  • Qwen3.8-Flash-Next содержит 125 миллиардов параметров с 6 миллиардами активных параметров.
  • Обе модели используют оптимизатор Muon и имеют схожие архитектурные решения.

Упомянуто

Важное из дайджеста

Открыть полный дайджест →