Phys.org01:40Наночастицы восстанавливают светочувствительность слепых сетчаток в предклиническом исследованииPhys.org01:20Исследование показывает 'вакциноподобные' реакции кораллов на патогеныForbes00:36Paramount достиг соглашения в антимонопольном деле на сумму $110 миллиардовMarketWatch23:54Apple может войти в клуб компаний с капитализацией в $5 триллионовPhys.org23:20Новый метод рентгеновского анализа предсказывает поведение анионов для улучшения батарейElectrek22:56Tesla получает крупнейший заказ на электрические грузовики в истории СШАArs Technica22:45Microsoft нейтрализует мошенническую платформу, использующую ИИ для компрометации аккаунтовSTAT News22:28Министерство здравоохранения США анонсировало новые инициативы по снижению тестирования на животных в разработке лекарствMMA Weekly22:20Джошуа Ван объяснил, почему не снялся с UFC 331 несмотря на травмуFast Company22:07DoorDash достигла исторического соглашения на $131.5 миллиона с водителями в Нью-Йорке

vestka

Интеграция текстовой и визуальной моделей в Алисе AI

Виртуальный помощник Алиса прошел через значительные изменения, объединив текстовую и визуальную модели в одну омнимодель. Ранее эти модели работали отдельно, что создавало сложности в восприятии запросов, содержащих как текст, так и изображения. Теперь же пользователи могут получать более согласованные и точные ответы, так как обе модели функционируют в едином контексте.

Процесс интеграции занял почти год и включал в себя множество испытаний и корректировок. Разработчики столкнулись с различиями в форматах ответов и вёрстке, что требовало тщательной работы над роутингом данных между моделями. Несмотря на трудности, команда смогла создать систему, которая значительно улучшает взаимодействие с пользователями, делая его более естественным и интуитивным.

Эта интеграция имеет важное значение для развития технологий искусственного интеллекта, так как она демонстрирует возможности объединения различных подходов в одной модели. Успешное слияние LLM и VLM может стать основой для дальнейших улучшений в области AI, открывая новые горизонты для создания более сложных и адаптивных систем.

Главное

  • Интеграция текстовой LLM и визуальной VLM заняла почти год.
  • Теперь Алиса воспринимает текст и изображения как единое целое.
  • Процесс включал в себя множество испытаний и корректировок.

Упомянуто

Персоны

Важное из дайджеста

Открыть полный дайджест →