Investing.com02:52Федеральная резервная система США планирует дальнейшие повышения процентных ставокInvesting.com02:36Председатель ФРС Логан призывает к повышению ставок на 50 базисных пунктов и болееPhys.org00:40Новый метод генерации почти неразличимых фотонов для квантовой связиFast Company00:30Университет Вермонта исследует применение цифровых двойников в медицинеOilPrice23:40Китай приостанавливает экспорт топлива в октябре на фоне глобального дефицита дизеляFortune20:54Paramount и Warner Bros. завершили сделку на $111 миллиардов с обязательством выпускать 30 фильмов в годCarscoops20:30GM и LG Energy приближаются к производству новых батарейCryptoPotato19:59Evernorth получает одобрение акционеров для выхода на Nasdaq с XRPArs Technica19:28Искусственный интеллект Ataraxos одержал победу в игре StrategoOilPrice19:00Историческая сделка по сверхпроводникам приближает коммерческое использование термоядерного синтеза

vestka

Liquid AI представила LFM2.5-VL-3B-DSpark: новый подход к декодированию для моделей с визуальным языком

Компания Liquid AI представила LFM2.5-VL-3B-DSpark, экспериментальную модель, использующую спекулятивное декодирование для улучшения работы с визуально-языковыми моделями. Эта новая версия добавляет около 280 миллионов параметров и позволяет увеличить скорость декодирования без изменения выходных данных модели, достигая до 3.13 раза быстрее на Apple silicon и до 2.66 раза на NVIDIA H100.

Спекулятивное декодирование представляет собой метод, при котором небольшая драфт-модель предлагает несколько токенов вперед, а основная модель проверяет их за один проход. Это позволяет значительно ускорить процесс генерации текста, что является важным для приложений, требующих высокой скорости обработки данных.

Выход LFM2.5-VL-3B-DSpark имеет значение для разработчиков, так как модель доступна на платформе Hugging Face и совместима с несколькими инструментами, такими как SGLang и MLX-VLM. Экспериментальный характер релиза и лицензия LFM Open License v1.0 позволяют использовать модель в коммерческих целях для компаний с годовым доходом до 10 миллионов долларов, что может способствовать ее широкому распространению в малом бизнесе.

Главное

  • Модель LFM2.5-VL-3B-DSpark добавляет около 280 миллионов параметров.
  • Декодирование на Apple silicon происходит до 3.13 раза быстрее.
  • На NVIDIA H100 скорость декодирования увеличивается до 2.66 раза.
  • Модель доступна на Hugging Face в форматах Safetensors и GGUF.
  • Лицензия LFM Open License v1.0 позволяет коммерческое использование для компаний с доходом до 10 миллионов долларов.

Упомянуто

Важное из дайджеста

Открыть полный дайджест →