Phys.org01:40Наночастицы восстанавливают светочувствительность слепых сетчаток в предклиническом исследованииPhys.org01:20Исследование показывает 'вакциноподобные' реакции кораллов на патогеныForbes00:36Paramount достиг соглашения в антимонопольном деле на сумму $110 миллиардовMarketWatch23:54Apple может войти в клуб компаний с капитализацией в $5 триллионовPhys.org23:20Новый метод рентгеновского анализа предсказывает поведение анионов для улучшения батарейElectrek22:56Tesla получает крупнейший заказ на электрические грузовики в истории СШАArs Technica22:45Microsoft нейтрализует мошенническую платформу, использующую ИИ для компрометации аккаунтовSTAT News22:28Министерство здравоохранения США анонсировало новые инициативы по снижению тестирования на животных в разработке лекарствMMA Weekly22:20Джошуа Ван объяснил, почему не снялся с UFC 331 несмотря на травмуFast Company22:07DoorDash достигла исторического соглашения на $131.5 миллиона с водителями в Нью-Йорке

vestka

Meta Superintelligence Labs анонсировала Muse Voice Transcribe: новый модель для обработки аудио в реальном времени

Meta Superintelligence Labs анонсировала Muse Voice Transcribe, модель, которая объединяет три ключевых функции: автоматическую транскрипцию речи, диаризацию для более чем 20 спикеров и определение окончания речи. Это позволяет избежать задержек и потенциальных ошибок, возникающих при использовании нескольких систем. Muse Voice Transcribe представляет собой первую в Meta модель для восприятия аудио в реальном времени.

Модель работает на основе авторегрессионного подхода и обрабатывает аудио в 80-миллисекундных чанках с частотой 12.5 Гц. Она доступна как хостируемый API на платформе Meta Model API по цене $3.00 за 1,000 минут аудио. В настоящее время Muse Voice Transcribe уже используется в таких приложениях, как Meta AI для Mac и Muse Code.

Внедрение Muse Voice Transcribe может значительно улучшить качество обработки аудио в реальном времени, что важно для различных приложений, включая голосовые помощники и системы автоматической транскрипции. Это также может повлиять на развитие технологий в области искусственного интеллекта и обработки естественного языка, предоставляя пользователям более эффективные инструменты для работы с аудиоинформацией.

Главное

  • Muse Voice Transcribe объединяет функции транскрипции, диаризации и определения окончания речи в одной модели.
  • Модель работает с аудио в 80-миллисекундных чанках на частоте 12.5 Гц.
  • Muse Voice Transcribe доступна через API по цене $3.00 за 1,000 минут аудио.

Упомянуто

Важное из дайджеста

Открыть полный дайджест →