Компания Gradium, основанная на базе исследовательской лаборатории Kyutai в Париже, анонсировала запуск нового инструмента Voice Design. Этот инструмент позволяет пользователям создавать синтетические голоса, просто вводя текстовое описание. В отличие от традиционных методов, которые требуют наличия референсного аудио или прав на использование голоса, Voice Design генерирует новый голос за считанные секунды, что значительно упрощает процесс.
Voice Design уже доступен через API Gradium и в Studio, включая бесплатный тарифный план. Пользователи могут создавать голоса, которые работают на том же стриминговом Text-to-Speech эндпоинте, что и голоса из каталога, обеспечивая ту же задержку и форматы вывода. Это решение открывает новые возможности для разработчиков и компаний, которым нужны уникальные голоса для различных приложений.
Запуск Voice Design может изменить подход к созданию синтетических голосов в индустрии. С учетом растущего спроса на персонализированные голосовые решения, Gradium предлагает эффективный инструмент, который может помочь компаниям удовлетворить потребности клиентов и улучшить взаимодействие с пользователями.