Немецкий разработчик DeepL представил масштабное обновление платформы DeepL Voice. Сервис научился переводить устную речь во время видеоконференций в режиме реального времени, сохраняя оригинальный тембр, интонацию, темп и эмоции говорящего, сообщает информагентство dpa.
Функция Speaker Match на старте поддерживает сохранение индивидуального голоса для 14 языков, тогда как сам перевод доступен более чем на 30 языках. До этого сервис DeepL Voice, запущенный около года назад, в основном специализировался на генерации текстовых субтитров в реальном времени.
Компания выпустила отдельные десктопные приложения для Windows и macOS, которые интегрируются в популярные платформы видеосвязи — Zoom, Microsoft Teams и Google Meet. По словам основателя и генерального директора DeepL Ярослава Кутыловски, разработка призвана сделать работу искусственного интеллекта незаметной для собеседников: система автоматически подстраивается под эмоциональное состояние и скорость речи спикера.
Кельнский стартап делает ключевую ставку на корпоративных клиентов, предлагая не только синхронный перевод звонков, но и бесшовную интеграцию со словарями и терминологическими базами компаний для единообразия коммуникаций.
Основанная в 2017 году компания DeepL насчитывает более 200 тысяч бизнес-клиентов и около 900 сотрудников. В мае стартап провел реструктуризацию и сократил 250 рабочих мест, однако сейчас, по заявлению руководства, вернулся к найму на фоне обострения конкуренции в сфере мультимодальных моделей с OpenAI, Google и Microsoft.





Пока нет комментариев. Будьте первым!