02.04.2024

OpenAI клонирует ваш голос после 15 секунд разговора

OpenAI представила первые результаты работы над уникальной разработкой – моделью Voice Engine. Технология способна генерировать естественно звучащую речь, идентичную оригинальному голосу диктора, используя всего лишь текст и 15-секундную аудиозапись. Небольшая модель способна создавать эмоциональные и реалистичные голоса.

Разработка Voice Engine началась в конце 2022 года. Модель уже находит применение в API преобразования текста в речь, а также в функциях ChatGPT Voice и Read Aloud. Вместе с тем, OpenAI осуществляет осторожный подход к более широкому распространению технологии, учитывая потенциал неправомерного использования синтетических голосов. Компания стремится инициировать диалог о безопасном внедрении синтетических голосов и адаптации общества к новым возможностям.

Среди ранних применений Voice Engine:

помощь в чтении для неграмотных и детей с использованием естественных и эмоциональных голосов;
перевод контента (видео и подкасты) для расширения глобальной аудитории;
улучшение предоставления основных услуг в отдаленных районах;
поддержка людей с заболеваниями, влияющими на речь, через терапевтические и образовательные приложения;
восстановление голоса у пациентов, страдающих от внезапных или дегенеративных состояний речи.

OpenAI подчеркивает серьезность рисков, связанных с генерацией речи, идеально имитирующей голоса людей, особенно в контексте выборов. В ответ на риски компания разработала меры безопасности, включая водяные знаки для отслеживания происхождения аудио, созданного Voice Engine, и активный мониторинг использования технологии. Партнеры, тестирующие Voice Engine, согласились с политикой использования, запрещающей имитацию другого лица или организации без согласия.

Компания предлагает шаги к повышению устойчивости общества к вызовам, представляемым убедительными генеративными моделями, включая пересмотр аутентификации на основе голоса как меры безопасности и разработку политик защиты использования чужих голосов в ИИ. OpenAI стремится к продолжению диалога о вызовах и возможностях синтетических голосов с политиками, исследователями, разработчиками и креативщиками, подчеркивая важность глобального понимания направления развития технологии.

««« Новости

Сайт: *
ФИО: *
E-mail: *	Телефон: *
Комментарий: *
* Введите ответ: 6+9

Бесплатно Экспресс-аудит сайта:

OpenAI клонирует ваш голос после 15 секунд разговора