02.04.2024 | OpenAI клонирует ваш голос после 15 секунд разговора |
OpenAI представила первые результаты работы над уникальной разработкой – моделью Voice Engine. Технология способна генерировать естественно звучащую речь, идентичную оригинальному голосу диктора, используя всего лишь текст и 15-секундную аудиозапись. Небольшая модель способна создавать эмоциональные и реалистичные голоса. Разработка Voice Engine началась в конце 2022 года. Модель уже находит применение в API преобразования текста в речь, а также в функциях ChatGPT Voice и Read Aloud. Вместе с тем, OpenAI осуществляет осторожный подход к более широкому распространению технологии, учитывая потенциал неправомерного использования синтетических голосов. Компания стремится инициировать диалог о безопасном внедрении синтетических голосов и адаптации общества к новым возможностям. Среди ранних применений Voice Engine:
OpenAI подчеркивает серьезность рисков, связанных с генерацией речи, идеально имитирующей голоса людей, особенно в контексте выборов. В ответ на риски компания разработала меры безопасности, включая водяные знаки для отслеживания происхождения аудио, созданного Voice Engine, и активный мониторинг использования технологии. Партнеры, тестирующие Voice Engine, согласились с политикой использования, запрещающей имитацию другого лица или организации без согласия. Компания предлагает шаги к повышению устойчивости общества к вызовам, представляемым убедительными генеративными моделями, включая пересмотр аутентификации на основе голоса как меры безопасности и разработку политик защиты использования чужих голосов в ИИ. OpenAI стремится к продолжению диалога о вызовах и возможностях синтетических голосов с политиками, исследователями, разработчиками и креативщиками, подчеркивая важность глобального понимания направления развития технологии. |
Проверить безопасность сайта