Она услышала свой голос впервые за 25 лет: как ИИ вернул его с 8 секунд видео
Искусственный интеллект восстановил голос женщины после 25 лет молчания, использовав всего несколько секунд домашнего видео.
Британская художница Сара Эзекейл из-за болезни не могла говорить своим голосом в течение 25 лет.
Теперь, благодаря искусственному интеллекту и едва слышному 8-секундному фрагменту из старого домашнего видео, она снова может услышать свой настоящий голос. В возрасте 34 лет у Сары диагностировали боковой амиотрофический склероз — в тот момент она ожидала второго ребёнка.
Это заболевание постепенно разрушает части нервной системы, вызывая слабость мышц языка, рта и горла, из-за чего некоторые пациенты физически теряют способность говорить. Позже Сара освоила технологию голосовой генерации с помощью компьютера, но созданный голос совсем не напоминал её собственный.
Несмотря на это, она продолжила карьеру художницы, сосредоточившись на цифровом искусстве. Однако её дети ни разу не слышали, как звучит настоящий голос их матери.
В последние годы специалисты всё чаще используют технологии для создания цифровых копий человеческого голоса. Обычно для этого требуются длительные и качественные аудиозаписи, но даже в таких случаях результат может звучать глухо и монотонно.
По словам Саймона Пула, представителя британской компании Smartbox, работающей в сфере медицинских коммуникаций, сначала они попросили у Сары часовой аудиозапись. Людям, которые могут потерять голос из-за таких заболеваний, как боковой амиотрофический склероз, специалисты рекомендуют заранее записать свой голос — это помогает сохранить личность и возможность полноценного общения.
Однако до появления смартфонов сделать качественные личные записи было сложно. В итоге Сара нашла лишь один короткий и некачественный фрагмент.
Клип из домашнего видео 90-х длился всего 8 секунд, был приглушённым и сопровождался шумом телевизора. Это побудило Саймона Пула обратиться к технологии, разработанной американскими специалистами из компании ElevenLabs, специализирующейся на ИИ. Их система способна воссоздавать голос даже по минимальным данным и делает его максимально похожим на настоящий.
Саймон использовал один инструмент для извлечения голосового образца из видео и другой — обученный на реальных голосах — для заполнения пробелов. Финальный результат оказался удивительно точным: голос Сары с лондонским акцентом и лёгкой шепелявостью.
«Я отправил ей образцы, и она написала, что чуть не расплакалась, когда их услышала. Она включила запись подруге, которая знала её до потери голоса, и та сказала, что это действительно звучит как её настоящий голос», — рассказал Саймон Пул.
По данным Британской ассоциации по борьбе с болезнями моторных нейронов, восемь из десяти пациентов сталкиваются с проблемами речи после постановки диагноза. При этом тембр, высота и интонация компьютерных голосов часто звучат неестественно.
«Преимущество новой технологии ИИ в том, что голоса стали по-настоящему человечными и выразительными. Они возвращают ту самую человечность, которая раньше терялась в механическом звучании. Особенно важно, чтобы человек, потерявший голос во взрослом возрасте, мог говорить своим настоящим голосом, а не использовать чужой», — убеждён Саймон Пул.