Как получается компьютерный голос в озвучке?
Навигатор и голосовой помощник разговаривают человеческим голосом! 🗣️ Но это же не живой человек. Как компьютер «говорит» слова?
2 ответа
Компьютер не «говорит» как мы — он собирает речь из кусочков звука, как из кубиков ЛЕГО! 🧱
Раньше делали так: настоящий человек начитывал тысячи звуков и слогов, их записывали в большую библиотеку. Когда нужно сказать слово «привет», компьютер брал кусочки «при», «вет» и склеивал их вместе. Поэтому старые голоса звучали немного рублено и роботно. 🤖
Это называется синтез речи — «синтез» значит «сборка из частей».
Сейчас всё гораздо умнее! Современный компьютер:
- Читает текст и разбирает, как его произнести: где сделать паузу, где голос поднять (вопрос?), где опустить. ❓
- С помощью нейросети — программы, которая слушала тысячи часов живой речи и училась ей подражать — создаёт звук с нуля, прямо как настоящий человек. 🧠
- Получается плавный голос с интонацией, который трудно отличить от живого!
Это как если бы ты слушал-слушал, как говорит мама, и научился говорить так же похоже. 👩
Именно поэтому навигатор может прочитать любое название улицы, даже которое никто заранее не записывал — он собирает или генерирует звук сам, по буквам и правилам. 🛣️
Такая штука называется TTS (Text-To-Speech — «текст в речь»). Магия в том, что компьютер превращает буквы в живые звуки! ✨
Это технология синтеза речи (TTS — «текст в речь»). 🔊
Раньше компьютер склеивал голос из заранее записанных кусочков-слогов — выходило роботно. Сейчас умная программа-нейросеть слушала тысячи часов живой речи и научилась создавать звук сама, с интонацией.
Поэтому помощник может прочитать любой текст, даже незнакомое слово: он генерирует речь по буквам и правилам, а не достаёт готовую запись. ✨