За считанные секунды можно создать копию голоса — появилась новая упрощённая модель для синтеза речи, способная…
За считанные секунды можно создать копию голоса — появилась новая упрощённая модель для синтеза речи, способная воспроизводить чужой голос по короткому аудиофрагменту. Все очень просто: достаточно предоставить нейросети несколько секунд записи человека, и она сможет произносить любой текст тем же голосом. Результат звучит довольно натурально: качество достигает 48 кГц, что сопоставимо с обычной аудиозаписью. Самое удивительное — это скорость. Модель генерирует речь в 150 раз быстрее, чем происходит реальное воспроизведение. Проще говоря, минутный текст она озвучит за доли секунды. При этом искусственному интеллекту требуется менее 1 ГБ видеопамяти, поэтому его можно запускать локально даже на стандартном ПК или ноутбуке. Скачать можно здесь (https://github.com/ysharma3501/LuxTTS).
Похожие посты
- появилась ACE-Step 1.5 XL, открытая звуковая модель, которая превосходит…13 апреля 2026 г.
- Вышел мощный генератор речи с открытым исходным кодом — модель Tada только что…18 марта 2026 г.
- Библиотека, представляющая собой настоящий кладезь навыков UI для ИИ-агентов…17 сентября 2026 г.
- Теперь можно запускать огромную модель с 35 миллиардами параметров прямо на…11 сентября 2026 г.
Подписывайся на Telegram-канал Нейроньюс: нейросети и ИИ сервисы https://t.me/neuro_services_news