За считанные секунды можно создать копию голоса — появилась новая упрощённая модель для синтеза речи, способная…
За считанные секунды можно создать копию голоса — появилась новая упрощённая модель для синтеза речи, способная воспроизводить чужой голос по короткому аудиофрагменту. Все очень просто: достаточно предоставить нейросети несколько секунд записи человека, и она сможет произносить любой текст тем же голосом. Результат звучит довольно натурально: качество достигает 48 кГц, что сопоставимо с обычной аудиозаписью. Самое удивительное — это скорость. Модель генерирует речь в 150 раз быстрее, чем происходит реальное воспроизведение. Проще говоря, минутный текст она озвучит за доли секунды. При этом искусственному интеллекту требуется менее 1 ГБ видеопамяти, поэтому его можно запускать локально даже на стандартном ПК или ноутбуке. Скачать можно здесь (https://github.com/ysharma3501/LuxTTS).
Похожие посты
- появилась ACE-Step 1.5 XL, открытая звуковая модель, которая превосходит…13 апреля 2026 г.
- Вышел мощный генератор речи с открытым исходным кодом — модель Tada только что…18 марта 2026 г.
- Alibaba представила новую флагманскую нейросеть Qwen 3.8 Max с 2,4 триллионами…03 августа 2026 г.
- Китайские разработчики представили GLM 5.2 — новую модель с открытым исходным…12 июля 2026 г.
Подписывайся на Telegram-канал Нейроньюс: нейросети и ИИ сервисы https://t.me/neuro_services_news