Китайские специалисты представили мощную нейросеть для создания озвучивания и точного копирования голоса — CosyVoice…
Китайские специалисты представили мощную нейросеть для создания озвучивания и точного копирования голоса — CosyVoice умеет следующее: 🕤Её можно запускать локально даже на простых устройствах, таких как калькулятор; 🕤По размеру модель значительно компактнее конкурентов, которые в три раза больше по объёму; 🕤Поддерживается девять языков: русский, английский, китайский, японский, корейский, немецкий, испанский, французский и итальянский; 🕤Для клонирования голоса достаточно короткого фрагмента продолжительностью от 3 до 10 секунд — модель полностью воспроизводит тембр и манеру речи; 🕤Поддерживается голосовой стриминг с минимальной задержкой около 150 миллисекунд, что позволяет клонировать голос в реальном времени; 🕤Функция Pronunciation Inpainting дает возможность вручную корректировать произношение отдельных слов; 🕤Доступна лицензия для коммерческого применения. Скачать модель можно на GitHub по ссылке (https://github.com/FunAudioLLM/CosyVoice) и на HuggingFace здесь (https://huggingface.co/FunAudioLLM/Fun-CosyVoice3-0.5B-2512).
Похожие посты
- SpaceXAI выпустила новую языковую модель Grok 4.6.12 августа 2026 г.
- В каталоге Immers Foundation Models доступны публичные эндпоинты для…10 августа 2026 г.
- OpenAI планирует убрать лимиты на текстовые диалоги в ChatGPT для тех, кто…07 августа 2026 г.
- Alibaba представила новую флагманскую нейросеть Qwen 3.8 Max с 2,4 триллионами…03 августа 2026 г.
Подписывайся на Telegram-канал Нейроньюс: нейросети и ИИ сервисы https://t.me/neuro_services_news