Репост из: [PYTHON:TODAY]
🎙 CosyVoice 3 — открытая нейросеть, которая умеет озвучивать текст, клонировать голос по короткому примеру и говорить сразу на нескольких языках — включая русский. Причем всё это можно запускать локально.
Возможности:
🎤 Клонирование голоса по короткому аудиофрагменту (Zero-Shot Voice Cloning).
🌍 Поддержка различных языков, включая русский, английский, немецкий, французский, испанский, японский и другие.
🗣 Генерация речи с управлением:
* эмоциями;
* скоростью;
* громкостью;
* стилем;
* акцентом;
* языком.
⚡️ Потоковая генерация голоса с задержкой около 150 мс, что позволяет использовать модель для голосовых ассистентов и общения в реальном времени.
🧠 Корректно читает:
* числа;
* даты;
* валюты;
* специальные символы;
* сложные текстовые конструкции без дополнительных модулей нормализации текста. ([GitHub][1])
🎧 Поддерживает кросс-языковое клонирование — например, можно использовать образец голоса на одном языке и синтезировать речь на другом.
Где может пригодится:
✅Голосовые боты.
✅Создание подкастов.
✅AI-ассистенты.
✅Игры.
✅Собственные голосовые интерфейсы.
✅Озвучка книг.
✅Дубляж видео.
Установка
Клонируем репозиторий:
git clone --recursive https://github.com/FunAudioLLM/CosyVoice.git
cd CosyVoice
git submodule update --init --recursive
Создаем окружение:
conda create -n cosyvoice python=3.10
conda activate cosyvoice
Устанавливаем зависимости:
pip install -r requirements.txt
Пример запуска:
python example.py
Или сразу поднимаем WebUI:
python webui.py --port 50000
После запуска откроется удобный веб-интерфейс для генерации речи.
♎️ GitHub/Инструкция
#python #soft #github
Возможности:
🎤 Клонирование голоса по короткому аудиофрагменту (Zero-Shot Voice Cloning).
🌍 Поддержка различных языков, включая русский, английский, немецкий, французский, испанский, японский и другие.
🗣 Генерация речи с управлением:
* эмоциями;
* скоростью;
* громкостью;
* стилем;
* акцентом;
* языком.
⚡️ Потоковая генерация голоса с задержкой около 150 мс, что позволяет использовать модель для голосовых ассистентов и общения в реальном времени.
🧠 Корректно читает:
* числа;
* даты;
* валюты;
* специальные символы;
* сложные текстовые конструкции без дополнительных модулей нормализации текста. ([GitHub][1])
🎧 Поддерживает кросс-языковое клонирование — например, можно использовать образец голоса на одном языке и синтезировать речь на другом.
Где может пригодится:
✅Голосовые боты.
✅Создание подкастов.
✅AI-ассистенты.
✅Игры.
✅Собственные голосовые интерфейсы.
✅Озвучка книг.
✅Дубляж видео.
Установка
Клонируем репозиторий:
git clone --recursive https://github.com/FunAudioLLM/CosyVoice.git
cd CosyVoice
git submodule update --init --recursive
Создаем окружение:
conda create -n cosyvoice python=3.10
conda activate cosyvoice
Устанавливаем зависимости:
pip install -r requirements.txt
Пример запуска:
python example.py
Или сразу поднимаем WebUI:
python webui.py --port 50000
После запуска откроется удобный веб-интерфейс для генерации речи.
♎️ GitHub/Инструкция
#python #soft #github