NVIDIA создала ИИ-модель для работы со звуком, это своего рода «фотошоп для звука»
Представьте себе технологию, которая может превратить мяуканье кошки в оперное пение или заставить саксофон залаять.
ИИ-модель Fugatto состоит из 2,5 млрд параметров.
Что она умеет?
• Преобразует текстовые описания в музыку и звуки
• Трансформирует одни звуки в другие (например, партию фортепиано - в человеческий голос)
• Создает сложные звуковые ландшафты с помощью технологии temporal interpolation
Представьте, вы можете сгенерировать реалистичный звук приближающейся грозы, где раскаты грома постепенно нарастают, достигают пика и медленно затихают вдали.
И всё это с точным контролем над каждым элементом звуковой картины.
Представьте себе технологию, которая может превратить мяуканье кошки в оперное пение или заставить саксофон залаять.
ИИ-модель Fugatto состоит из 2,5 млрд параметров.
Что она умеет?
• Преобразует текстовые описания в музыку и звуки
• Трансформирует одни звуки в другие (например, партию фортепиано - в человеческий голос)
• Создает сложные звуковые ландшафты с помощью технологии temporal interpolation
Представьте, вы можете сгенерировать реалистичный звук приближающейся грозы, где раскаты грома постепенно нарастают, достигают пика и медленно затихают вдали.
И всё это с точным контролем над каждым элементом звуковой картины.