Компанія Nvidia анонсувала революційну нейромережу під назвою Fugatto, яка використовує генеративний ШІ для створення унікальних звуків і обробки звичних звукових сигналів за допомогою текстових команд.
Про це повідомляє The Verge.
Назва Fugatto розшифровується як Foundational Generative Audio Transformer Opus 1.
Можливості нейромережі
Fugatto здатна поєднувати різні звуки, наприклад, злиття котячого нявкання із звуком труби або трансформацію мелодії фортепіано у звучання людського голосу. Окрім цього, вона може виконувати завдання, які не були передбачені її початковим навчанням. Серед них:
- Виділення мовлення зі звукового потоку та зміна його характеристик — тону, акценту чи емоційного забарвлення.
- Генерація звуків, які динамічно змінюються, наприклад, шуму дощу, що пересувається по різних локаціях.
Розробники вважають Fugatto потенційно таким же революційним проривом для музичної індустрії, яким колись став синтезатор.
Незважаючи на потенціал, компанія Nvidia не поспішає відкривати доступ до Fugatto для широкої аудиторії. Причина — ризики, пов’язані з використанням технології, включно зі створенням контенту, що може порушувати авторські права чи законодавство.
Новий аналог ChatGPT
Nvidia також представила свою мовну модель, здатну працювати локально на комп’ютерах без необхідності підключення до інтернету. Її ключові особливості:
- Вибір між двома мовними моделями — Mistral і Llama 2.
- Можливість відповідати на запити, створювати контент та навіть обробляти відео з YouTube.
- Програма називається Chat with RTX, що інтегрує сучасні ШІ-функції у звичний робочий процес.
Таким чином, Nvidia робить вагомий внесок у розвиток генеративних технологій, одночасно обережно ставлячись до питань безпеки та етики.
