Bark — генерация речи и звуков из текста
★ 35k
Bark — это открытая модель генеративного текста-в-аудио от Suno: она озвучивает текст реалистичной речью на многих языках, а также умеет смех, вздохи, простые звуковые эффекты и даже напевание. Берут, когда нужно синтезировать голосовую озвучку из текста локально: сделать голос для роликов, ботов, прототипов, озвучить реплики с интонацией и невербальными вставками. Работает как text-to-speech с выразительными пресетами голосов; веса открыты, запуск на своём железе (для комфортной скорости желателен GPU). Направление — синтез речи и звуков из текста (TTS), а не расшифровка речи в текст (для этого whisperX/faster-whisper) и не клонирование конкретного голоса: озвучивает произвольный текст готовыми голосами. Подходит для контента и экспериментов; для продакшна оценивайте качество на своём языке и лицензию.
- #TTS