Open Source: #audio

Проекты каталога, отмеченные тегом #audio. Теги работают как отдельные посадочные страницы, чтобы похожие инструменты было проще находить и связывать между собой.

В подборке 10 проектов с суммарным рейтингом 663,871 звёзд на GitHub. Основные языки: Python, C, C++.

Фильтры

Языки

Репозитории

Найдено: 10
yt-dlp/yt-dlp
yt-dlp

yt-dlp — feature-rich CLI-загрузчик аудио и видео, выросший как активный fork youtube-dl и youtube-dlc.

Звёзды 168,862 Форки 14,202 Автор yt-dlp Язык Python Лицензия Unlicense
Открыть
FFmpeg/FFmpeg
FFmpeg

FFmpeg — набор библиотек и консольных инструментов для обработки видео, аудио, субтитров и метаданных.

Звёзды 61,473 Форки 13,938 Автор FFmpeg Язык C Лицензия NOASSERTION
Открыть
RVC-Boss/GPT-SoVITS
GPT-SoVITS

GPT-SoVITS — проект для few-shot синтеза речи и переноса голоса с небольшим объемом аудиоданных.

Звёзды 59,078 Форки 6,442 Автор RVC-Boss Язык Python Лицензия MIT
Открыть
ggml-org/whisper.cpp
whisper.cpp

whisper.cpp — высокопроизводительная C/C++-реализация инференса OpenAI Whisper для распознавания речи.

Звёзды 51,075 Форки 5,706 Автор ggml-org Язык C++ Лицензия Не указано
Открыть
coqui-ai/TTS
Coqui TTS

Coqui TTS — набор инструментов глубокого обучения для синтеза речи и экспериментов с голосом.

Звёзды 45,634 Форки 6,125 Автор coqui-ai Язык Python Лицензия MPL-2.0
Открыть
2noise/ChatTTS
ChatTTS

ChatTTS — генеративная модель речи для диалоговых и повседневных аудиосценариев.

Звёзды 39,522 Форки 4,248 Автор 2noise Язык Python Лицензия AGPL-3.0
Открыть
suno-ai/bark
bark

Bark — генеративная модель аудио от Suno для речи и звуков по текстовому заданию.

Звёзды 39,177 Форки 4,673 Автор suno-ai Язык Jupyter Notebook Лицензия MIT
Открыть
myshell-ai/OpenVoice
OpenVoice

OpenVoice — модель для быстрого клонирования голоса и экспериментов с синтезом речи.

Звёзды 36,789 Форки 4,102 Автор myshell-ai Язык Python Лицензия MIT
Открыть