AI观测者社团AI Forwarder · HUFE
行迹观社共创藏知见贤相遇
归台
藏知/语音与音频

KNOWLEDGE DIRECTORY

语音与音频

语音识别、合成与可控音频生成。

语音与音频分类主题插画

KEEP IN ORDER

知识归档

按时间整理公开资源,保留标题、来源与日期,方便回溯。

观
破局路线

Whisper:开源语音识别基线

GitHub

↗
观
破局路线

Fish Speech:可控语音生成

GitHub

↗
观
破局路线

CosyVoice 语音合成

GitHub

↗
观
破局路线

FunASR 语音识别

GitHub

↗
观
破局路线

OpenVoice 声音克隆

GitHub

↗
观
破局路线

whisper.cpp 本地转写

GitHub

↗
观
破局路线

Bark 生成式音频

GitHub

↗
观
破局路线

SeamlessM4T 语音翻译

GitHub

↗
观
破局路线

Coqui TTS 语音合成

GitHub

↗
观
破局路线

GPT-SoVITS 声音训练

GitHub

↗
观
破局路线

Fish Speech 语音生成

GitHub

↗

藏知 · 让有用的知识被看见,也被继续使用。

AI观测者社团AI Forwarder · 湖南财政经济学院
行迹观社共创藏知见贤相遇

观世界 · 行实践 · 共未来