待验证90% 置信事实时间未知
Fish Audio是一款基于深度学习的文本转语音(TTS)服务,支持多种音色克隆和自然语音合成
1
来源数
90%
置信度
长期有效
时效性
2026/6/2
首次发现
来源
Coze工作流搭建:一键生成短视频完整教程
bilibiliA流AIGC
涉及实体
相关事实
待验证博主使用了名为「Fish Speech S2 Pro」的本地TTS模型来克隆真人声音为桌面宠物配音78% 相似待验证Fish Speech是一个开源的文本转语音模型,其S2 Pro版本支持零样本和少样本声音克隆,只需几秒到几十秒的参考音频即可生成高度相似的合成语音77% 相似待验证Fish Speech底层采用了VITS架构的改进版本,将文本编码、韵律预测和声码器整合在一个端到端的框架中71% 相似待验证Fish Audio采用的技术路线支持零样本(Zero-shot)语音克隆,即只需少量参考音频即可复制特定音色69% 相似待验证现代TTS技术已从早期基于规则的拼接合成发展到基于深度学习的端到端语音生成,底层技术包括Transformer架构语音模型、神经网络声码器(WaveNet、HiFi-GAN)及韵律建模69% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/37894API
curl https://kongchang.com/api/v1/knowledge/claims/37894MCP
get_claim(id=37894)