待验证80% 置信事实时间未知
Fish Speech是一个开源的文本转语音模型,其S2 Pro版本支持零样本和少样本声音克隆,只需几秒到几十秒的参考音频即可生成高度相似的合成语音
1
来源数
80%
置信度
长期有效
时效性
2026/6/1
首次发现
来源
Codex桌面宠物实战:从零打造会说话的AI小精灵
bilibili灵姐说AI
涉及实体
相关事实
待验证Fish Audio采用的技术路线支持零样本(Zero-shot)语音克隆,即只需少量参考音频即可复制特定音色83% 相似待验证Fish Audio是一款基于深度学习的文本转语音(TTS)服务,支持多种音色克隆和自然语音合成77% 相似待验证博主使用了名为「Fish Speech S2 Pro」的本地TTS模型来克隆真人声音为桌面宠物配音74% 相似已验证现代零样本或少样本声音克隆技术仅需几秒到几分钟的参考音频,就能生成高度逼真的目标说话人语音73% 相似待验证语音克隆技术底层通常分为说话人自适应(Speaker Adaptation)和零样本克隆(Zero-shot Voice Cloning)两类路径68% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/25994API
curl https://kongchang.com/api/v1/knowledge/claims/25994MCP
get_claim(id=25994)