待验证90% 置信决策规则时间未知
实时流式转写选WebSocket接口,一句话/短语音选REST接口;WebSocket首字延迟通常<300ms,REST整段返回延迟随音频时长线性增长
1
来源数
90%
置信度
长期有效
时效性
-
首次发现
来源
涉及实体
相关事实
待验证相比轮询方案,WebSocket在语音流传输场景下的延迟通常可降低50%以上79% 相似待验证实时转写(边说边出字)对延迟和网络要求高,且准确率通常低于事后上传转写;如果不需要现场看字幕,选事后转写模式准确率更有保障73% 相似待验证选择支持离线唤醒+离线语音指令的机型(如高通4155平台以上),断网或地库场景下识别延迟可控制在500ms内,纯在线方案在弱网时唤醒失败率显著上升70% 相似待验证传统语音AI采用串行管线设计,即VAD→ASR→LLM→TTS四个独立模块依次传递数据,每个环节引入约100-300毫秒延迟,四段叠加总延迟往往超过1秒70% 相似待验证领先水平的实时语音转录延迟约在200-400毫秒,业界主流方案包括OpenAI的Whisper、Google Speech-to-Text和AssemblyAI69% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/475686API
curl https://kongchang.com/api/v1/knowledge/claims/475686MCP
get_claim(id=475686)