待验证85% 置信决策规则时间未知
中文垂直场景(医疗/法律/金融)应选支持热词/自学习模型的API,通用模型在专业术语上识别率可能骤降10-20个百分点,热词功能可显著挽回准确率
1
来源数
85%
置信度
长期有效
时效性
-
首次发现
来源
涉及实体
相关事实
部分验证2023年斯坦福大学Nelson Liu等人的研究发现,当关键信息被放置在长上下文的中间位置时,模型性能可下降超过20%65% 相似待验证斯坦福大学2023年发布的Lost in the Middle研究(Liu et al.)显示,当关键信息位于上下文中间段时,模型检索准确率相比头部和尾部下降约20-30个百分点,且在上下文超过32K token时尤为显著61% 相似待验证普通话通用场景识别准确率≥95%已是主流水平,选购时应重点看专业领域/口音/多人会议等复杂场景的实测准确率,官方宣称的98%通常是标准朗读环境数据60% 相似待验证在公开的中文医疗ASR基准测试中通用模型的医疗术语召回率通常在70%-85%之间60% 相似待验证Anthropic的研究表明,即便温和的对齐训练也会导致模型在某些推理密集型任务上下降2-8个百分点60% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/475688API
curl https://kongchang.com/api/v1/knowledge/claims/475688MCP
get_claim(id=475688)