待验证75% 置信事实时间未知
Anthropic分析100万条真实对话后发现,人类提问水平和AI回答水平的相关性系数达到0.92
1
来源数
75%
置信度
长期有效
时效性
2026/6/1
首次发现
来源
AI输出质量与提问水平相关性0.92:判断力才是真正的护城河
bilibili梗直哥丶
涉及实体
相关事实
待验证研究发现强大的LLM在评估开放式问答质量方面与人类评分者的一致性可达80%以上65% 相似待验证使用模糊问题提问平均需要5次来回交流才能解决问题,而使用精确问题(三要素模板)基本一次解决,答案准确率从30%跃升至90%以上65% 相似待验证研究显示复杂代理任务的token消耗往往是等效单次对话的20-100倍64% 相似待验证研究指出消费者对明显由AI生成的客服回复满意度平均比真人回复低20%-30%64% 相似待验证测评维度覆盖越广、题目越多(超过200题)虽显全面,但普通用户答题疲劳会导致后半段随意作答,反而降低数据质量;日常自查选择60-120题、20分钟内可完成的套餐更可靠63% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/20807API
curl https://kongchang.com/api/v1/knowledge/claims/20807MCP
get_claim(id=20807)