待验证50% 置信事实精确时间
2023 年一项学术研究发现在特定提示条件下 Codex 模型约 1% 的输出与训练数据存在逐字匹配
1
来源数
50%
置信度
长期有效
时效性
2026/8/9
首次发现
来源
相关事实
待验证2022年Hoffman等人的Chinchilla论文重新校准了算力最优的参数-数据比例,指出此前许多大模型训练不充分66% 相似待验证2024 年的多项基准测试表明,经过严格安全对齐的模型在代码生成任务上的拒绝率比基座模型高出 15-30%,在创意写作任务上的自我审查率高达 40%65% 相似待验证2023年,研究人员证明只需污染不到1%的训练数据,就能在特定触发条件下改变模型行为65% 相似待验证2024年发表在ACL会议上的一项研究表明,当某一观点在训练数据中出现频率超过对立观点3倍以上时,模型倾向于呈现该观点为'主流共识'65% 相似待验证2024年研究表明即使AI生成内容仅占训练数据的10-20%,在多代训练后也足以引发可测量的质量退化64% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/718420API
curl https://kongchang.com/api/v1/knowledge/claims/718420MCP
get_claim(id=718420)