待验证50% 置信权衡取舍精确时间
通过LoRA等参数高效微调方法,恶意行为体仅需少量计算资源和数据即可移除开源模型内置的安全对齐,使得在模型层面防止滥用对开源生态几乎完全失效
1
来源数
50%
置信度
长期有效
时效性
2026/8/27
首次发现
来源
涉及实体
相关事实
引用此条事实
Stable URI
https://kongchang.com/claim/810395API
curl https://kongchang.com/api/v1/knowledge/claims/810395MCP
get_claim(id=810395)