待验证70% 置信事实时间未知
Kimi-2.5是月之暗面(Moonshot AI)推出的强化学习推理模型,是国内首批明确以强化学习推理为核心训练范式的模型之一
1
来源数
70%
置信度
长期有效
时效性
2026/6/1
首次发现
来源
Swarm IDE:开源多智能体协作开发环境,1500 Star的Agent编排利器
githubchmod777john
涉及实体
相关事实
待验证Kimi-K2-Thinking采用了强化学习(RL)训练范式来增强推理能力79% 相似已验证David Ha与Schmidhuber在2018年发表了论文《World Models》,展示了智能体如何在梦境中完成强化学习训练60% 相似待验证Wondering 是一款AI学习工具,其Slogan为「Duolingo for learning anything」,试图把游戏化、碎片化的学习范式复制到任何知识的学习上59% 相似待验证Unsloth是由Daniel和Michael Han兄弟创立的开源项目,专注于大模型的训练加速和推理优化58% 相似待验证任务路由的思想根源可追溯到早期专家系统和集成学习中的模型选择与混合专家(MoE)机制58% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/29582API
curl https://kongchang.com/api/v1/knowledge/claims/29582MCP
get_claim(id=29582)