#推理能力
共 2 篇相关文章

·5 分钟
Reflective Recovery:让大模型从错误中学会自我纠错
arXiv 论文提出 Reflective Recovery 自监督方法,将大模型失败的推理轨迹转化为恢复训练数据,教会 LLM 自我纠错,突破 Scaling Collapse 瓶颈,在 AIME、Minerva 等基准上显著提升准确率。
阅读全文 →
科技前沿·8 分钟
DeepSeek V3.2发布:推理比肩GPT-5,首创思考融入工具调用
DeepSeek V3.2正式发布并开源,推理能力比肩GPT-5,仅次于Gemini 3.0 Pro。首创将深度思考融入工具调用,智能体能力达开源最高水平,长思考版本DeepSeek V3.2 Specialty斩获IMO 2025金牌。
阅读全文 →