共 3 篇相关文章

Opus 5 据称在 KernelBench GPU kernel 生成基准上取得碾压性成绩,推文暗示内部 Model 2 能力更强。本文解析 KernelBench 评测意义、AI 自动编写高性能计算代码的前景及行业竞争信号。

探讨如何通过合约级验证器验证LLM生成的GPU内核代码正确性,解决AI代码生成中的并行竞态、边界越界等信任问题,构建生成-验证-迭代的自动化工作流。

GLM-5.2疑似进入内部测试,或将正式发布;摩尔线程开源MUSA Coder,首个基于国产GPU全栈训练的代码大模型,27B版本Kernel Bench评测超越Claude Opus;Codex新增邀请机制、夸克高考志愿Agent上线、Google为Anthropic提供350亿美元担保等AI行业动态一览。