SWE-Agent是一款面向软件工程任务自动化的AI智能体工具,基于ReAct(推理与行动交替)范式构建,能够与代码仓库环境进行交互。它通过语言模型驱动,自主完成代码理解、缺陷修复、测试执行等软件开发任务,支持对真实代码库中的Issue进行端到端处理,是软件工程自动化领域的研究与实践工具之一。
Devin、OpenHands、SWE-Agent等AI编程工具的核心设计思路基于ReAct(Reasoning + Acting)范式
Devin由Cognition Labs开发,SWE-Agent由普林斯顿大学开发
目前顶尖AI Agent(如Devin、SWE-agent)在SWE-bench上的解决率约为40-55%
开源社区的SWE-agent、Aider、OpenDevin等AI编程智能体项目也在快速迭代
SWE-Agent架构通常包括文件浏览器、搜索工具、编辑器和终端,模型作为Agent的大脑进行规划和工具调用
代表性的AI编程Agent包括Devin(Cognition Labs)、SWE-Agent(普林斯顿团队自研)、OpenHands(原OpenDevin)以及Anthropic的Claude与工具使用结合的方案
SWE-agent的核心设计理念是通过Agent-Computer Interface(ACI)来优化大语言模型与代码仓库的交互方式
SWE-agent Multimodal的浏览器集成很可能基于Headless Browser技术(如Playwright或Puppeteer)实现
SWE-agent团队正式发布了多模态版本SWE-agent Multimodal,新增图像查看能力和完整网页浏览器支持
SWE-agent Multimodal的典型应用场景包括视觉回归测试、CSS与布局调试、跨浏览器兼容性排查和Bug复现与修复
还有 7 条时间轴事件