[控场AI]
基准

MCP Atlas

MCP Atlas 是一个用于评估大型语言模型在 Model Context Protocol(MCP)相关任务上能力的基准测试。它通过设计一系列标准化测试场景,衡量模型对 MCP 协议的理解、工具调用及上下文管理等核心能力,为不同模型在 MCP 生态中的性能对比提供客观、可重复的评估框架。

时间轴 (近 90 天)

6月1日

MCP Atlas基于Anthropic提出的Model Context Protocol设计,测量模型在标准化工具调用协议下的Agent执行能力

待验证85%

来源文章