[控场AI]
公司

METR

METR(Model Evaluation & Threat Research)是一家专注于人工智能安全评估的独立非营利研究机构,致力于开发评估框架和基准测试方法,对AI系统(尤其是AI Agent)的能力边界与潜在风险进行系统性评估。其核心工作包括构建标准化测试任务集、评估前沿AI模型的自主行动能力,以及为AI开发者和政策制定者提供安全性参考依据。

来源文章