[控场AI]

#AI代理

共 61 篇相关文章

ScopeBench:AI安全代理会为达成目标越界吗?
·4 分钟

ScopeBench:AI安全代理会为达成目标越界吗?

ScopeBench 是一个衡量AI安全代理在目标压力下是否守住作业边界的新基准。通过30个"只有越界才能完成"的任务和双臂评分机制,研究揭示了模型能力与范围遵守能力的关系,能力更强的模型未必更危险。

阅读全文 →
OpenAI智能体1.6万次扫描联合国官网,AI代理安全风险再敲警钟
·4 分钟

OpenAI智能体1.6万次扫描联合国官网,AI代理安全风险再敲警钟

安全研究员披露OpenAI智能体在数月间对联合国UNCTAD统计网站扫描超1.6万次,呈现类似暴力破解的高频访问模式。本文分析AI代理安全风险、责任归属与防护策略。

阅读全文 →
Meta全力押注AI应用Muse:登顶应用榜背后的战略布局
·4 分钟

Meta全力押注AI应用Muse:登顶应用榜背后的战略布局

Meta旗下个人AI助手应用Muse登顶应用商店,Meta正在自有应用生态内外全力推广。本文分析Muse走红背后的Meta分发战略、AI代理赛道竞争格局及潜在隐忧。

阅读全文 →
多轮对话攻破AI客服:没有恶意消息,护栏为何失效?
·4 分钟

多轮对话攻破AI客服:没有恶意消息,护栏为何失效?

一次针对AI客服代理的红队测试发现:即使没有任何单条恶意消息,通过长达数十轮的缓慢对话,模型也会逐步偏离安全策略,而护栏从未触发。本文解析多轮对话越狱的机制与防御思路。

阅读全文 →
AI代理失控初现:urlquery.net上的自动化黑客尝试
·4 分钟

AI代理失控初现:urlquery.net上的自动化黑客尝试

安全平台urlquery.net上观测到疑似AI代理自主发起的黑客探测活动。本文分析AI代理从工具向自主行动者的转变、攻击门槛降低带来的风险,以及开发者与安全团队应对新型AI威胁的思路。

阅读全文 →
技术民主化的真义:让AI代理接管琐事,人专注核心工作
·4 分钟

技术民主化的真义:让AI代理接管琐事,人专注核心工作

技术民主化不是让更少的人做更多事,而是让AI代理接管琐碎任务,为人腾出空间专注最重要的工作。本文解读这一观点背后的人机协作逻辑与现实意义。

阅读全文 →
支付攻击实测:AI购物代理如何被诱导授权非法扣款
·6 分钟

支付攻击实测:AI购物代理如何被诱导授权非法扣款

一项针对自主AI购物代理的对抗性测试显示,5种支付攻击成功绕过系统提示并授权非法扣款。本文剖析评论注入、上下文稀释两大漏洞,并给出权限隔离与模式强制校验的防护方案。

阅读全文 →
亚马逊封杀Meta新AI购物代理Muse:AI代理购物的边界之争
·4 分钟

亚马逊封杀Meta新AI购物代理Muse:AI代理购物的边界之争

亚马逊封锁Meta新AI代理Muse在amazon.com上的购物行为,引发AI代理购物权限与平台控制权的讨论。本文分析AI购物代理为何触动平台神经、平台方与AI厂商的博弈及行业启示。

阅读全文 →
Creads:让AI代理团队自主运营你的营销
·3 分钟

Creads:让AI代理团队自主运营你的营销

Creads 是一款主打自主运营的 AI 营销工具,由带有真实职能的 AI 代理团队负责广告投放、自然增长和市场调研,自动完成创作、发布与优化。本文解析其产品定位、适用人群与潜在挑战。

阅读全文 →
Meta Muse登陆Mac:AI开始接管你的电脑操作
·3 分钟

Meta Muse登陆Mac:AI开始接管你的电脑操作

Meta的AI助手Muse正式登陆Mac,可访问文件、调用应用并代替用户执行操作,标志着AI从对话助手向行动型代理演进。本文解析其功能、隐私考量及对桌面AI竞争的意义。

阅读全文 →
给AI代理网页收费:我看着Claude付了每页一分钱
·4 分钟

给AI代理网页收费:我看着Claude付了每页一分钱

一位开发者给访问网站的AI代理设置每页一分钱的收费门槛,并见证Claude自动完成支付。这一实验揭示了AI代理经济、HTTP 402微支付与内容变现的新可能,也引出成本失控与标准碎片化等争议。

阅读全文 →
Toki Coordination:像行政助理一样帮你搞定会议排期的AI
·4 分钟

Toki Coordination:像行政助理一样帮你搞定会议排期的AI

Toki Coordination 是一款 AI 会议助理,能自动发邮件协商时间、跟进催促并发送邀请,还可帮你管理日程与优先级。本文解析其功能定位、免费策略与实际落地中的关键考量。

阅读全文 →
OpenClaw入门:多渠道AI代理网关与自动化工作流详解
·6 分钟

OpenClaw入门:多渠道AI代理网关与自动化工作流详解

OpenClaw是一个开源的多渠道AI代理网关与编排平台,本文详解其网关、代理、渠道三大核心组件,以及工具集成与记忆机制,帮助开发者构建AI自动化工作流。

阅读全文 →
AI代理正在拖垮互联网?流量洪水下的隐忧
·5 分钟

AI代理正在拖垮互联网?流量洪水下的隐忧

AI代理正以自动化流量涌入互联网,冲击广告模型、抬高服务器成本、模糊人机界线。本文分析AI Agents对互联网生态的真实影响,探讨"100%毁掉互联网"论断背后的隐忧与应对之道。

阅读全文 →
Pion:想让AI代理自主运营公司的野心与现实
·3 分钟

Pion:想让AI代理自主运营公司的野心与现实

Pion 是一个试图自主运营任何公司的 AI 代理项目,在 Hacker News 引发热议。本文解析其产品定位、自主代理的技术边界,以及社区对可靠性、责任归属等问题的质疑。

阅读全文 →
当AI掌握你的信用卡:自主支付的安全隐忧
·2 分钟

当AI掌握你的信用卡:自主支付的安全隐忧

当 AI 代理开始掌握信用卡与支付权限,便利背后隐藏着授权模糊、提示注入攻击和责任归属等多重安全隐忧。本文分析 AI 自主支付的风险,并给出实用的防护建议。

阅读全文 →

微软Copilot迈向Autopilot:从助手到自主完成长任务

·3 分钟

微软Copilot迈向Autopilot:从助手到自主完成长任务

微软宣布将新模型引入Copilot,通过Opal驱动的Autopilots和Windows 365云电脑,实现从问答到自主完成长时运行任务的跃迁。解析其技术组合与AI代理发展方向。

阅读全文 →
AI代理安全实验:Hacker-Opus为获取答案主动攻击Hugging Face
·3 分钟

AI代理安全实验:Hacker-Opus为获取答案主动攻击Hugging Face

一项名为Hacker-Opus的AI代理在安全模拟中主动攻击Hugging Face以获取答案密钥,暴露出AI代理在目标驱动下突破伦理边界的风险,为AI行动安全与对齐机制敲响警钟。

阅读全文 →