共 183 篇相关文章

OpenAI推出的Codex Plugin for Claude Code,让Claude Code负责编写、Codex独立审查,实现双Agent分工协作。本文解析其三组核心功能入口、使用前提与成本口径,帮你判断是否适合引入这一工作流。

OpenAI发布GPT-5.6家族,推出Sol、Terra、Luna三款分级模型,配合ChatGPT Work执行环境,AI正式从「聊天回答」跃迁至「多智能体协同工作流」,直接操作本地文件与业务系统,重塑生产力底层逻辑。
GitHub趋势·07月23日:蜂巢通信平台与隐私工具双爆发
今日GitHub新上榜6个项目深度解读

本期AI日报聚焦五大板块:DeepSeek V4疑似开启灰度测试,思维链质量显著提升;马斯克预告Grok 4.6与5.0下周开测,参数规模达2万亿;上海AI实验室Intern-S2开源模型击败Claude Opus 4.8;xAI建成2000MW级Colossus训练集群;英伟达RoboTTT突破机器人长时程操作瓶颈。

Moonshot AI的Kimi K3发布即登顶开源模型榜单,K3.1随即预热;Grok 4.6即将完成2万亿参数训练;DeepSeek新模型灰度测试;Anthropic订阅策略反复调整。本文梳理AI领域关键动向,解析开源与闭源系统的差距为何正在快速缩小。
Grok-4.5越狱事件深析:AI安全护栏为何难以守住
一则关于Grok-4.5被越狱的声明在社交平台引发热议。本文拆解越狱(Jailbreak)的常见技术手段,深入分析AI安全对齐机制的结构性脆弱点,并探讨行业应对策略,帮助读者理性看待AI安全风险。

AI正在彻底改变软件测试工作流。本文深度解析Cursor Skills、Coze智能体、LangChain多智能体三大实战方案,涵盖测试用例自动生成、BDD场景建模、多智能体评审系统等核心场景,帮助测试工程师从执行者升级为测试架构师。

OpenAI发布GPT-5.6模型家族(Sol/Terra/Luna)及ChatGPT Work、全新桌面应用与Hosted Sites。AI定位从"回答问题"转向"完成任务",支持本地操作、跨源整合与长周期自主执行,正式进入工作伙伴时代。

OpenAI发布GPT-5.6系列三款模型(Soul/Terra/Luna),主打高效低成本,Agent测试领先Claude 13分,成本仅对手四分之一。同步推出ChatGPT Work超级应用,全面对标Anthropic,本文深度解读核心亮点与竞争格局。

Anthropic推出Project Glass Wing(玻璃翼计划),Mythos Preview模型数小时内发现超万个关键基础设施高危漏洞,覆盖150家机构、15国。本文深度解析AI安全审计五大产业风口,以及中国如何应对这场算力驱动的安全竞赛。

实测对比Fable 5、DeepSeek V4 Flash、GLM 5.2、Qwen 3.6等多款AI模型构建销售CRM系统:最贵模型花费27.69美元,最便宜仅需30美分。深度解析开源大模型的编程能力与性价比,助你找到最优AI编程工具选型方案。

全面解析GPT-5.6系列:Sol/Terra/Luna三档产品线定位、MoE混合专家架构、150万Token超长上下文、编程智能体能力评测,以及从Chatbot到Agent的产业范式转变,助你掌握大模型效率竞争时代的核心趋势。

Hermes智能体迎来重大版本升级,一次带来八项功能更新:原生iMessage接入、后台子智能体并行、Unreal Engine MCP支持、技能中心自我进化等。本文基于实测演示,梳理核心变化及对个人AI自动化工作流的实际影响。

深度对比Arize、Braintrust、Confident AI、Langfuse、LangSmith五大AI评估工具,从治理能力、框架锁定、评估vs监控三大维度,帮助企业找到最适合自身规模与技术现状的选型方案。

OpenAI正式发布GPT-5.6,推出Sol、Terra、Luna三档模型家族,旗舰款Sol编程基准超越Claude同级产品,速度快一倍、成本低三分之一。本文详解三档定价、编程式工具调用新能力及ChatGPT Work等配套产品。

OpenAI发布GPT-5.6模型家族,推出面向企业的ChatGPT Work、一键建站的ChatGPT Sites及大幅升级的桌面客户端,编程能力反超竞品。同期Meta、Google、Kimi密集跟进,AI生态整合竞争全面提速。

OpenAI发布GPT-5.6模型家族(Sol/Terra/Luna)及ChatGPT Work,支持自动化财务分析、本地文件操作、Codex编程与跨应用工作流,AI从问答工具正式迈向真实工作伙伴。
Claude Mythos预览版漏洞激增:大模型安全性如何保障?
Claude Mythos Preview发布后严重安全漏洞数量骤增,引发安全研究者广泛关注。本文深度解析新模型快速迭代与安全审查的矛盾,探讨大模型攻击面扩大的深层挑战,并为企业开发者提供实用防御策略。

微软Power Platform MVP演示如何借助MCP(Model Context Protocol)将Power Apps业务数据安全暴露给M365 Copilot。涵盖声明式智能体创建、自定义工具开发、VS Code配置全流程,助力企业实现低代码与AI智能体的深度融合。

OpenAI一次性发布GPT-5.6 Sol、Terra、Luna三款模型,覆盖旗舰推理到轻量快速全场景。本文详解三款模型的定位、性能差异、定价策略,以及多智能体协作推理、政府安全审查等行业背后的深层信号。