共 39 篇相关文章

深入分析开源权重模型的核心争论:模型权重公开发布带来透明度与创新,但也引发安全滥用风险。本文探讨分级发布、红队测试等折中方案,解读开源AI背后的行业博弈与治理挑战。

Poolside沉寂18个月后发布Laguna开放权重模型,以1180亿参数挑战Moonshot Kimi K3的2.8万亿参数。前OpenAI、GitHub高管纷纷入局开源赛道,硅谷能否缩小与中国AI模型的差距?深度解析这场不对称竞赛。

顶级AI大语言模型能写代码、通过专业考试,却连一张准确的图表都画不出来。本文深入剖析AI在图表生成上频频翻车的根本原因,揭示大模型智能不均衡的真相,并给出人机协作的实践建议。

Reddit社区曝光Gemini 3.6 Flash模型,标题中frontier一词暗示谷歌DeepMind正将前沿能力下放至轻量Flash分支。本文解析版本号逻辑、Flash系列定位及其对AI行业竞争格局的影响。

xAI Grok 4.5已登陆Cursor编辑器,全套餐免费可用。本文详解开启方式、基准测试表现、Token成本对比,以及与主力模型混搭的实用策略,帮你最大化这一免费窗口的价值。

OpenAI发布GPT-5.6家族,推出Sol、Terra、Luna三款分级模型,配合ChatGPT Work执行环境,AI正式从「聊天回答」跃迁至「多智能体协同工作流」,直接操作本地文件与业务系统,重塑生产力底层逻辑。

Anthropic Claude Code Artifacts正式面向Pro/Max用户开放,支持生成交互式网页并实时部署。本文盘点AI Agent最新动态:阿宝公测、字节EdgeBench评测、微软Frontier Company成立,及OpenAI、Anthropic的算力布局。

阿里Qwen新旗舰、DeepSeek V4 GA、智谱GLM下一代模型几乎同步进入测试阶段。本文梳理三条产品线的最新技术信号,并深度分析DeepSeek疑似蒸馏专有模型Fable 5的争议,探讨国产大模型竞速背后的行业走向。

OpenAI发布GPT-5.6再次拉高前沿模型预期,Anthropic随即延长Fable 5可用期;与此同时,数据中心电力瓶颈浮现、开源模型GLM5.2逼近顶级闭源、AI工程评审负担被忽视——本文梳理当前AI行业最值得关注的四大信号。

AI圈24小时重磅动态:DeepSeek V4 Flash正式版即将推出,原生支持视觉能力;OpenAI承认GPT-5.6-Soul推理预算被下调;Anthropic重开Fable 5留住用户;字节跳动C-Dance 2.5支持3分钟4K视频生成。一文梳理最新AI行业动向。

吴恩达《AI for Everyone》课程精华解读:厘清ANI与AGI的本质区别,破除AI炒作与恐慌,了解深度学习如何驱动各行业变革,帮助非技术人群建立理性的AI认知框架。

OpenAI发布GPT-5.6模型家族,推出面向企业的ChatGPT Work、一键建站的ChatGPT Sites及大幅升级的桌面客户端,编程能力反超竞品。同期Meta、Google、Kimi密集跟进,AI生态整合竞争全面提速。

Databricks在百万行生产级代码库上对主流编程Agent进行系统测试,揭示Token单价误导成本判断、开源模型GLM 5.2可挑战高难任务、Harness框架决定实际表现等关键发现,为企业AI编程工具选型提供实战参考。

GLM-5.2凭借74.4分的Frontiers-WE成绩超越GPT-5.5,跻身开源权重模型编程能力第一。MIT开源许可支持本地部署,Vercel CEO公开背书,开源与闭源旗舰的差距正在快速收窄。

OpenAI前沿评估团队负责人Tejal Patwardhan深度揭示:AI模型能力被系统性低估,推理模型突破沙箱、湿实验室创纪录、AGI Index内部指标……真实进展曲线远比外界认知更陡峭。

OpenAI正式发布GPT-5.6家族,包含Sol旗舰版、Terra平衡版、Luna轻量版三款模型。编码能力刷新行业标杆,90分钟可生成Minecraft克隆版。同时OpenAI首次公开反对美国政府对模型发布的限制,前沿AI监管时代正式来临。

AI编程助手Devin正式支持Kimi K2.7与GLM 5.2两款大模型,桌面端与CLI双端可用。7月5日前Pro、Max及Teams用户使用两款新模型不消耗任何配额,结合FrontierCode Extended强劲评测表现,是团队评估AI编程工具的绝佳窗口。

惠普(HP Inc.)与OpenAI建立「Frontier」战略合作伙伴关系,将生成式AI部署至客户体验、软件开发与企业运营三大核心领域。本文深度解析合作背后的转型逻辑及对PC行业的深远影响。

OpenAI首席财务官Sarah Fryer在All-In Podcast深度访谈中,就1220亿美元融资逻辑、IPO时间表、与Anthropic的战略差异、算力短缺危机及与Jony Ive合作的神秘新硬件展开坦率讨论,揭示OpenAI的长期战略布局。

一位开发者在X平台质疑AI编程助手Fable被大幅削弱,发现系统将4-10倍token路由至Opus模型,Fable仅完成约20%工作量。本文深度解析多模型路由机制、透明度痛点及AI工具信任危机背后的行业趋势。