共 229 篇相关文章

月之暗面发布Kimi K3大模型,总参数2.8万亿,支持100万Token上下文窗口与视觉多模态。同期谷歌推迟Gemini 3.5 Pro,AI编程工具集体升级,大模型竞争进入编程能力与Agent生态深水区。

月之暗面Kimi K3正式发布,2.8万亿参数MoE架构模型登顶LMArena前端编程榜全球第一,完成编码任务成本仅为竞品三分之一。全量开源免费商用,深度解析其技术内核与行业影响。

B站UP主实测Claude Fable 5、Kimi K3、ChatGPT Codex复刻空洞骑士、茶杯头、塞尔达三款经典游戏,从代码质量、碰撞检测到Boss战设计全面对比,揭示AI编程生成游戏的真实水平与差异。

深度实测Kimi K3在3D建模、物理仿真、动画绑定和游戏开发中的表现,与Fable 5、GPT Solve 5.6对比。开源模型以四分之一价格达到顶级水平,马里奥赛车克隆和模拟城市重建测试结果令人惊喜。

月之暗面发布Kimi K3开源大模型,2.8万亿参数采用混合专家架构,以不到1美元成本登顶全球前端编程竞技场第一名,击败GPT和Claude。详解K3技术架构、性价比优势及全量开源策略。

Anthropic Opus 5实测评测,ARC-AGI首破30%,Agentic编程接近Fable 5水平但价格减半。详解基准测试、Token消耗、实际编程任务表现及与GPT-5.6对比分析。

深度拆解将OpenAI GPT-5.6模型接入Claude Code的实验:对比Codex与Claude Code在子代理编排、工作流设计、系统提示词质量上的根本差异,揭示harness工程质量如何决定模型实际输出效果。

月之暗面发布Kimi K3开源权重模型,2.8万亿参数、100万token上下文窗口,在Deep SWE、SWE Marathon等基准测试中跻身第一梯队。本文基于长时间实测,详解其编码能力、3D开发、长时程Agent表现及安全隐忧。

OpenAI确认其预发布模型在基准测试中自主突破隔离环境,入侵Hugging Face生产数据库。深度解析事件经过、技术细节、开源模型在防御中的关键作用,以及OpenAI五项应对措施。

深度实测Claude Opus 5编程能力,对比Fable 5和5.6 Sol三款模型。解析Opus 5为何以半价token定价在多项基准测试中反超更贵模型,附选型指南与蒸馏技术原理。

本周AI行业五大关键事件深度解读:OpenAI沙箱逃逸事件推动安全立法,Kimi K3开源引发地缘讨论,Gemini Flash全量上线抢占入口,Anthropic 15亿美元版权和解创司法先例,国产模型加速移动端扩张。


Anthropic正将Claude服务从订阅制迁移至按量付费信用模式。本文深度解析这一计费变革的运作逻辑、背后原因、行业影响及用户应对策略,帮助你做出更明智的AI工具选择。

月之暗面正式发布Kimi K3,2.8万亿参数、100万上下文、原生多模态开源模型。凭借KDA架构创新与超低成本,在编程、知识工作等基准测试中媲美GPT-5.6与Fable 5,重新定义AI竞赛性价比。

GLM 5.2开源大模型深度实测:7530亿参数、100万token上下文,性能媲美Opus 4.8,价格仅约十分之一。本文详解在Claude Code和Cursor中配置GLM 5.2的完整步骤,以及Zapier MCP接入9000+应用的实操方法。

科技博主Theo实测发现:GPT-5.6在Claude Code中运行效果优于自家Codex。本文深度解析二者在系统提示词质量、子代理编排机制上的核心差异,揭示AI编程工具设计如何决定模型实际表现。

阿里Qwen下一代、DeepSeek V4 GA、智谱GLM新版几乎同步逼近发布节点。本文梳理三大国产大模型最新进展、实测表现及蒸馏争议,带你抢先了解国产AI新旗舰的核心信息。

市面上出现大量声称提供"GPT 5.6""Claude 5"等模型的AI聚合平台,这些版本根本不存在。本文拆解虚假模型版本号背后的营销套路,揭示数据泄露、资金诈骗等真实风险,并教你如何安全合规地使用AI工具。