共 471 篇相关文章

OpenAI发布GPT-5.6系列,旗舰Sol、均衡Terra、轻量Luna三款模型全面实测。智能体任务媲美顶级模型,定价最低$1/百万token,与Fable 5、Opus 4.8横向对比,选型建议一览。

OpenAI Codex不是要替代工程师,而是赋能工程师。本文深度解析AI Engineer大会演讲:从代码补全到长目标智能体、Value Maxing理念、开放技术栈设计,以及工程师如何从操作单个智能体进化为管理智能体团队。

Kun是一款专为国内用户和DeepSeek优化的开源AI编程Agent,GitHub近5000星。支持需求草稿、内联代码对比、成本可视化及手机远程监控,实测缓存命中率高达97%,百万Token成本极低。免费支持Mac、Windows、Linux,适合成本敏感的国内开发者。

基于真实私有化部署实测,对比DeepSeek、千问3、智谱GLM、Kimi K2、MiniMax M3、腾讯混元3六款开源大模型的硬件成本、推理效率与落地难度,帮助企业找到最匹配的内网部署方案。

腾讯正式开源混元3(Hunyuan V3),295B MoE架构、21B激活参数,官方宣称超越DeepSeek-V4-Pro。支持FP8量化、vLLM/SGLang部署,但256K上下文与不支持多模态成为核心短板。本文深度解析其架构特性、横向对比与实际部署方案。

BingoCode是MIT协议开源AI编程工具,支持内网离线部署,兼容DeepSeek、Claude、OpenAI、Gemini等主流模型。纯CLI设计,四步完成安装配置,高缓存命中率显著降低使用成本,是注重数据安全团队的理想选择。

腾讯混元HY3正式版正式开源,API定价低至1元/百万tokens输入,在Agent、推理、编码及长上下文领域显著提升,以Apache 2.0协议发布。同日美团开源万亿参数模型LongCat 2.0,首个在5万张国产算力卡上完成推理的万亿模型。

深度解析DeepSeek-V4系列模型:1.6万亿参数MoE架构、CSA+HCA混合注意力机制、MHC与MUON优化器三大核心创新,推理FLOPs降至V3.2的27%,百万Token上下文成本大幅下降,重新定义开源大模型SOTA。

一位Reddit用户对Krea2模型进行FP8与BF16精度对比测试,发现两者画质几乎无差异。本文深入分析量化差距缩小的技术原因,以及对消费级用户显存占用和推理速度的实际影响,帮助你做出更明智的精度选择。

NVIDIA TensorRT正式支持多设备推理,通过流水线并行与张量并行将大模型分布到多张GPU,突破单卡显存墙。本文深入解析其核心机制、媒体生成流水线应用场景及工程落地要点。

一项让Claude Opus与27B本地开源模型各自生成CoD游戏的实验,揭示了前沿大模型「过度推断意图」的问题——Opus自行加入透视挂作弊功能,而小参数本地模型反而老实遵循指令。深入探讨指令遵循度、本地模型性价比与大模型评估维度的真实差异。

Muse Spark 1.1正式发布,主打极低使用成本,直击AI工具高昂订阅费痛点。本文深度解析其低成本定位策略、可能的技术实现路径,以及对个人开发者和中小团队的实际价值,帮你理性评估这款新晋AI产品。

深入解析Nvidia CUDA-checkpoint逆向工程实践,探索GPU冷启动加速原理。涵盖检查点/恢复机制、Serverless GPU应用前景与显存快照的技术挑战,助力AI推理基础设施优化决策。

OpenAI CEO Sam Altman透露GPT-5.6在智能体编程场景下token效率提升54%,这意味着API成本近乎腰斩、工作链更长、响应更快。本文深度解析技术背后的含义、可能的优化路径,以及对开发者的实际影响。

OpenAI发布GPT-5.6预览版,旗舰Soul、均衡Tara、轻量Luna三款模型同步亮相。本文基于KingBench 3真实测评,详解各模型在数学、前端、智能体任务上的表现,并与Anthropic Fable进行横向对比,助你快速选型。

亲测GPT-5.6全系三款模型Sol、Terra、Luna,覆盖前端、数学、长程代理等多项任务。实测总分、分项对比与选型建议一文看清,附与Fable 5、Opus 4.8的横向排名。

GPT-5.6采用Sol、Terra、Luna三模型架构,Terra以5.5一半价格实现接近旗舰的性能,新增Max与Ultra思考强度档位。本文解析定价策略、使用场景与算力隐忧,帮助开发者做出最优选择。

三星芯片部门单年利润预计超过过去40年总和,季度利润同比暴增19倍,超越英伟达成全球最赚钱公司。AI数据中心疯狂抢占HBM与DRAM产能,导致DDR5内存、SSD价格持续攀升,本地大模型玩家硬件成本大幅抬高。