共 45 篇相关文章

腾讯开源推理模型混元HY3(Hunyuan 3)深度解析:MoE架构、2950亿总参数、Apache 2.0商用许可,编程与前端表现媲美DeepSeek V4 Pro,成本仅为专有模型的1/35。多方实测数据全面解读。

腾讯混元Hy3正式发布,295B参数MoE架构,激活仅21B,支持256K超长上下文。幻觉率从12.5%降至5.4%,MRCR得分近乎翻倍,内置MTP与EAGLE投机解码,SGLang Day-0即可部署。本文深度拆解其四大核心亮点与Agent-first定位。

腾讯正式开源混元3(Hunyuan V3),295B MoE架构、21B激活参数,官方宣称超越DeepSeek-V4-Pro。支持FP8量化、vLLM/SGLang部署,但256K上下文与不支持多模态成为核心短板。本文深度解析其架构特性、横向对比与实际部署方案。

腾讯混元HY3正式版正式开源,API定价低至1元/百万tokens输入,在Agent、推理、编码及长上下文领域显著提升,以Apache 2.0协议发布。同日美团开源万亿参数模型LongCat 2.0,首个在5万张国产算力卡上完成推理的万亿模型。

Vibe Coding遭遇天花板?本文深度解析AI编程三段式进阶路径,涵盖Claude Code、Codex工具选型、SuperPower规范驱动开发(SDD),以及从氛围编程走向企业级工程化的完整方法论,助你跨越屎山代码困境。

DeepSeek V4本月即将发布,Flash版或超越同级最强开源模型HY3,并首次支持原生视觉;OpenAI承认悄悄下调GPT-5.6推理预算;Anthropic延长Fable 5访问权限应对GPT-6竞争;字节Seedance 2.5支持180秒4K视频生成——AI竞争持续白热化。

国内31家企业联合签署首个智能体隐私自律公约,涵盖静默读屏物理授权、禁止隐私数据商业训练、自主付款资金红线三大核心条款。本文同步梳理国产大模型首次中立平台登顶、算力军备加速、开源生态效率优化等最新动态,解读AI智能体商业化落地的机遇与阵痛。

零基础理解AI大模型:厘清人工智能、机器学习、深度学习与大语言模型的关系,梳理从深蓝到ChatGPT、DeepSeek的演进脉络,盘点通义千问、智谱、文心一言等国产大模型竞争格局,助你快速入门大模型应用开发。

开发者将腾讯Hunyuan3D模型移植至Apple MLX框架,M4 Max实测形状生成仅需20秒、峰值内存5.6GB,量化后甚至可在iPhone运行。Modelr开源应用支持实时流式可视化,是首个专为Apple Silicon打造的本地图生3D桌面工具。

深度横评开源模型Trellis 2、混元2.1、UltraShape与付费产品Tripo 3.1、Hi3D,从几何结构、纹理质量到复杂细节全面对比,帮你判断本地运行的开源3D生成器是否值得替代付费方案。

OpenAI GPT-5.6携Sawa、Terra、Luna三款子模型上线,马斯克Grok 4.5同日开放,Anthropic、Meta、英伟达等巨头同步出招。本周AI旗舰模型密集发布,算力自主、多模态与音频统一模型三大趋势同步升温,开发者工具生态持续完善。

深入解析LangChain框架核心价值:大模型三大局限、统一模型接口、模块化架构设计,手把手配置DeepSeek API,理解SystemMessage/HumanMessage/AIMessage/ToolMessage消息体系,为Agent智能体开发打下基础。

从大模型三大局限切入,系统讲解LangChain框架的核心定位、环境配置、API密钥准备、模型初始化与消息体系。掌握init_chat_model通用调用方式,理解AIMessage/HumanMessage/SystemMessage机制,为构建Agent智能体打好基础。

基于真实私有化部署实测,对比DeepSeek、千问3、智谱GLM、Kimi K2、MiniMax M3、腾讯混元3六款开源大模型的硬件成本、推理效率与落地难度,帮助企业找到最匹配的内网部署方案。

真实调试案例:面对400MB源码、4万文件导致的程序崩溃循环,MiniMax M3、DeepSeek、混元等国产模型全部给出错误方向,而GPT-5.4 mini经过深度推理成功定位根因。深度解析跑分与实战能力的鸿沟。

系统讲解Coze(扣子)智能体搭建平台的核心定位、与Dify/n8n等工具的区别,以及Agent、工作流、多Agent模式的完整能力体系,帮助零基础开发者快速上手智能体开发。

腾讯混元与清华联合发布DiscoBench,首个专门评测搜索代理动态歧义澄清能力的基准测试集。覆盖11个领域463个歧义实例,揭示主流大模型在主动提问上的真实短板与改进方向。

从零掌握LangChain框架核心用法:解析大模型三大局限,讲解init_chat_model统一接口配置、Message消息类型体系,以及从LLM调用迈向Agent智能体开发的完整路径,适合Python AI应用开发者入门参考。

华为开源模型盘古2.0 Flash参加大模型高考评测,92B MoE架构获得613分,排名第33。本文深度解析其稳定性隐患、不到一元的超低推理成本,以及作文双模型交叉打分机制,帮助企业评估国产开源大模型选型价值。

OpenAI顶配模型将集成至Codex编程环境,在Cerebras晶圆级芯片上实现750 Token/秒推理速度。本文深度解析MoE架构原理、订阅体系调整动向,以及腾讯混元、Longcat 2.0等开源模型的同步突破,帮助开发者把握AI编程工具的选择策略。