共 203 篇相关文章

深度对比Claude Sonnet 4.6、GPT-5.1 Codex和DeepSeek-R1三大编程AI模型,从API价格、SWE-Bench Verified解决率等维度进行实测横评,帮助开发者选择最适合的AI编程助手。
行业洞察AMD Instinct MI355X通过SGLang+MoRI全栈优化,在DeepSeek-R1分离式推理中实现TCO比NVIDIA B200低5%,每GPU吞吐量高1.25倍。深度解析MoRI量化通信、KV Cache优化及推测解码等核心技术突破。
深度解读系统梳理LLM推理能力的技术演进路线,涵盖Chain-of-Thought思维链、Tree-of-Thought、OpenAI o1与DeepSeek-R1推理模型的核心原理与差异,解读开源项目Awesome-LLM-Reasoning的研究趋势洞察。

月之暗面发布Kimi K3开源大模型,2.8万亿参数采用混合专家架构,以不到1美元成本登顶全球前端编程竞技场第一名,击败GPT和Claude。详解K3技术架构、性价比优势及全量开源策略。

Kimi 3正式纳入Pro订阅计划,付费用户可直接体验最新旗舰模型。本文解析Kimi 3的能力升级方向、月之暗面的订阅制商业化策略,以及国产大模型竞争格局的变化。

Thinking Machines发布Inkling开源多模态大模型,近万亿参数MoE架构,100万tokens上下文窗口,Apache 2.0协议开源。本文深度解析其技术架构、基准表现、实测体验与定价策略。

解读DeepSeek创始人梁文峰罕见对话记录,深入分析DeepSeek以愿景驱动团队、战略克制聚焦AGI、坚持开源的核心哲学,以及这套理念对中美AI竞争格局的深层意义。

英伟达CEO黄仁勋公开为AI开源模型辩护,称知识蒸馏是合法学习方式而非抄袭,高度评价DeepSeek和Kimi等中国模型。联合微软、Meta等20多家企业发公开信支持开源AI,OpenAI和谷歌缺席。深度解析黄仁勋力挺开源背后的技术信念与商业逻辑。

OpenRouter数据显示中国AI模型已占美国AI消费量58%。DoorDash、Airbnb等硅谷巨头纷纷采用Kimi、DeepSeek、通义千问等中国开源大模型,凭借低价高性能和开源权重优势快速渗透全球市场。

深入对比Codex与Claude Code两大AI智能体编程工具,从AI Agent概念解析、工具选型、成本考量到GPT账号配置,提供完整的新手上手指南,助你快速掌握AI智能体开发工作流。

深度解读月之暗面Kimi-K3技术报告,分析其长上下文处理、MoE架构设计、推理能力提升等核心技术突破,探讨国产大模型在全球AI竞争中的定位与发展趋势。

月之暗面Kimi-K3模型即将在HuggingFace发布,从模型架构、许可协议到社区反应,全面解读这一国产大模型开源事件的战略意义与行业影响。

面对AI风口,Java开发者如何从传统CRUD后端转型为AI应用开发者?本文解析AI+国家战略、中国AI追赶逻辑,并给出夯实Java基础、补齐大模型应用能力的实用转型路径。

DeepSeek创始人梁文锋在四小时深度对话中,揭示了从思维链到具身智能的AGI五步路线图。在仅两万张GPU算力约束下,如何用TileLang编译器破解国产替代难题,API现金流如何为AGI探索托底?本文梳理这套克制而自洽的战略逻辑。

DeepSeek创始人梁文锋4小时闭门会完整解读:无KPI管理、只赚合理利润、最强模型持续开源、持续学习攻克AGI——一份罕见的AI战略自白,揭示克制如何成为核心竞争力。

DeepSeek梁文锋4小时投资者交流会解读:10个月回本的克制定价、开源不影响收入的逻辑、Agent-持续学习-自我迭代的AGI路线图,以及国产芯片、人才与你的护城河。

DeepSeek创始人梁文锋在4小时内部投资者对话中,深度分享开源初心、定价逻辑、算力布局与AGI五阶段路线图。解读"只赚10个月回本利润"背后的长期主义经营哲学。

前沿AI模型正加速走向通用化:成本大幅下降、通用模型在数学推理与竞赛编程中超越专用模型、小型编程任务趋近自动化、多智能体工作流持续进化。本文深度解析这些信号背后的技术逻辑与行业影响。

一位开发者使用Codex的Extra High推理模式处理一个20分钟任务,竟消耗70%配额。本文深度解析AI编程工具的token计费机制、高推理模式的成本放大效应,以及开发者如何合理控制用量。

中国商务部密集磋商是否限制顶尖开源AI模型海外访问,涉及阿里、字节跳动、DeepSeek等头部企业。与此同时,DeepSeek低调研发自有推理芯片近一年,首次开启外部融资约70亿美元。中美AI出口管制镜像博弈加剧,全球开发者面临技术选型新变局。