共 1430 篇相关文章

DeepSeek V4正式版即将发布,V4 Pro版本参数量达1.6万亿,支持百万字上下文处理。本文解析D-SPARK推理加速框架、风骨定价策略及V4从对话工具到生产级应用的技术跃升。

详解DeepSeek-OCR从vLLM推理部署、Unsloth模型加载到微调训练的完整流程,涵盖云服务器环境配置、显卡选择、代码调用等关键步骤,一张4090显卡即可跑通全链路。

解读DeepSeek创始人梁文峰罕见对话记录,深入分析DeepSeek以愿景驱动团队、战略克制聚焦AGI、坚持开源的核心哲学,以及这套理念对中美AI竞争格局的深层意义。

英伟达CEO黄仁勋公开为AI开源模型辩护,称知识蒸馏是合法学习方式而非抄袭,高度评价DeepSeek和Kimi等中国模型。联合微软、Meta等20多家企业发公开信支持开源AI,OpenAI和谷歌缺席。深度解析黄仁勋力挺开源背后的技术信念与商业逻辑。

DeepSeek开源大模型震动硅谷,OpenAI坚守闭源阵营,微软英伟达Meta力挺开源。深度解析AI开源闭源路线之争、苹果美光芯片博弈及AI历史认知战背后的战略博弈。

DeepSeek完成超500亿融资,估值突破3500亿。创始人梁文锋深度阐述为何将团队稳定视为唯一核心利益,揭示DeepSeek留住顶尖AI人才的管理哲学与通往AGI的独特战略逻辑。

英伟达CEO黄仁勋公开表态称市场两次误解了DeepSeek和Kimi的影响,认为中国开源模型不会削弱算力需求,反而会通过降低门槛催生更多AI应用,最终放大整体算力消耗。

从零掌握DeepSeek-OCR部署与微调全流程:涵盖vLLM推理引擎部署、Unsloth高效微调、数据集预处理、LoRA训练、效果验证及RAG向量数据库集成,为开发者提供可落地的大模型定制化实战路径。

阿里Qwen下一代、DeepSeek V4 GA、智谱GLM新版几乎同步逼近发布节点。本文梳理三大国产大模型最新进展、实测表现及蒸馏争议,带你抢先了解国产AI新旗舰的核心信息。

DeepSeek联合北京大学开源推理加速技术DSpark,在高并发场景下单用户生成速度提升57%~85%。本文详解DSpark三大核心设计:半自回归草稿、置信度评分与自适应调度器,以及配套开源框架DSpec的完整内容。

DeepSeek V4正式版预计7月中旬发布,引入峰谷定价机制;美团开源万亿参数MoE模型LongCat 2.0,支持百万token上下文;Cursor推出iOS应用,AI编程工具进入移动化时代。一文速览AI行业最新动态。

DeepSeek创始人梁文锋在四小时深度对话中,揭示了从思维链到具身智能的AGI五步路线图。在仅两万张GPU算力约束下,如何用TileLang编译器破解国产替代难题,API现金流如何为AGI探索托底?本文梳理这套克制而自洽的战略逻辑。

Rocky是一款极简透明的开源编程智能体,核心Loop仅几百行Python代码,原生集成DeepSeek搜索与Research模式,内置SWE基准测试环境,适合学习Coding Agent原理、文献调研与可复现的Agent实验。

DeepSeek创始人梁文锋4小时闭门会完整解读:无KPI管理、只赚合理利润、最强模型持续开源、持续学习攻克AGI——一份罕见的AI战略自白,揭示克制如何成为核心竞争力。

DeepSeek梁文锋4小时投资者交流会解读:10个月回本的克制定价、开源不影响收入的逻辑、Agent-持续学习-自我迭代的AGI路线图,以及国产芯片、人才与你的护城河。

DeepSeek开源推测解码工具库DeepSpec,生产环境实测推理速度提升60-85%,吞吐量最高提升661%。集成三大算法、九个预训练Checkpoint与九个评测基准,三步即可上手,MIT协议免费商用。

DeepSeek创始人梁文锋在投资者交流会上系统阐述:无KPI的组织文化、10个月回本的定价逻辑、开源长期策略、持续学习突破AGI瓶颈,以及国产芯片一年内生态成熟的预判。

DeepSeek创始人梁文锋在4小时内部投资者对话中,深度分享开源初心、定价逻辑、算力布局与AGI五阶段路线图。解读"只赚10个月回本利润"背后的长期主义经营哲学。

Redis作者antirez开发纯C推理引擎DS4「矮星」,通过不对称量化将DeepSeek V4 Flash从500GB压缩至80.8GB,实现128GB统一内存本地部署,每秒生成26.7个Token。本文深度解析MoE架构优势、三档部署现实与本地大模型的真正门槛。

无ChatGPT账号也能用Codex!本文详解如何通过Codex++管理工具,将DeepSeek、豆包等国产大模型接入Codex,包含Base URL配置、API Key获取、Token充值全流程步骤。