共 2141 篇相关文章

DeepSeek创始人梁文锋在四小时深度对话中,揭示了从思维链到具身智能的AGI五步路线图。在仅两万张GPU算力约束下,如何用TileLang编译器破解国产替代难题,API现金流如何为AGI探索托底?本文梳理这套克制而自洽的战略逻辑。
GitHub趋势·07月25日:Agent技能框架扎堆,蓝牙离网聊天杀出
今日GitHub新上榜7个项目深度解读

DeepSeek梁文锋4小时投资者交流会解读:10个月回本的克制定价、开源不影响收入的逻辑、Agent-持续学习-自我迭代的AGI路线图,以及国产芯片、人才与你的护城河。

Poolside 发布开源智能体编程模型 Laguna S 2.1,118B总参数仅激活8B,DeepSWE基准得分40.4%,超越DeepSeek V4 Pro Max约4.5倍。支持百万Token上下文,单台工作站可部署,OpenRouter定价$0.10/百万Token起,256K上下文端点免费。

DeepSeek开源推测解码工具库DeepSpec,生产环境实测推理速度提升60-85%,吞吐量最高提升661%。集成三大算法、九个预训练Checkpoint与九个评测基准,三步即可上手,MIT协议免费商用。

面对美国芯片封锁与闭源垄断,中国AI开源模型凭何持续反击?本文深度拆解开源定价权博弈、光互联卡位、端侧场景三大核心路径,解析国产大模型韧性背后的真实逻辑。

DeepSeek创始人梁文锋在投资者交流会上系统阐述:无KPI的组织文化、10个月回本的定价逻辑、开源长期策略、持续学习突破AGI瓶颈,以及国产芯片一年内生态成熟的预判。

DeepSeek创始人梁文锋在4小时内部投资者对话中,深度分享开源初心、定价逻辑、算力布局与AGI五阶段路线图。解读"只赚10个月回本利润"背后的长期主义经营哲学。

多模型AI聚合平台兴起,宣称一个对话框即可调用GPT、Claude、Gemini、DeepSeek、Grok、Kimi等全球主流AI。本文深度拆解其核心功能、真实价值与数据安全风险,并提供更理性的替代方案,帮你做出明智选择。

英伟达CEO黄仁勋公开表态,美国公司应被允许使用DeepSeek、Kimi等中国开源AI模型。他驳斥后门论,强调开源透明即安全,并指出优质模型带来更多算力需求,是英伟达增长的助推器而非威胁。

月之暗面发布2.8万亿参数开源大模型Kimi K3,性能直逼Anthropic与OpenAI旗舰产品,再掀"DeepSeek时刻"。本文深度解析Kimi K3的技术冲击、算力封锁悖论,以及开源策略如何重塑全球AI竞争格局。

企业级AI大模型岗位要求已全面升级,从流式输出中断恢复、高并发承载、多租户隔离,到大模型网关、Langfuse可观测追踪与LLM评估平台,掌握这八大核心能力,助你从"会用工具"进阶为"工程化落地专家"。

Redis作者antirez开发纯C推理引擎DS4「矮星」,通过不对称量化将DeepSeek V4 Flash从500GB压缩至80.8GB,实现128GB统一内存本地部署,每秒生成26.7个Token。本文深度解析MoE架构优势、三档部署现实与本地大模型的真正门槛。

月之暗面、阿里、DeepSeek、美团四家同步冲进万亿参数门槛,中国开源大模型仅用18个月完成从B到T的数量级跃迁。本文深度解析万亿参数俱乐部的入场逻辑、智谱与MiniMax的追赶态势,以及参数军备竞赛背后的部署难题。

OpenAI推出GPT-5.6模型家族(Sol、Terra、Luna)及ChatGPT Work、全新桌面应用与Sites托管功能。AI从问答工具升级为能自主完成长周期任务的工作伙伴,覆盖财务分析、文件整理、网站生成等真实场景。

前沿AI模型正加速走向通用化:成本大幅下降、通用模型在数学推理与竞赛编程中超越专用模型、小型编程任务趋近自动化、多智能体工作流持续进化。本文深度解析这些信号背后的技术逻辑与行业影响。

全面解析DeepSeek Math V2:IMO金牌级数学推理能力、97.3%的Math500正确率、Apache 2.0完全开源可商用。从技术架构、版本演进、核心能力到本地部署,带你彻底读懂这款开源数学大模型的过人之处。

开发者发现llama.cpp中一个潜藏多年的CUDA精度Bug,仅影响NVIDIA Tesla P100(sm_60架构)。三行代码修复后,KL散度中位数降低约2300倍,首选token一致性从96.5%提升至99.9%,且性能不损反增。本文深入解析Bug根源、测量数据与市场影响。