共 6 篇相关文章

AI浪潮制造新一代科技巨富,算力垄断与技术控制权的集中正重燃百年前反垄断辩论。从镀金时代到算法霸权,探讨私人权力边界、监管路径与公共利益的守护之道。

实测对比4张V100 16G原生PCIe与2张V100 32G SXM转接PCIe方案的推理性能。从预处理速度、输出速度到性价比,深度解析多卡堆叠的功耗墙与带宽瓶颈,帮你找到本地大模型部署的最优解。
非NVIDIA硬件运行CUDA的四大替代方案对比
深度解析在AMD、Intel等非NVIDIA硬件上运行CUDA的主流技术路径,涵盖ROCm/HIP、ZLUDA、SYCL/oneAPI、OpenCL四大方案的原理、适用场景与局限性,帮助开发者突破GPU供应商锁定。

AMD MI355X在运行GLM5.2大模型时实现单节点2626 tokens/秒吞吐量,总拥有成本仅为英伟达Blackwell的一半。本文深度解析这一性价比优势背后的技术逻辑、ROCm生态进展,以及对AI算力市场格局的深远影响。

SpaceX与开源AI实验室Reflection AI达成每月1.5亿美元算力租赁协议,总额超60亿美元。深度解析Colossus 2数据中心、英伟达GB300芯片战略意义及AI算力市场格局变化。

Perplexity与Intel达成合作,将本地AI模型和混合推理能力带到Intel Core Ultra Series 3笔记本电脑上。本文解析混合推理架构的优势、Intel NPU算力支撑,以及AI从云端走向终端的行业趋势。