共 396 篇相关文章

AMD MI355X在运行GLM5.2大模型时实现单节点2626 tokens/秒吞吐量,总拥有成本仅为英伟达Blackwell的一半。本文深度解析这一性价比优势背后的技术逻辑、ROCm生态进展,以及对AI算力市场格局的深远影响。

深入解析如何使用NVIDIA Nsight Systems与Nsight Compute优化神经重建管线。从CPU-GPU同步阻塞到内核级性能剖析,掌握自动驾驶仿真场景下GPU密集型AI管线的系统性优化方法。

Unsloth最新版本一次性带来GLM-5.2全推理级别支持、3倍长上下文能力(单卡q4_0可达20万token)、全新Model Hub及Chat Canvas交互功能,大幅提升本地大模型微调与推理体验。

Unsloth发布v0.1.47-beta版本,这款拥有6.79万Star的开源大模型微调框架,可将Llama、Mistral、Qwen等主流模型微调速度提升2倍以上,显存占用降低约70%,让消费级GPU也能完成高效微调。

AMD Ryzen AI Halo开发套件定价4000美元,搭载128GB统一内存与XDNA 2 NPU,主打本地大模型推理。本文深度解析其架构优势、性能局限、与Mac Studio的对比,以及软件生态挑战,助你判断是否适合你的AI开发需求。

大模型能力已基本定型,AI应用开发成为最大风口。本文为Java程序员指路:无需转Python,掌握LangChain4j、RAG、Function Calling、MCP等技能栈,以航空智能客服为实战案例,解锁Java+AI双重竞争力。

Manticore Search团队通过重构ONNX推理路径,将文本嵌入计算速度提升14倍。本文深度解析批处理、会话复用、零拷贝内存优化与线程调优四大核心手段,为向量检索系统建设提供实践参考。

Gas Town是一款用Go语言开发的开源多智能体工作区管理器,已获超16,000个GitHub Star。本文解析其核心架构、技术选型优势及多智能体协作的典型应用场景,适合关注AI工程化与Agent编排的开发者参考。

Meta在GitHub开源Astryx设计系统,5600+ Stars迅速走红。这个TypeScript项目主打「Agent Ready」,专为AI编程助手优化组件结构,有效解决AI生成UI代码时的幻觉问题,重塑前端开发工具链新范式。

深入解析Harness架构——新一代智能体(Agent)设计范式。涵盖Harness与提示词工程、上下文工程的演进关系,多Agent协同、沙箱安全、反馈回路等核心组件,助力大模型应用开发工程师提升面试竞争力。
GitHub趋势·第3期:AI Agent技能包开源爆发
每周一盘点GitHub本周热门项目,深度解读用法和场景
GitHub趋势·第2期:Agent技能包生态爆发
每周一盘点GitHub本周热门项目,深度解读用法和场景

深入解析神经渲染代理(Neural Render Proxies)技术:如何用神经网络替代高成本光照计算,实现实时交互、逆向渲染与端到端可微分优化,及其在游戏、数字孪生、NeRF等领域的应用价值。

英伟达不只是GPU芯片巨头,更通过投资与资本回流构建了AI繁荣的闭环生态。本文深度解析英伟达"银行化"商业模式的运作逻辑、潜在系统性风险,以及AI基础设施估值泡沫的隐忧。

Redis之父用纯C引擎将284B参数DeepSeek模型压缩至76GB,在MacBook Pro上实现每秒26Token的本地推理。本文拆解MoE架构、非对称量化技术原理,直面硬件门槛与质量代价,厘清本地AI推理的真实边界。

零基础如何学习大模型?本文梳理三类人群的差异化学习路线、硬件配置建议(16G内存即可起步)、Python语言准备及云服务算力方案,帮你建立科学的AI学习认知框架,避免走弯路。

球迷必看!基于AIPC本地算力的「爱看球Agent」实测体验:自动预约直播、后台录制分析、智能提取高光片段,几分钟看完整场比赛精华。深度解析本地AI处理方案如何颠覆传统观赛方式。

AMD显卡用户跑本地大模型屡遭黑屏掉卡?本文复盘Ollama三大致命痛点,详解迁移至LM Studio后token速度从5提升至36的完整方案,含ROCm配置、投机采样开启及GFX版本避坑指南。