共 303 篇相关文章

Ollama是一款免费开源的本地大模型管理平台,支持macOS、Windows、Linux和Docker,可轻松部署DeepSeek等开源模型。无需复杂GPU环境配置,支持API与CLI调用,助你零成本构建私有AI应用。

英伟达不只是GPU芯片巨头,更通过投资与资本回流构建了AI繁荣的闭环生态。本文深度解析英伟达"银行化"商业模式的运作逻辑、潜在系统性风险,以及AI基础设施估值泡沫的隐忧。

Redis之父用纯C引擎将284B参数DeepSeek模型压缩至76GB,在MacBook Pro上实现每秒26Token的本地推理。本文拆解MoE架构、非对称量化技术原理,直面硬件门槛与质量代价,厘清本地AI推理的真实边界。

AMD显卡用户跑本地大模型屡遭黑屏掉卡?本文复盘Ollama三大致命痛点,详解迁移至LM Studio后token速度从5提升至36的完整方案,含ROCm配置、投机采样开启及GFX版本避坑指南。

Ollama是GitHub上超175K Star的开源本地大模型运行工具,基于Go语言开发,支持Llama、Mistral、Qwen等主流模型,三步即可完成本地部署,开箱即用,适合开发者与AI爱好者快速上手本地LLM推理。

云端AI随用随取,为何银行、医院仍要自建Local AI?本文深度解析本地大模型私有化部署的核心驱动力、完整技术栈(Ollama、RAG、向量数据库),以及知识问答、合规审查等落地场景,帮你看清企业级AI部署的必然趋势。

本文通过词云工具实战案例,详解如何用Dify工作流结合MCP协议打造企业级AI应用。涵盖工具引入、参数传递、代码执行全链路,以及MCP版本兼容性避坑指南,助力团队快速落地智能副驾解决方案。

手把手教你在Windows上通过WSL部署Hermes Agent AI智能体,涵盖Ubuntu安装、MiniMax模型配置、网页界面搭建及微信远程连接全流程,附MiMo免费误区等关键避坑点。

OpenAI与博通联合推出定制AI芯片Jalapeño,专为大语言模型推理场景设计,聚焦性能、效率与规模三大目标。本文深度解析其技术逻辑、战略意图,以及对英伟达和整个AI算力格局的深远影响。

系统讲解如何从零复现GitHub开源项目,涵盖尽职调查(Star/Issues/README)、虚拟环境搭建、依赖安装、脚本解读、断点调试等完整流程,帮助研究生和初级开发者高效跑通别人的代码,少走弯路。

Box2D创造者Erin Catto正式发布开源3D物理引擎Box3D,融合Box2D成熟架构与Valve Rubikon商业级技术,支持跨平台确定性仿真与SIMD加速接触求解,为游戏开发和实时仿真提供高性能新选择。

面向零基础学习者的Python系统学习路径解析,涵盖基础语法、面向对象编程、爬虫实战、自动化办公与数据分析,附学习方法论与配套资源建议,助你高效入门Python编程。

深度实测Qwythos-9B开源模型,基于5亿条Claude推理数据蒸馏训练,支持104万Token上下文、无审查限制,最低4GB显存即可本地部署。包含LlamaCPP部署教程、代码生成与多模态能力测试。

详解如何用4块二手RTX 3090 SXM4显卡搭建本地AI推理服务器,通过Llama.cpp和Unsloth IQ量化方案运行GLM-5.2开源模型,实测Token生成速度、GPU利用率及代码生成质量。

详解如何用Ollama+千问3.5-9B+Hormis框架在本地免费部署AI智能体,实现网页抓取、桌面操作、文件管理等功能。涵盖环境配置、上下文扩展、驱动搭建全流程,低配电脑也能运行。

详解Ollama下载安装与使用方法,手把手教你在Windows/Mac/Linux本地部署DeepSeek、Llama等开源大模型,零基础也能轻松上手,数据私有免费使用。

XiaoWu是一款完全本地运行的AI语音输入法,基于本地大语言模型实现高精准语音识别、智能标点添加和极简交互设计。无需联网,保护隐私,支持一键安装,适合高频文字输入场景。

Google Android Bench基准测试显示,开源前沿模型已能解决50%-60%的Android开发任务,Gemma 4等中等规模模型仅需20GB RAM即可本地运行,本地AI辅助Android开发正式成为可行方案。