共 31 篇相关文章

Meta Muse Glimmer 30B实测评测,296亿参数稠密模型采用Apache 2.0开源协议,视觉理解能力出色,支持128K上下文,24GB显存即可本地运行。详解基准测试、多模态识别表现与局限。

开发者反馈Ollama Cloud调用GLM模型在OpenCode中频繁随机停止响应,本文分析流式超时、停止符误判等可能原因,并提供调整超时参数、拆分任务等实用解决方案。

解析开发者对Ollama Cloud上线Qwen3-Max的强烈需求,探讨本地推理工具向云端延伸的趋势、中国大模型全球化进程,以及开发者使用Qwen3-Max的实用部署路径。

Unsloth Desktop是一款开源桌面应用,支持Mac/Windows/Linux三平台,集成本地模型训练与推理功能,提供2倍训练加速、70%显存节省,支持GGUF、MLX等格式及Claude Code连接,是本地AI开发的一站式平台。

详解24GB显卡跑本地大语言模型时显存的真实可用量。从模型权重、KV缓存到运行时余量,拆解显存三大消耗桶,提供结构化规划方法和实操建议,帮你避免OOM踩坑。

探索如何利用本地大语言模型(Local LLM)自动将学术论文转换为演示幻灯片,在保护未发表研究数据隐私的同时,大幅提升科研工作者制作PPT的效率。涵盖工具原理、隐私优势及本地AI应用趋势。

LocusTether是一个完全本地化的AI可穿戴替代方案,基于Jetson Thor边缘设备运行Whisper语音转录和Ollama大模型推理,实现零云端依赖的对话记录与摘要生成,真正保障数据隐私安全。

开发者让Mistral、Qwen、Llama等五个不同本地大模型在虚拟小镇Pepperton中自主生活,AI居民自发发明了社交网络、集体阴谋论和判例法体系。开源项目完整复现多智能体社会涌现实验。

Mitra 是一款开源桌面伴侣应用,以可爱动画角色陪伴工作,具备智能反应、健康提醒功能,采用零追踪本地优先架构保护隐私,轻量设计不占资源,支持社区定制扩展。

Vao2是一款开源个人信息聚合器,整合新闻、YouTube、GitHub和RSS订阅到单一信息流,通过Ollama本地AI生成内容摘要,兼顾隐私保护与零成本使用,适合重视数据主权的技术用户。

FluentDB是一款专为Mac打造的AI数据库客户端,支持PostgreSQL、MySQL、SQLite等主流数据库,集成Claude、OpenAI及Ollama本地模型。本文详细评测其AI能力、隐私保护机制与使用体验。

深度解析Project Rai-chan的技术栈实现,涵盖Ollama+Gemma本地大模型、Unity渲染、VOICEVOX语音合成等核心组件,探讨本地AI伴侣在记忆系统、隐私保护与多模态整合方面的技术路径。

Kimi K3与Claude旗舰模型实测对比,涵盖电商页面、3D格斗游戏、飞行模拟器三大任务。Kimi K3以1/8的价格实现90%的输出质量,速度更快且支持本地部署,重新定义AI编程工具性价比。

RX 9060 XT与RTX 5060 Ti同为16GB显存,本地AI推理该选谁?从CUDA生态、ROCm兼容性、LLM推理性能到实际使用体验,全面对比两款显卡在本地AI场景中的优劣与适用人群。

深度分析Ollama Pro $20/月订阅的实际价值,从用量额度、等效API成本、ZDR零数据保留隐私政策三个维度,帮助开发者判断这项编程AI订阅是否划算。

三星芯片部门单年利润预计超过过去40年总和,季度利润同比暴增19倍,超越英伟达成全球最赚钱公司。AI数据中心疯狂抢占HBM与DRAM产能,导致DDR5内存、SSD价格持续攀升,本地大模型玩家硬件成本大幅抬高。

Ollama是一款免费开源的本地大模型管理平台,支持macOS、Windows、Linux和Docker,可轻松部署DeepSeek等开源模型。无需复杂GPU环境配置,支持API与CLI调用,助你零成本构建私有AI应用。

XiaoWu是一款完全本地运行的AI语音输入法,基于本地大语言模型实现高精准语音识别、智能标点添加和极简交互设计。无需联网,保护隐私,支持一键安装,适合高频文字输入场景。

深入解析GitHub Copilot SDK的核心概念与实战用法,涵盖Agent Loop智能体循环、Hooks生命周期控制、Custom Agents编排模式、Skills复用模块及本地模型集成等关键特性,助你快速上手AI应用开发。
产品体验联想ThinkBook 16+搭载AMD R7-H255处理器,售价4799元,定位AI编程与商务办公。本文从处理器性能、价格定位、适用场景等方面分析这款16英寸高性能笔记本的实际表现与购买建议。