共 72 篇相关文章
PrismML突破:270亿参数大模型如何跑进iPhone?
初创公司PrismML将阿里Qwen 3.6大模型从54GB压缩至4GB以内,实现270亿参数全激活在iPhone 17 Pro本地运行。本文解析其压缩技术原理、与苹果稀疏架构的差异,以及端侧AI的商业价值与待验证的关键疑问。

苹果正式起诉OpenAI窃取商业机密,指控渗透"每个层级"。涉案前员工跳槽后利用漏洞下载机密文件,并在苹果内部系统留下自证聊天记录。本文深度解析案件证据、双方胜算与对AI硬件生态的影响。

Gemini Nano端侧AI模型目前语言支持有限,希伯来语、阿拉伯语等RTL语言尚无官方时间表。本文深度解析Gemini Nano多语言支持的技术瓶颈、商业优先级现实,以及未来一两年内的改善预期与实用替代方案。

MELTing Point论文首次以真实用户场景评测手机端大语言模型性能,覆盖iPhone、三星、Pixel等设备,测试TinyLlama、Mistral-7B等模型,揭示GPU推理优势、47度高温警告与prefill-decode分离方案,为边缘侧AI落地提供方法论参考。

大型AI模型依赖稳定云端连接,在弱网、偏远或资源受限场景中力不从心。本文深入解析小型AI模型如何通过离线推理、知识蒸馏与端侧部署,以更低成本、更高可靠性实现AI普惠,覆盖边缘计算、隐私保护等核心优势。

苹果芯片部门高管公开解析Mac Mini在AI开发者中需求激增的原因:统一内存架构突破显存瓶颈、优异能效比支持长时间本地部署,结合苹果端侧AI战略,Mac Mini正成为本地大模型推理的热门选择。

据法国爆料网站Dealabs消息,Google Pixel系列产品或将全面涨价。Pixel Watch 5 41mm版本起售价可能上调至399美元,LTE版本或达499美元,较前代Watch 4涨幅近15%。整个Pixel生态或均受波及,官方定价仍待正式发布确认。

本地大模型工具Ollama完成6500万美元B轮融资,累计融资8800万美元。900万开发者在用,85%财富500强企业内部已部署。本文深度解析企业青睐本地大模型的核心原因:数据合规、Agent降本、开源生态三大驱动力。

当苹果连续两年未能兑现新Siri承诺,外界纷纷质疑:苹果是否已输掉AI竞赛?本文拆解两条AI赛道——软件模型之争与端侧硬件之争,重新审视苹果在AI时代的真实处境与潜在胜算。

谷歌正式确认将在纽约举办Made by Google硬件发布会,新一代Pixel系列手机蓄势待发。新机预计搭载新版Tensor芯片并深度整合Gemini AI能力,端侧AI功能全面升级。本文解读发布时间选择背后的市场信号与Pixel的AI战略布局。

Needle是仅有2600万参数的工具调用专用模型,本文详解如何用Ollama替代Gemini生成训练数据,在单张显卡上完成本地微调,最终实现96.7% F1得分,适合边缘设备与端侧AI部署。

XiaoWu是一款完全本地运行的AI语音输入法,基于本地大语言模型实现高精准语音识别、智能标点添加和极简交互设计。无需联网,保护隐私,支持一键安装,适合高频文字输入场景。

Google发布Gemma 4 12B开源模型,120亿参数即可在16GB显存笔记本上本地运行,采用Apache 2.0协议支持商业使用。Gemma系列累计下载量突破1.5亿次,成为最受欢迎的开源AI模型之一。

印度首富穆克什·安巴尼正将AI深度融入信实集团Jio的电信服务,覆盖超5亿用户。从实时语音翻译到智能家居,解读安巴尼如何通过电信基础设施实现AI民主化,及其对全球AI竞争格局的影响。

苹果正式开放WWDC26开发者调查问卷,邀请全球开发者分享对大会的看法与建议。了解调查背景、今年AI看点及参与方式,把握Apple生态技术趋势。

Google发布Gemma 4 12B开放权重模型,12B参数量级可在笔记本电脑本地运行。本文解析其性能优势、本地部署价值及开源生态竞争格局,助开发者快速上手评估。

华为开发者大会发布盘古大模型2.0全面开源及鸿蒙OS 7系统级Agent能力。本文深度解析盘古2.0稀疏架构效率优势、鸿蒙7端侧30B模型本地运行机制,以及Agent入口争夺背后的流量重构、数据主权与商业模式变局。

Perplexity与Intel达成合作,将本地AI模型和混合推理能力带到Intel Core Ultra Series 3笔记本电脑上。本文解析混合推理架构的优势、Intel NPU算力支撑,以及AI从云端走向终端的行业趋势。