共 205 篇相关文章

Unsloth v0.1.45-beta正式发布,带来Gemma 4多token预测(MTP)完整支持、AMD ROCm与NVIDIA Blackwell硬件适配、全新Hub下载管理器与紧凑型RAG系统,助力本地大模型微调与推理提速。

Unsloth v0.1.46-beta正式发布,核心变更聚焦DiffusionGemma:默认禁用工具调用、启用artifacts画布。本文深度解析此次更新背后的产品逻辑与扩散语言模型的发展趋势,适合LLM微调开发者参考。

Unsloth最新版本v0.1.464-beta新增DiffusionGemma、Gemma 4 MTP和MiniMax-M3支持,推理速度提升约2倍。同时带来全新Hub页面、文档RAG问答、张量并行优化及Cloudflare加密隧道,覆盖CUDA/ROCm/Windows全平台。

Google发布Gemma 4 12B开源模型,120亿参数即可在16GB显存笔记本上本地运行,采用Apache 2.0协议支持商业使用。Gemma系列累计下载量突破1.5亿次,成为最受欢迎的开源AI模型之一。

Google推出DiffusionGemma文本扩散语言模型,推理速度达Gemma 4系列的4倍。本文解析文本扩散技术原理、4倍速度提升的实际意义,以及这一架构创新对AI行业的深远影响。

谷歌发布开源扩散式语言模型DiffusionGemma,将扩散模型思路引入文本生成,实现最高4倍速度提升与实时自我纠错能力。本文详解其核心技术原理、与传统自回归模型的差异及行业影响。

Google发布Gemma 4 12B开放权重模型,12B参数量级可在笔记本电脑本地运行。本文解析其性能优势、本地部署价值及开源生态竞争格局,助开发者快速上手评估。

详细介绍Google Gemma 4开源模型的本地部署方法,包括Ollama一键安装运行31B旗舰版、手机端运行1.2B轻量版,以及工具调用等实测体验,助你零成本体验高性能AI模型。
教程攻略详解如何用Ollama本地部署Gemma 4模型运行Codex,实现零成本AI编程。涵盖安装配置、模型选择、实际效果演示,替代每月20-200美元的付费方案,适合独立开发者和预算有限的团队。
教程攻略深度解析Google Gemma 4开源模型系列,涵盖31B、26B MOE、14B/12B三档模型红黑榜评测,提供Windows/Linux/Mac部署方案及MS-Swift微调实战教程,助你精准选型构建本地Agent工作流。
产品体验实测Google Gemma 4开源模型在三台手机上的离线运行表现,详解Dense与MOE架构区别,附Ollama + Claude Code完整部署教程。从1B到31B四款模型覆盖手机到工作站全场景,4GB显存即可运行。
科技前沿本周AI重磅更新汇总:Anthropic推出Claude Code代码审查功能,Google Gemma 4开源模型意外泄露,DeepSeek V4发布再度推迟,微软Copilot Cowork重塑协作方式,以及OpenAI收购PromptFool等行业动态深度解析。
产品体验通过Tauri框架开发Markdown编辑器,实测对比Qwen 3.6与Gemma 4两款本地大模型在规划能力、代码生成、开发效率等方面的表现差异,帮助开发者选择最适合的本地AI编程模型。
产品体验深度体验谷歌Gemma 4开源AI模型,涵盖本地部署教程、与ChatGPT正面对比、手机离线运行演示。四种模型尺寸从手机到工作站全覆盖,通过LM Studio零代码搭建,数据完全私密且永久免费。
科技前沿NVIDIA与Google DeepMind联合展示Gemma 4开源模型在DGX Spark桌面平台上的视觉翻译、长上下文问答和实时代码生成能力,解读开源AI与边缘算力融合的产业趋势及开发者实际启示。
教程攻略深度解析Google Gemma 4模型在NVIDIA DGX Spark上的部署方案。涵盖DGX Spark硬件架构、Gemma 4技术亮点、本地AI部署优势及开发者实践指南,助你掌握桌面级AI超算的最新玩法。
产品体验localOCR是一款基于Gemma-4、Llama 3.2等视觉语言模型的本地OCR开源工具,支持离线运行,保障数据隐私。本文详解其技术架构、多模型支持、适用场景及相比传统OCR的核心优势。
教程攻略深度解析Unsloth开源项目:通过Web UI实现本地大模型微调与推理,支持Gemma 4、Qwen3.6、DeepSeek等主流模型,显存降低70%,速度提升5倍。