共 262 篇相关文章
产品体验深入解析Unsloth这款GitHub 6万+星标的开源大模型训练工具,支持Gemma 4、Qwen3、DeepSeek等主流模型的本地微调与推理,通过LoRA/QLoRA技术大幅降低显存需求,助力开发者在消费级显卡上高效训练大模型。

Ollama紧急扩容迎接万亿参数级开源模型,Kimi K3、Qwen 3.8等即将开源。同期Hugging Face向OpenAI提出1亿美元安全补偿,阿里Coder移动端上线,DeepSeek暂停融资。一文梳理开源大模型生态最新动态。

黄仁勋发布AI改革宣言,联合微软、Meta、Dell等20家科技巨头力挺开源AI路线,反对封闭模型高价垄断。本文解析开源与封闭模型的价格差距、蒸馏争议、Hugging Face事件及这场路线之争对全球AI产业的深远影响。

DeepSeek开源大模型震动硅谷,OpenAI坚守闭源阵营,微软英伟达Meta力挺开源。深度解析AI开源闭源路线之争、苹果美光芯片博弈及AI历史认知战背后的战略博弈。

DeepSeek完成超500亿融资,估值突破3500亿。创始人梁文锋深度阐述为何将团队稳定视为唯一核心利益,揭示DeepSeek留住顶尖AI人才的管理哲学与通往AGI的独特战略逻辑。

英伟达CEO黄仁勋公开表态称市场两次误解了DeepSeek和Kimi的影响,认为中国开源模型不会削弱算力需求,反而会通过降低门槛催生更多AI应用,最终放大整体算力消耗。

黄仁勋首条推文力挺开源AI模型,微软、Meta等50家硅谷企业联名反对封禁中国开源大模型。深度解析闭源与开源阵营的利益博弈、中国开源模型的碾压式增长数据,以及开源生态背后的战略阳谋。

中国开源大模型DeepSeek、Kimi K3集体爆发,冲击OpenAI等闭源厂商。从黄仁勋力挺开源到CUDA护城河被填平,深度解析开源与闭源两条AI路线背后的商业逻辑、芯片生态与中美战略博弈。
每日AI新鲜事·07月27日晚间版:Kimi K3倒计时与中国芯片超越Intel
2026年07月27日晚间版 AI新闻速递+热点深度讨论

月之暗面Kimi-K3模型即将在HuggingFace发布,从模型架构、许可协议到社区反应,全面解读这一国产大模型开源事件的战略意义与行业影响。

深入解析Kimi K3模型量化部署方案,对比q4与q8量化的存储需求、精度差异与硬件配置要求,帮助开发者评估本地自托管的可行性与最佳实践。

GLM 5.2开源大模型深度实测:7530亿参数、100万token上下文,性能媲美Opus 4.8,价格仅约十分之一。本文详解在Claude Code和Cursor中配置GLM 5.2的完整步骤,以及Zapier MCP接入9000+应用的实操方法。

从零掌握DeepSeek-OCR部署与微调全流程:涵盖vLLM推理引擎部署、Unsloth高效微调、数据集预处理、LoRA训练、效果验证及RAG向量数据库集成,为开发者提供可落地的大模型定制化实战路径。

AI Agent学习路径完整指南:从大模型基础、核心技术到实战项目,系统梳理智能体入门方法,剖析速成教程营销陷阱,助你少走弯路构建真正可落地的知识体系。

Notion联合创始人Simon Last深度分享:从GPT-4初体验到个人智能体、自定义智能体的完整演进历程。揭秘每半年重写AI框架的秘诀、工程师如何变身"智能体经理",以及Notion成为"模型界瑞士"的战略布局。

为什么有人敲了四年代码依然心里没底?本文拆解"三段式"计算机学习修炼法:打牢基本功、尽早定方向、边学边干,并附AI大模型、智能应用开发、运维、测试五大方向选择指南,帮你找到可复制的高手成长路径。
动手学大模型:4.4万星LLM实战教程完整指南
《动手学大模型 Dive into LLMs》是GitHub上44830星的中文LLM实战教程,以Jupyter Notebook形式覆盖Transformer原理、LoRA微调、RAG搭建、Prompt Engineering等核心主题,适合开发者系统入门大语言模型。

全面解析DeepSeek Math V2:IMO金牌级数学推理能力、97.3%的Math500正确率、Apache 2.0完全开源可商用。从技术架构、版本演进、核心能力到本地部署,带你彻底读懂这款开源数学大模型的过人之处。

CivitAI的"抢先体验"付费机制引发Reddit社区热议:功能性模型是否应长期锁在付费墙后?本文深度解析创作者变现、社区共识与平台责任之间的张力,探讨AI开源生态商业化的合理边界。

jlens-gguf是一款开源工具,将Anthropic雅可比透镜(Jacobian Lens)可解释性方法引入GGUF与llama.cpp生态,支持模型内部观测、实时引导(steering)及abliteration操作,兼容dense与MoE架构,让本地推理用户也能探索大模型内部机制。