共 262 篇相关文章

小米悄然在Hugging Face上传MiMo-V2.5-DFlash权重,附带独立MTP模型,有望解决llama.cpp兼容问题,让300B超大模型本地推理速度翻倍。社区正期待GGUF量化转换。

DeepSeek传闻以约500亿美元估值融资,估值仅为OpenAI与Anthropic的二十分之一,却凭借5倍价格优势持续蚕食AI双雄中段市场。本文解析开源模型如何从价格、成本结构与市场分层三个维度,对美国AI巨头形成实质性利润挤压。

大模型微调是什么?本文用通俗语言讲清微调的本质原理、适用场景与企业实战路径,帮助零基础开发者理解何时需要微调、微调改变了什么,掌握AI大模型应用开发的完整技能体系。

全面解析Spring AI核心模块:ChatModel对话、EmbeddingModel向量化、RAG检索增强生成、Tool Calling工具调用及MCP协议。Java开发者快速接入DeepSeek、ChatGPT等大模型的实战教程,涵盖Milvus向量数据库与Ollama本地模型集成。

腾讯HY3开源大模型正式发布,2950亿MoE架构仅激活210亿参数,实测前端开发、3D模拟、代码生成表现出色,性价比碾压同级竞品,与DeepSeek V4 Pro正面竞争,Apache 2.0商用免费。

Spring AI 1.0稳定版发布,Java开发者无需转Python即可开发AI应用。本文涵盖大模型接入、RAG知识库、智能客服、Agent智能体五种模式及企业级落地实践,助你用Spring技术栈全面进入AI开发领域。

DeepSeek以"商业化盈利+开源免费"双轨模式挑战AI行业垄断格局,冲击英伟达等科技巨头逾万亿美元市值。本文深度解析DeepSeek开源战略的商业逻辑、全球反响及其对AI产业格局的深远影响。

系统梳理LangChain、LangGraph到多智能体开发的进阶路线,涵盖RAG、Tool Calling、MCP等核心概念,帮助开发者快速切入AI应用开发,掌握大模型工程化实战能力。

Anthropic Claude Code Artifacts正式面向Pro/Max用户开放,支持生成交互式网页并实时部署。本文盘点AI Agent最新动态:阿宝公测、字节EdgeBench评测、微软Frontier Company成立,及OpenAI、Anthropic的算力布局。

月之暗面正式发布Kimi K3,拥有2.8万亿参数,成为全球规模最大的开放权重大模型。支持100万Token超长上下文、原生多模态与常开思考模式,并搭载Kimi Delta Attention等自研架构创新,多项基准测试跻身全球前三。

月之暗面发布全球参数量最大开源模型Kimi K3,2.8万亿参数配合MoE架构,训练效率较K2提升2.5倍。斯坦福AI报告显示中美顶尖模型差距已缩至2.7%。本文深度解析Kimi K3技术亮点、市场反应与中美AI竞争新态势。

本期AI日报聚焦五大板块:DeepSeek V4疑似开启灰度测试,思维链质量显著提升;马斯克预告Grok 4.6与5.0下周开测,参数规模达2万亿;上海AI实验室Intern-S2开源模型击败Claude Opus 4.8;xAI建成2000MW级Colossus训练集群;英伟达RoboTTT突破机器人长时程操作瓶颈。

Moonshot AI的Kimi K3发布即登顶开源模型榜单,K3.1随即预热;Grok 4.6即将完成2万亿参数训练;DeepSeek新模型灰度测试;Anthropic订阅策略反复调整。本文梳理AI领域关键动向,解析开源与闭源系统的差距为何正在快速缩小。

手把手教你用Cherry Studio、MCP协议和Ollama搭建本地AI智能体与知识库,涵盖环境配置、文件操作、网页爬取、终端控制及本地RAG知识库全流程,数据不出本地,隐私有保障。

手把手教你用Ollama+Dify搭建本地企业级RAG知识库,涵盖模型安装、IP监听配置、自定义微调模型导入、Embedding向量检索全流程,彻底摆脱云端API依赖,保障数据安全。

手把手教你将ChatGPT桌面端接入本地大模型,实现零成本、无限Token、数据完全本地化。涵盖Ollama直连方案与CC Switch中转方案,兼容LM Studio、llama.cpp、vLLM,同样适用于Claude Code等AI智能体。

全球科技板块深度回调背后,韩国120万散户杠杆账户触及爆仓线,中国Kimi K3以2.8万亿参数刷新开源大模型记录,再度冲击AI高估值叙事。本文深度解析这场从东亚蔓延至全球的AI泡沫震荡。

DeepSeek等开源模型工具调用表现差,真的是模型本身的问题吗?本文深度解析"工具修复框架"的设计思路,揭示框架层缺陷如何被误算为模型能力短板,以及如何通过确定性修复规则和修复节点机制,让开源模型稳定运行超长智能体任务。
llmfit:一条命令检测硬件能跑哪些本地大模型
llmfit 是用 Rust 编写的开源命令行工具,无需下载模型即可预判本地硬件能否运行指定 LLM。覆盖数百种模型与 Ollama、llama.cpp 等主流推理后端,帮助开发者在本地部署大模型前快速完成硬件适配评估,避免反复试错。

为想转型AI大模型领域的开发者提供一份系统学习路线:第一个月打好Python与API基础,第二个月聚焦开发岗技术栈(LangChain/FastAPI),第三个月通过RAG、AI Agent实战项目完成转型,少走弯路,快速上手。