共 39 篇相关文章

腾讯混元Hy3正式发布,295B参数MoE架构,激活仅21B,支持256K超长上下文。幻觉率从12.5%降至5.4%,MRCR得分近乎翻倍,内置MTP与EAGLE投机解码,SGLang Day-0即可部署。本文深度拆解其四大核心亮点与Agent-first定位。

Databricks在百万行生产级代码库上对主流编程Agent进行系统测试,揭示Token单价误导成本判断、开源模型GLM 5.2可挑战高难任务、Harness框架决定实际表现等关键发现,为企业AI编程工具选型提供实战参考。

基于真实私有化部署实测,对比DeepSeek、千问3、智谱GLM、Kimi K2、MiniMax M3、腾讯混元3六款开源大模型的硬件成本、推理效率与落地难度,帮助企业找到最匹配的内网部署方案。

加拿大Palantir采购争议揭示了政府AI战略的核心隐患:合同不透明、供应商锁定与监督缺失。本文深度解析AI公共治理的困境与可行出路,探讨如何在拥抱AI技术的同时守护民主问责与技术主权。

Unsloth发布v0.1.47-beta版本,这款拥有6.79万Star的开源大模型微调框架,可将Llama、Mistral、Qwen等主流模型微调速度提升2倍以上,显存占用降低约70%,让消费级GPU也能完成高效微调。

企业AI落地的核心不在于调用通用大模型,而在于构建"模型-工具链-沙盒-评估"自强化飞轮。本文深度解析这一闭环的四大环节、隐性知识护城河的形成逻辑,以及"每瓦特Token价值"这一效率新指标,为企业AI战略提供清晰方向。

深度解析Java程序员转型AI应用开发的最佳路径,涵盖Spring AI框架、RAG检索增强生成、Function Calling工具调用等核心技术,并通过航空智能客服项目实战演示完整技术栈落地方案。

详解如何在3080Ti 12GB显存上本地部署多模态AI Agent系统,涵盖LLM、语音识别、语音合成、图片生成、视频生成五大模块的选型方案、显存动态加载策略及实际性能表现。

深入介绍LlamaFactory开源项目,一个支持100+大语言模型和视觉语言模型的统一微调框架,涵盖LoRA、QLoRA、RLHF等高效微调方法,提供Web UI可视化操作,GitHub超7万Star,ACL 2024收录。
教程攻略详解Ollama本地大模型管理工具的核心功能与特点,包括免费开源、跨平台支持、智能GPU/CPU调度、API集成等能力,帮助你零成本在本地运行DeepSeek等开源大模型。
教程攻略详细介绍Codex对接DeepSeek V4模型的完整流程,包括API Key获取、CC Switch中转配置、插件解锁等步骤,帮助国内用户以低成本使用AI编程与对话工具。
科技前沿深度解析月之暗面Kimi K2.5全量开源大模型:1T参数MoE混合专家架构、视觉编程截图转代码、百Agent并行集群能力,在AI编程和多模态理解赛道登顶开源榜首,为开发者提供媲美GPT-4O的免费开源方案。
教程攻略详解2026年AI大模型开发完整学习路径,涵盖Prompt工程、RAG检索增强、Agent智能体开发、模型微调四大核心技术栈,附零基础分阶段学习计划,助你快速掌握企业级AI应用开发落地能力。
产品体验
教程攻略深度解析Ollama开源项目,一行命令本地运行DeepSeek、Qwen、Kimi-K2.5等主流大模型。详解安装使用、模型生态、技术架构及适用场景,助你快速上手本地LLM部署。
产品体验深度解析Chatbox开源AI客户端,一款支持多模型切换、本地数据存储的桌面应用。近4万GitHub Star,支持OpenAI、Claude等API接入,适合个人开发者和企业用户的AI交互工具。
产品体验深入解析Unsloth这款GitHub 6万+星标的开源大模型训练工具,支持Gemma 4、Qwen3、DeepSeek等主流模型的本地微调与推理,通过LoRA/QLoRA技术大幅降低显存需求,助力开发者在消费级显卡上高效训练大模型。
教程攻略Ollama是GitHub上17万Star的开源工具,支持DeepSeek、Qwen、Gemma等主流大模型本地运行。本文详解Ollama的安装使用、支持模型、适用场景及核心优势,助你快速实现大模型本地化部署。