共 122 篇相关文章

Hugging Face开源项目ml-intern,可自主读论文、写训练脚本、Finetune大模型,深度集成HF生态与smolagents框架。本文解析其核心功能、模型切换方式及对ML工程师职业的真实影响。

深入解析开源LLM控制平面工具Otari——涵盖多模型统一接入、成本可观测、安全合规治理等核心能力,帮助团队构建可管理、可运营的生产级AI应用基础设施。

详解Codex接入外置模型的两种主流方法:通过中转站点手动配置密钥,或使用CC工具自动桥接GPT、DeepSeek等大模型。涵盖auth/config文件配置、CC工具使用技巧及多模型切换实战,助你快速解锁Codex完整能力。

本文系统讲解CrewAI核心概念(Agent、Task、Process、Crew、Pipeline),并演示如何结合FastAPI封装多Agent协作服务。涵盖GPT、通义千问、Ollama本地模型三种接入方案及实测对比,助你快速上手多智能体应用开发。

无ChatGPT Plus账号也能用Codex!本文详解通过Codex++管理工具接入DeepSeek API的完整流程,5步配置即可在国内低成本使用Codex,充值10元即够用。
警惕大厂AI智能体:如何保护你的研究知识产权
当你把研究代码、算法或未发表论文交给大厂AI Agent时,数据真的安全吗?本文深度剖析AI智能体的数据风险,并提供本地化部署、最小权限等实操防护建议,帮助研究者守住核心IP。

手把手教你搭建完整RAG检索增强生成流水线,基于Ollama + LangChain + FAISS + Qwen 1.5B,无需GPU即可在本地实现文档检索与智能问答,附切分、嵌入、向量库全流程实战详解。

Ollama是一款免费开源的大语言模型管理工具,支持macOS、Windows、Linux和Docker,可将DeepSeek等开源模型部署到本地,无需API付费,保障数据隐私,轻松搭建私有知识库。

Redis之父用纯C引擎将284B参数DeepSeek模型压缩至76GB,在MacBook Pro上实现每秒26Token的本地推理。本文拆解MoE架构、非对称量化技术原理,直面硬件门槛与质量代价,厘清本地AI推理的真实边界。

云端AI随用随取,为何银行、医院仍要自建Local AI?本文深度解析本地大模型私有化部署的核心驱动力、完整技术栈(Ollama、RAG、向量数据库),以及知识问答、合规审查等落地场景,帮你看清企业级AI部署的必然趋势。

Needle是仅有2600万参数的工具调用专用模型,本文详解如何用Ollama替代Gemini生成训练数据,在单张显卡上完成本地微调,最终实现96.7% F1得分,适合边缘设备与端侧AI部署。

手把手教你在Windows上通过WSL部署Hermes Agent AI智能体,涵盖Ubuntu安装、MiniMax模型配置、网页界面搭建及微信远程连接全流程,附MiMo免费误区等关键避坑点。

深入解析LangChain框架中Model与Agent的核心关系,涵盖模型统一接口、智能体工具调用、中间件机制等关键概念,帮助零基础开发者快速建立大模型应用开发的系统认知。

详解如何利用Agent+Skill架构搭建AI驱动的接口自动化测试框架,涵盖Claude Code环境搭建、大模型选择、测试用例自动生成、脚本执行到报告输出的完整流程,零代码实现自动化测试。

深度解析月之暗面Kimi K2.7 Code编程大模型,涵盖MoE架构细节、性能基准测试、API定价对比、6倍速高速版及与Claude、GPT的竞争格局分析,帮助开发者评估是否值得采用。

OpenFugu是一个用Zig语言复现Sakana AI Fugu Ultra模型的开源项目,探索非主流系统编程语言在AI领域的可能性。本文分析其技术选择、Zig在ML领域的优势与挑战,以及项目前景。

PilotDeck 是清华系团队开源的本地 Agent 控制台,通过 Workspace 隔离上下文、白盒化记忆管理和智能模型路由,解决多任务 Agent 项目串线、记忆不可查、成本失控三大痛点,支持 Always-On 后台执行。

小米开源MiMo Code编程工具,通过SQLite FTS5全文搜索驱动的跨会话记忆系统,解决AI编程助手上下文遗忘问题。支持多Agent协作、百万行代码级项目,兼容Claude Code及OpenAI API,GitHub已获9.2K Star。

实测Liquid AI开源的LFM2.5模型本地部署全过程,包括架构解析、16GB显存踩坑记录、GraphRAG工具调用对比GPT-o3s,揭示8.3B参数模型如何在Agent任务中以更少资源实现更强表现。

详解CrewAI多Agent协作框架的核心概念与实战搭建流程,涵盖Agent、Task、Crew定义,FastAPI封装API服务,以及GPT-4o Mini、通义千问Max、Llama 3.1三大模型实测对比与选型建议。