共 7 篇相关文章

Unsloth发布v0.1.47-beta版本,这款拥有6.79万Star的开源大模型微调框架,可将Llama、Mistral、Qwen等主流模型微调速度提升2倍以上,显存占用降低约70%,让消费级GPU也能完成高效微调。

一位开发者将2019年的GPT-2(355M参数)重新微调,在免费Kaggle GPU上实现了88%的函数调用成功率。本文深度解析这一反直觉实验背后的技术路径与启示:小模型+针对性指令微调,同样能构建可用的LLM Agent能力。

纠结Géron、Chollet还是Raschka?本文针对机器学习自学者,逐一拆解4本经典书籍的定位与适用场景,帮助以模型微调、小型语言模型(SLM)为目标的学习者找到最对口的进阶路径。

一位拥有3年经验的AI研究工程师向FAANG投递50份简历,却颗粒无收。本文深度拆解顶级大厂AI岗位的隐性门槛、LinkedIn幽灵职位真相,以及MLE与Research Engineer的定位差异,帮你找到真正有效的求职策略。
AI热点风向标·06月29日晚间版:LangChain与Agent教程热潮
06月29日晚间版 AI热门话题深度讨论,5个热点
教程攻略深度拆解Hermes Agent四大递进实战案例:终端ReAct循环观测、飞书AI助手部署、四层持久记忆架构、Skill三阶自主进化机制,涵盖DeepSeek直连与开放Skill生态,助你掌握Agent从执行到成长的完整路径。