共 21 篇相关文章

Needle是仅有2600万参数的工具调用专用模型,本文详解如何用Ollama替代Gemini生成训练数据,在单张显卡上完成本地微调,最终实现96.7% F1得分,适合边缘设备与端侧AI部署。
产品体验Unsloth是GitHub 63K+ Star的开源大模型训练工具,支持Gemma 4、Qwen 3、DeepSeek等主流模型。通过显存优化降低50%-80%显存占用,让RTX 4090也能微调7B模型,提供Web UI一键训练。
教程攻略详解Unsloth开源工具如何通过LoRA优化和Web UI界面,让消费级显卡也能高效微调Gemma 4、Qwen3、DeepSeek等主流大模型,训练速度提升2-5倍,显存降低50%-70%。
教程攻略Unsloth是GitHub 63K星标的开源大模型微调工具,支持Gemma 4、Qwen3、DeepSeek等模型。通过底层内核优化实现训练加速数倍、显存大幅降低,消费级GPU即可完成微调,提供Web UI图形界面,适合个人开发者和企业私有化部署。
教程攻略详解Unsloth开源工具如何在本地高效微调大模型,支持Gemma 4、Qwen3、DeepSeek等主流模型,通过LoRA优化显著降低显存占用,提供Web UI界面降低训练门槛,适合个人开发者和中小团队使用。
产品体验Unsloth是GitHub上超63000星的开源项目,提供Web UI界面支持本地训练和微调Gemma 4、Qwen3、DeepSeek等主流大模型,大幅降低硬件门槛和技术难度,适合个人开发者和企业私有化部署。
产品体验Unsloth是GitHub 63K+星标的开源大模型微调工具,支持Gemma 4、Qwen 3、DeepSeek等主流模型,通过LoRA/QLoRA技术将训练速度提升2-5倍,显存降低80%,提供Web UI界面让本地微调大模型变得简单高效。
产品体验Unsloth 是 GitHub 63000+ Star 的开源大模型训练工具,支持 Gemma 4、Qwen3、DeepSeek 等主流模型的本地微调,提供 Web UI 界面、显存优化和 2-5 倍训练加速,让消费级 GPU 也能跑通模型微调全流程。
产品体验Unsloth 是 GitHub 6.3万星标的开源大模型训练工具,支持 Gemma 4、Qwen3、DeepSeek 等主流模型的本地微调与部署。提供 Web UI 界面,显存占用降低50%,训练速度提升2-5倍,适合企业和个人开发者使用。

Stripe以70亿美金收购AI路由平台OpenRouter,Claude系统提示词全文公开,端侧模型Needle仅14MB跑在手表上。深度解析AI API中转赛道与端侧化趋势的行业变局。

XLeRobot是一款开源DIY家用机器人,使用3D打印零件、廉价舵机和深度相机,通过本地微调SmolVLA视觉语言动作模型,实现从环境探索、物体定位到机械臂操控的端到端自主任务闭环。

OpenAI发布GPT-5.6系列预览版,推出So、Terra、Luna三档定位模型。实测显示三款模型在长程智能体任务上全部满分,价格对标GPT-5.5降幅高达50%。本文详解性能评测数据、定价策略与选型建议。

OpenAI发布GPT-5.6系列,旗舰Sol、均衡Terra、轻量Luna三款模型全面实测。智能体任务媲美顶级模型,定价最低$1/百万token,与Fable 5、Opus 4.8横向对比,选型建议一览。

OpenAI发布GPT-5.6预览版,旗舰Soul、均衡Tara、轻量Luna三款模型同步亮相。本文基于KingBench 3真实测评,详解各模型在数学、前端、智能体任务上的表现,并与Anthropic Fable进行横向对比,助你快速选型。

亲测GPT-5.6全系三款模型Sol、Terra、Luna,覆盖前端、数学、长程代理等多项任务。实测总分、分项对比与选型建议一文看清,附与Fable 5、Opus 4.8的横向排名。
开源探索·第8期:AI本地化浪潮:开源工具夺回控制权
每周四挖掘值得关注的AI开源项目
开源探索·第3期:开源AI本地化与脱云浪潮
每周四挖掘值得关注的AI开源项目
开源探索·第1期:开源大模型降门槛本地化部署与Agent生态
每周四挖掘值得关注的AI开源项目