共 919 篇相关文章
产品体验实测Qwen3.6系列7-8个量化模型在工具调用、命令行操作、Bug修复、数学推理等8大维度的表现,对比NVFP4、APEX、Q4、Q6量化方案,附总分排名与选购建议,帮你找到最适合本地部署的量化版本。
产品体验基于Qwen 3.5 Omni全模态模型和ESP32-S3的开源AI桌宠小猫项目,支持情感语音交互、视觉感知、手势互动和一日记录复盘功能。附完整复刻教程,含硬件清单、3D打印模型和代码烧录指南。
科技前沿阿里开源Qwen3.6 35B模型,256专家MoE架构仅需3B激活参数,SWE Bench成绩逼近Claude Opus。xAI发布Voice Cloning API支持28种语言,NVIDIA开源OpenShell安全沙箱,Sam Altman表态模型智力优先。
教程攻略详细教程教你用Hermes Agent搭配Qwen3.6开源大模型,在本地零成本部署私有AI助手。涵盖WSL环境配置、模型下载启动、Telegram机器人对接及开机自启设置,实现无限Token、数据私有的AI Agent体验。
产品体验实测对比三款基于Qwen3.6 27B的社区邪修量化模型:OmniMerge V4代码能力提升15.8个百分点,40B OPUS蒸馏版支持角色扮演与创意写作,16GB特化版让小显存也能跑稠密模型。附显存要求、参数设置与选型建议。
科技前沿悟空2.2P 35B MOE模型正式开源,采用对抗式杂交蒸馏技术,综合性能超越Qwen3.6-27B。4090显卡Q5量化达158 tokens/s,仅需8.9G显存即可运行,支持256K上下文。详解核心技术、硬件配置与实测数据。
科技前沿Qwen3.6实验性MTP-GGUF版本实测,单GPU将35B-A3B模型推理速度提升至220 token/s,比原版快1.4倍且精度零损失。详解MTP原理、最优Draft Tokens策略及RTX 5090实测数据。
行业洞察企业如何选择开源大模型?本文从模型能力、硬件需求、业务场景三个维度,深度对比Llama 3.1、Qwen 2.5、DeepSeek、Mistral等主流开源模型,提供选型决策框架与实践建议。
深度解读深入解析阿里开源Qwen3.5模型的混合注意力架构创新,详解Gated Delta Net如何实现256K上下文19倍加速,多模态视觉反超Gemini 3 Pro和GPT-5.2的评测数据,以及RL后训练策略与实际应用Demo。
产品体验实测Qwen 3.6多Token预测(MTP)技术,通过ik_llama.cpp仅需三个参数即可将推理速度从34.2提升至41 tokens/s,零质量损失、零额外模型的免费提速方案。附MTP与DFlash对比及完整配置教程。
产品体验详细实测阿里巴巴开源的Qwen Code CLI命令行编码工具,涵盖安装配置、API密钥设置、实际开发体验及与Claude Code对比。基于通义零码4800亿参数MoE模型,免费开源的AI编程助手。
观点碰撞AI周报终章涵盖Qwen3VL多版本发布及M1 MacBook本地部署实测、Claude Haiku 4.5编程能力评测、Karpathy nano-chat开源项目与Agent十年论、Nof1让7个AI模型用真金白银炒币的社会实验,以及AI生成内容超越人类产出的深度观察。
教程攻略详解Ollama本地运行大模型的完整指南,支持DeepSeek、Qwen、Kimi-K2.5等主流开源模型,涵盖安装使用、模型生态、隐私优势及企业私有化部署场景,GitHub 17万Star的热门开源工具。
教程攻略详解Ollama开源工具的安装使用方法,支持DeepSeek、Qwen、Kimi-K2.5、GLM-5等主流大模型本地部署,17万Star的最受欢迎本地大模型运行框架,助你实现离线AI推理与隐私保护。
深度解读深度解析QuantBrain-Agent开源项目,基于Qwen2.5-72B-AWQ大模型,融合LangGraph多智能体、LoRA微调、MCP工具链与CoT+ReAct架构,实现A股投研全自动化。
教程攻略深度解析Unsloth开源项目:通过Web UI实现本地大模型微调与推理,支持Gemma 4、Qwen3.6、DeepSeek等主流模型,显存降低70%,速度提升5倍。
教程攻略Ollama是GitHub上17万星标的开源本地大模型部署工具,一行命令即可运行DeepSeek、Qwen、Kimi-K2.5、GLM-5等主流模型。本文详解Ollama的核心优势、支持模型及本地推理的深层意义。

深度解析OpenAI下一代模型Astra的多智能体协作能力、神秘代号Mew4线索,以及Cursor Origin平台、Qwen 3.8本地模型、GPT-5.6降价等AI行业重磅动态。