共 21 篇相关文章

Qwen通义千问开发者暗示用户不必等待35B-A3B模型,社区猜测可能有更大规模MoE模型发布或产品线策略调整。本文解读命名规则、分析三种可能方向及对开源大模型生态的影响。

分享Qwen3-4B模型微调实践全过程,通过补充100-200条身份稳定数据,成功解决角色混乱问题。详解小模型微调中的数据策略、效果验证方法及MoE架构进阶规划。

Qwen3.8-27B成为Unsloth社区使用量最高的开源模型,远超DeepSeek-R1和Qwen3.6-35B-A3B。27B参数量化后可在消费级显卡本地部署,成为开发者首选基座模型。深度解析其爆火原因与开源生态趋势。
每日AI新鲜事·07月28日晚间版:黄仁勋力挺开源AI与Qwen3.7现身
2026年07月28日晚间版 AI新闻速递+热点深度讨论
每日AI新鲜事·07月22日早间版:Qwen3.8巨参与结构化输出
2026年07月22日早间版 AI新闻速递+热点深度讨论

阿里千问第五代模型Qwen3全面解析:6款Dense与MoE架构模型覆盖0.6B至235B,全球首款开源混合推理模型,旗舰235B性能追平Gemini 2.5 Pro,开发者与企业部署的完整参考指南。

深入解析大模型微调的核心原理与实战路径:从理解模型权重本质,到Qwen3本地部署、数据集准备、垂直领域训练,帮助AI应用开发者掌握从应用开发到模型微调的完整技能栈,提升市场竞争力。
每日AI新鲜事·07月21日早间版:语音工具扎堆与MoE效率之争
2026年07月21日早间版 AI新闻速递+热点深度讨论
每日AI新鲜事·07月20日午间版:小MoE干翻大模型
2026年07月20日午间版 AI新闻速递+热点深度讨论
每日AI新鲜事·07月19日晚间版:Kimi K3震场与小MoE大能耐
2026年07月19日晚间版 AI新闻速递+热点深度讨论

一张二手RTX 3090,一个16.8GB的GGUF文件,Qwen3.6 27B即可本地离线运行。SWE-bench得分77分媲美Claude Sonnet,MTP技术让推理速度提升至59 token/s。无订阅、无云端、数据不出门,本地AI编程助手完整部署指南。

Unsloth针对Qwen3.6系列发布NVFP4量化版本,采用W4A4真4bit张量核心运算,相比NVIDIA官方实现最高2.5倍推理加速,MMLU-Pro等多项基准测试精度持平甚至超越BF16全精度,本地部署效率大幅提升。

深度解析OpenAI最新GPT-5.6发布:Sol、Terra、Luna三模型定价策略、Cerebras芯片推理优势,以及政府监管框架下OpenAI与Anthropic的不同应对路径,揭示中美AI竞争格局。

在16GB显存条件下,Ornith 35B与Qwen 3.6 35B谁更强?本文梳理超24小时实测结果,涵盖推理速度、256K长上下文、Agency工具调用、HumanEval编程评测等多项测试,帮助本地部署用户做出选择。

DeepSeek R1默认不支持Function Calling和JSON Output,千问三凭借可编程思维切换成开源智能体首选。本文梳理大模型选型核心陷阱、版本关键差异及MCP协议新机制,助你在LangChain智能体开发中少走弯路。

深入解析Pi Coding Agent的核心设计哲学、四大基础工具、扩展系统开发实战、Skills技能管理,以及与Claude Code的详细对比,帮助开发者打造高度定制化的AI编程工作流。
科技前沿DeepSeek发布OCR2视觉理解模型,用大语言模型替代CLIP重构视觉编码器;月之暗面推出Kimi K2.5,集群代理模式可调度100+子代理;微软Maia 200定制AI芯片开始部署;阿里发布Qwen3 Max Thinking正式版。
科技前沿Anthropic为Claude Code新增自定义子智能体功能,Cursor发布代码审查Agent BugBot,通义千问推出92种语言翻译模型,谷歌发布三款实验性AI产品。一文详解AI编程工具和大模型生态的最新动态。
科技前沿Qwen3.6实验性MTP-GGUF版本实测,单GPU将35B-A3B模型推理速度提升至220 token/s,比原版快1.4倍且精度零损失。详解MTP原理、最优Draft Tokens策略及RTX 5090实测数据。
深度解读深入解析阿里开源Qwen3.5模型的混合注意力架构创新,详解Gated Delta Net如何实现256K上下文19倍加速,多模态视觉反超Gemini 3 Pro和GPT-5.2的评测数据,以及RL后训练策略与实际应用Demo。