[控场AI]
模型千问3 / 千问三

Qwen3

阿里巴巴推出的第五代千问大模型系列,全球首款开源混合推理模型,共六个尺寸,支持Dense和MoE双架构,旗舰模型235B-A22B可与Gemini 2.5 Pro正面抗衡

核心事实

时间轴 (近 90 天)

8月27日

GQA(分组查询注意力)等技术可以有效压缩KV Cache,Qwen3系列也采用了类似优化

待验证50%
8月27日

Unsloth Desktop当前已支持Qwen3、Meta系列模型以及DeepSeek等多种主流模型

待验证50%
8月25日

UP主的测试环境为RTX 5070显卡(12GB显存)、Qwen3系列9B参数模型、64K上下文长度

待验证50%
8月25日

在RTX 5070(12GB显存)配置下,本地Qwen3 9B模型的输出速度达到约70-76 token/秒

待验证50%
8月25日

该1-bit量化的27B模型能够在仅8GB内存的设备上运行

待验证50%
8月25日

Qwen3覆盖从0.6B到235B的多种参数规模,支持思考模式(thinking mode)混合推理能力,覆盖119种语言的多语言预训练数据

待验证50%
8月24日

该量化模型相较于BF16全精度版本保留了约77%的准确率

待验证50%
8月24日

该消息主要来自单一Twitter来源,具体测试基准、评测方法和适用场景细节尚待验证

待验证50%
8月22日

Qwen3采用RoPE旋转位置编码并通过YaRN等技术进行外推扩展,使用GQA分组查询注意力降低长序列KV缓存显存占用

待验证50%
7月22日

Qwen系列采用Apache 2.0协议开放,允许商业使用和二次修改

已验证65%

还有 2 条时间轴事件

全部知识事实 (12)

来源文章