待验证60% 置信基准精确时间
在16GB Mac Mini上Ornith 9B简单请求下生成速度约为16 tokens/秒
2
来源数
60%
置信度
中期 (~90 天)
时效性
2026/7/7
首次发现
有效期至:2026/10/5
来源
Ornith 9B实测:16GB Mac Mini能否胜任本地AI编码?
bilibili四月的尾巴_2026/7/4
相关事实
待验证Ornith 35B(4bit MLX)在Mac Studio上生成速度约100 tokens/秒,比9B在Mac Mini上快近5倍83% 相似待验证27B稠密模型在24GB M4 Pro Mac mini上使用4-bit量化可以运行,速度约为11 tok/s71% 相似待验证在16GB M4 Mac Mini上,Ornith 9B GGUF版本加载后6.2GB用于模型权重,最大上下文长度可达26万tokens70% 相似待验证在配备96GB显存的M2 Max上以1-bit精度运行时,简单任务生成速度稳定在约28-30 tokens/秒69% 相似待验证Gemma量化模型在高性能笔记本电脑上Token生成速度可达每秒20-50个,纯CPU推理约5-15 tokens/秒,INT4量化下NVIDIA RTX 4060/4070可将推理速度提升3-5倍67% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/176265API
curl https://kongchang.com/api/v1/knowledge/claims/176265MCP
get_claim(id=176265)