待验证95% 置信事实时间未知
BERT的参数规模为3.4亿,GPT-3的参数规模为1750亿
1
来源数
95%
置信度
长期有效
时效性
2026/6/1
首次发现
来源
GitHub 8000+ Star:最全LLM学习资源库深度解析
githubWangRongsheng
涉及实体
相关事实
待验证千问三235B MoE总参数量2350亿,但每次推理实际激活的参数约22B74% 相似已验证Qwen3-235B总参数量为2350亿,采用MoE架构,每次前向推理实际激活的参数量约22B73% 相似部分验证通义千问发布了Qwen 3.8 Max模型,参数规模高达2.4万亿69% 相似待验证据Artificial Analysis数据,Qwen 3.8的270亿参数模型在Agentic指数上拿到51分,超过GPT-5.6 Terra、DeepSeek v4 Pro、GPT-5.6 Luna以及Gemini 3.7 Flash66% 相似待验证2.4万亿参数模型在BF16精度下考虑KV Cache和激活值后实际约需1.4-1.5TB显存66% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/34539API
curl https://kongchang.com/api/v1/knowledge/claims/34539MCP
get_claim(id=34539)