待验证50% 置信事实精确时间
MoE概念最早由Jacobs等人于1991年提出,谷歌2017年将其规模化至语言模型,Mistral的Mixtral系列将稀疏MoE带入开源社区
1
来源数
50%
置信度
长期有效
时效性
2026/7/15
首次发现
来源
相关事实
已验证MoE(混合专家)的核心思想可追溯至1991年Jacobs等人提出的早期混合专家框架,谷歌2021年的Switch Transformer将其推入大规模语言模型时代76% 相似待验证MoE架构历史可追溯至1991年Jacobs等人的原始论文,Google于2017年将其应用于序列到序列模型并显著提升性能74% 相似待验证MoE架构最早由Google在2017年提出,后被Mistral的Mixtral系列和阿里的Qwen系列等广泛采用73% 相似待验证谷歌于2017年通过Shazeer等人的Sparsely-Gated MoE论文将MoE规模化至语言模型72% 相似待验证混合专家架构(MoE)的思路源于1991年的学术研究,近年被Mistral、DeepSeek、Google(Gemini 1.5)等广泛采用71% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/520787API
curl https://kongchang.com/api/v1/knowledge/claims/520787MCP
get_claim(id=520787)