[控场AI]
模型GPT-4o Mini

GPT-4o-mini

GPT-4o-mini是OpenAI推出的轻量级大语言模型,属于GPT-4o系列的精简版本。该模型在保留较强自然语言理解与生成能力的同时,具有更低的推理成本和更快的响应速度,适用于对延迟和成本敏感的应用场景,如文本分类、摘要生成、对话系统及多智能体协作等任务。

核心事实

时间轴 (近 90 天)

8月23日

轻量模型(如GPT-4o-mini、Claude 3 Haiku、Gemini Flash)的调用成本通常只有旗舰模型的1/10到1/50

待验证50%
8月23日

GPT-4o相比GPT-4降价约50%

待验证60%
7月18日

旗舰模型的单次调用成本往往是轻量模型的10至50倍

待验证50%
7月13日

GPT-4 Turbo的调用成本相比初代GPT-4降低了约80%

待验证50%
7月12日

旗舰模型(如GPT-4o、Claude 3.5 Sonnet)与轻量模型(如GPT-4o-mini、Claude Haiku)在价格上可相差10-20倍,但在大量常规任务上性能差距并不显著

待验证50%
7月10日

Anthropic、OpenAI等公司的公开定价数据显示每百万Token的推理成本约在0.5-15美元区间

已验证65%
7月2日

合理的模型路由可以在不明显牺牲输出质量的前提下将月度成本降低 60%-80%

待验证50%
6月1日

GPT-4o的调用成本约为GPT-4o-mini的15-20倍

已验证80%
5月31日

OpenAI推出GPT-4o mini作为对轻量级高性能模型市场需求的回应

已验证80%
5月31日

中间层轻量模型(如Claude 3 Haiku、GPT-4o-mini)价格约为旗舰模型的1/10至1/20

已验证65%

全部知识事实 (10)

来源文章