[控场AI]
模型

GPT-4o

OpenAI旗舰多模态大语言模型,输入价格约每百万Token 2.5美元

核心事实

时间轴 (近 90 天)

9月12日

context-degradation-benchmark 项目以 Jupyter Notebook 为载体,对比 Claude Opus、GPT 系列的 Codex 变体以及 GPT-4o 在长上下文场景下的表现

待验证50%
9月12日

UP主在2022年末、2023年初时认为GPT只是个玩具,直到4o模型出现才意识到判断失误

待验证50%
9月12日

OpenAI GPT-4o、Meta的视频版多模态模型以及国内多家大模型也在视频理解赛道持续发力

待验证50%
9月12日

套壳平台可以在后台接入真实的GPT-4o或其他开源模型,然后在前端UI标注虚构的模型名字

待验证50%
9月11日

7B以下参数的模型在指令遵循、长文推理等方面与GPT-4o、DeepSeek-V3等商用模型差距明显,适合文本分类、简单问答等轻量任务

待验证50%
9月11日

Claude Code、GPT-4o、Devin等主流工具均在SWE-bench上有公开成绩

待验证50%
9月11日

满血不降智宣传语暗指使用GPT-4o、Claude 3.5 Sonnet等完整版本模型,但模型路由由第三方控制,用户无从验证

待验证50%
9月11日

Claude是Anthropic开发的大语言模型,在代码生成能力上与OpenAI的GPT-4o、Google的Gemini形成竞争

待验证50%
9月10日

本周AI行业出现密集更新:Anthropic更新Claude系列,Meta和Google相继推出模型升级,OpenAI发布GPT-4o等新版本

待验证50%
9月10日

DeepSeek-R1 蒸馏模型在 AIME 2024、MATH-500、LiveCodeBench 等任务上表现出色,在多数场景下与 GPT-4o 和 DeepSeek V3 相当,部分指标超越 OpenAI o1-mini

待验证50%

还有 40 条时间轴事件

全部知识事实 (20)

已验证

GPT-4o的输入价格约为每百万token 2.5美元

90%
已验证

GPT-3时代的上下文窗口仅有2,048个Token,而Google Gemini已支持百万级Token,Claude支持200K Token,GPT-4 Turbo支持128K Token

90%
已验证

GPT-4V、Claude 3、Gemini是现代多模态大模型的代表,能够同时处理文本、图像等多种数据类型

90%
已验证

2024年发布的GPT-4o将图像生成能力直接整合进多模态大语言模型中

85%
已验证

Claude 3.5支持200K Token上下文窗口,GPT-4o支持128K Token上下文窗口

80%
已验证

GPT-4o的输入Token价格约为每百万Token 2.5美元,输出Token约为每百万Token 10美元

80%
已验证

GPT-4o的调用成本约为GPT-4o-mini的15-20倍

80%
已验证

大模型API中输出Token的单价通常是输入Token的2-4倍

80%
已验证

OpenAI的GPT-4o API定价为每百万输入Token 2.5美元、每百万输出Token 10美元

80%
已验证

目前主流的大语言模型包括GPT-4、Claude、DeepSeek、通义千问等

80%
已验证

OpenAI推出GPT-4o mini作为对轻量级高性能模型市场需求的回应

80%
已验证

合理的模型路由可以在不明显牺牲输出质量的前提下将月度成本降低 60%-80%

75%
已验证

视觉-语言模型(VLM)的代表性工作包括OpenAI的GPT-4V、Google的Gemini以及开源社区的LLaVA

75%
已验证

OpenAI的GPT-4o语音模式是端到端语音融合的代表性探索

70%
已验证

在MMLU、HumanEval等主流基准测试上,Claude 3.5、GPT-4o、Gemini 1.5 Pro、Grok-2之间的分差已压缩至统计误差范围内

65%
已验证

GPT-4、Claude 3.5 Sonnet、Gemini 1.5 Pro等新一代大语言模型在HumanEval、SWE-bench等代码能力基准测试上的得分已大幅超越此前版本

65%
已验证

OpenAI的ChatGPT高级语音模式基于GPT-4o端到端语音架构,直接将音频输入映射到音频输出,延迟压缩至300毫秒以内

65%
已验证

OpenAI的GPT系列以整数版本号递增(GPT-3、GPT-4),并以字母后缀区分变体,如「o」代表优化版本(GPT-4o),「mini」代表轻量版本

65%
已验证

提示词工程在2022-2023年随GPT-3/4的普及而迅速成熟

65%
已验证

VLM(视觉语言模型)能够同时处理图像和文本输入,通过视觉编码器将图像转换为模型可理解的向量表示,再与文本信息融合进行推理

65%

来源文章