GPT-4o
OpenAI旗舰多模态大语言模型,输入价格约每百万Token 2.5美元
核心事实
时间轴 (近 90 天)
context-degradation-benchmark 项目以 Jupyter Notebook 为载体,对比 Claude Opus、GPT 系列的 Codex 变体以及 GPT-4o 在长上下文场景下的表现
UP主在2022年末、2023年初时认为GPT只是个玩具,直到4o模型出现才意识到判断失误
OpenAI GPT-4o、Meta的视频版多模态模型以及国内多家大模型也在视频理解赛道持续发力
套壳平台可以在后台接入真实的GPT-4o或其他开源模型,然后在前端UI标注虚构的模型名字
7B以下参数的模型在指令遵循、长文推理等方面与GPT-4o、DeepSeek-V3等商用模型差距明显,适合文本分类、简单问答等轻量任务
Claude Code、GPT-4o、Devin等主流工具均在SWE-bench上有公开成绩
满血不降智宣传语暗指使用GPT-4o、Claude 3.5 Sonnet等完整版本模型,但模型路由由第三方控制,用户无从验证
Claude是Anthropic开发的大语言模型,在代码生成能力上与OpenAI的GPT-4o、Google的Gemini形成竞争
本周AI行业出现密集更新:Anthropic更新Claude系列,Meta和Google相继推出模型升级,OpenAI发布GPT-4o等新版本
DeepSeek-R1 蒸馏模型在 AIME 2024、MATH-500、LiveCodeBench 等任务上表现出色,在多数场景下与 GPT-4o 和 DeepSeek V3 相当,部分指标超越 OpenAI o1-mini
还有 40 条时间轴事件
全部知识事实 (20)
GPT-4o的输入价格约为每百万token 2.5美元
90%已验证GPT-3时代的上下文窗口仅有2,048个Token,而Google Gemini已支持百万级Token,Claude支持200K Token,GPT-4 Turbo支持128K Token
90%已验证GPT-4V、Claude 3、Gemini是现代多模态大模型的代表,能够同时处理文本、图像等多种数据类型
90%已验证2024年发布的GPT-4o将图像生成能力直接整合进多模态大语言模型中
85%已验证Claude 3.5支持200K Token上下文窗口,GPT-4o支持128K Token上下文窗口
80%已验证GPT-4o的输入Token价格约为每百万Token 2.5美元,输出Token约为每百万Token 10美元
80%已验证GPT-4o的调用成本约为GPT-4o-mini的15-20倍
80%已验证大模型API中输出Token的单价通常是输入Token的2-4倍
80%已验证OpenAI的GPT-4o API定价为每百万输入Token 2.5美元、每百万输出Token 10美元
80%已验证目前主流的大语言模型包括GPT-4、Claude、DeepSeek、通义千问等
80%已验证OpenAI推出GPT-4o mini作为对轻量级高性能模型市场需求的回应
80%已验证合理的模型路由可以在不明显牺牲输出质量的前提下将月度成本降低 60%-80%
75%已验证视觉-语言模型(VLM)的代表性工作包括OpenAI的GPT-4V、Google的Gemini以及开源社区的LLaVA
75%已验证OpenAI的GPT-4o语音模式是端到端语音融合的代表性探索
70%已验证在MMLU、HumanEval等主流基准测试上,Claude 3.5、GPT-4o、Gemini 1.5 Pro、Grok-2之间的分差已压缩至统计误差范围内
65%已验证GPT-4、Claude 3.5 Sonnet、Gemini 1.5 Pro等新一代大语言模型在HumanEval、SWE-bench等代码能力基准测试上的得分已大幅超越此前版本
65%已验证OpenAI的ChatGPT高级语音模式基于GPT-4o端到端语音架构,直接将音频输入映射到音频输出,延迟压缩至300毫秒以内
65%已验证OpenAI的GPT系列以整数版本号递增(GPT-3、GPT-4),并以字母后缀区分变体,如「o」代表优化版本(GPT-4o),「mini」代表轻量版本
65%已验证提示词工程在2022-2023年随GPT-3/4的普及而迅速成熟
65%已验证VLM(视觉语言模型)能够同时处理图像和文本输入,通过视觉编码器将图像转换为模型可理解的向量表示,再与文本信息融合进行推理
65%