[控场AI]
模型

GPT-4

核心事实

时间轴 (近 90 天)

9月12日

前沿级别(frontier-grade)是AI行业用来描述当前最顶尖大模型能力层次的术语,通常指代GPT-4、Claude 3、Gemini Ultra等模型

待验证50%
9月12日

Harvey 是法律 AI 赛道中融资规模最大的初创公司之一,基于 GPT-4 定制训练,主要面向大型律所提供合同分析、尽职调查和法律备忘录生成服务

待验证50%
9月12日

Casetext 以判例检索起家,其 CoCounsel 产品将 GPT-4 引入法律研究工作流

待验证50%
9月12日

Altman称他以为2023年做出GPT-4之后很快就会出现更大规模的颠覆,软件业务会立刻被重新洗牌,但结果并非如此

待验证50%
9月12日

在纯CPU环境下,本地模型辅助编程的体验与云端服务(如GitHub Copilot、Claude、GPT-4)存在明显差距

待验证50%
9月12日

部分大型语言模型已能在MATH、AIME等竞赛级题库中取得超过80%的正确率

待验证50%
9月12日

GPT-4、Claude、Gemini等模型相继在MMLU上突破90%的准确率,导致该基准的区分度消失

待验证50%
9月11日

对于一个3400字的任务prompt,GPT-4只用81个单词就完成了回复

待验证50%
9月11日

该用户认为GPT-4无需特别调教就能理解用户对简洁性的需求

待验证50%
9月11日

一位同时订阅Claude和GPT-4高级版(各200美元/月)的用户在Reddit上抱怨Claude回复过于冗长

待验证50%

还有 40 条时间轴事件

全部知识事实 (20)

已验证

GPT-4的训练成本据估计超过1亿美元

90%
已验证

大语言模型的预训练过程需要数千块高端GPU并行运算数月,耗资通常在数千万到数亿美元之间

90%
已验证

MOE架构将模型内部划分为多个专家子网络,每次推理时由门控网络动态选择少数专家参与计算,实际激活参数量远小于总参数量

90%
已验证

训练一次GPT-4级别的模型需要数万块A100/H100 GPU协同工作数月

90%
已验证

GPT-4、Claude、Gemini等大语言模型的核心工作原理是基于Transformer架构的下一个token预测

90%
已验证

2024年发布的GPT-4o将图像生成能力直接整合进多模态大语言模型中

85%
已验证

GPT-4和Mixtral等主流大模型也采用了MoE架构

85%
已验证

GPT-4 级别模型的单次调用延迟可能在 1-30 秒之间浮动

80%
已验证

目前主流模型GPT-4、Claude、Gemini、通义千问均原生支持Function Calling能力

80%
已验证

ChatGPT Plus订阅价格为每月20美元

80%
已验证

2023年以来,随着GPT-4、Claude等大语言模型推理能力的飞跃,Agent从学术概念迅速走向工程实践

80%
已验证

AutoGPT于2023年3月发布,展示了GPT-4自主完成复杂任务的可能性

80%
已验证

Function Call是OpenAI在2023年6月随GPT-3.5/GPT-4 API更新引入的一项能力,允许开发者在API请求中定义函数的JSON Schema描述

80%
已验证

GPT-4的输入Token价格约为输出Token价格的1/3

80%
已验证

目前主流的大语言模型包括GPT-4、Claude、DeepSeek、通义千问等

80%
已验证

Cursor支持GPT-4、Claude等多模型调用能力

80%
已验证

GPT-4在2023年初的API调用成本约为每百万token 30美元

80%
已验证

业界估算GPT-4的训练成本超过1亿美元,涉及数万块A100 GPU、数月的持续运算和PB级别的训练数据

80%
已验证

GPT-4、Claude等大语言模型的代码生成能力源于训练数据中包含了GitHub上数以亿计的开源代码库

80%
已验证

Function Calling能力最早由OpenAI在2023年6月的GPT-3.5/4 API中正式引入

80%

来源文章