热门实体
近期最受关注的 AI 实体与高置信度知识事实
Trending
OpenAI是一家专注于人工智能研究与开发的美国科技公司,致力于构建安全、有益的通用人工智能系统。其主要业务涵盖大型语言模型(如GPT系列)、代码生成模型(如Codex)及图像生成模型(如DALL·E)的研发,并通过API向外部开发者和企业提供AI能力服务。公司以推动AI安全性与可解释性研究为重要使命之一。
Agent(智能体)是人工智能领域中能够感知环境、自主决策并采取行动以完成目标的程序或系统。其核心特征包括:具备自主性,可在无持续人工干预下运行;具备目标导向性,能规划并执行多步骤任务;以及工具调用能力,可与外部系统或API交互。Agent广泛应用于任务自动化、对话系统、编程辅助等场景。
大语言模型(Large Language Model,LLM),是基于深度学习技术、经过海量文本数据训练的自然语言处理模型。其核心能力包括文本理解、生成、推理与对话,能够处理翻译、摘要、代码生成、问答等多种语言任务。LLM通常采用Transformer架构,参数规模从数十亿到数千亿不等,是当前人工智能应用的重要基础组件。
Anthropic是一家美国人工智能安全公司,专注于大型语言模型的研究与开发。其代表性产品为Claude系列AI助手模型。公司以AI安全为核心研究方向,致力于开发可解释、可靠且符合人类价值观的人工智能系统,由前OpenAI研究人员于2021年创立。
AI编程是指借助人工智能技术辅助或部分自动化软件开发过程的技术范式。其核心能力包括代码生成、智能补全、错误检测与修复、代码审查及自然语言转代码等。该范式通常以大型语言模型为基础,融入开发工具或集成开发环境中,旨在提升开发效率、降低编程门槛,适用于代码撰写、调试、文档生成等多个软件工程环节。
Token是自然语言处理和大语言模型中文本的基本处理单元,由分词器(Tokenizer)将原始文本切分而成,可对应一个单词、子词、字符或标点符号。模型在处理输入和生成输出时均以Token为单位进行计算,Token数量直接影响模型的上下文窗口限制、推理速度及API调用费用。不同语言和模型的Token划分规则存在差异。
GPT(Generative Pre-trained Transformer)是由OpenAI开发的大规模预训练语言模型系列,基于Transformer架构,通过在海量文本数据上进行无监督预训练后经微调使用。该模型系列具备自然语言理解与生成能力,可执行文本续写、问答、摘要、翻译、代码生成等多种任务,是自然语言处理领域的代表性基础模型之一。
Claude是由人工智能安全公司Anthropic开发的大语言模型系列。该模型具备自然语言理解与生成、多轮对话、文本摘要、代码编写及分析等能力,适用于问答、写作辅助、编程支持等多种场景。Claude在设计上注重安全性与可靠性,以"宪法AI"等技术方法为基础,致力于生成符合人类价值观的输出内容。
Google是美国跨国科技公司,成立于1998年,总部位于加利福尼亚州。其核心业务涵盖互联网搜索引擎、在线广告、云计算、操作系统及硬件产品,旗下产品包括Google搜索、Chrome浏览器、Android操作系统、YouTube及Google Cloud等。Google隶属于母公司Alphabet Inc.,是全球最具影响力的科技企业之一,同时在人工智能领域持续开展研究与产品开发。
GitHub是一个基于Git版本控制系统的代码托管与协作平台,由微软旗下运营。它支持开发者托管、管理和分享代码仓库,提供Pull Request、Issue跟踪、代码审查等协作工具,并集成持续集成/持续部署(CI/CD)功能。GitHub也是全球最大的开源软件社区之一,广泛用于个人项目、团队开发及开源项目协作。
上下文管理是指在信息处理或对话系统中,对相关背景信息(上下文)进行维护、存储与调度的机制和策略集合。其核心目标是确保系统在处理请求时能够访问必要的历史信息与状态数据,常见手段包括上下文缓存、压缩与摘要、历史记录维护及生命周期控制等,广泛应用于编程语言运行时、操作系统及AI对话系统等领域。
Claude Code是由Anthropic开发的AI编程辅助工具,基于Claude大语言模型构建。它能够帮助开发者完成代码生成、代码补全、错误调试、代码解释及重构等编程任务,支持多种编程语言。该工具可集成于主流开发环境中,通过自然语言交互方式提升编程效率,适用于个人开发者及专业软件工程师。
大模型(Large Model)是指基于深度学习技术、具有大规模参数量的机器学习模型,涵盖语言、视觉、多模态等多种类型。其通过在海量数据上进行预训练,获得通用的知识表示与推理能力,可通过微调或提示工程适配问答、生成、分类、翻译等多种下游任务,是当前人工智能领域的主流技术范式之一。
ChatGPT是由OpenAI开发的对话式人工智能助手,基于大型语言模型(GPT系列)构建。用户可通过自然语言与其进行多轮对话,支持文本生成、问题解答、代码编写、翻译、摘要等多种任务。ChatGPT具备上下文理解能力,能够在连续对话中保持语境一致,广泛应用于个人辅助、内容创作及开发者工具等场景。
DeepSeek是由深度求索公司开发的大语言模型系列,具备自然语言理解与生成、代码编写、逻辑推理等核心能力。该系列模型以高性能与高效率为主要特征,支持多种自然语言处理任务,包括对话、问答、文本摘要及复杂推理,面向研究与商业应用场景提供开放或闭源版本。
检索增强生成(Retrieval-Augmented Generation,RAG)是一种结合信息检索与大语言模型生成能力的人工智能技术框架。其核心机制是在生成回答前,先从外部知识库中检索相关文档或片段,将其作为上下文输入模型,从而使模型能够利用最新或领域专属知识进行回答,有效缓解大语言模型的幻觉问题和知识截止局限性。
Agentic Coding(智能体编程)是一种以AI代理为核心驱动力的软件开发范式。在该范式中,AI代理能够自主理解任务目标、规划执行步骤、调用工具并迭代修正代码,而非仅被动响应单次指令。开发者的角色从逐行编写代码转变为提供高层需求描述与审查决策,AI代理负责完成代码生成、测试、调试等具体实现环节,具有较高的自主性与多步骤推理能力。
Cursor是一款面向开发者的AI驱动代码编辑器,基于VS Code构建,深度集成大型语言模型能力。其核心功能包括智能代码补全、自然语言编程指令、多文件上下文理解以及AI辅助代码生成与重构,旨在通过人机协作方式提升软件开发效率。Cursor支持多种主流编程语言,并兼容VS Code的插件生态。
微软(Microsoft)是一家美国跨国科技公司,由比尔·盖茨和保罗·艾伦创立,总部位于华盛顿州雷德蒙德。公司主要从事操作系统、办公软件、云计算服务及硬件设备的研发与销售,核心产品包括Windows操作系统、Office办公套件及Azure云平台。微软是全球最大的软件公司之一,业务涵盖消费级与企业级市场,并积极布局人工智能领域。
Python是一种通用的高级编程语言,以简洁易读的语法著称。它支持多种编程范式,包括面向对象、函数式和过程式编程,拥有丰富的标准库和第三方生态系统。Python广泛应用于数据科学、机器学习、Web开发、自动化脚本及科学计算等领域,是全球使用最广泛的编程语言之一。
高置信度知识
DeepSeek将API利润设定为'10个月收回设备成本'这一标准,而非利润最大化
DeepSeek目前大概有2万张H系列等效算力,大部分是最近一两个月才到位的
华为的950超节点在性能和价格上可平替英伟达GB200/GB300,代价是四张华为卡顶一张英伟达,时间上落后两年
MoE(混合专家)的核心思想可追溯至1991年Jacobs等人提出的早期混合专家框架,谷歌2021年的Switch Transformer将其推入大规模语言模型时代
Qwen3 Max 采用 MoE(混合专家)架构
从预训练检查点到可商用产品需经历监督式指令微调(SFT)和基于人类反馈的强化学习(RLHF)两个后训练阶段
安装Claude Code CLI前需先安装Node.js环境,可执行node -v验证
Qwen 3 Max和DeepSeek-V3均采用MoE架构,总参数量达数千亿,但实际推理激活参数仅为总量的一小部分
斯坦福大学2023年Chen等人的研究证实GPT-4在数月内的数学推理能力存在显著波动
通义千问发布了Qwen 3.8 Max模型,参数规模高达2.4万亿
开放权重模型指参数权重文件向公众开放下载,可本地部署微调,但训练数据和完整源码不一定公开,区别于完全开源
官方称Sonnet 5在推理、工具使用、编码和知识工作方面相比Sonnet 4.6均有显著提升,整体性能已逼近OPUS 4.8但价格更低
Karpathy强调Vibe Coding更适合概念验证场景,而非生产级代码
Kimi K3由月之暗面(Moonshot AI)开发
DeepSeek R1发布后英伟达单日市值蒸发约6000亿美元,创美股历史上单只股票最大单日市值损失记录
DeepSeek-V3、Google的Gemini及GPT-4(据传)均采用类似MoE架构
业内普遍认为Kimi K3是当下能力最强的开源大模型,编程能力尤为突出
JSON Schema是一种基于JSON格式的声明式规范,起源于2009年的社区草案,由IETF在RFC 8927及后续草案中推进标准化工作
Kimi K3定价为输入3美元/百万token、输出15美元/百万token,与Anthropic的Sonnet 5持平
Anthropic的Claude 3系列支持200K Token上下文窗口,Google Gemini 1.5 Pro达到100万Token