Google DeepMind
Google DeepMind是Alphabet旗下的人工智能研究机构,由DeepMind与Google Brain于2023年合并而成。该机构致力于推进基础人工智能研究与应用开发,研究领域涵盖深度学习、强化学习、蛋白质结构预测(AlphaFold)、自然语言处理及科学计算等。其研究成果广泛应用于医疗健康、科学发现及Google旗下产品,是全球重要的AI研究机构之一。
核心事实
时间轴 (近 90 天)
Project Astra是Google DeepMind的前沿研究项目,旨在构建能够实时理解和响应物理世界的通用AI助手
Gemini版本号从3.2直接跳到3.5,跳过了3.3和3.4
Gemini Pro在科研技术路线图生成测试中存在图像模糊、稳定性差、频繁报错无法生成图片的问题
斯坦福的'Generative Agents'用虚拟小镇评测社交能力,Google DeepMind用各类游戏评测通用智能
Google DeepMind也在研究类似的AI Agent桌面操控技术
Gemini模型家族经历了从1.0到2.0再到2.5的多次迭代,采用多模态原生架构
Google DeepMind在2023年提出了能力弹性(Capability Elicitation)框架,强调模型的真实行为边界只有在特定触发条件下才会暴露
Google DeepMind的许多前沿研究基于JAX构建
OpenAI和Google DeepMind等机构也在各自的安全报告中开始披露模型在不同话题类别上的表现差异
Gemma 4是Google DeepMind于2025年发布的开源多模态模型,采用混合专家(MoE)架构,以Apache 2.0许可证开源
还有 40 条时间轴事件
全部知识事实 (11)
Project Astra是Google DeepMind的前沿研究项目,旨在构建能够实时理解和响应物理世界的通用AI助手
90%已验证Gemini是Google DeepMind于2023年底发布的多模态大语言模型,具备处理文本、图像、音频、视频和代码的能力
90%待验证斯坦福的'Generative Agents'用虚拟小镇评测社交能力,Google DeepMind用各类游戏评测通用智能
85%已验证MCP已获得包括OpenAI、Google DeepMind在内的多家主流AI公司支持
80%已验证Gemini 3.0 Pro是Google DeepMind推出的多模态大语言模型,属于Gemini系列的旗舰推理级别版本
80%待验证Google DeepMind也在研究类似的AI Agent桌面操控技术
70%待验证Gemini Pro在科研技术路线图生成测试中存在图像模糊、稳定性差、频繁报错无法生成图片的问题
70%部分验证Veo 3.1具备原生音频同步生成能力,能根据场景内容自动生成匹配的环境音效和背景声
70%部分验证Google AI Studio 提供 Veo 3.1 视频生成模型,支持4K分辨率和音画同步生成能力
65%待验证Google AI Studio的文本转语音功能生成的音频文件可免费下载使用
60%待验证Gemini版本号从3.2直接跳到3.5,跳过了3.3和3.4
60%