共 69 篇相关文章

牛津机器人研究所发布测绘级Spires数据集,首次量化3D高斯泼溅在离轨视角下的几何崩塌问题。覆盖125000平方米、24个序列,采用Leica RTC360扫描仪提供毫米级真值,为NeRF和3DGS重建质量评估提供权威基准。

Boreas数据集由多伦多大学发布,在同一路线上跨越四季采集44次,提供128线激光雷达、360度雷达和摄像头的同步数据,含32万+三维标注框,专为恶劣天气下的自动驾驶感知研究设计。

一位网友在旧货店以6美元淘到波士顿动力Spot机器人校准靶。本文解析校准靶在机器人视觉系统中的作用,包括传感器标定原理、Spot多传感器融合需求,以及这块靶子的收藏与实用价值。

深入解析对抗性服装(AI Adversarial Clothing)的技术原理,了解NoRecognition项目如何利用对抗样本干扰AI视觉识别系统,探讨反监控服装的实际效果、局限性及隐私保护意义。

CANOE数据集由多伦多大学发布,基于无人水面艇采集360°雷达、128线激光雷达、立体相机、声呐及GPS/INS数据,覆盖加拿大多个湖泊场景,为水面自主导航感知与多传感器融合研究提供高质量开源基准。

深度解析碳抵消机制的核心缺陷:从森林碳汇核算陷阱到额外性验证难题,揭示碳信用市场如何成为企业逃避实质减排的工具,以及技术手段能否重建碳市场信任。

深度解析一份覆盖Linux、C++、ROS2、SLAM到自主导航的9阶段机器人工程师自学路线图,分析其项目驱动的学习方法、技术栈设计优缺点,并为自学者提供实用建议。

Waymo CEO公开阐述特斯拉纯视觉自动驾驶方案的核心局限,从摄像头物理边界、冗余安全缺失、成本与安全权衡等角度解析多传感器融合方案的优势,深度剖析自动驾驶两大技术路线之争。

Figure.AI发布F.03机器人自主攀爬梯子演示,展现动态平衡、多肢体协调与环境感知的突破性进展。深度解析爬梯技术难点、强化学习训练方法及其在工业巡检、救援等场景的应用前景。

探讨仅用16个样本实现100%准确率背后的深层意义,解析持续学习中数据效率与模型稳定性的关键作用,以及波动复合效应对长期学习系统的影响。

详解大规模双目相机与IMU同步数据集的获取方法,盘点KITTI、EuRoC、nuScenes、Waymo等主流开源数据集,分析组合使用策略与传感器异构性、时间同步等工程陷阱。

四足机器人实现超过5米/秒奔跑速度,同时具备负载能力和复杂地形穿越能力。本文解析速度、负载与地形适应性的技术难点,探讨强化学习Sim-to-Real范式如何突破四足机器人的不可能三角,以及物流救援等应用前景。

深入分析AI自主作战坦克的技术实现路径,包括强化学习训练、环境感知与决策引擎,探讨全球军事AI竞赛现状及致命性自主武器系统的伦理困境与法律边界。

深度解析美国禁止中国人形机器人进入市场的政策背景、战略动机与行业影响。从数据安全、产业保护到全球供应链重塑,全面解读中美AI竞争如何延伸至物理智能与机器人硬件领域。

伦敦盖特威克机场推出英国首个机器人代客泊车服务,采用AGV自动导引车托举搬运车辆,可提升30%-60%停车空间利用率。本文详解系统运作原理、落地挑战与自动化停车的商业逻辑。

Cursor蜂群实验让AI团队仅凭835页文档用Rust从零实现SQLite数据库引擎。全前沿模型花费上万美元,混合模型分工仅需千余美元,成本相差7.9倍。本文解析多智能体协作的经济账、三大失效模式与工程化启示。

GPT-5.6全面上线,强化编程、电脑操作与长链路智能体任务,用户额度双重置。同时字节跳动C-Dance 2.5 API开放、Mistral推出单RGB摄像头自然语言导航模型,AI能力细分趋势凸显。

Grok 4.5正式发布,1.5万亿参数、50万上下文窗口,编程实战成本仅为竞品十分之一。本文深度解析其核心能力、Cursor训练数据优势、性能实测数据,以及马斯克体系数据飞轮的战略逻辑。

xAI发布Grok 4.5大模型,数学推理与代码生成能力大幅跃升;TypeScript 7编译速度提升10倍重塑前端生态;OpenAI GPT-Life主攻实时交互;欧盟私信扫描法规引发隐私争议。一文读懂本周最具影响力的科技动态。

Ego Vision是一个开源自动驾驶感知项目,整合YOLO11目标检测、ByteTrack多目标跟踪与Depth Anything V2深度估计,实现GO/减速/停车/紧急制动四种驾驶动作预测。本文深度解析其技术架构、决策逻辑与工程价值。