共 29 篇相关文章

深入解析Mighty Camera Board如何仅用一颗全局快门相机和IMU,在设备端实时完成VIO视觉惯性里程计、深度估计与障碍物三维建图,为机器人和无人机提供碰撞避免与自主导航能力。

一位网友在旧货店以6美元淘到波士顿动力Spot机器人校准靶。本文解析校准靶在机器人视觉系统中的作用,包括传感器标定原理、Spot多传感器融合需求,以及这块靶子的收藏与实用价值。

深入解析对抗性服装(AI Adversarial Clothing)的技术原理,了解NoRecognition项目如何利用对抗样本干扰AI视觉识别系统,探讨反监控服装的实际效果、局限性及隐私保护意义。

CANOE数据集由多伦多大学发布,基于无人水面艇采集360°雷达、128线激光雷达、立体相机、声呐及GPS/INS数据,覆盖加拿大多个湖泊场景,为水面自主导航感知与多传感器融合研究提供高质量开源基准。

详解一位工程师如何从零构建RGB与红外双模态数据集,通过冷启动策略、半自动化数据挖掘和边缘采集闭环,从500帧手工标注扩展到300万帧规模,为计算机视觉开发者提供可复制的数据工程方法论。

Waymo CEO公开阐述特斯拉纯视觉自动驾驶方案的核心局限,从摄像头物理边界、冗余安全缺失、成本与安全权衡等角度解析多传感器融合方案的优势,深度剖析自动驾驶两大技术路线之争。

详解基于麦克纳姆轮的全向移动机器人动感模拟平台,利用VR追踪器实现三自由度运动模拟与重定心校正,为低成本VR沉浸体验提供可行方案。

深入解析旋转隐形无人机的设计原理,探讨单旋翼自旋结构如何利用视觉暂留实现伪装效果,分析其在侦察监控、蜂群部署等领域的应用前景与技术挑战。

探讨基于相机标定参数合成190°鱼眼驾驶视频的技术路径,分析几何一致性对ADAS感知模型训练的关键影响,以及合成数据在环视系统中的机遇与域差距挑战。

深度分析计算机视觉(CV)工程师与标准SDE的薪资对比、职业发展空间及满意度。探讨CV工程师的专业化优势与市场限制,帮助技术从业者做出明智的职业选择。

详解大规模双目相机与IMU同步数据集的获取方法,盘点KITTI、EuRoC、nuScenes、Waymo等主流开源数据集,分析组合使用策略与传感器异构性、时间同步等工程陷阱。
Gemini Robotics 2赋能Apollo 2:全身智能如何重新定义…
深度解析谷歌DeepMind Gemini Robotics 2如何赋能Apptronik Apollo 2人形机器人实现全身智能,探讨VLA大模型驱动具身智能的技术突破、硬件与AI融合范式及通用机器人的商业化前景。

探讨从单张法线图重建三维网格的核心难题——深度不连续处理。介绍逐像素权重方法如何让表面自然断开,避免强行积分导致的几何错误,并分析细小结构可靠性与绝对尺度标定两大未解问题。

伦敦盖特威克机场推出英国首个机器人代客泊车服务,采用AGV自动导引车托举搬运车辆,可提升30%-60%停车空间利用率。本文详解系统运作原理、落地挑战与自动化停车的商业逻辑。

GPT-5.6全面上线,强化编程、电脑操作与长链路智能体任务,用户额度双重置。同时字节跳动C-Dance 2.5 API开放、Mistral推出单RGB摄像头自然语言导航模型,AI能力细分趋势凸显。

Womprat是Punk Labs开源的轻量级空中小目标追踪工具,完全基于CPU运行,无需GPU和训练模型。采用经典计算机视觉算法,支持自动获取与手动Lock-On模式,适用于边缘设备和嵌入式系统部署。
计算机视觉职业发展路径:本科生入局指南
计算机视觉(CV)值得作为独立职业吗?本文深度解析CV工程师的就业现状、读硕vs先就业的抉择逻辑、边缘部署的核心竞争力,以及从传统CV转型多模态AI工程师的实操建议,帮助本科生规划清晰的职业路径。

深度解析基于卡尔曼滤波的多传感器融合无人机追踪系统:从单摄像头升级为摄像头+RF双传感器方案,涵盖恒加速度模型、乱序测量处理(OOSM)、轨迹预测等核心技术,融合RMSE达3.36px,显著优于单传感器方案。