照片视频与OSD匹配
背景
项目已经对照片、视频和 OSD 的匹配可行性做过一次较完整的样本分析,这份经验直接决定了后续“视频识别结果能否反算经[坐标已隐藏]的可信边界。
已确认结论
- 原始照片虽然去除了画面水印,但仍完整保留 EXIF 和 DJI XMP 元数据,可用于精确匹配 OSD。
- 5 组照片与最近 OSD 记录的时间差均小于 0.6 秒,平面坐标差为 0.007 到 0.072 米,高度差不超过 0.132 米。
- 对照片样本,应优先采用照片自身 XMP 中的姿态信息,而不是机械地取最近一条 OSD。
- 视频帧匹配不能使用“帧号除以 30fps”的简化算法,必须读取帧 PTS。
视频与 OSD 的匹配规则
- 视频首帧绝对时间 =
creation_time + 帧 PTS - 在按时间排序的 OSD 中查找目标帧前后两条记录。
- [坐标已隐藏][坐标已隐藏]高度、速度等连续数值采用线性插值。
- 姿态角需要先判断是否处于快速转动或角度跳变区间,再决定是否插值。
可用区间与不可用区间
- 视频与 OSD 有效重叠区间约为 741.281 秒。
- 视频最后约 223.956 秒无对应 OSD。
- 超出 OSD 覆盖范围的帧可以保留 YOLO 识别结果,但不能生成目标地理坐标。
落地规则
- 照片定位优先级: 原始照片 XMP > 最近 OSD > OSD 插值
- 视频定位优先级: 帧 PTS + 前后 OSD 插值 > 最近 OSD 单点
- 高度字段使用时,要明确
AbsoluteAltitude和 OSDheight的对应关系,避免把相对高度混成绝对高度。
待确认
- 不同镜头类型和变焦倍率下,
liveviewWorldRegion的映射是否都已验证。 - 视频进入无 OSD 区间后,业务侧如何展示“仅识别、不定位”的结果。
- 后续是否需要把这套匹配逻辑沉淀成统一服务,而不是案例级分析。
参考来源
- 公众号落地笔记:[[第四十一篇-把像素变成经[坐标已隐藏]