拍完之后发生了什么:从上传到重建完成

点下提交,素材离开手机,接下来的一切都在云端与系统后台发生。这一页把这段"看不见的过程"拆开讲清楚,方便你知道等待的每一分钟花在了哪。
四段链路
- 上传:环绕视频连同拍摄时记录的相机位姿数据一起上传。位姿数据来自系统 AR 能力,它让云端不必从零估算相机的位置轨迹。
- 配准:云端把视频拆成关键帧,靠高精度位姿数据辅助图像配准——知道每张照片是从哪拍的,帧与帧的对应关系就省了大量计算。
- 3D 高斯训练:重建算法优化几百万个"高斯团"的颜色、位置、透明度,直到从任何视角看都与真实画面一致。
- 产出沉浸空间:训练完成,生成一条 Interactive Photo,回到应用里的相册页就能看。
时间都花在哪
- 公开口径:平均约 5 分钟完成重建(相同清晰度下训练速度居前)。一年后的生态活动报道里,基于 Spatial Recon Kit 的端侧方案已把单次建模平均耗时压到约 3.5 分钟。
- 具体耗时与场景复杂度、素材质量、网络条件都有关系,以最新版本实际表现为准。
等待期间手机端在做什么
方舟 3D 图形引擎在本地先渲染一份基于稠密点云的空间预览——拍完几乎立刻就能看到场景的大致立体轮廓,不必干等到训练完成(细节见点云预览)。
简单说:点云先给你看个大概,高斯模型随后精修到位。这也是"拍完即看、等待不空等"的体验来源。