把一段环拍视频变成能放进游戏或建模软件的3D场景,通常要在多个工具之间来回倒腾,还常被NVIDIA的CUDA生态卡住。Spirula Studio想把这件事压进一个程序:从照片或视频提取画面、估计相机位置,训练3D Gaussian Splatting——用大量带颜色和透明度的三维点还原场景——再转成由多边形构成、方便后续编辑的网格。它不要求另装Python、PyTorch或摄影测量工具COLMAP。
更值得留意的是它押注Vulkan Compute,让通用计算能跨NVIDIA、AMD、Intel和Apple GPU运行,而CUDA只作为旧后端保留。项目作者称,两种后端提供相同的训练和网格生成功能,速度差异通常只有几个百分点;借助量化训练,8GB显存最多可容纳1000万个带完整SH信息的Gaussian点。它还原生处理鱼眼和360度相机,并内置视频抽帧、AI遮罩等环节。不过这些兼容性、效率和画质说法目前均来自项目自身,材料未提供独立测试。