发布者认证信息(营业执照和身份证)未完善,请登录后完善信息登录
 总算清楚只需两张照片就能 2D 变 3D,华人学者开发出新 AI 应用 - 最新消息 - 三农网
Hi,你好,欢迎来到三农网
  • 产品
  • 求购
  • 公司
  • 展会
  • 招商
  • 资讯
当前位置: 首页 » 资讯 » 中国新农村 找商家、找信息优选VIP,安全更可靠!
总算清楚只需两张照片就能 2D 变 3D,华人学者开发出新 AI 应用 - 最新消息
发布日期:2023-07-28 10:14:28  浏览次数:8

2 张废片啪地一合!错过的精彩瞬间立刻重现,还能从 2D 升到 3D 效果。看,小男孩可爱的笑容马上跃然浮现:

吹灭生日蛋糕蜡烛的瞬间也被还原了出来:

咧嘴笑起来的过程看着也太治愈了吧~

咱就是说,这回相机里熊孩子 / 毛孩子的废片终于有救了!而且完全看不出是后期合成的效果,仿佛是原生拍摄的一般。

这就是谷歌、康奈尔大学、华盛顿大学最近联合推出的成果,能只用 2 张相近的照片还原出 3D 瞬间,目前已被 CVPR 2022 收录。

论文作者一作、二作均为华人,一作小姐姐本科毕业于浙江大学。

用 2 张照片正反向预测中间场景

这种方法适用于两张非常相似的照片,比如连拍时产生的一系列照片。

方法的关键在于将 2 张图片转换为一对基于特征的分层深度图像 (LDI),并通过场景流进行增强。整个过程可以把两张照片分别看做是“起点”和“终点”,然后在这二者之间逐步预测出每一刻的变化。

具体来看,过程如下:

首先,将两张照片用单应矩阵(homegraphy)对齐,分别预测两张照片的稠密深度图。然后将每个 RGBD 图像转换为彩色的 LDI,通过深度感知修复背景中被遮挡的部分。

其中,RGB 图像即为普通 RGB 图像 + 深度图像。

之后用二维特征提取器修复 LDI 的每个颜色层,以获取特征层,从而生成两份特征图层。下一步就到了模拟场景运动部分。通过预测两个输入图像之间的深度和光流,就能计算出 LDI 中每个像素的场景流。

而如果想要两张图之间渲染出一个新的视图、并提升到 3D,在此需要将两组带特征值的 LDI 提升到一对 3D 点云中,还要沿着场景流双向移动到中间的时间点。然后再将三维的特征点投影展开,形成正向、反向的二维特征图及对应深度图。

最后将这些映射与时间线中对应时间点的权重线性混合,将结果传给图像合成网络,就能得到最后的效果了。

实验结果

从数据方面来看,该方法在所有误差指标上,均高于基线水平。

在 UCSD 数据集上,这一方法可以保留画面中的更多细节,如(d)所示。

在 NVIDIA 数据集上进行消融实验表明,该方法在提高渲染质量上表现也很 nice。

不过也存在一些问题:当两张图像之间的改变比较大时,会出现物体错位的现象。

比如下图中酒瓶的瓶嘴移动了,不该发生变化的酒杯也摇晃了起来。

还有照片如果没有拍全的地方,在合成的时候难免会出现“截肢”的情况,比如下图中喂考拉的手。

团队介绍

该研究的一作为 Qianqian Wang,现在在康奈尔大学读博四。

她本科毕业于浙江大学,师从周晓巍。

研究兴趣为计算机视觉、计算机图形学和机器学习。

二作是 Zhengqi Li,博士毕业于康纳尔大学,本科毕业于明尼苏达大学,目前在 Google Research。

曾获提名 CVPR 2019 最佳论文,谷歌 2020 博士奖研金,2020 年 Adobe Research 奖学金,入围 Baidu 2021 年 AI 华人新星百强榜单。

参与此项研究的还有华盛顿大学教授 Brian Curless。

他还提出过另一种方法能够实现类似效果,同样只用到了 2 张照片,通过新型帧插值模型生成连贯的视频。

论文地址:

https://3d-/

VIP企业最新发布
全站最新发布
最新VIP企业
背景开启

三农网是一个开放的平台,信息全部为用户自行注册发布!并不代表本网赞同其观点或证实其内容的真实性,需用户自行承担信息的真实性,图片及其他资源的版权责任! 本站不承担此类作品侵权行为的直接责任及连带责任。

如若本网有任何内容侵犯您的权益,请联系 QQ: 1130861724

网站首页 | 实时热点 | 侵权删除 | 付款方式 | 联系方式 | 法律责任 | 网站地图 ©2022 zxb2b.com 三农网,中国大型农产品交易电商平台 鄂公网安备42018502006996 SITEMAPS | 鄂ICP备14015623号-20

返回顶部