首页
在没有3D监督的情况下学习3D对象形状和布局
返回

在没有3D监督的情况下学习3D对象形状和布局

2022-12-19 科技信息 By:佚名
最佳答案可以通过每个对象的3D形状和空间中对象的3D布局来指定3D场景。然而,直接测量3D结构通常是不切实际的;因此,从2D图像推断3D场景的形状和布局是计算机视觉中的一个基本问题。arXiv.org最近的一篇论文提出了一种从单个图像预测复杂场景中的3D对象形状和布局的方法。它在训练期间不使用地面实况形状或...

可以通过每个对象的3D形状和空间中对象的3D布局来指定3D场景。然而,直接测量3D结构通常是不切实际的;因此,从2D图像推断3D场景的形状和布局是计算机视觉中的一个基本问题。

arXiv.org最近的一篇论文提出了一种从单个图像预测复杂场景中的3D对象形状和布局的方法。它在训练期间不使用地面实况形状或布局,多视图图像中的对象轮廓用于学习。

预测3D形状的MeshR-CNN增加了一个布局网络,该网络估计每个对象的3D位置。三个数据集的结果展示了可扩展多视图监督的实用性。该方法可扩展到具有许多对象的复杂、逼真的场景,并且可以从嘈杂的真实世界视频中学习,而无需昂贵的地面实况。

3D场景由一组对象组成,每个对象都有一个形状和一个布局,给出了它们在空间中的位置。从2D图像中理解3D场景是一个重要目标,在机器人和图形学中都有应用。虽然最近在从单个图像预测3D形状和布局方面取得了进展,但大多数方法依赖于3D地面实况进行训练,而大规模收集的成本很高。我们克服了这些限制,并提出了一种无需任何地面实况形状或布局信息即可学习预测对象的3D形状和布局的方法:相反,我们依赖于具有2D监督的多视图图像,可以更轻松地大规模收集。通过对3DWarehouse、Hypersim和ScanNet的广泛实验,我们证明了我们的方法可以扩展到真实图像的大型数据集,并且与依赖3D地面实况的方法相比具有优势。在无法获得可靠的3D地面实况的Hypersim和ScanNet上,我们的方法优于在较小和较少多样化数据集上训练的监督方法。

猜你喜欢
离合器片打滑怎么解决(离合器片)

离合器片打滑怎么解决(离合器片)

12-19 0 阅读
怎么知道室温是多少度(室温是多少度)

怎么知道室温是多少度(室温是多少度)

12-18 0 阅读
丈夫有外遇该怎么办(丈夫有外遇怎么办)

丈夫有外遇该怎么办(丈夫有外遇怎么办)

12-18 0 阅读
手机杀毒软件哪个好(手机杀毒软)

手机杀毒软件哪个好(手机杀毒软)

12-18 0 阅读
电脑怎么更新苹果手机系统(怎么更新苹果手机系统)

电脑怎么更新苹果手机系统(怎么更新苹果手机系统)

12-18 0 阅读
Windows(8.1及Update五大新特征)

Windows(8.1及Update五大新特征)

12-18 0 阅读
热门推荐
有效市场是什么意思(有效市场)

有效市场是什么意思(有效市场)

12-18 0 阅读
iphone4s(配置(iphone4s的配置))

iphone4s(配置(iphone4s的配置))

12-18 0 阅读
体罚机作文(体罚机)

体罚机作文(体罚机)

05-17 0 阅读
如何百米冲刺(百米冲刺技巧)

如何百米冲刺(百米冲刺技巧)

12-18 0 阅读
永久c自行车怎么样(永久c自行车)

永久c自行车怎么样(永久c自行车)

12-18 0 阅读
qq名称群名(qq群个性名称)

qq名称群名(qq群个性名称)

12-18 0 阅读
如何让电脑运行更快(如何让电脑运行更快)

如何让电脑运行更快(如何让电脑运行更快)

12-18 0 阅读
维普通达官网(维普通达)

维普通达官网(维普通达)

12-18 0 阅读
nsaids怎么读(nsaids)

nsaids怎么读(nsaids)

12-18 0 阅读
湖南省特种作业操作证查询系统(湖南特种作业操作证网上查询系统)

湖南省特种作业操作证查询系统(湖南特种作业操作证网上查询系统)

12-18 0 阅读