首页
在没有3D监督的情况下学习3D对象形状和布局
返回

在没有3D监督的情况下学习3D对象形状和布局

2022-12-19 科技信息 By:佚名
最佳答案可以通过每个对象的3D形状和空间中对象的3D布局来指定3D场景。然而,直接测量3D结构通常是不切实际的;因此,从2D图像推断3D场景的形状和布局是计算机视觉中的一个基本问题。arXiv.org最近的一篇论文提出了一种从单个图像预测复杂场景中的3D对象形状和布局的方法。它在训练期间不使用地面实况形状或...

可以通过每个对象的3D形状和空间中对象的3D布局来指定3D场景。然而,直接测量3D结构通常是不切实际的;因此,从2D图像推断3D场景的形状和布局是计算机视觉中的一个基本问题。

arXiv.org最近的一篇论文提出了一种从单个图像预测复杂场景中的3D对象形状和布局的方法。它在训练期间不使用地面实况形状或布局,多视图图像中的对象轮廓用于学习。

预测3D形状的MeshR-CNN增加了一个布局网络,该网络估计每个对象的3D位置。三个数据集的结果展示了可扩展多视图监督的实用性。该方法可扩展到具有许多对象的复杂、逼真的场景,并且可以从嘈杂的真实世界视频中学习,而无需昂贵的地面实况。

3D场景由一组对象组成,每个对象都有一个形状和一个布局,给出了它们在空间中的位置。从2D图像中理解3D场景是一个重要目标,在机器人和图形学中都有应用。虽然最近在从单个图像预测3D形状和布局方面取得了进展,但大多数方法依赖于3D地面实况进行训练,而大规模收集的成本很高。我们克服了这些限制,并提出了一种无需任何地面实况形状或布局信息即可学习预测对象的3D形状和布局的方法:相反,我们依赖于具有2D监督的多视图图像,可以更轻松地大规模收集。通过对3DWarehouse、Hypersim和ScanNet的广泛实验,我们证明了我们的方法可以扩展到真实图像的大型数据集,并且与依赖3D地面实况的方法相比具有优势。在无法获得可靠的3D地面实况的Hypersim和ScanNet上,我们的方法优于在较小和较少多样化数据集上训练的监督方法。

猜你喜欢
蒲地蓝消炎片的作用有哪些功效(蒲地蓝消炎片的作用有哪些)

蒲地蓝消炎片的作用有哪些功效(蒲地蓝消炎片的作用有哪些)

12-19 0 阅读
申请一个公众号要钱吗(申请公众号要钱吗)

申请一个公众号要钱吗(申请公众号要钱吗)

12-19 0 阅读
直销家园网官网(直销家园网)

直销家园网官网(直销家园网)

12-01 0 阅读
进口轴承(关于进口轴承的介绍)

进口轴承(关于进口轴承的介绍)

12-18 0 阅读
亚米级是啥意思(亚米级是什么意思)

亚米级是啥意思(亚米级是什么意思)

12-19 0 阅读
柏吉尔资料(柏吉尔)

柏吉尔资料(柏吉尔)

12-18 0 阅读
热门推荐
九月第一天怎么发朋友圈说说(九月第一天怎么发朋友圈)

九月第一天怎么发朋友圈说说(九月第一天怎么发朋友圈)

12-18 0 阅读
第一款Blocks模块化智能手表可供预订

第一款Blocks模块化智能手表可供预订

12-19 0 阅读
怎么保证余额宝的安全(余额宝安全漏洞)

怎么保证余额宝的安全(余额宝安全漏洞)

12-18 0 阅读
荣耀C系列的新成员有望很快推出

荣耀C系列的新成员有望很快推出

12-18 0 阅读
spn故障码大全(spn)

spn故障码大全(spn)

12-19 0 阅读
蓝色生活一(2015)和生活8 xl在美国首次亮相

蓝色生活一(2015)和生活8 xl在美国首次亮相

12-18 0 阅读
曾经是小小少年到如今风度翩翩歌词(曾经小小少年到如今风度翩翩什么歌)

曾经是小小少年到如今风度翩翩歌词(曾经小小少年到如今风度翩翩什么歌)

12-19 0 阅读
小欧手机游戏(小欧手机)

小欧手机游戏(小欧手机)

12-18 0 阅读
人最正确的睡觉方向财运(人最正确的睡觉方向)

人最正确的睡觉方向财运(人最正确的睡觉方向)

10-05 0 阅读
LG KF510(LG KF600)

LG KF510(LG KF600)

12-18 0 阅读