NeRF新研究来了：3D场景无痕移除不需要对象，精确到毛发

程序猿 • 2025年11月27日 06:44:24 • 用户投稿 • 阅读 1

神经辐射场（NeRF）已经成为一种流行的新视图合成方法。虽然 NeRF 正在快速泛化到更广泛的应用以及数据集中，但直接编辑 NeRF 的建模场景仍然是一个巨大的挑战。一个重要的任务是从 3D 场景中删除不需要的对象，并与其周围场景保持一致性，这个任务称为 3D 图像修复。在 3D 中，解决方案必须在多个视图中保持一致，并且在几何上具有有效性。

本文来自三星、多伦多大学等机构的研究人员提出了一种新的三维修复方法来解决这些挑战，在单个输入图像中给定一小组姿态图像和稀疏注释，提出的模型框架首先快速获得目标对象的三维分割掩码并使用该掩码，然后引入一种基于感知优化的方法，该方法利用学习到的二维图像再进行修复，将他们的信息提取到三维空间，同时确保视图的一致性。

该研究还通过训练一个很有挑战性的现实场景的数据集，给评估三维场景内修复方法带来了新的基准测试。特别是，该数据集包含了有或没有目标对象的同一场景的视图，从而使三维空间内修复任务能够进行更有原则的基准测试。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

论文地址：https://arxiv.org/pdf/2211.12254.pdf论文主页：https://spinnerf3d.github.io/

下面为效果展示，在移除一些对象后，还能与其周围场景保持一致性：

本文方法和其他方法的比较，其他方法存在明显的伪影，而本文的方法不是很明显：

方法介绍

作者通过一种集成的方法来应对三维场景编辑任务中的各种挑战，该方法获取场景的多视图图像，以用户输入提取到的 3D 掩码，并用 NeRF 训练来拟合到掩码图像中，这样目标对象就被合理的三维外观和几何形状取代。现有的交互式二维分割方法没有考虑三维方面的问题，而且目前基于 NeRF 的方法不能使用稀疏注释得到好的结果，也没有达到足够的精度。虽然目前一些基于 NeRF 的算法允许去除物体，但它们并不试图提供新生成的空间部分。据目前的研究进展，这个工作是第一个在单一框架中同时处理交互式多视图分割和完整的三维图像修复的方法。

研究者利用现成的、无 3D 的模型进行分割和图像修复，并以视图一致性的方式将其输出转移到 3D 空间。建立在 2D 交互式分割工作的基础上，作者所提出的模型从一个目标对象上的少量用户用鼠标标定的图像点开始。由此，他们的算法用一个基于视频的模型初始化掩码，并通过拟合一个语义掩码的 NeRF ，将其训练成一个连贯的 3D 分割。然后，再应用预先训练的二维图像修复到多视图图像集上，NeRF 拟合过程用于重建三维图像场景，利用感知损失去约束 2 维画图像的不一致，以及画深度图像规范化掩码的几何区域。总的来说，研究者们提供了一个完整的方法，从对象选择到嵌入的场景的新视图合成，在一个统一的框架中对用户的负担最小，如下图所示。

综上所述，这篇工作的贡献如下：

一个完整的 3D 场景操作过程，从用户交互的对象选择开始，到 3D 修复的 NeRF 场景结束；将二维的分割模型扩展到多视图情况，能够从稀疏注释中恢复出具有三维一致的掩码；确保视图一致性和感知合理性，一种新的基于优化的三维修复公式，利用二维图像修复；一个新的用于三维编辑任务评估的数据集，包括相应的操作后的 Groud Truth。

具体到方法上面，该研究首先描述了如何从单视图注释中初始化一个粗略的 3D 掩码。将已标注的源代码视图表示为 I_1。将对象和源视图的稀疏信息给一个交互式分割模型，用来估计初始源对象掩码。然后将训练视图作为一个视频序列，与一起给出一个视频实例分割模型 V ，以计算，其中是 I_i 的对象掩码的初始猜测。初始的掩码通常在边界附近是不准确的，因为训练视图实际上并不是相邻的视频帧，而视频分割模型通常是未知 3D 的。

多视图分割模块获取输入的 RGB 图像、相应的相机内在和外部参数，以及初始掩码去训练一个语义 NeRF 。上图描述了语义 NeRF 中使用的网络；对于点 x 和视图目录 d，除了密度 σ 和颜色 c 外，它还返回一个 pre-sigmoid 型的对象 logit，s (x)。为了其快速收敛，研究者使用 instant-NGP 作为他们的 NeRF 架构。与光线 r 相关联的期望客观性是通过在等式中呈现 r 上的点的对数而不是它们相对于密度的颜色而得到的：

然后使用分类损失进行监督：

用于监督基于 NeRF 的多视图分割模型的总体损失为：

最后，采用两个阶段进行优化，进一步改进掩码；在获得初始三维掩码后，从训练视图呈现掩码，并用于监督二次多视图分割模型作为初始假设（而不是视频分割输出）。

上图显示了视图一致的修复方法概述。由于数据的缺乏妨碍了直接训练三维修改修复模型，该研究利用现有的二维修复模型来获得深度和外观先验，然后监督 NeRF 对完整场景的渲染拟合。这个嵌入的 NeRF 使用以下损失进行训练：

该研究提出具有视图一致性的修复方法，输入为 RGB。首先，该研究将图像和掩码对传输给图像修复器以获得 RGB 图像。由于每个视图都是独立修复的，因此直接使用修复完的视图监督 NeRF 的重建。本文中，研究者并没有使用均方误差（MSE）作为 loss 生成掩码，而是建议使用感知损失 LPIPS 来优化图像的掩码部分，同时仍然使用 MSE 来优化未掩码部分。该损失的计算方法如下：

即使有感知损失，修复视图之间的差异也会错误地引导模型收敛到低质量几何（例如，摄像机附近可能形成 “模糊” 几何测量，以解释每个视图的不同信息）。因此，研究员使用已生成的深度图作为 NeRF 模型的额外指导，并在计算感知损失时分离权值，使用感知损失只拟合场景的颜色。为此，研究者使用了一个对包含不需要的对象的图像进行了优化的 NeRF，并渲染了与训练视图对应的深度图。其计算方法是用到相机的距离而不是点的颜色代替的方法：

然后将渲染的深度输入到修复器模型，以获得修复完的深度图。研究发现，使用 LaMa 进行深度绘制，如 RGB，可以得到足够高质量的结果。这个 NeRF 可以是与用于多视图分割的相同模型，若使用其他来源来获取掩码，如人工注释的掩码，一个新的 NeRF 将被安装到场景中。然后，这些深度图被用来监督已修复的 NeRF 的几何形状，通过其渲染深度然后将渲染的深度输入到修复器模型，以获得修复完的深度图。研究发现，使用 LaMa 进行深度绘制，如 RGB，可以得到足够高质量的结果。这个 NeRF 可以是与用于多视图分割的相同模型，若使用其他来源来获取掩码，如人工注释的掩码，一个新的 NeRF 将被安装到场景中。然后，这些深度图被用来监督已修复的 NeRF 的几何形状，通过其渲染深度到修复的深度的到修复的深度的距离：

实验结果

多视图分割：首先评估 MVSeg 模型，没有任何编辑修复。在本实验中，假设稀疏图像点已经给出了一个现成的交互式分割模型，并且源掩码是可用的。因此，该任务是将源掩码传输到其他视图中。下表显示，新模型优于 2D（3D 不一致）和 3D 基线。此外研究者提出的两阶段优化有助于进一步改进所得到的掩码。

定性分析来说，下图将研究人员的分割模型的结果与 NVOS 和一些视频分割方法的输出进行了比较。与 3D 视频分割模型的粗边相比，他们的模型降低了噪声并提高了视图的一致性。虽然 NVOS 使用涂鸦（scribbles）不是研究者新模型中使用的稀疏点，但新模型的 MVSeg 在视觉上优于 NVOS。由于 NVOS 代码库不可用，研究人员复制了已发布的 NVOS 的定性结果（更多的例子请参见补充文档）。

下表显示了 MV 方法与基线的比较，总的来说，新提出的方法明显优于其他二维和三维修复方法。下表进一步显示，去除几何图形结构的引导会降低已修复的场景质量。

定性结果如图 6、图 7 所示。图 6 表明，本文方法可以重建具有详细纹理的视图一致场景，包括有光泽和无光泽表面的连贯视图。图 7 表明，本文的感知方法减少了掩码区域的精确重建约束，从而在使用所有图像时防止了模糊的出现，同时也避免了单视图监督造成的伪影。

Fireflies.ai

自动化会议记录和笔记工具，可以帮助你的团队记录、转录、搜索和分析语音对话。

99 查看详情

以上就是NeRF新研究来了：3D场景无痕移除不需要对象，精确到毛发的详细内容，更多请关注创想鸟其它相关文章！

版权声明：本文内容由互联网用户自发贡献，该文观点仅代表作者本人。本站仅提供信息存储空间服务，不拥有所有权，不承担相关法律责任。
如发现本站有涉嫌抄袭侵权/违法违规的内容，请发送邮件至 chuangxiangniao@163.com 举报，一经查实，本站将立刻删除。
发布者：程序猿，转转请注明出处：https://www.chuangxiangniao.com/p/828403.html

ai o pdf 工具神经网络

打赏

微信扫一扫

支付宝扫一扫

0 0

关于作者

程序猿签约作者

414.1K 文章

0 评论

2 粉丝

这个人很懒，什么都没有留下～

寻道大千镇魔凶魂天尉打法策略，技能拆解与阵容搭配指南

上一篇 2025年11月27日 06:44:24

sublime怎么修改标签页(tab)的样式和大小_sublime自定义Tab外观与尺寸方法

下一篇 2025年11月27日 06:44:24

用户投稿

composer require-dev和require有什么不同_Composer Require与Require-Dev区别解析

require用于声明项目运行必需的依赖，如框架、数据库组件和第三方SDK，这些包会随项目部署到生产环境；2. require-dev用于声明仅在开发和测试阶段需要的工具，如PHPUnit、PHPStan、Faker等，不会默认部署到生产环境；3. 安装时composer install根据环境决定…

程序猿
2026年5月10日
10000
用户投稿

Golang JSON序列化：控制敏感字段暴露的最佳实践

本教程探讨golang中如何高效控制结构体字段在json序列化时的可见性。当需要将包含敏感信息的结构体数组转换为json响应时，通过利用`encoding/json`包提供的结构体标签，特别是`json:”-“`，可以轻松实现对特定字段的忽略，从而避免敏感数据泄露，确保api…

程序猿
2026年5月10日
0000
用户投稿

利用海象运算符简化条件赋值：Python教程与最佳实践

本文旨在探讨Python中海象运算符（:=）在条件赋值场景下的应用。通过对比传统if/else语句与海象运算符，以及条件表达式，分析海象运算符在简化代码、提高可读性方面的优势与局限性。并通过具体示例，展示如何在列表推导式等场景下合理使用海象运算符，同时强调其潜在的复杂性及替代方案，帮助开发者更好地掌…

程序猿
2026年5月10日
1000
用户投稿

Debian syslog性能优化技巧有哪些

提升Debian系统syslog (通常基于rsyslog)性能，关键在于精简配置和高效处理日志。以下策略能有效优化日志管理，提升系统整体性能：精简配置，高效加载: 在rsyslog配置文件中，仅加载必要的输入、输出和解析模块。使用全局指令设置日志级别和格式，避免不必要的处理。自定义模板: 创…

程序猿
2026年5月10日
0000
用户投稿

比特币新手教程比特币交易平台有哪些

比特币是一种去中心化的数字货币，基于区块链技术实现点对点交易，具有匿名性、有限发行和不可篡改等特点；新手可通过交易所购买，P2P交易获得比特币，常用平台包括Binance、OKX和Huobi；交易流程包括注册账户、实名认证、绑定支付方式、充值法币并下单购买，可选择市价单或限价单；比特币存储方式有交易…

程序猿
2026年5月10日
0000
用户投稿

c++中的SFINAE技术是什么_c++模板编程中的SFINAE原理与应用

SFINAE 是“替换失败不是错误”的原则，指模板实例化时若参数替换导致错误，只要存在其他合法候选，编译器不报错而是继续重载决议。它用于条件启用模板、类型检测等场景，如通过 decltype 或 enable_if 控制函数重载，实现类型特征判断。尽管 C++20 引入 Concepts 简化了部分…

程序猿
2026年5月10日
0000
用户投稿

Go语言mgo查询构建：深入理解bson.M与日期范围查询的正确实践

本文旨在解决go语言mgo库中构建复杂查询时，特别是涉及嵌套`bson.m`和日期范围筛选的常见错误。我们将深入剖析`bson.m`的类型特性，解释为何直接索引`interface{}`会导致“invalid operation”错误，并提供一种推荐的、结构清晰的代码重构方案，以确保查询条件能够正确…

程序猿
2026年5月10日
1000
用户投稿

Golang goroutine与channel调试技巧

使用go run -race检测数据竞争，结合runtime.NumGoroutine监控协程数量，通过pprof分析阻塞调用栈，利用select超时避免永久阻塞，有效排查goroutine泄漏、死锁和数据竞争问题。 Go语言的goroutine和channel是并发编程的核心，但它们也带来了调试上…

程序猿
2026年5月10日
0000
用户投稿

使用 Jupyter Notebook 进行探索性数据分析

Jupyter Notebook通过单元格实现代码与Markdown结合，支持数据导入（pandas）、清洗（fillna）、探索（matplotlib/seaborn可视化）、统计分析（describe/corr）和特征工程，便于记录与分享分析过程。 Jupyter Notebook 是进行探索性…

程序猿
2026年5月10日
0000
《魔兽世界》将于6月11日开启国服回归技术测试

《%ign%ignore_a_1%re_a_1%》官方宣布，将于6月11日开启国服回归技术测试，时间为7天，并称可以在6月内正式开服，玩家们可以访问官网下载战网客户端并预下载“巫妖王之怒”客户端，技术测试详情见下图。 WordAi WordAI是一个AI驱动的内容重写平台 53 查看详情以上就是《…

程序猿
2026年5月10日 • 用户投稿
2000
用户投稿

如何在HTML中插入表单元素_HTML表单控件与输入类型使用指南

HTML表单通过标签构建，包含action和method属性定义数据提交目标与方式，常用input类型如text、password、email等适配不同输入需求，配合label、required、placeholder提升可用性，结合textarea、select、button等控件实现完整交互，是…

程序猿
2026年5月10日
1000
用户投稿

网站标题关键词更新后，搜索引擎为何仍显示旧标题？

网站标题更新后，搜索引擎为何显示旧标题？网站SEO优化中，站长常修改网站标题关键词，期望搜索结果显示自定义标题。然而，即使更新标签、meta keywords、meta description和结构化数据中的name属性后，搜索结果仍显示旧标题，这令人费解。本文将对此进行解释。问题：站长修改了网…

程序猿
2026年5月10日
1000
用户投稿

创建指定大小并填充特定数据的Golang文件教程

本文将介绍如何使用Golang创建一个指定大小的文件，并用特定数据填充它。我们将使用 `os` 包提供的函数来创建和截断文件，从而实现快速生成大文件的目的。示例代码展示了如何创建一个10MB的文件，并将其填充为全零数据。掌握这些方法，可以方便地在例如日志系统或磁盘队列等场景中，预先创建测试文件或初始…

程序猿
2026年5月10日
0000
用户投稿

Python命令怎样使用profile分析脚本性能 Python命令性能分析的基础教程

使用Python的cProfile模块分析脚本性能最直接的方式是通过命令行执行python -m cProfile your_script.py，它会输出每个函数的调用次数、总耗时、累积耗时等关键指标，帮助定位性能瓶颈；为进一步分析，可将结果保存为文件python -m cProfile -o ou…

程序猿
2026年5月10日
0000
用户投稿

使用 WebCodecs VideoDecoder 实现精确逐帧回退

本文档旨在解决在使用 WebCodecs VideoDecoder 进行视频解码时，实现精确逐帧回退的问题。通过比较帧的时间戳与目标帧的时间戳，可以避免渲染中间帧，从而提高用户体验。本文将提供详细的解决方案和示例代码，帮助开发者实现精确的视频帧控制。在使用 WebCodecs VideoDecod…

程序猿
2026年5月10日
0000
如何插入查询结果数据_SQL插入Select查询结果方法

使用INSERT INTO…SELECT语句可高效插入数据，通过NOT EXISTS、LEFT JOIN、MERGE语句或唯一约束避免重复；表结构不一致时可通过别名、类型转换、默认值或计算字段处理；结合存储过程可提升可维护性，支持参数化与动态SQL。将查询结果数据插入到另一个表中，可以…

程序猿
2026年5月10日 • 用户投稿
0000
用户投稿

Discord.py 交互按钮超时与持久化解决方案

本教程旨在解决Discord.py中交互按钮在一段时间后出现“This Interaction Failed”错误的问题。我们将深入探讨视图（View）的超时机制，并提供通过正确设置timeout参数以及利用bot.add_view()方法实现按钮持久化的具体方案，确保您的机器人交互功能稳定可靠，即…

程序猿
2026年5月10日
0000
用户投稿

Debian Copilot的社区活跃度如何

debian copilot是codeberg社区维护的ai助手，旨在为debian用户提供服务。尽管搜索结果中没有直接提供关于debian copilot社区支持活跃度的具体数据，但我们可以通过debian社区的整体活跃度和特点来推断其活跃性。 Debian社区的一般情况： Debian拥有详尽的…

程序猿
2026年5月10日
0000
用户投稿

python中zip函数详解 python多序列压缩zip函数应用场景

zip函数的应用场景包括：1) 同时遍历多个序列，2) 合并多个列表的数据，3) 数据分析和科学计算中的元素运算，4) 处理csv文件，5) 性能优化。zip函数是一个强大的工具，能够简化代码并提高处理多个序列时的效率。在Python中，zip函数是一个非常有用的工具，它能够将多个可迭代对象打包成…

程序猿
2026年5月10日
0000
用户投稿

JavaScript 动态菜单点击高亮效果实现教程

本教程详细介绍了如何使用 JavaScript 实现动态菜单的点击高亮功能。通过事件委托和状态管理，当用户点击菜单项时，被点击项会高亮显示（绿色），同时其他菜单项恢复默认样式（白色）。这种方法避免了不必要的DOM操作，提高了性能和代码可维护性，确保了无论点击方向如何，功能都能稳定运行。动态菜单高亮…

程序猿
2026年5月10日
2000

发表回复

登录后才能评论

NeRF新研究来了：3D场景无痕移除不需要对象，精确到毛发

方法介绍

实验结果

关于作者

相关推荐

发表回复