arXiv:2606.13345cs.CV2026-06被引 1

一次输入,全视角生成:3D场景编辑速度与结构一致性双提升

JointEdit3D: Feed-Forward 3D Scene Editing in a Unified Latent Space

论文配图:JointEdit3D: Feed-Forward 3D Scene Editing in a Unified Latent Space
图 1 · 摘自论文原文
  • 基于统一潜空间的前馈式编辑,单参考图驱动多视角生成
  • 在15K数据集上实现更优的编辑区域质量与3D结构完整性
  • 适合需要高效、保真3D内容生成的研究者与开发者

现有3D场景编辑方法通常依赖于显式3D表示的逐场景优化或级联编辑-重建流程,导致测试时开销高、3D感知弱且结构不一致。为在编辑过程中联合建模外观合成与几何预测,我们构建了一个统一的RGB-几何重建-生成潜空间,并将其适配为前馈式3D场景编辑框架。提出的JointEdit3D通过观察单一编辑后的RGB参考潜空间,利用源场景锚定机制生成其余视角的RGB和修改后的几何潜空间。该框架引入专用的SceneAnchor分支注入源场景结构,避免强制复制;同时采用编辑/背景感知损失,平衡编辑区域保真度与未编辑内容的保留。针对缺乏标准评估资源的问题,我们构建了包含15,000对样本的SceneEdit3D-15K数据集及100样本的SceneEdit3D-Bench基准。实验表明,JointEdit3D在编辑区域质量与3D结构完整性上优于现有基线,同时保持了良好的背景保留性能。

原文摘要 · Abstract (English)

Existing 3D scene editing methods typically rely on per-scene optimization over explicit 3D representations or cascaded edit-and-reconstruct pipelines, resulting in high test-time cost, limited 3D awareness, and structural inconsistencies. To couple appearance synthesis and geometry prediction during editing, we build on a unified RGB-geometry reconstruction-generation latent space and adapt it to feed-forward 3D scene editing. The resulting framework, \textbf{JointEdit3D}, performs asymmetric latent inpainting by observing only a single edited RGB reference latent and generating the remaining RGB views and edited geometry latent under source-scene anchoring. JointEdit3D introduces a dedicated SceneAnchor Branch to inject source-scene structure without forcing direct copying, and adopts edit/background-aware losses to balance edited-region fidelity with unedited-content preservation. To address the lack of paired resources for standardized 3D scene editing evaluation, we introduce SceneEdit3D-15K, a dataset with 15K paired editing samples and renderer-provided 3D annotations, together with SceneEdit3D-Bench, a curated 100-sample benchmark. Experiments show that JointEdit3D improves edited-region quality and 3D structural completeness over prior baselines while maintaining competitive background preservation.

3D编辑潜空间前馈生成结构一致性

Thank you to arXiv for use of its open access interoperability. PaperDance 不是 arXiv 官方产品;中文卡片由大模型生成,请以原文为准。