Occupancy Flow: 4D Reconstruction by Learning Particle Dynamics论文笔记

Motivation

it is not clear how to extend these results to time-varying topologies. Approaches treating each time step individually lack continuity and exhibit slow inference, while traditional 4D reconstruction methods often utilize a template model or discretize the 4D space at fixed resolution

目前的SOTA方法难以扩展到时变拓扑结构。单独处理每个时间步长的方法缺乏连续性,推理速度慢,而传统的4D重建方法通常使用模板模型或以固定分辨率离散4D空间

Contribution

present Occupancy Flow, a novel spatio-temporal representation of time-varying 3D geometry with implicit correspondences

具有隐式对应的时变三维几何的时空表示。模型隐式地随时间产生对应关系,从而实现快速推断,同时提供时间动态的合理物理描述


相关工作

4D重构:目前的方法有,固定视角的模板模型,多视角,强动作假设(如刚性和线性假设)

多视角:该方法需要足够多的宽基线视图来覆盖场景,并且受限于这些视图中的模糊性

固定视角的模板模型:这些结果受到模板模型的质量和可用性的限制,并且非常特定于领域。此外,获得足够的模板是非常昂贵的,因此现有的大多数工作都集中在特定的形状类别上,如人体、手或脸

形状配准和插值:基于变形场的方法

现有的方法中,有的只考虑一小组输入点上的向量场。有的计算整个嵌入空间上的变形场,但他们的方法无法处理几何体的体积变化。有的方法提出了一种通过预测带符号距离场的演化来隐式获得对应关系的相关方法。然而,由于它们要求LaplaCian算子是不变的,所以它只在小运动下才能成功。有的引入形状变形网络,其中通过预测模板的参数化以及从任意形状到该模板的转换来学习网格对应关系。但它对于某些对象类是高度专门化的,并且需要对每个配准进行昂贵的微调。与这些方法对比,OFlow可以自动从观测中获取丰富的先验知识来解决歧义


方法

OFlow推导

目的:推断一个连续的三维形状表示的演变,它隐式地和密集地捕捉时间上的对应

s : [0, T] → \mathbb{R}^{3} 定义一个点在时间区间[0, T]内的连续3D轨迹,s(0) ∈ \mathbb{R}^{3} 和s(T) ∈ \mathbb{R}^{3} 表示轨迹的起点和终点。进一步,v : \mathbb{R}^{3} × [0, T] → \mathbb{R}^{3} 代表连续的速度场,描述时间空间中每一个点的3D速度。s(⋅)和v ( ⋅ , ⋅ )之间的关系通过下式可微方程来描述(在时间区间[0, T]内):

当对于每个初始条件s (0) = p , p ∈ \mathbb{R}^{3}求解这个ODE时,我们得到了前向流forward flow \Phi\mathbb{R}^{3} × [ 0 , T ] → \mathbb{R}^{3},满足如下条件

 流\Phi(p,t)描述了随矢量场v ( ⋅ , ⋅ )初始点p在时刻t的位置,可以将公式重构为

 我们定义反向流backforward flow \Psi : \mathbb{R}^{3} × [ 0 , T ] → \mathbb{R}^{3} 作为\Phi的逆变换。这个逆变换可以通过对每个( p, \tau) ∈ \mathbb{R}^{3} × [ 0 , T ],( p, \tau)∈\mathbb{R}^{3} × [ 0, T ]和初始条件设置为\Psi ( p, \tau) = r ( 0 )求解逆向ODE得到

模型概述

正向流

We obtain the correspondence loss Lcorr by taking the ℓ2-distance between the propagated points and the ground truth points on the mesh at t = τ

 其中θ and ˆθ表示网络参数,fθ(·)代表占用网络(occupancy network),vˆθ(·, ·)代表速度网络(velocity network),速度网络框架如下

 

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 1
    评论
Go语言(也称为Golang)是由Google开发的一种静态强类型、编译型的编程语言。它旨在成为一门简单、高效、安全和并发的编程语言,特别适用于构建高性能的服务器和分布式系统。以下是Go语言的一些主要特点和优势: 简洁性:Go语言的语法简单直观,易于学习和使用。它避免了复杂的语法特性,如继承、重载等,转而采用组合和接口来实现代码的复用和扩展。 高性能:Go语言具有出色的性能,可以媲美C和C++。它使用静态类型系统和编译型语言的优势,能够生成高效的机器码。 并发性:Go语言内置了对并发的支持,通过轻量级的goroutine和channel机制,可以轻松实现并发编程。这使得Go语言在构建高性能的服务器和分布式系统时具有天然的优势。 安全性:Go语言具有强大的类型系统和内存管理机制,能够减少运行时错误和内存泄漏等问题。它还支持编译时检查,可以在编译阶段就发现潜在的问题。 标准库:Go语言的标准库非常丰富,包含了大量的实用功能和工具,如网络编程、文件操作、加密解密等。这使得开发者可以更加专注于业务逻辑的实现,而无需花费太多时间在底层功能的实现上。 跨平台:Go语言支持多种操作系统和平台,包括Windows、Linux、macOS等。它使用统一的构建系统(如Go Modules),可以轻松地跨平台编译和运行代码。 开源和社区支持:Go语言是开源的,具有庞大的社区支持和丰富的资源。开发者可以通过社区获取帮助、分享经验和学习资料。 总之,Go语言是一种简单、高效、安全、并发的编程语言,特别适用于构建高性能的服务器和分布式系统。如果你正在寻找一种易于学习和使用的编程语言,并且需要处理大量的并发请求和数据,那么Go语言可能是一个不错的选择。

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论 1
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值