Action-conditioned On-demand Motion Generation

QIUJING LU, YiPeng Zhang, Mingjian Lu, Vwani Roychowdhury

2022-07-17Contrastive Learning Motion Generation Human action generation

Abstract

We propose a novel framework, On-Demand MOtion Generation (ODMO), for generating realistic and diverse long-term 3D human motion sequences conditioned only on action types with an additional capability of customization. ODMO shows improvements over SOTA approaches on all traditional motion evaluation metrics when evaluated on three public datasets (HumanAct12, UESTC, and MoCap). Furthermore, we provide both qualitative evaluations and quantitative metrics demonstrating several first-known customization capabilities afforded by our framework, including mode discovery, interpolation, and trajectory customization. These capabilities significantly widen the spectrum of potential applications of such motion generation models. The novel on-demand generative capabilities are enabled by innovations in both the encoder and decoder architectures: (i) Encoder: Utilizing contrastive learning in low-dimensional latent space to create a hierarchical embedding of motion sequences, where not only the codes of different action types form different groups, but within an action type, codes of similar inherent patterns (motion styles) cluster together, making them readily discoverable; (ii) Decoder: Using a hierarchical decoding strategy where the motion trajectory is reconstructed first and then used to reconstruct the whole motion sequence. Such an architecture enables effective trajectory control. Our code is released on the Github page: https://github.com/roychowdhuryresearch/ODMO

Results

Task	Dataset	Metric	Value	Model
Activity Recognition	CMU Mocap	Accuracy	93.51	ODMO
Activity Recognition	CMU Mocap	Diversity	6.56	ODMO
Activity Recognition	CMU Mocap	FID	34	ODMO
Activity Recognition	CMU Mocap	Multimodality	2.49	ODMO
Activity Recognition	HumanAct12	Accuracy	97.81	ODMO
Activity Recognition	HumanAct12	Diversity	0.705	ODMO
Activity Recognition	HumanAct12	FID	0.12	ODMO
Activity Recognition	HumanAct12	Multimodality	2.57	ODMO
Activity Recognition	UESTC RGB-D	Accuracy	93.67	ODMO
Activity Recognition	UESTC RGB-D	Diversity	7.11	ODMO
Activity Recognition	UESTC RGB-D	FID	0.15	ODMO
Activity Recognition	UESTC RGB-D	Test	0.17	ODMO
Human action generation	CMU Mocap	Accuracy	93.51	ODMO
Human action generation	CMU Mocap	Diversity	6.56	ODMO
Human action generation	CMU Mocap	FID	34	ODMO
Human action generation	CMU Mocap	Multimodality	2.49	ODMO
Human action generation	HumanAct12	Accuracy	97.81	ODMO
Human action generation	HumanAct12	Diversity	0.705	ODMO
Human action generation	HumanAct12	FID	0.12	ODMO
Human action generation	HumanAct12	Multimodality	2.57	ODMO
Human action generation	UESTC RGB-D	Accuracy	93.67	ODMO
Human action generation	UESTC RGB-D	Diversity	7.11	ODMO
Human action generation	UESTC RGB-D	FID	0.15	ODMO
Human action generation	UESTC RGB-D	Test	0.17	ODMO

Action-conditioned On-demand Motion Generation

Abstract

Results

Related Papers

Action-conditioned On-demand Motion Generation

Abstract

Results

Related Papers