MotionDiffuse: Text-Driven Human Motion Generation withDiffusion Model # 论文阅读

URL

https://arxiv.org/pdf/2208.15001

主页:https://mingyuan-zhang.github.io/projects/MotionDiffuse.html

TD;DR

22 年 8 月商汤的文章,引用量 200+。基于 SD,任务是输入文本的动作描述,生成对应的动作序列。

已有的 motion 生成方法的输入 condition 可以分为 3 类,包括预设好的 pose 序列类别、音乐、自然语言,本文主要关注的是自然语言生成的方式。用语言生成的方法大多只能支持少量词语的短句生成,或者只能生成简单的 pose
在这里插入图片描述

Model & Method

因为是 22 年的文章,当时还有 motion module 这个东西,所以本文生成连续帧的方式是吧时间信息 t 通过 positional embedding 的方式注入到训练过程中,生成的动作序列长度是固定的。
在这里插入图片描述

Dataset & Results

在这里插入图片描述

Thought

  • 文章比较老,t 注入的方式没有什么参考价值。可以参考一下造数据的方法,和 gt 格式
  • 本文似乎可以用 prompt 分别控制 body 的每一个独立肢体 lib

相关推荐

  1. 论文阅读笔记】清单

    2024-05-11 08:30:03       51 阅读

最近更新

  1. TCP协议是安全的吗?

    2024-05-11 08:30:03       18 阅读
  2. 阿里云服务器执行yum,一直下载docker-ce-stable失败

    2024-05-11 08:30:03       19 阅读
  3. 【Python教程】压缩PDF文件大小

    2024-05-11 08:30:03       18 阅读
  4. 通过文章id递归查询所有评论(xml)

    2024-05-11 08:30:03       20 阅读

热门阅读

  1. HTTP/1.0、HTTP/1.1、HTTP/2.0区别

    2024-05-11 08:30:03       11 阅读
  2. AI学习指南概率论篇-概率分布

    2024-05-11 08:30:03       9 阅读
  3. 超级好用的C++实用库之动态库加载器

    2024-05-11 08:30:03       9 阅读
  4. axios常用配置

    2024-05-11 08:30:03       9 阅读
  5. npm详解

    2024-05-11 08:30:03       10 阅读
  6. 【服务治理中间件】consul介绍和基本原理

    2024-05-11 08:30:03       13 阅读
  7. Express中间件(完善)

    2024-05-11 08:30:03       11 阅读