Pith. sign in

Paper Citation Record · LEDGER

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks

As of 21 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 7 inbound Pith citation observations for arXiv:2411.19786.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2411.19786 v1

Coverage vector

measured 44 of 44 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-12T05:52:13.242838Z

measured 51 of 51 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-21T06:32:19.484+00:00

measured 7 of 7 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-15T23:44:29.327801Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-16T22:08:36.251284Z

Reference resolution

44 of 44 outbound references displayed

  • verified exact0
  • verified fuzzy30
  • unresolved14
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 0b629d2c-9a3d-4146-9130-fef736dbf0e0 · outbound

This paper cites High- resolution image synthesis with latent diffusion models,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks High- resolution image synthesis with latent diffusion models,

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-12T05:52:13.047042Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T05:52:13.047042Z digest=sha256:92d76e6ac4bee7f77e6ab857bd168b1babfe9cf55c5f73e5e1cced396fa2f4c4

Observation b1d601ec-a8d1-4d25-a2f3-b1cd9f21f40f · outbound

This paper cites Dreamfusion: Text- to-3d using 2d diffusion,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Dreamfusion: Text- to-3d using 2d diffusion,

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T05:52:13.945790Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T05:52:13.052198Z digest=sha256:576862b4681e7a671dc5c5f43718e24691b95cfdc7e4d5da4234cf5c0f73c97d

Observation 2c5f955d-48b8-4a1f-b6b5-45c71f3b8938 · outbound

This paper cites Denoising diffusion probabilistic models,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Denoising diffusion probabilistic models,

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T05:52:13.928662Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T05:52:13.057196Z digest=sha256:510fcff4ee2cd88867752139b1fea50edc260579bfa2f458312652eab6e4f81c

Observation 76596414-0756-4c69-83b8-52330fccb102 · outbound

This paper cites Generative modeling by estimating gradients of the data distribution,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Generative modeling by estimating gradients of the data distribution,

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T05:52:13.913799Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T05:52:13.061836Z digest=sha256:6b0913de0ec2487d016433d79b836b960f6af88af7f9f0ca1b325456bb1aa844

Observation 2fe49b92-a640-499f-9602-3753bc73d4eb · outbound

This paper cites Learning transferable visual models from natural language supervision,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Learning transferable visual models from natural language supervision,

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T05:52:13.897948Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T05:52:13.066371Z digest=sha256:107615149bdbf344a772f5b52fc777e60be318537ff9004e8692471fd33b8e67

Observation 538d97fe-ebf0-4f5d-aa45-39bc8898a01d · outbound

This paper cites Human motion diffusion model,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Human motion diffusion model,

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T05:52:13.882810Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T05:52:13.070825Z digest=sha256:ee5746cfcf0cb52e0861a61ac03e3a6b38ec26a0905bd725571e6e416a59555f

Observation c2a61631-56fc-4e89-87e4-49c1caef5d4d · outbound

This paper cites MotionDiffuse: Text-Driven Human Motion Generation with Diffusion Model.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks MotionDiffuse: Text-Driven Human Motion Generation with Diffusion Model

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-12T05:52:13.075861Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T05:52:13.075861Z digest=sha256:d8826e0df7f55e5012d4847020c2a3f9649d8d536e7943b1d9307f404e44fd3a

Observation 97cff239-508f-478d-be41-0ea0dabdf2f3 · outbound

This paper cites Executing your commands via motion diffusion in latent space,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Executing your commands via motion diffusion in latent space,

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T05:52:13.867947Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T05:52:13.080305Z digest=sha256:54de0931dc9dcce1aec0133aefee322d2c06f47089d38c077516e2968f588663

Observation ad73abdd-10e2-4a7f-9845-1ad64954df48 · outbound

This paper cites T2m-gpt: Generating human motion from textual descriptions with discrete representations,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks T2m-gpt: Generating human motion from textual descriptions with discrete representations,

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T05:52:13.851397Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T05:52:13.084855Z digest=sha256:6263871fa88a29621d1e3d80a9ce454f8961eed4443be2da2af4cf362b9cd8a3

Observation 18dd5306-cdcf-439e-8dd5-e8e43a1d79ed · outbound

This paper cites Tm2t: Stochastic and tokenized modeling for the reciprocal generation of 3d human motions and texts,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Tm2t: Stochastic and tokenized modeling for the reciprocal generation of 3d human motions and texts,

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T05:52:13.833912Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T05:52:13.089395Z digest=sha256:c92a5d83b4f61771e697c4252160404e4f7b6ab7a3ada8704b16e4cb1240f2f6

Observation 816eed48-f234-4697-a6c7-5c6f33869717 · outbound

This paper cites Motiongpt: Human motion as a foreign language,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Motiongpt: Human motion as a foreign language,

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T05:52:13.818484Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T05:52:13.093718Z digest=sha256:902865f1af143ec74f4e2faa5ceea47d5929ef6afb9e2ad8ad8ebacd6b5493a2

Observation c0381cc0-50e2-4687-a9fd-a03fbe246e0f · outbound

This paper cites Action-conditioned 3d human motion synthesis with transformer V AE,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Action-conditioned 3d human motion synthesis with transformer V AE,

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T05:52:13.803721Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T05:52:13.098600Z digest=sha256:6de6969d2f733e2a2c6b8c108335f25d430da321c8171e3826d4e56a7379da72

Observation 9227a4cc-b078-4651-a79b-570e966861c3 · outbound

This paper cites Generating diverse and natural 3d human motions from text,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Generating diverse and natural 3d human motions from text,

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T05:52:13.789156Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T05:52:13.102731Z digest=sha256:e809d44cff9a3686808722d1e893bad6879745d124893defdb9bd5d1e4474e07

Observation 76a6828a-2288-4956-bc74-258039c2a1c4 · outbound

This paper cites Ai choreographer: Music conditioned 3d dance generation with aist++,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Ai choreographer: Music conditioned 3d dance generation with aist++,

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T05:52:13.774534Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T05:52:13.106868Z digest=sha256:6a151f1349399134cafc50352810655d923c256ccf6e27fa6b2ae36edcfaeaea

Observation 15e93ff4-bffe-4c01-9d22-5f0fb14eb114 · outbound

This paper cites Learning a bidirectional mapping between human whole-body motion and natural language using deep recurrent neural networks,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Learning a bidirectional mapping between human whole-body motion and natural language using deep recurrent neural networks,

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-12T05:52:13.111345Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T05:52:13.111345Z digest=sha256:5d311b1777217074a4a115a47efcc5e04bfa2a29431119607dc47b09ad34119e

Observation 2dfc77b6-ba03-43fd-ba42-7cf3aa5ecc76 · outbound

This paper cites Temos: Generating diverse human motions from textual descriptions,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Temos: Generating diverse human motions from textual descriptions,

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T05:52:13.746973Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T05:52:13.116972Z digest=sha256:ab8c436e87df397afd29b7d9c46588d3b983c6d11bb40c4979bc1494bff2394d

Observation 00c411e7-cd4f-46bf-86eb-9769a044d2bc · outbound

This paper cites Linguistic descriptions of human motion with generative adversarial seq2seq learning,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Linguistic descriptions of human motion with generative adversarial seq2seq learning,

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T05:52:13.731906Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T05:52:13.121395Z digest=sha256:65850abbf07b40e84965e94c95e4a845e56dfed14b5a9a4fad0dec78303161ea

Observation 9b058caf-2ce2-4b12-bff9-85123d7ceec6 · outbound

This paper cites Fg-t2m: Fine- grained text-driven human motion generation via diffusion model,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Fg-t2m: Fine- grained text-driven human motion generation via diffusion model,

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T05:52:13.718462Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T05:52:13.125557Z digest=sha256:8f2f3bd52ce915b9ef41e8fa9a2c9f9e0ccfb5a40354b3fe09aba1830da5906a

Observation a36e7c80-1eff-4eb8-85e2-0bc4dec77284 · outbound

This paper cites Paired recurrent autoencoders for bidirectional translation between robot actions and linguistic descrip- tions,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Paired recurrent autoencoders for bidirectional translation between robot actions and linguistic descrip- tions,

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T05:52:13.704203Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T05:52:13.129942Z digest=sha256:1ac669f7e0eb76297ef222b796e05f02f97f1539eac5c6c8e3c9b8eb6ae2e660

Observation 2724f12c-55d6-4253-8c7b-0891979348aa · outbound

This paper cites Scaling Instruction-Finetuned Language Models.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Scaling Instruction-Finetuned Language Models

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-12T05:52:13.134606Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T05:52:13.134606Z digest=sha256:1d2728d8b82a4929633a5a365ca8fc316977121bd8dc91c3d543c691e81c78ea

Observation 27c27e14-62ce-41cb-b80b-76fa27b9dd05 · outbound

This paper cites LLaMA: Open and Efficient Foundation Language Models.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks LLaMA: Open and Efficient Foundation Language Models

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-12T05:52:13.139336Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T05:52:13.139336Z digest=sha256:6089eae1b710a13862fc3a92a18d27aaa6e13381b512028e6dd3e3f7717fcfcd

Observation 9658c6fb-6cd7-42ac-91ad-34dca0279a29 · outbound

This paper cites SMPLer-X: Scaling Up Expressive Human Pose and Shape Estimation.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks SMPLer-X: Scaling Up Expressive Human Pose and Shape Estimation

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-12T05:52:13.144053Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T05:52:13.144053Z digest=sha256:75aba7c811f5346eca1cac3f0ee847212af08f3ff6924bf7c1a6c31d16445bf9

Observation a96f0d06-617e-46a7-9251-cd4b091a1fce · outbound

This paper cites Image as a Foreign Language: BEiT Pretraining for All Vision and Vision-Language Tasks.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Image as a Foreign Language: BEiT Pretraining for All Vision and Vision-Language Tasks

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-12T05:52:13.148876Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T05:52:13.148876Z digest=sha256:829463d138529dc27e3be5c2f0ac608f052ee20de2dcea5f3b053f71f14f6d6e

Observation 6a47e63b-7aeb-4a43-b772-47b738dfea4c · outbound

This paper cites Imagebind: One embedding space to bind them all,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Imagebind: One embedding space to bind them all,

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T05:52:13.689629Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T05:52:13.153475Z digest=sha256:98b3eb9a5ff2ffdf5a7cf2cad8b3ca7b8da55657398f0a4e4167411c46579459

Observation b2108a1a-b7a5-4d6e-8014-684dbe14b4b6 · outbound

This paper cites Mm-diffusion: Learning multi-modal diffusion models for joint audio and video generation,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Mm-diffusion: Learning multi-modal diffusion models for joint audio and video generation,

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T05:52:13.674626Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T05:52:13.157727Z digest=sha256:fd202b2f1bc1d0df046ef6688f0dcea062f99ca286bf6622143635ec5485b05e

Observation 405e59fe-d1a7-42d2-8738-72f94624b9db · outbound

This paper cites One transformer fits all distributions in multi-modal diffusion at scale,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks One transformer fits all distributions in multi-modal diffusion at scale,

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T05:52:13.660469Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T05:52:13.162202Z digest=sha256:0fac1d481bdbff773141f6a246ce242da702888b79394241500d68302130619a

Observation d1eaf926-d43f-4f39-a598-0a7abe75fa1a · outbound

This paper cites Flamingo: a visual language model for few-shot learning,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Flamingo: a visual language model for few-shot learning,

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T05:52:13.645839Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T05:52:13.166574Z digest=sha256:4bd34feafb64e0cb986546211a3332b04266a3c0c751a3f8be5d262b87e471ad

Observation ef9f9af7-5ad0-4756-befd-c5c4039c7f6c · outbound

This paper cites BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language Models.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language Models

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-12T05:52:13.171240Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T05:52:13.171240Z digest=sha256:85968663c1f80689442ffee8606bc3d3657a5369402455dc7c4eef76f3066582

Observation 54fd7be5-824b-45b0-b9a5-03c0a5b5a574 · outbound

This paper cites Visual Instruction Tuning.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Visual Instruction Tuning

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-12T05:52:13.175692Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T05:52:13.175692Z digest=sha256:334c2cfd88069582543682b66a44a574baf2ea1541850fc186951b8b0bbc6a7f

Observation 013937f0-d7c9-4e4b-895e-3d0673c3eb1c · outbound

This paper cites Improved denoising diffusion proba- bilistic models,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Improved denoising diffusion proba- bilistic models,

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T05:52:13.631117Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T05:52:13.180170Z digest=sha256:46941e6880d145ec53c97be6927566654369459b2c9ff93cccd7b874384545fd

Observation 1e3e28b9-0fb0-4428-843b-874e7776a81c · outbound

This paper cites Motionclip: Exposing human motion generation to CLIP space,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Motionclip: Exposing human motion generation to CLIP space,

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T05:52:13.616164Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T05:52:13.184514Z digest=sha256:436d475fbc4049763165eeb619220721d676df88ec7e05883b97601b110a507c

Observation 4cfa8e18-3109-4a53-aac8-d565338ad23a · outbound

This paper cites Scalable diffusion models with transformers,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Scalable diffusion models with transformers,

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-12T05:52:13.188715Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T05:52:13.188715Z digest=sha256:508d8db98504ca78a94683b8371d8c165802c6c5a46aadc2e66aa8121cbe0371

Observation e36e5725-e577-40cf-b8d6-943c81844dd2 · outbound

This paper cites Attention is all you need,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Attention is all you need,

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T05:52:13.590622Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T05:52:13.193008Z digest=sha256:781aff4d7456a623e68d4918476687b84985abd2f37e78ba4d6e8bd528a60006

Observation 417c5097-5110-4e2c-829a-b3cbb4b10f5e · outbound

This paper cites A style-based generator architecture for generative adversarial networks,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks A style-based generator architecture for generative adversarial networks,

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T05:52:13.576361Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T05:52:13.197528Z digest=sha256:4c753b26881e4d900812d1ecd2a5716d499b24a7ae67db5d002c3f55aa20ab2d

Observation 4f75b23c-44a4-49de-8d34-da62737508d2 · outbound

This paper cites Classifier-free diffusion guidance,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Classifier-free diffusion guidance,

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-12T05:52:13.201820Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T05:52:13.201820Z digest=sha256:be282c2c17014f46823c7e91176361b3ecbaee3d4ffffa3015f9b8f4d2244d93

Observation 878afcdb-0196-41df-8c40-ac1aa34aa1b2 · outbound

This paper cites Bleu: a method for automatic evaluation of machine translation,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Bleu: a method for automatic evaluation of machine translation,

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T05:52:13.552079Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T05:52:13.206756Z digest=sha256:ebb55bac9c4a89a69a06502425bd25e58b786a6b240b76d129322dc274d410ad

Observation b884c5ff-60dc-4a35-89f3-d87f9381cabe · outbound

This paper cites Rouge: A package for automatic evaluation of summaries,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Rouge: A package for automatic evaluation of summaries,

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-12T05:52:13.211097Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T05:52:13.211097Z digest=sha256:f1d78091a19e8b82914abba3ab64290c5c6868ebd704c6ad4f15522a3093eed1

Observation c859f280-f889-47cd-9856-ab71d3252a93 · outbound

This paper cites Cider: Consensus-based image description evaluation,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Cider: Consensus-based image description evaluation,

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T05:52:13.528297Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T05:52:13.215594Z digest=sha256:b63b580398bdc374eafd6ac1580d77510d2ed3a8728f202264c1173775020cac

Observation 90621055-0ae4-42e4-b31e-873df0a3da8f · outbound

This paper cites Bertscore: Evaluating text generation with BERT,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Bertscore: Evaluating text generation with BERT,

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-12T05:52:13.220087Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T05:52:13.220087Z digest=sha256:b9800c2944dddacae2905682ca77f1de462a0d87a384720b4dca58237aa19bc0

Observation b538b436-b80f-4704-8914-6508e48ffca8 · outbound

This paper cites SGDR: stochastic gradient descent with warm restarts,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks SGDR: stochastic gradient descent with warm restarts,

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T05:52:13.503937Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T05:52:13.224383Z digest=sha256:171fd4382a7f2dac866e1138490ee89e5f855f0b8576f362a56f468f9b728f5c

Observation d1daaf47-3535-4b82-accb-64fbf2b41f8b · outbound

This paper cites Hutumotion: Human-tuned navigation of latent motion diffusion models with minimal feedback,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Hutumotion: Human-tuned navigation of latent motion diffusion models with minimal feedback,

Reference 41

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T05:52:13.488005Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T05:52:13.228705Z digest=sha256:e2a6e586c892442f4ca11cd2d0cb4c9564c811f7958dc232c5af66626792df43

Observation 0929dd87-8ca2-4431-96d1-037f33542f8b · outbound

This paper cites Remodiffuse: Retrieval-augmented motion diffusion model,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Remodiffuse: Retrieval-augmented motion diffusion model,

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-12T05:52:13.233165Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T05:52:13.233165Z digest=sha256:fd1239b7fc527289731dea02cc63127829bd4839cc97a340784e77c13c022a13

Observation 19fd68b8-a457-41bf-a89c-ffc6768e0b38 · outbound

This paper cites Digital life project: Autonomous 3d characters with social intelligence,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Digital life project: Autonomous 3d characters with social intelligence,

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T05:52:13.473565Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T05:52:13.237866Z digest=sha256:9d10cc30bd0acede94c00ca3c2f206f25e9cf53ddcf458edf068969ea6af49de

Observation 33edda76-76c3-4fee-b406-9ed37793acdc · outbound

This paper cites Momask: Generative masked modeling of 3d human motions,.

MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks Momask: Generative masked modeling of 3d human motions,

Reference 44

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T05:52:13.458886Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-12T05:52:13.242838Z digest=sha256:0dcaa365df2c255c2614b2b300c9c0d0ceba61a117e86962896283e767185b47

Pith citing papers

Observation 858df5a9-f3f3-4252-a366-c667601f7480 · inbound

AI-Generated Fall Data: Assessing LLMs and Diffusion Model for Wearable Fall Detection cites this paper.

AI-Generated Fall Data: Assessing LLMs and Diffusion Model for Wearable Fall Detection MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-15T23:44:29.327801Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:44:29.327801Z digest=sha256:10a33b61b28ee12fd5d8e8bd9af79d4d1ca957166808b67a54ba7133f5ec1e35

Observation 18d31264-d99b-489d-a295-4f7e87275235 · inbound

IRG-MotionLLM: Interleaving Motion Generation, Assessment and Refinement for Text-to-Motion Generation cites this paper.

IRG-MotionLLM: Interleaving Motion Generation, Assessment and Refinement for Text-to-Motion Generation MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks

Reference 74

Resolution
unresolved
no resolver link, observed 2026-08-03T17:06:58.070074Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T17:06:58.070074Z digest=sha256:09f7b5583730a8a5b736c0c1d3b976c598a9276280e00a91235ec9c1d364ac8b

Observation 2e468f55-0f87-4456-bae5-6685c26b69db · inbound

ViBES: A Conversational Agent with Behaviorally-Intelligent 3D Virtual Body cites this paper.

ViBES: A Conversational Agent with Behaviorally-Intelligent 3D Virtual Body MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks

Reference 115

Resolution
verified exact
arxiv_id, observed 2026-05-16T22:08:36.253141Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-05-16T22:04:07.403410Z digest=sha256:ec92e31d63c1053d2a30c12b69e0bd8d5dc0329fafe7fd1c71a2704df464b846

Observation 4d048991-0494-448a-bf11-fe22d1859185 · inbound

LLaMo: Scaling Pretrained Language Models for Unified Motion Understanding and Generation with Continuous Autoregressive Tokens cites this paper.

LLaMo: Scaling Pretrained Language Models for Unified Motion Understanding and Generation with Continuous Autoregressive Tokens MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks

Reference 75

Resolution
verified exact
arxiv_id, observed 2026-05-16T05:02:19.797149Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-05-16T05:01:11.880003Z digest=sha256:7cbee8c6e58bdd3285f247dedf0587923c44761de472e73a73a6627b32734919

Observation df34b9c4-3719-4282-8039-2c5e1fea2e1b · inbound

Encoder-Free Human Motion Understanding via Structured Motion Descriptions cites this paper.

Encoder-Free Human Motion Understanding via Structured Motion Descriptions MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks

Reference 25

Resolution
verified exact
arxiv_id, observed 2026-05-11T14:21:04.380355Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-05-09T22:03:49.029939Z digest=sha256:a55f63cfea4b11599b531ca753623d380e3bd137ba5a56407934ba7338a15e7e

Observation f08ce8ca-eaa7-45a0-8a24-23bd51ccce74 · inbound

MUGEN: A Unified Framework for Efficient Motion Understanding and Generation cites this paper.

MUGEN: A Unified Framework for Efficient Motion Understanding and Generation MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-01T05:19:21.180225Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-01T05:19:21.180225Z digest=sha256:ba0ef64cc547d55c88da7c86b187705150632da6d2c062aeeab50c6dca6f380d

Observation 2c10617f-ac15-4d3a-b230-d47cc55430d8 · inbound

MRBench: A Comprehensive Benchmark for Human Motion-Text Retrieval cites this paper.

MRBench: A Comprehensive Benchmark for Human Motion-Text Retrieval MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-12T00:39:25.254936Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-12T00:39:25.254936Z digest=sha256:8f2ce9642c82194111890740ce268b97ec4629b8f60f953189f6dd4f720b8e1b