{"as_of":"2026-08-13T05:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c4375445b9329739c25557bb377914eebb9a60a6c00b8b8b68c70d0eacb32f69","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T21:59:00.831962Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T13:02:31.728467Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-12T13:02:33.216965Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"cited_work":{"arxiv_id":"2412.07797","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.07797","snapshot_observed_at":"2026-08-12T13:02:33.216965Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","venue":"cs.CV","work_id":"5c9b80a3-57f8-4aa9-8dac-09db71fb8437","year":2024},"citing_paper":{"arxiv_id":"2411.16575","last_updated":"2025-07-08T20:15:01Z","snapshot_observed_at":"2026-08-12T19:47:09.580070Z","submitted_at":"2024-11-25T16:59:42Z","title":"Rethinking Diffusion for Text-Driven Human Motion Generation: Redundant Representations, Evaluation, and Masked Autoregression","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T13:02:31.728467Z"},"links":{"cited_paper":"/paper/2412.07797","citing_paper":"/paper/2411.16575"},"observation_digest":"sha256:ad5ca0b1b52e84bbbbffb241314d76f91df1155132e670b59e67c642c0ccb8da","observation_id":"095fc63c-918d-48a3-b117-e1090b2bf474","resolution":{"observed_at":"2026-08-12T13:02:33.221375Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07797","snapshot_observed_at":"2026-08-03T12:14:47.331478Z","title":"arXiv preprint arXiv:2412.07797 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29180","last_updated":"2026-07-31T09:01:25Z","snapshot_observed_at":"2026-08-07T10:50:51.981505Z","submitted_at":"2026-07-31T09:01:25Z","title":"MoRAE: Flow-Friendly Self-Supervised Latents for Text-to-Motion Generation","version":1},"reference_index":104,"source":"arxiv_source","source_observed_at":"2026-08-03T12:14:47.331478Z"},"links":{"cited_paper":"/paper/2412.07797","citing_paper":"/paper/2607.29180"},"observation_digest":"sha256:ff2ffd52e5be7d0ee8500e02be3719fd4efeaad53dbf82cd51faab065e4f6b52","observation_id":"1bf7fd6e-690c-40a7-9772-259cc52668af","resolution":{"observed_at":"2026-08-03T12:14:47.331478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.07797/citation-record","integrity":"/paper/2412.07797/integrity","json":"/paper/2412.07797/citation-record.json","paper":"/paper/2412.07797"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.234960Z","title":"Ahuja and L","venue":null,"work_id":"2889bbff-152f-41d3-bfce-bf2859c994d5","year":2019},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.695903Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:41e09e48686803ffcca52d1877809b3ee14cdef1b7c353baf80fd724731626fe","observation_id":"6fb30838-d2b7-48d2-b167-a2905e55aa3b","resolution":{"observed_at":"2026-08-11T21:59:01.238060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.699855Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.699855Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:80dfdbbbd9d2d361fa6bcf485142dddee10a01fae8cb678247b364c414815310","observation_id":"0abc43f2-2dff-4e2a-aaa4-0efde6ebe489","resolution":{"observed_at":"2026-08-11T21:59:00.699855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-11T21:59:00.703233Z","title":null,"venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.703233Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:03c078cb43078d43c08f607cd25562f06351fe2454b7349b8beb37cb763832aa","observation_id":"10497420-112a-4d41-873a-fccc4d4cad9f","resolution":{"observed_at":"2026-08-11T21:59:00.703233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.221141Z","title":"Deep video generation, prediction and completion of human action sequences","venue":null,"work_id":"659b3aeb-d7e0-40bd-b167-9358122b11b2","year":2018},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.707121Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:b4a325ab343ab228854772c86d74657a6c5d2492ba88db7a6fe5a1a2983576d9","observation_id":"2a9f7fa6-3521-40dd-8a38-61c9b22c2d38","resolution":{"observed_at":"2026-08-11T21:59:01.224367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.212339Z","title":"Murphy, William T","venue":null,"work_id":"6dbcc1f2-7b71-47a8-bf3b-b1c8af703f7d","year":2023},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.710635Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:14c0ca1e7f319cd1cfcddd44bacf8bee0bd994b3eab6848ea0937215410dc1ed","observation_id":"2b0c43ad-793e-4598-87bb-8bd9890296e4","resolution":{"observed_at":"2026-08-11T21:59:01.215559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.203566Z","title":"Chen, Chengkuan Chen, Yicong Li, Tiffany Y","venue":null,"work_id":"eff6df38-db38-44ce-8442-ea6ac79f68eb","year":2022},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.713828Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:7897c69c9dbb364f63f560168ae94b85c4b2ccd6ed2e1eb118de8c47bede02a3","observation_id":"8ca6b4db-b0b3-4352-96e1-67ee0f94941a","resolution":{"observed_at":"2026-08-11T21:59:01.206838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.194991Z","title":"Executing your commands via motion diffusion in latent space","venue":null,"work_id":"660d0098-72ab-4884-b9b3-e814e54976c3","year":2023},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.717107Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:78bda432f3e58fa3bed13e032c058c0e01e9c47abe63efae545c4ac8e1278ed1","observation_id":"34e3737d-f557-4f3a-833d-6071691dcffa","resolution":{"observed_at":"2026-08-11T21:59:01.198102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.186328Z","title":"Transformer-XL: At- tentive language models beyond a fixed-length context","venue":null,"work_id":"d00dc7f8-96bf-4769-9656-fb23ce3cb9bb","year":2019},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.719984Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:0f87d4ed6d9c5e2557836fbff41f2bf99ce6af413175561f92984fe61e227166","observation_id":"f4f65d82-7e3c-4ef7-82ab-c6ee89c87ef6","resolution":{"observed_at":"2026-08-11T21:59:01.189323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.14217","last_updated":"2022-05-27T14:40:07Z","snapshot_observed_at":"2026-08-04T19:09:10.486489Z","submitted_at":"2022-04-28T15:51:11Z","title":"CogView2: Faster and Better Text-to-Image Generation via Hierarchical Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.14217","snapshot_observed_at":"2026-08-11T21:59:00.722886Z","title":"Cogview2: Faster and better text-to-image generation via hi- erarchical transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.722886Z"},"links":{"cited_paper":"/paper/2204.14217","citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:4a5210fd73758cfd78531f45dbc7d39ecc441ed718b187824c9595c85614cc1f","observation_id":"371a702e-4539-496e-b139-e92be2e23988","resolution":{"observed_at":"2026-08-11T21:59:00.722886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.177193Z","title":"Synthesis of compositional animations from textual descriptions","venue":null,"work_id":"f81afd60-36dc-4667-9482-15df16ab008b","year":2021},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.726327Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:a8dda52242797388001376b8376826be3b2986e972fcaba8c9cf6e605d25acce","observation_id":"06f081b0-d9aa-4ab7-8187-5c1370358c89","resolution":{"observed_at":"2026-08-11T21:59:01.180584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.167875Z","title":"Chatglm: A family of large language mod- els from glm-130b to glm-4 all tools, 2024","venue":null,"work_id":"73833c27-f436-4dbe-ac39-65d8471cfe3f","year":2024},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.729414Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:2699079b39bcc0ba93498d6c57c478b8e8b9efcfdc40e104ce4049918efc5c90","observation_id":"c56629a7-ab28-4330-8174-c3660c37555e","resolution":{"observed_at":"2026-08-11T21:59:01.171165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.158586Z","title":"Ac- tion2motion: Conditioned generation of 3d human motions","venue":null,"work_id":"0b2584b3-e01d-41c3-831d-b33af8cb31b4","year":2020},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.732295Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:31cdda8fc4c24137ce41670dd2fa45286984e2a7f197c2ce633c2ebc28b25c1f","observation_id":"487b197c-e4b7-4abf-acd0-578d374c419f","resolution":{"observed_at":"2026-08-11T21:59:01.161861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.149309Z","title":"Generating diverse and natural 3d human motions from text","venue":null,"work_id":"2bb083f4-c87a-4fcd-802e-b39acb326073","year":2022},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.735414Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:61a28747d2fc8cb40e5695799c685e940ea488392798c7f5b685bac05d216eb1","observation_id":"7ec22085-2a66-40af-bfe4-a03af86dc8d8","resolution":{"observed_at":"2026-08-11T21:59:01.152735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.139543Z","title":"Tm2t: Stochastic and tokenized modeling for the reciprocal gener- ation of 3d human motions and texts","venue":null,"work_id":"dbdda06f-a7db-4e97-85a4-6217a0aad71a","year":2022},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.738372Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:06e69e08a6521c7f84579f90cc205c0e8ddbc2704cb90d5d3f395117bf784eba","observation_id":"e42ea98d-857e-4153-8dc8-0898d52557f9","resolution":{"observed_at":"2026-08-11T21:59:01.142870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.130263Z","title":"Action2video: Gener- ating videos of human 3d actions","venue":null,"work_id":"e2843c6f-3a68-4f5d-9425-f2e1013e3eff","year":2022},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.741655Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:dea3ed966af5920cae486f43b60e4c4e27a6bcca013a5c14f4635088de5d14df","observation_id":"191a0a08-1949-4844-a998-25481d12e03c","resolution":{"observed_at":"2026-08-11T21:59:01.133612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.120871Z","title":"Momask: Generative masked mod- eling of 3d human motions","venue":null,"work_id":"9b64cd36-b9d7-47f8-8117-a1fc7ac70ee8","year":2023},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.744455Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:3d4c0320bf3df7538c19151a33d1a4911d470d9ffe2b870707795568ea0df676","observation_id":"ad6ddf6c-f7f2-4efd-bccb-1d48f7906bc4","resolution":{"observed_at":"2026-08-11T21:59:01.124280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.111534Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilib- rium","venue":null,"work_id":"9ed7d1e2-6699-4afa-a14e-3205d78b0eb5","year":2017},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.747324Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:bf84ef2a81a1c20e947f27236d45d1bfee0856fe08c40bde924bcdd42b86414c","observation_id":"e3acedc8-e1ed-4dc6-a7cd-30abd6d4ffcf","resolution":{"observed_at":"2026-08-11T21:59:01.114859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.101961Z","title":"Motiongpt: Human motion as a foreign language","venue":null,"work_id":"2667c6b0-ab26-470e-898e-3df4f9859102","year":2024},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.750590Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:ecef36e8d50476c74eb6d8098e9fa4fb465aa5f28734c5dcb078772c8238af23","observation_id":"16173c95-e0b3-497f-9213-02e2fbbcaec1","resolution":{"observed_at":"2026-08-11T21:59:01.105666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.753425Z","title":"Brown, Benjamin Chess, Rewon Child, Scott Gray, Alec Radford, Jeffrey Wu, and Dario Amodei","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.753425Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:0d5eb85ee9b6df909252261bb44506de7008eb0359052ddb26351aa5861cec0c","observation_id":"4027dbb8-e875-4428-a895-789421a7c6a1","resolution":{"observed_at":"2026-08-11T21:59:00.753425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.00349","last_updated":"2023-01-01T11:46:43Z","snapshot_observed_at":"2026-08-12T06:41:02.178705Z","submitted_at":"2022-09-01T10:34:57Z","title":"FLAME: Free-form Language-based Motion Synthesis & Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.00349","snapshot_observed_at":"2026-08-11T21:59:00.756326Z","title":"Flame: Free- 9 form language-based motion synthesis & editing","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.756326Z"},"links":{"cited_paper":"/paper/2209.00349","citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:0d5a9730bee7db421a144af12d0f4bdcc697932a2636b26b02525a9109585551","observation_id":"00e661cb-c32c-43a9-b09c-7fe32fe7fb38","resolution":{"observed_at":"2026-08-11T21:59:00.756326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.088614Z","title":"Priority-centric human motion genera- tion in discrete latent space, 2023","venue":null,"work_id":"d7ea67d4-882b-4800-b880-fee0a924e048","year":2023},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.759533Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:ce790eb76a753f764286df904ae91d146a56ce00b10c8cf964a96fa6f1ed572f","observation_id":"870e23f9-3b96-48f0-af03-ee061b3b6f2a","resolution":{"observed_at":"2026-08-11T21:59:01.091442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.079635Z","title":"Omg: Towards open-vocabulary motion generation via mix- ture of controllers","venue":null,"work_id":"c09a603d-7d8b-4e08-8396-6121f23b9823","year":2024},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.762290Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:1e7b925b30fdec7130468e3333cce9e29292ceb5aece74ae7d8459fd1dc8b6ca","observation_id":"138a9a06-a8d3-4f23-9e47-d901b8bd7e57","resolution":{"observed_at":"2026-08-11T21:59:01.082938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.765073Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.765073Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:1141da69e36f199341d8f5a56a6c379395f2d8c12344a126b17385f39e8fb3a2","observation_id":"2edaea5e-b392-4e01-9331-6f9b0aa02848","resolution":{"observed_at":"2026-08-11T21:59:00.765073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.767522Z","title":"SGDR: Stochastic gradi- ent descent with warm restarts","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.767522Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:2ef594bd86f327b5d578071c7fbec786ac39c285077580fa057e449b0041b922","observation_id":"4b49a8b0-5deb-4e10-a68e-1f672d622cad","resolution":{"observed_at":"2026-08-11T21:59:00.767522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.060221Z","title":"Troje, Ger- ard Pons-Moll, and Michael J","venue":null,"work_id":"f8794d1f-fc6a-4310-9e85-80d7e3a6d57b","year":2019},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.769898Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:58f039599669aa4b6cf07399949e1531b18072838589760760980bbe4cfe8d9d","observation_id":"fa69ab03-75df-41bc-bc18-ef7ec7007537","resolution":{"observed_at":"2026-08-11T21:59:01.062954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.051125Z","title":"Hierarchical transformers are more efficient language models","venue":null,"work_id":"2f9e707d-4d97-42f8-b991-d12d476c84e9","year":2022},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.772292Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:cce3490c3761a9905be0ac318ac564f84b8a8353d59abc79b90c31a6599ec762","observation_id":"41b112ac-3cab-4f57-8ead-7681fb15b765","resolution":{"observed_at":"2026-08-11T21:59:01.054620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.041594Z","title":"Pappagari, Piotr ˙Zelasko, Jes´us Villalba, Yishay Carmiel, and Najim Dehak","venue":null,"work_id":"88a1b815-38fe-49ea-8d65-d8f80aa29b1b","year":2019},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.774893Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:e2439cb31fcd2ce5a683c85a0317ac4c48cef1003ee8ba71a07d5bcc25ac0226","observation_id":"1652bc0b-7399-4296-9280-ca8ea03800d3","resolution":{"observed_at":"2026-08-11T21:59:01.045073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.032384Z","title":"Black, and G ¨ul Varol","venue":null,"work_id":"b8017902-7ece-4ba8-a551-2f3bb6f92458","year":2021},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.777388Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:d8645e5b077fd9f45b99905409c3e31b24a55ef66de18ae7b95789b35d2992d9","observation_id":"ec8ebc47-3b3d-45b1-8680-a6b2408f7fae","resolution":{"observed_at":"2026-08-11T21:59:01.035630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.022988Z","title":"Mmm: Generative masked motion model, 2024","venue":null,"work_id":"c1f1a08b-a4b5-42f7-bcd1-7c176c5502ac","year":2024},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.779919Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:4a0cefcf2db457e0d396a782c5e238a55553c8bd0e76beca5b2c5fa7e94ed647","observation_id":"6d0ae4e7-e484-4308-84e3-b1295a70f447","resolution":{"observed_at":"2026-08-11T21:59:01.026368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.782342Z","title":"The KIT motion-language dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.782342Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:4a90256df380e2a6dfea02a050b5ded9eafc1109bf1223c3639b32d34e08b2d1","observation_id":"543b52f5-8712-4e4b-ad08-872580f1073f","resolution":{"observed_at":"2026-08-11T21:59:00.782342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:01.008477Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"c912c028-7fcc-49db-92a7-2483185151cc","year":2021},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.784997Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:55abc1946d8ee0efd06ac5230c518daf1db3037507b7bc63e739731524145fc2","observation_id":"a570f79b-a83a-4020-8383-de05fbf8ad0d","resolution":{"observed_at":"2026-08-11T21:59:01.012022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.787409Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.787409Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:ee4a6583ae4692feb5bcb85bfd34fd7cd649e3dc41d2853c1446f47e2933b2f4","observation_id":"4ff26f27-2295-4de5-bdda-a0c65d52e6a7","resolution":{"observed_at":"2026-08-11T21:59:00.787409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.790113Z","title":"High-resolution image syn- thesis with latent diffusion models, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.790113Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:18315fbff65a5ddb8ef4e54b3cc7852222a8f0d40f889a4d8043759262866365","observation_id":"5578ec87-20a5-44a8-b64c-d69f1ac873dd","resolution":{"observed_at":"2026-08-11T21:59:00.790113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.792904Z","title":"Human motion diffu- sion model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.792904Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:93103cf73e677ce8d4c1eb43d7c1ed4fe21b7a0fc0ed4acacbb90cc12c7d521d","observation_id":"b7791359-ef65-42eb-9c9a-7982d617842c","resolution":{"observed_at":"2026-08-11T21:59:00.792904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.983877Z","title":"Neural discrete representation learning","venue":null,"work_id":"83048dae-50f4-4624-9c2a-15b6ed2f3248","year":2017},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.795874Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:9d08bf50d7846e11504a2f7d3315240cf020ea8949745852dc434bf846972207","observation_id":"0ffc5829-64c4-4ae0-82a7-16c3378224bc","resolution":{"observed_at":"2026-08-11T21:59:00.987049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.974727Z","title":"Shazeer, Niki Parmar, Jakob Uszkoreit, Llion Jones, Aidan N","venue":null,"work_id":"054d6134-f5a7-4d0f-b4da-4af258ec3ffc","year":2017},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.798745Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:f3e4a615b01d5f032adc48035ee3652b4c43fa7746a7f8957572463230d10541","observation_id":"ebfdf256-4d57-4b52-9cdd-820cee900fd9","resolution":{"observed_at":"2026-08-11T21:59:00.977955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.965612Z","title":"Emu3: Next-token prediction is all you need","venue":null,"work_id":"ca7779bd-071a-4c74-889f-2a76ab5873c8","year":2024},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.801734Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:32ab49858ee49a8fe5055de6591e93e7b8ab72cb230887ab767d846ad788e4e6","observation_id":"8d97ef13-934f-431c-b9e9-4076994f6272","resolution":{"observed_at":"2026-08-11T21:59:00.968914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.956676Z","title":null,"venue":null,"work_id":"03a5464f-8e75-405f-93f1-25617a33aa0e","year":2023},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.804552Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:a4433835800cce1978d831a30b4386646f1ae524d6e10849f1ebd21e7b08ac5e","observation_id":"9ed4050f-722e-4c11-b86f-aa0bfaa78df0","resolution":{"observed_at":"2026-08-11T21:59:00.959796Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.947536Z","title":"Learning diverse stochastic human-action generators by learning smooth la- tent transitions, 2019","venue":null,"work_id":"42dd3de9-dbe3-416f-9353-3bb0cec173c2","year":2019},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.807251Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:664305a36cf65143eb53bfd1a4418345a0f3096cea11f27bc010a92ac92a16d4","observation_id":"bd7df208-471d-4d83-ba42-70b328fd3867","resolution":{"observed_at":"2026-08-11T21:59:00.950974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.938973Z","title":null,"venue":null,"work_id":"7daf76c8-4433-48e3-9bc2-98801b39b616","year":2022},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.810209Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:290dd2d423318561d52388c411b7490386cdc332db3cbfc283af450515d99a84","observation_id":"b7277666-5c22-4dd1-8106-12320ff4514e","resolution":{"observed_at":"2026-08-11T21:59:00.941781Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.930167Z","title":"Prompt engineering a prompt engineer","venue":null,"work_id":"43fd3b1d-709d-43bb-8c30-781f871aafc9","year":2024},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.813193Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:32caf9b1ee4a6d32951275a2d8faa34fadf1f041ec0edbc727a76b462558d60e","observation_id":"aa7b6365-8c65-4c1b-9d30-54ba70a0483c","resolution":{"observed_at":"2026-08-11T21:59:00.932918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.921497Z","title":"Animationgpt:an aigc tool for generating game combat mo- tion assets","venue":null,"work_id":"1133d36f-6a83-49ae-8609-e88b7ae61c28","year":2024},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.816187Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:0b329c5e7db6d8f00bda359c0ae45994c5a4c203744f14d90dd951868cf21066","observation_id":"24a65980-fac7-4e8d-a4aa-6efc565758e0","resolution":{"observed_at":"2026-08-11T21:59:00.924461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.912207Z","title":"T2m-gpt: Generating human motion from textual de- scriptions with discrete representations","venue":null,"work_id":"b74fac10-69f7-4407-b4a8-4603228a7ff1","year":2023},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.819345Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:4e5918cab8b01efedfe38afd0e75d208c0089f27e40f44fc09066bc3d9de5006","observation_id":"0be45cf8-430a-418d-b3e0-ba3f77804286","resolution":{"observed_at":"2026-08-11T21:59:00.915551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.15001","last_updated":"2022-08-31T17:58:54Z","snapshot_observed_at":"2026-08-09T16:31:06.714132Z","submitted_at":"2022-08-31T17:58:54Z","title":"MotionDiffuse: Text-Driven Human Motion Generation with Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.15001","snapshot_observed_at":"2026-08-11T21:59:00.822292Z","title":"Motiondif- fuse: Text-driven human motion generation with diffusion model","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.822292Z"},"links":{"cited_paper":"/paper/2208.15001","citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:0ccf44d61138568623becfd4e0334ec3c8205e9ae512573d5fbc920146f26073","observation_id":"7e7ed5b1-c9f6-4366-abc9-bc6a5c19cf0a","resolution":{"observed_at":"2026-08-11T21:59:00.822292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.01116","last_updated":"2023-04-03T16:29:00Z","snapshot_observed_at":"2026-07-06T15:11:32.429514Z","submitted_at":"2023-04-03T16:29:00Z","title":"ReMoDiffuse: Retrieval-Augmented Motion Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.01116","snapshot_observed_at":"2026-08-11T21:59:00.825552Z","title":"Remodiffuse: Retrieval-augmented motion diffusion model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.825552Z"},"links":{"cited_paper":"/paper/2304.01116","citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:fe11dc424e70ed7cbff3ea74f7512ebf5983d113288dbd81c449bbbc2a20f64a","observation_id":"2aa3a18d-b925-46e7-8bcd-2cd6b1fd47fc","resolution":{"observed_at":"2026-08-11T21:59:00.825552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.902054Z","title":"Attt2m: Text-driven human motion generation with multi- perspective attention mechanism","venue":null,"work_id":"16ba5be3-65e1-48a2-9330-341929fff32f","year":2023},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.828914Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:f4be50f423d8b2ea32950ae79b2db75013dc7d373ce6888d400d72e90d3f187e","observation_id":"27799f90-864a-41e7-817c-b4e83b2dfe2e","resolution":{"observed_at":"2026-08-11T21:59:00.906034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:59:00.891610Z","title":"walk like a monkey","venue":null,"work_id":"49101d12-9323-4a1f-be50-f14c87caf087","year":2023},"citing_paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T21:59:00.831962Z"},"links":{"citing_paper":"/paper/2412.07797"},"observation_digest":"sha256:6beb083bec86f5d7c8cc7950f06599a6161426ce8f73de8577e73e038e1234db","observation_id":"12118471-662c-4b4e-ab61-8b758bbd89a9","resolution":{"observed_at":"2026-08-11T21:59:00.895633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.07797","last_updated":"2024-12-05T08:30:43Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T18:18:50.832376Z","submitted_at":"2024-12-05T08:30:43Z","title":"Mogo: RQ Hierarchical Causal Transformer for High-Quality 3D Human Motion Generation"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":32},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 2 inbound Pith citation observations for arXiv:2412.07797."}